tr

PDF tablo çıkarma

PDF içindeki tabloları algılayın ve CSV, Excel (XLSX) veya JSON olarak dışa aktarın; çizgili veya çizgisiz. Tarayıcıda yerel, yükleme yok.

Cihazınızda yerel olarak işleniyor ...

Çıktı biçimi Çıktı dosyasının hedef biçimi.
  • CSV
  • Excel (XLSX)
  • JSON
Tablo algılama
  • Otomatik
  • Çizgili (ızgara)
  • Çizgisiz (boşluklar)
Ayraç
  • Virgül
  • Noktalı virgül
  • Sekme

Dosyalarınız

    Cihazınızda yerel olarak işleniyor ...

    0%

    Dosyam yükleniyor mu?

    Hayır. Her şey tarayıcınızda çalışır - dosyanız cihazınızdan asla çıkmaz. Bunu nasıl doğrularsınız

    Yükleme yok%100 yerel
    İçerik sizde kalırüçüncü taraf erişimi yok
    Hosted in GermanyGlobal Content Delivery
    Bağımsız denetlendiTLS A+ · Başlıklar A+

    Sayılar çoğu zaman tam da kullanılamayacakları yerde sıkışıp kalır: PDF içindeki tablolarda. Faturalar, raporlar, hesap özetleri, araştırmalar: bu değerleri Excel'e, bir veritabanına veya bir betiğe aktarmak isteyenler şimdiye dek ya elle yeniden yazdı ya da yapıştırırken dağılan sütunlarla boğuştu. Bu araç PDF içindeki tabloları otomatik olarak tanır ve yapısını koruyarak dışa aktarır: hesap tabloları ve içe aktarmalar için CSV, her tablo için ayrı bir sayfa içeren Excel çalışma kitabı (XLSX) veya kodla işlemek için koordinatlar içeren JSON olarak.

    Algılama, bu sınıfın bilinen uzman araçlarının dayandığı iki tekniği kullanır: çizgili tablolar, sayfada gerçekten çizilmiş çizgiler üzerinden tanınır (ızgara modu); çizgiler hücre ızgarasını oluşturur ve her metin kendi hücresine atanır. Çizgisiz tablolar hizalama üzerinden tanınır (boşluk modu): birden çok satırda aynı sütun konumlarında duran metin blokları sütunları oluşturur, kesintisiz boşluklar da sütun sınırlarını belirler. Otomatik mod önce çizgileri arar, bulamazsa boşluk analizine geçer; her iki mod ayrıca elle de seçilebilir. Birden çok tablo ve çok sayfalı PDF desteklenir: algılanan her tablo ayrı ayrı dışa aktarılır.

    Dürüst ve önemli: algılama, PDF'nin metin katmanını okur. Taranmış veya yalnızca görsellerden oluşan bir PDF'de böyle bir katman yoktur; bu durumda araç boş ya da uydurma tablolar üretmek yerine bunu açıkça söyler. Taramaları önce "PDF OCR" ile aranabilir metne dönüştürün, tabloları sonra çıkarın. Karmaşık düzenlerin de sınırları vardır: birleştirilmiş hücreler veya iç içe tablolar yaklaşık olarak aktarılır, piksel piksel yeniden kurulmaz. Her şey tarayıcıda pdf.js ile yerel olarak çalışır; dosyanız cihazınızdan asla çıkmaz.

    Teknik özellikler

    Teknik özellikler
    Giriş formatlarıPDF
    Otomatik dönüştürmePNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
    Çıkış formatlarıCSV, XLSX, JSON
    Toplu işlemeHayır
    İşlemeTarayıcıda yerel (JavaScript)
    Dosya yüklemeYok

    3 adımda

    1. PDF dosyanızı bırakın.
    2. Çıktı biçimini ve algılamayı seçin.
    3. Tabloları CSV, XLSX veya JSON olarak indirin.

    Sınırlar: Tabloları kenar çizgileri (ızgara) veya metin hizalaması (boşluklar) üzerinden algılar ve CSV (her tablo için bir dosya, birden çoğu ZIP olarak), XLSX (her tablo için bir sayfa) veya JSON (sayfa, hücre ve PDF punto cinsinden konumlarla) olarak dışa aktarır. Gerçek bir metin katmanı gerekir: taranmış PDF dosyalarını önce "PDF OCR" ile dönüştürün. Birleştirilmiş hücreler ve karmaşık düzenler yaklaşık olarak aktarılır; Excel çıktısında yalnızca belirsizlik içermeyen sayılar (nokta ondalıklı) sayı hücresine dönüşür. Parola korumalı PDF dosyalarını önce "PDF kilidini aç" ile açın.

    Sık sorulan sorular

    Araç tabloları nasıl algılıyor?

    İki teknikle: çizgili tablolarda çizilmiş çizgiler hücre ızgarasını oluşturur (ızgara modu). Çizgisiz tablolarda sütunlar, metin hizalaması ve kesintisiz boşluklar üzerinden tanınır (boşluk modu). Otomatik mod uygun tekniği kendisi seçer.

    Taranmış belgemde neden tablo bulunamıyor?

    Bir tarama yalnızca görüntü piksellerinden oluşur; okunabilir bir metin katmanı yoktur. PDF'yi önce "PDF OCR" ile aranabilir metne dönüştürün, tabloları sonra çıkarın.

    Birden çok tabloyu ve sayfayı tek seferde dışa aktarabilir miyim?

    Evet. Tüm sayfalar taranır ve algılanan her tablo ayrı ayrı dışa aktarılır: kendi CSV dosyası olarak (birden çoğu bir ZIP içinde), bir Excel dosyasında kendi sayfası olarak veya JSON içinde ayrı bir kayıt olarak.

    JSON çıktısında neler var?

    Yapının tamamı: her tablo için sayfası, algılama modu ve konumu; her hücre için metni ve PDF punto cinsinden sınırlayıcı kutusu (başlangıç sol altta). Betikler ve veri hatları için idealdir.

    Birleştirilmiş hücreler neden tam çıkmıyor?

    Birden çok sütuna yayılan birleştirilmiş bir hücrenin ızgarada tek bir konumu yoktur; içeriği ilgili hücrelerden birine düşer, diğerleri boş kalır. Bu dürüst bir yaklaşımdır: uzman masaüstü araçları bile bunu hatasız çözemez.

    PDF dosyam bir sunucuya yükleniyor mu?

    Hayır. Algılama ve dışa aktarma tamamen tarayıcıda pdf.js ile yerel olarak çalışır; dosya cihazınızdan asla çıkmaz.

    Tablo çıkarma akıllı telefonda veya Chromebook'ta da çalışır mı?

    Evet, güncel tarayıcısı olan her cihazda - Windows, Mac, Linux, Chromebook veya akıllı telefon. Çok büyük PDF'ler mobil cihazlarda yalnızca daha fazla zaman ve bellek ister.

    İlgili araçlar

    PDF metne · PDF OCR aranabilir · XLSX'ten CSV'ye · CSV'den XLSX'e · CSV'den JSON'a · PDF Markdowna