ms

Ekstrak jadual PDF

Kesan jadual dalam PDF dan eksport sebagai CSV, Excel (XLSX) atau JSON, bergaris atau tidak. Setempat dalam pelayar, tanpa muat naik.

Memproses secara setempat pada peranti anda ...

Format output Format sasaran bagi fail keluaran.
  • CSV
  • Excel (XLSX)
  • JSON
Pengesanan jadual
  • Automatik
  • Bergaris (grid)
  • Tanpa garis (jarak)
Pemisah
  • Koma
  • Koma bertitik
  • Tab

Fail anda

    Memproses secara setempat pada peranti anda ...

    0%

    Adakah fail saya dimuat naik?

    Tidak. Semuanya berjalan dalam pelayar anda - fail anda tidak pernah meninggalkan peranti. Bagaimana ini boleh disahkan

    Tiada muat naik100% setempat
    Kandungan kekal milik andatiada capaian pihak ketiga
    Hosted in GermanyGlobal Content Delivery
    Diaudit bebasTLS A+ · HTTP header A+

    Angka sering terperangkap di tempat yang tidak boleh digunakan: dalam jadual PDF. Invois, laporan, penyata bank, kajian: sesiapa yang mahukan nilai itu dalam Excel, pangkalan data atau skrip selama ini terpaksa menaipnya semula atau bergelut dengan lajur yang berselerak apabila ditampal. Alat ini mengecam jadual dalam PDF secara automatik dan mengeksportnya dengan struktur terpelihara: sebagai CSV untuk hamparan dan import, sebagai buku kerja Excel (XLSX) dengan satu helaian bagi setiap jadual, atau sebagai JSON dengan koordinat untuk diproses dalam kod.

    Pengesanan menggunakan dua teknik yang sama seperti alat pakar yang terkenal: jadual bergaris dikesan melalui garisan yang benar-benar dilukis pada halaman (mod grid); garisan membentuk grid sel dan setiap teks diletakkan ke dalam selnya. Jadual tanpa garisan dikesan melalui penjajaran (mod jarak): blok teks yang berada pada kedudukan lajur yang sama merentasi beberapa baris membentuk lajur, dan ruang kosong yang berterusan menjadi sempadan lajur. Mod automatik mencari garisan dahulu dan jika tiada, beralih kepada analisis jarak; kedua-dua mod juga boleh dipilih terus. Berbilang jadual dan PDF berbilang halaman disokong: setiap jadual yang dikesan dieksport secara berasingan.

    Jujur dan penting: pengesanan membaca lapisan teks PDF. PDF imbasan, atau yang hanya mengandungi imej, tiada lapisan itu; alat ini akan memberitahunya secara terus terang dan bukannya menghasilkan jadual kosong atau rekaan. Tukarkan imbasan dahulu dengan "PDF OCR", kemudian ekstrak jadualnya. Susun atur rumit juga ada hadnya: sel tergabung atau jadual bersarang hanya dianggarkan, bukan dibina semula piksel demi piksel. Semuanya berjalan setempat dalam pelayar melalui pdf.js; fail anda tidak pernah meninggalkan peranti.

    Data teknikal

    Data teknikal
    Format inputPDF
    Penukaran automatikPNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
    Format outputCSV, XLSX, JSON
    Pemprosesan kelompokTidak
    PemprosesanSetempat dalam pelayar (JavaScript)
    Muat naik failTiada

    Dalam 3 langkah

    1. Letakkan PDF anda.
    2. Pilih format output dan cara pengesanan.
    3. Muat turun jadual sebagai CSV, XLSX atau JSON.

    Batasan: Mengesan jadual melalui garisan tepi (grid) atau penjajaran teks (jarak) dan mengeksportnya sebagai CSV (satu fail bagi setiap jadual, beberapa dalam ZIP), XLSX (satu helaian bagi setiap jadual) atau JSON (dengan halaman, sel dan kedudukan dalam mata PDF). Memerlukan lapisan teks sebenar: tukarkan dahulu PDF imbasan dengan "PDF OCR". Sel tergabung dan susun atur rumit hanya dianggarkan; dalam Excel hanya nombor yang jelas (perpuluhan titik) menjadi sel nombor. Buka dahulu PDF berkata laluan dengan "Buka kunci PDF".

    Soalan lazim

    Bagaimanakah alat ini mengesan jadual?

    Dengan dua teknik: pada jadual bergaris, garisan yang dilukis membentuk grid sel (mod grid). Pada jadual tanpa garisan, lajur dikesan melalui penjajaran teks dan ruang kosong berterusan (mod jarak). Mod automatik memilih sendiri teknik yang sesuai.

    Mengapa tiada jadual ditemui dalam imbasan saya?

    Imbasan hanyalah piksel imej, tanpa lapisan teks yang boleh dibaca. Tukarkan dahulu PDF kepada teks boleh cari dengan "PDF OCR", kemudian ekstrak jadualnya.

    Bolehkah saya mengeksport beberapa jadual dan halaman sekali gus?

    Boleh. Semua halaman disemak dan setiap jadual yang dikesan dieksport berasingan: sebagai fail CSV tersendiri (beberapa digabungkan dalam ZIP), sebagai helaian tersendiri dalam fail Excel, atau sebagai entri dalam JSON.

    Apakah kandungan eksport JSON?

    Struktur lengkap: bagi setiap jadual halamannya, mod pengesanan dan kedudukannya; bagi setiap sel teksnya dan kotak sempadan dalam mata PDF (asalan di bawah kiri). Sesuai untuk skrip dan saluran data.

    Mengapa sel tergabung tidak tepat?

    Sel yang digabung merentasi beberapa lajur tiada kedudukan tunggal dalam grid; kandungannya jatuh ke salah satu sel berkaitan dan yang lain kekal kosong. Ini anggaran yang jujur: alat desktop pakar pun tidak menyelesaikannya tanpa cacat.

    Adakah PDF saya dimuat naik?

    Tidak. Pengesanan dan eksport berjalan sepenuhnya setempat dalam pelayar melalui pdf.js; fail tidak pernah meninggalkan peranti anda.

    Adakah pengekstrakan jadual berfungsi juga di telefon pintar atau Chromebook?

    Ya, pada mana-mana peranti dengan pelayar terkini - Windows, Mac, Linux, Chromebook atau telefon pintar. PDF yang sangat besar cuma memerlukan lebih masa dan memori pada peranti mudah alih.

    Alat berkaitan

    PDF kepada teks · PDF OCR (boleh dicari) · XLSX kepada CSV · CSV kepada XLSX · CSV kepada JSON · PDF kepada Markdown