id

Ekstrak tabel PDF

Deteksi tabel di dalam PDF dan ekspor sebagai CSV, Excel (XLSX), atau JSON, dengan atau tanpa garis. Lokal di browser, tanpa unggah.

Memproses secara lokal di perangkat Anda ...

Format keluaran Format tujuan dari berkas hasil.
  • CSV
  • Excel (XLSX)
  • JSON
Deteksi tabel
  • Otomatis
  • Dengan garis (kisi)
  • Tanpa garis (jarak)
Pemisah
  • Koma
  • Titik koma
  • Tab

Berkas Anda

    Memproses secara lokal di perangkat Anda ...

    0%

    Apakah berkas saya diunggah?

    Tidak. Semuanya berjalan di peramban Anda - berkas Anda tidak pernah meninggalkan perangkat. Bagaimana ini dapat diverifikasi

    Tanpa unggahan100% lokal
    Isi tetap milikmutanpa akses pihak ketiga
    Hosted in GermanyGlobal Content Delivery
    Diaudit independenTLS A+ · HTTP header A+

    Angka sering terjebak justru di tempat yang tidak bisa dimanfaatkan: di dalam tabel PDF. Faktur, laporan, rekening koran, hasil riset: siapa pun yang membutuhkan nilai-nilai itu di Excel, basis data, atau skrip selama ini harus mengetik ulang atau bergulat dengan kolom yang berantakan saat ditempel. Alat ini mengenali tabel di PDF secara otomatis dan mengekspornya dengan struktur utuh: sebagai CSV untuk lembar kerja dan impor, sebagai buku kerja Excel (XLSX) dengan satu lembar per tabel, atau sebagai JSON dengan koordinat untuk diproses dalam kode.

    Pendeteksian memakai dua teknik yang sama dengan alat spesialis ternama: tabel bergaris dikenali dari garis yang benar-benar digambar di halaman (mode kisi); garis membentuk kisi sel dan setiap teks ditempatkan ke selnya. Tabel tanpa garis dikenali dari perataan (mode jarak): blok teks yang berada di posisi kolom yang sama pada beberapa baris membentuk kolom, dan celah yang terus kosong menjadi batas kolom. Mode otomatis mencari garis lebih dulu lalu beralih ke analisis jarak; kedua mode juga bisa dipilih langsung. Beberapa tabel dan PDF multihalaman didukung: setiap tabel yang terdeteksi diekspor terpisah.

    Jujur dan penting: pendeteksian membaca lapisan teks PDF. PDF hasil pindaian, atau yang hanya berisi gambar, tidak punya lapisan itu; alat ini akan mengatakannya terus terang alih-alih menghasilkan tabel kosong atau karangan. Konversikan pindaian lebih dulu dengan "PDF OCR", lalu ekstrak tabelnya. Tata letak rumit juga punya batas: sel gabungan atau tabel bersarang hanya didekati, tidak direkonstruksi piksel demi piksel. Semuanya berjalan lokal di browser lewat pdf.js; berkasmu tidak pernah meninggalkan perangkat.

    Data teknis

    Data teknis
    Format masukanPDF
    Konversi otomatisPNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
    Format keluaranCSV, XLSX, JSON
    Pemrosesan massalTidak
    PemrosesanLokal di peramban (JavaScript)
    Unggah berkasTidak ada

    Dalam 3 langkah

    1. Letakkan PDF-mu.
    2. Pilih format keluaran dan cara deteksi.
    3. Unduh tabel sebagai CSV, XLSX, atau JSON.

    Batasan: Mendeteksi tabel lewat garis tepi (kisi) atau perataan teks (jarak) dan mengekspornya sebagai CSV (satu berkas per tabel, beberapa dalam ZIP), XLSX (satu lembar per tabel), atau JSON (dengan halaman, sel, dan posisi dalam poin PDF). Membutuhkan lapisan teks asli: konversikan dulu PDF hasil pindaian dengan "PDF OCR". Sel gabungan dan tata letak rumit hanya didekati; pada Excel hanya angka yang tidak ambigu (desimal titik) yang menjadi sel angka. Buka dulu PDF berkata sandi dengan "Buka kunci PDF".

    Pertanyaan umum

    Bagaimana alat ini mendeteksi tabel?

    Dengan dua teknik: pada tabel bergaris, garis yang digambar membentuk kisi sel (mode kisi). Pada tabel tanpa garis, kolom dikenali dari perataan teks dan celah yang terus kosong (mode jarak). Mode otomatis memilih sendiri teknik yang tepat.

    Mengapa tidak ada tabel yang ditemukan di hasil pindaian saya?

    Hasil pindaian hanyalah piksel gambar, tanpa lapisan teks yang bisa dibaca. Konversikan dulu PDF menjadi teks yang dapat dicari dengan "PDF OCR", lalu ekstrak tabelnya.

    Bisakah saya mengekspor beberapa tabel dan halaman sekaligus?

    Bisa. Semua halaman dipindai dan setiap tabel yang terdeteksi diekspor terpisah: sebagai berkas CSV sendiri (beberapa digabung dalam ZIP), sebagai lembar sendiri di berkas Excel, atau sebagai entri di JSON.

    Apa isi ekspor JSON?

    Struktur lengkap: untuk tiap tabel halamannya, mode deteksi, dan posisinya; untuk tiap sel teksnya dan kotak pembatas dalam poin PDF (titik asal di kiri bawah). Ideal untuk skrip dan alur data.

    Mengapa sel gabungan tidak persis?

    Sel yang digabung melintasi beberapa kolom tidak punya posisi tunggal di kisi; isinya jatuh ke salah satu sel terkait dan sisanya kosong. Ini pendekatan yang jujur: alat desktop spesialis pun tidak menyelesaikannya tanpa cacat.

    Apakah PDF saya diunggah?

    Tidak. Pendeteksian dan ekspor berjalan sepenuhnya lokal di browser lewat pdf.js; berkas tidak pernah meninggalkan perangkatmu.

    Apakah ekstraksi tabel juga berfungsi di ponsel atau Chromebook?

    Ya, di perangkat apa pun dengan peramban terbaru - Windows, Mac, Linux, Chromebook, atau ponsel. PDF yang sangat besar hanya butuh lebih banyak waktu dan memori di perangkat seluler.

    Alat terkait

    PDF ke teks · PDF OCR (dapat dicari) · XLSX ke CSV · CSV ke XLSX · CSV ke JSON · PDF ke Markdown