nl

PDF-tabellen extraheren

Herken tabellen in een PDF en exporteer ze als CSV, Excel (XLSX) of JSON, met of zonder randen. Lokaal in de browser, zonder upload.

Verwerkt lokaal op je apparaat ...

Uitvoerformaat Het doelformaat van het uitvoerbestand.
  • CSV
  • Excel (XLSX)
  • JSON
Tabelherkenning
  • Automatisch
  • Met randen (raster)
  • Zonder randen (afstanden)
Scheidingsteken
  • Komma
  • Puntkomma
  • Tab

Jouw bestanden

    Verwerkt lokaal op je apparaat ...

    0%

    Wordt mijn bestand geüpload?

    Nee. Alles draait in je browser - je bestand verlaat je apparaat nooit. Zo is dat verifieerbaar

    Geen upload100% lokaal
    Inhoud blijft bij jougeen toegang voor derden
    Hosted in GermanyGlobal Content Delivery
    Onafhankelijk getoetstTLS A+ · HTTP-headers A+

    Cijfers zitten vaak precies daar vast waar je er niets mee kunt: in tabellen in een PDF. Facturen, rapporten, bankafschriften, onderzoeken: wie die waarden in Excel, een database of een script nodig heeft, typte ze tot nu toe over of vocht met kolommen die bij het plakken uit elkaar vallen. Deze tool herkent tabellen in de PDF automatisch en exporteert ze met behoud van structuur: als CSV voor spreadsheets en imports, als Excel-werkmap (XLSX) met een werkblad per tabel of als JSON met coördinaten voor verwerking in code.

    De herkenning gebruikt dezelfde twee technieken als de bekende gespecialiseerde tools: tabellen met randen worden herkend aan de daadwerkelijk getekende lijnen op de pagina (rastermodus); de lijnen vormen het celraster en elke tekst wordt aan zijn cel toegewezen. Tabellen zonder randen worden herkend aan de uitlijning (afstandsmodus): tekstblokken die over meerdere regels op dezelfde kolomposities staan vormen de kolommen, en doorlopende witruimtes markeren de kolomgrenzen. De automatische stand zoekt eerst naar lijnen en valt anders terug op de afstandsanalyse; beide standen zijn ook vast te kiezen. Meerdere tabellen en meerpagina-PDF's worden ondersteund: elke herkende tabel wordt apart geëxporteerd.

    Eerlijk en belangrijk: de herkenning leest de tekstlaag van de PDF. Een gescande PDF, of een die alleen uit afbeeldingen bestaat, heeft zo'n laag niet; daar meldt de tool dat open en eerlijk in plaats van lege of verzonnen tabellen te produceren. Zet scans eerst om met "PDF OCR" en haal de tabellen er daarna uit. Ook complexe lay-outs hebben grenzen: samengevoegde cellen of geneste tabellen worden benaderd, niet pixelperfect gereconstrueerd. Alles draait lokaal in de browser via pdf.js; je bestand verlaat je apparaat nooit.

    Technische gegevens

    Technische gegevens
    InvoerformatenPDF
    Automatische conversiePNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
    UitvoerformatenCSV, XLSX, JSON
    BatchverwerkingNee
    VerwerkingLokaal in de browser (JavaScript)
    BestandsuploadGeen

    In 3 stappen

    1. Sleep je PDF hierheen.
    2. Kies uitvoerformaat en herkenning.
    3. Download de tabellen als CSV, XLSX of JSON.

    Beperkingen: Herkent tabellen via randlijnen (raster) of tekstuitlijning (afstanden) en exporteert ze als CSV (een bestand per tabel, meerdere als ZIP), XLSX (een werkblad per tabel) of JSON (met pagina, cellen en posities in PDF-punten). Vereist een echte tekstlaag: zet gescande PDF's eerst om met "PDF OCR". Samengevoegde cellen en complexe lay-outs worden benaderd; in Excel worden alleen eenduidige getallen (decimale punt) echte getalcellen. Open beveiligde PDF's eerst met "PDF ontgrendelen".

    Veelgestelde vragen

    Hoe herkent de tool tabellen?

    Met twee technieken: bij tabellen met randen vormen de getekende lijnen het celraster (rastermodus). Bij tabellen zonder randen worden kolommen herkend aan de tekstuitlijning en doorlopende witruimtes (afstandsmodus). De automatische stand kiest zelf de juiste techniek.

    Waarom vindt hij geen tabellen in mijn scan?

    Een scan bestaat alleen uit beeldpixels, zonder leesbare tekstlaag. Zet de PDF eerst om in doorzoekbare tekst met "PDF OCR" en haal de tabellen er daarna uit.

    Kan ik meerdere tabellen en pagina's tegelijk exporteren?

    Ja. Alle pagina's worden doorzocht en elke herkende tabel wordt apart geëxporteerd: als eigen CSV-bestand (meerdere gebundeld in een ZIP), als eigen werkblad in een Excel-bestand of als item in de JSON.

    Wat bevat de JSON-export?

    De volledige structuur: per tabel de pagina, de herkenningsmodus en de positie; per cel de tekst en het begrenzingskader in PDF-punten (oorsprong linksonder). Ideaal voor scripts en datapipelines.

    Waarom kloppen samengevoegde cellen niet precies?

    Een cel die over meerdere kolommen is samengevoegd heeft geen eenduidige plek in het raster; de inhoud belandt in een van de betrokken cellen en de rest blijft leeg. Dat is een eerlijke benadering: ook gespecialiseerde desktoptools lossen dit niet foutloos op.

    Wordt mijn PDF geüpload?

    Nee. Herkenning en export draaien volledig lokaal in de browser via pdf.js; het bestand verlaat je apparaat nooit.

    Werkt de tabel-extractie ook op een smartphone of Chromebook?

    Ja, op elk apparaat met een actuele browser - Windows, Mac, Linux, Chromebook of smartphone. Heel grote PDF's vragen op mobiele apparaten alleen meer tijd en geheugen.

    Gerelateerde tools

    PDF naar tekst · PDF OCR doorzoekbaar · XLSX naar CSV · CSV naar XLSX · CSV naar JSON · PDF naar Markdown