de

PDF-Tabellen extrahieren

Erkenne Tabellen in einer PDF und exportiere sie als CSV, Excel (XLSX) oder JSON - mit und ohne Rahmenlinien. Lokal im Browser, ohne Upload.

Läuft lokal auf deinem Gerät ...

Ausgabeformat Das Zielformat der Ausgabedatei.
  • CSV
  • Excel (XLSX)
  • JSON
Tabellenerkennung
  • Automatisch
  • Mit Rahmenlinien (Gitter)
  • Ohne Rahmenlinien (Abstände)
Trennzeichen
  • Komma
  • Semikolon
  • Tabulator

Deine Dateien

    Läuft lokal auf deinem Gerät ...

    0%

    Wird meine Datei hochgeladen?

    Nein. Die Umwandlung läuft komplett in Deinem Browser - Deine Datei verlässt Dein Gerät nie. So ist das nachprüfbar

    Kein Upload100% lokal
    Inhalte bleiben bei dirkein Zugriff durch Dritte
    Hosted in GermanyGlobal Content Delivery
    Extern geprüftTLS A+ · Header A+

    Zahlen stecken oft genau dort fest, wo man sie nicht weiterverarbeiten kann: in PDF-Tabellen. Rechnungen, Berichte, Kontoauszüge, Studien - wer die Werte in Excel, eine Datenbank oder ein Skript übernehmen will, tippt sie bisher ab oder kämpft mit zerfallenden Copy-Paste-Spalten. Dieses Werkzeug erkennt Tabellen in der PDF automatisch und exportiert sie strukturiert: als CSV für Tabellenkalkulation und Import, als Excel-Arbeitsmappe (XLSX) mit einem Blatt pro Tabelle oder als JSON mit Koordinaten für die Weiterverarbeitung im Code.

    Die Erkennung arbeitet mit zwei Verfahren, wie sie auch die bekannten Spezialwerkzeuge dieser Klasse nutzen: Tabellen mit Rahmenlinien werden über die tatsächlich gezeichneten Linien der Seite erkannt (Gitter-Modus) - die Linien bilden das Zellraster, jeder Text wird seiner Zelle zugeordnet. Tabellen ohne Rahmen werden über die Ausrichtung erkannt (Abstands-Modus): Textblöcke, die über mehrere Zeilen an denselben Spaltenpositionen stehen, bilden die Spalten, durchgehende Lücken die Spaltengrenzen. Die Automatik prüft zuerst auf Linien und fällt sonst auf die Abstandsanalyse zurück; beide Modi lassen sich auch fest wählen. Mehrere Tabellen und mehrseitige PDFs werden unterstützt - jede erkannte Tabelle wird einzeln exportiert.

    Ehrlich und wichtig: Die Erkennung liest die Textebene der PDF. Ein eingescanntes oder rein aus Bildern bestehendes PDF hat keine solche Ebene - dort meldet das Werkzeug das offen, statt leere oder erfundene Tabellen auszugeben. Wandle Scans zuerst mit „PDF OCR" in durchsuchbaren Text um und extrahiere die Tabellen danach. Auch komplexe Layouts haben Grenzen: verbundene Zellen, verschachtelte Tabellen oder Zellen mit vielen Umbrüchen werden angenähert, nicht pixelgenau rekonstruiert. Alles läuft lokal im Browser via pdf.js; deine Datei verlässt dein Gerät nicht.

    Technische Daten

    Technische Daten
    EingabeformatePDF
    Auto-KonvertierungPNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
    AusgabeformateCSV, XLSX, JSON
    StapelverarbeitungNein
    VerarbeitungLokal im Browser (JavaScript)
    Datei-UploadKeiner

    In 3 Schritten

    1. PDF ablegen.
    2. Ausgabeformat und Erkennung wählen.
    3. Tabellen als CSV, XLSX oder JSON herunterladen.

    Grenzen: Erkennt Tabellen über Rahmenlinien (Gitter) oder Textausrichtung (Abstände) und exportiert sie als CSV (eine Datei pro Tabelle, mehrere als ZIP), XLSX (ein Blatt pro Tabelle) oder JSON (mit Seiten-, Zell- und Positionsangaben in PDF-Punkten). Benötigt eine echte Textebene - eingescannte oder Bild-PDFs zuerst mit "PDF OCR" umwandeln, sonst erscheint ein ehrlicher Hinweis statt einer leeren Tabelle. Verbundene Zellen, verschachtelte Tabellen und stark gestaltete Layouts werden angenähert; im Excel-Export werden nur eindeutige Zahlen (Punkt-Dezimal) als Zahlen übernommen. Passwortgeschützte PDFs zuerst mit "PDF entsperren" öffnen.

    Häufige Fragen

    Wie erkennt das Werkzeug Tabellen?

    Mit zwei Verfahren: Bei Tabellen mit Rahmen bilden die gezeichneten Linien das Zellraster (Gitter-Modus). Bei Tabellen ohne Rahmen werden Spalten über die Textausrichtung und durchgehende Lücken erkannt (Abstands-Modus). Die Automatik wählt selbst das passende Verfahren.

    Warum findet es in meinem Scan keine Tabellen?

    Ein Scan besteht nur aus Bildpixeln und hat keine Textebene, die sich auslesen ließe. Wandle das PDF zuerst mit "PDF OCR" in durchsuchbaren Text um und extrahiere die Tabellen danach.

    Kann ich mehrere Tabellen und Seiten auf einmal exportieren?

    Ja. Alle Seiten werden durchsucht und jede erkannte Tabelle einzeln exportiert: als eigene CSV-Datei (mehrere gebündelt als ZIP), als eigenes Blatt in einer Excel-Datei oder als Eintrag im JSON.

    Was enthält der JSON-Export?

    Die vollständige Struktur: pro Tabelle Seite, Erkennungsmodus und Position sowie pro Zelle Text und Begrenzungsrahmen in PDF-Punkten (Ursprung unten links) - ideal für Skripte und Datenpipelines.

    Warum stimmen verbundene Zellen nicht exakt?

    Eine über mehrere Spalten verbundene Zelle hat im Raster keine eindeutige Position; ihr Inhalt landet in einer der beteiligten Zellen, die übrigen bleiben leer. Das ist eine ehrliche Annäherung - auch spezialisierte Desktop-Werkzeuge lösen das nicht fehlerfrei.

    Wird die PDF hochgeladen?

    Nein. Erkennung und Export laufen vollständig lokal im Browser via pdf.js; die Datei verlässt dein Gerät nicht.

    Funktioniert die Tabellen-Extraktion auch auf dem Smartphone oder Chromebook?

    Ja, auf jedem Gerät mit einem aktuellen Browser - Windows, Mac, Linux, Chromebook oder Smartphone. Sehr große PDFs brauchen auf Mobilgeräten nur mehr Zeit und Speicher.

    Passende Tools

    PDF in Text · PDF OCR durchsuchbar · XLSX zu CSV · CSV zu XLSX · CSV zu JSON · PDF zu Markdown