Es entsteht keine Auftragsverarbeitung deiner Datei-Inhalte. Du brauchst keinen AVV mit gottrix, um vertrauliche oder geschäftliche Dokumente zu verarbeiten.
Hosted in GermanyGlobal Content Delivery
Origin-Server bei Hetzner in Deutschland, weltweite Auslieferung über ein Content-Delivery-Netz. Deine Dateiinhalte werden dabei nie übertragen - sie verlassen dein Gerät nicht.
Zahlen stecken oft genau dort fest, wo man sie nicht weiterverarbeiten kann: in PDF-Tabellen. Rechnungen, Berichte, Kontoauszüge, Studien - wer die Werte in Excel, eine Datenbank oder ein Skript übernehmen will, tippt sie bisher ab oder kämpft mit zerfallenden Copy-Paste-Spalten. Dieses Werkzeug erkennt Tabellen in der PDF automatisch und exportiert sie strukturiert: als CSV für Tabellenkalkulation und Import, als Excel-Arbeitsmappe (XLSX) mit einem Blatt pro Tabelle oder als JSON mit Koordinaten für die Weiterverarbeitung im Code.
Die Erkennung arbeitet mit zwei Verfahren, wie sie auch die bekannten Spezialwerkzeuge dieser Klasse nutzen: Tabellen mit Rahmenlinien werden über die tatsächlich gezeichneten Linien der Seite erkannt (Gitter-Modus) - die Linien bilden das Zellraster, jeder Text wird seiner Zelle zugeordnet. Tabellen ohne Rahmen werden über die Ausrichtung erkannt (Abstands-Modus): Textblöcke, die über mehrere Zeilen an denselben Spaltenpositionen stehen, bilden die Spalten, durchgehende Lücken die Spaltengrenzen. Die Automatik prüft zuerst auf Linien und fällt sonst auf die Abstandsanalyse zurück; beide Modi lassen sich auch fest wählen. Mehrere Tabellen und mehrseitige PDFs werden unterstützt - jede erkannte Tabelle wird einzeln exportiert.
Ehrlich und wichtig: Die Erkennung liest die Textebene der PDF. Ein eingescanntes oder rein aus Bildern bestehendes PDF hat keine solche Ebene - dort meldet das Werkzeug das offen, statt leere oder erfundene Tabellen auszugeben. Wandle Scans zuerst mit „PDF OCR" in durchsuchbaren Text um und extrahiere die Tabellen danach. Auch komplexe Layouts haben Grenzen: verbundene Zellen, verschachtelte Tabellen oder Zellen mit vielen Umbrüchen werden angenähert, nicht pixelgenau rekonstruiert. Alles läuft lokal im Browser via pdf.js; deine Datei verlässt dein Gerät nicht.
Technische Daten
Technische Daten
Eingabeformate
PDF
Auto-Konvertierung
PNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
Ausgabeformate
CSV, XLSX, JSON
Stapelverarbeitung
Nein
Verarbeitung
Lokal im Browser (JavaScript)
Datei-Upload
Keiner
In 3 Schritten
PDF ablegen.
Ausgabeformat und Erkennung wählen.
Tabellen als CSV, XLSX oder JSON herunterladen.
Grenzen: Erkennt Tabellen über Rahmenlinien (Gitter) oder Textausrichtung (Abstände) und exportiert sie als CSV (eine Datei pro Tabelle, mehrere als ZIP), XLSX (ein Blatt pro Tabelle) oder JSON (mit Seiten-, Zell- und Positionsangaben in PDF-Punkten). Benötigt eine echte Textebene - eingescannte oder Bild-PDFs zuerst mit "PDF OCR" umwandeln, sonst erscheint ein ehrlicher Hinweis statt einer leeren Tabelle. Verbundene Zellen, verschachtelte Tabellen und stark gestaltete Layouts werden angenähert; im Excel-Export werden nur eindeutige Zahlen (Punkt-Dezimal) als Zahlen übernommen. Passwortgeschützte PDFs zuerst mit "PDF entsperren" öffnen.
Häufige Fragen
Wie erkennt das Werkzeug Tabellen?
Mit zwei Verfahren: Bei Tabellen mit Rahmen bilden die gezeichneten Linien das Zellraster (Gitter-Modus). Bei Tabellen ohne Rahmen werden Spalten über die Textausrichtung und durchgehende Lücken erkannt (Abstands-Modus). Die Automatik wählt selbst das passende Verfahren.
Warum findet es in meinem Scan keine Tabellen?
Ein Scan besteht nur aus Bildpixeln und hat keine Textebene, die sich auslesen ließe. Wandle das PDF zuerst mit "PDF OCR" in durchsuchbaren Text um und extrahiere die Tabellen danach.
Kann ich mehrere Tabellen und Seiten auf einmal exportieren?
Ja. Alle Seiten werden durchsucht und jede erkannte Tabelle einzeln exportiert: als eigene CSV-Datei (mehrere gebündelt als ZIP), als eigenes Blatt in einer Excel-Datei oder als Eintrag im JSON.
Was enthält der JSON-Export?
Die vollständige Struktur: pro Tabelle Seite, Erkennungsmodus und Position sowie pro Zelle Text und Begrenzungsrahmen in PDF-Punkten (Ursprung unten links) - ideal für Skripte und Datenpipelines.
Warum stimmen verbundene Zellen nicht exakt?
Eine über mehrere Spalten verbundene Zelle hat im Raster keine eindeutige Position; ihr Inhalt landet in einer der beteiligten Zellen, die übrigen bleiben leer. Das ist eine ehrliche Annäherung - auch spezialisierte Desktop-Werkzeuge lösen das nicht fehlerfrei.
Wird die PDF hochgeladen?
Nein. Erkennung und Export laufen vollständig lokal im Browser via pdf.js; die Datei verlässt dein Gerät nicht.
Funktioniert die Tabellen-Extraktion auch auf dem Smartphone oder Chromebook?
Ja, auf jedem Gerät mit einem aktuellen Browser - Windows, Mac, Linux, Chromebook oder Smartphone. Sehr große PDFs brauchen auf Mobilgeräten nur mehr Zeit und Speicher.
Nur mit deiner Zustimmung messen wir mit Cookies anonymisiert die Nutzung, um gottrix zu verbessern. Deine Dateien bleiben immer lokal auf deinem Gerät. Datenschutz