Innehållet stannar hos digingen åtkomst för tredje part
Ditt filinnehåll behandlas inte på någon server. Du behöver inget personuppgiftsbiträdesavtal med gottrix för att hantera konfidentiella eller affärsdokument.
Hosted in GermanyGlobal Content Delivery
Origin-servrar hos Hetzner i Tyskland, global leverans via ett content delivery network (CDN). Ditt filinnehåll överförs aldrig i processen - det lämnar aldrig din enhet.
Siffror fastnar ofta precis där de inte går att använda: i tabeller i en PDF. Fakturor, rapporter, kontoutdrag, studier: den som behöver värdena i Excel, en databas eller ett skript har hittills skrivit av dem för hand eller kämpat med kolumner som faller sönder vid inklistring. Det här verktyget känner igen tabellerna i PDF:en automatiskt och exporterar dem med strukturen bevarad: som CSV för kalkylblad och importer, som Excel-arbetsbok (XLSX) med ett blad per tabell eller som JSON med koordinater för vidare bearbetning i kod.
Igenkänningen bygger på samma två tekniker som de kända specialverktygen: tabeller med kantlinjer känns igen på de linjer som faktiskt är ritade på sidan (rutnätsläge); linjerna bildar cellrutnätet och varje text tilldelas sin cell. Tabeller utan kantlinjer känns igen på justeringen (avståndsläge): textblock som står på samma kolumnpositioner över flera rader bildar kolumnerna, och de mellanrum som förblir tomma blir kolumngränserna. Det automatiska läget letar först efter linjer och faller annars tillbaka på avståndsanalysen; båda lägena kan också väljas fast. Flera tabeller och flersidiga PDF:er stöds: varje hittad tabell exporteras separat.
Ärligt och viktigt: igenkänningen läser PDF:ens textlager. En skannad PDF, eller en som bara består av bilder, saknar ett sådant lager; då säger verktyget det öppet i stället för att producera tomma eller påhittade tabeller. Konvertera skanningar först med "PDF OCR" och extrahera tabellerna efteråt. Även komplexa layouter har gränser: sammanfogade celler eller nästlade tabeller approximeras, de återskapas inte pixelperfekt. Allt körs lokalt i webbläsaren via pdf.js; din fil lämnar aldrig din enhet.
Tekniska data
Tekniska data
Indataformat
PDF
Automatisk konvertering
PNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
Utdataformat
CSV, XLSX, JSON
Batchbearbetning
Nej
Bearbetning
Lokalt i webbläsaren (JavaScript)
Filuppladdning
Ingen
I 3 steg
Släpp din PDF här.
Välj utdataformat och igenkänning.
Ladda ner tabellerna som CSV, XLSX eller JSON.
Begränsningar: Känner igen tabeller via kantlinjer (rutnät) eller textjustering (avstånd) och exporterar dem som CSV (en fil per tabell, flera som ZIP), XLSX (ett blad per tabell) eller JSON (med sida, celler och positioner i PDF-punkter). Kräver ett riktigt textlager: konvertera skannade PDF:er först med "PDF OCR". Sammanfogade celler och komplexa layouter approximeras; i Excel blir bara entydiga tal (decimalpunkt) riktiga talceller. Öppna lösenordsskyddade PDF:er först med "Lås upp PDF".
Vanliga frågor
Hur känner verktyget igen tabeller?
Med två tekniker: i tabeller med kantlinjer bildar de ritade linjerna cellrutnätet (rutnätsläge). I tabeller utan kantlinjer känns kolumnerna igen på textjusteringen och de mellanrum som förblir tomma (avståndsläge). Det automatiska läget väljer rätt teknik självt.
Varför hittas inga tabeller i min skanning?
En skanning består bara av bildpixlar, utan läsbart textlager. Konvertera PDF:en först till sökbar text med "PDF OCR" och extrahera tabellerna efteråt.
Kan jag exportera flera tabeller och sidor på en gång?
Ja. Alla sidor genomsöks och varje hittad tabell exporteras separat: som egen CSV-fil (flera buntas i en ZIP), som eget blad i en Excel-fil eller som post i JSON-filen.
Vad innehåller JSON-exporten?
Hela strukturen: för varje tabell dess sida, igenkänningsläge och position; för varje cell dess text och avgränsningsruta i PDF-punkter (origo nere till vänster). Perfekt för skript och datapipelines.
Varför blir sammanfogade celler inte exakta?
En cell som sträcker sig över flera kolumner har ingen entydig plats i rutnätet; innehållet hamnar i en av cellerna och de övriga förblir tomma. Det är en ärlig approximation: inte ens specialiserade skrivbordsverktyg löser detta felfritt.
Laddas min PDF upp någonstans?
Nej. Igenkänning och export körs helt lokalt i webbläsaren via pdf.js; filen lämnar aldrig din enhet.
Fungerar tabellextraktionen även på mobil eller Chromebook?
Ja, på varje enhet med en aktuell webbläsare - Windows, Mac, Linux, Chromebook eller mobil. Mycket stora PDF:er kräver bara mer tid och minne på mobila enheter.
Endast med ditt samtycke mäter vi användningen anonymiserat via cookies för att förbättra gottrix. Dina filer stannar alltid lokalt, på din enhet. Integritet