Innehållet stannar hos digingen åtkomst för tredje part
Ditt filinnehåll behandlas inte på någon server. Du behöver inget personuppgiftsbiträdesavtal med gottrix för att hantera konfidentiella eller affärsdokument.
Hosted in GermanyGlobal Content Delivery
Origin-servrar hos Hetzner i Tyskland, global leverans via ett content delivery network (CDN). Ditt filinnehåll överförs aldrig i processen - det lämnar aldrig din enhet.
Markdown är formatet för anteckningar, wikis, statiska webbplatser och AI-verktyg: enkelt, versionshanterbart och läsbart överallt. Den som velat återanvända innehållet i en PDF där har hittills behövt kopiera det mödosamt bit för bit. Det här verktyget läser textlagret i PDF:en och returnerar det som Markdown med den grova strukturen redan på plats - rubriker, punktlistor och stycken i stället för en enda textvägg.
Strukturen identifieras med en heuristik: rader med ett märkbart större teckensnitt än brödtexten blir rubriker (#, ## eller ###), rader som börjar med en punkt eller siffra blir Markdown-listor, och ett större vertikalt mellanrum markerar ett nytt stycke. Ur de rena textpositionerna skapas på så sätt ett läsbart, återanvändbart Markdown-dokument - en idealisk startpunkt som du sedan förfinar i din editor.
Ärligt och viktigt: detta är en strukturapproximation, inte en exakt layoutrekonstruktion. Tabeller, flerspaltige sidor och fin formatering kan inte härledas förlustfritt från textlagret. Som med vanlig textextrahering gäller: en skannad eller rent bildbaserad PDF saknar textlager - resultatet förblir då tomt och du behöver i stället PDF OCR. Allt körs lokalt i webbläsaren via pdf.js; din fil lämnar inte din enhet.
Begränsningar: Omvandlar det befintliga textlagret i en PDF till Markdown (UTF-8 .md). Rubriker, listor och stycken identifieras heuristiskt utifrån teckenstorlek och avstånd - en strukturapproximation, inte en exakt layoutrekonstruktion. Tabeller och flerspaltige sidor approximeras endast linjärt. Skannade eller rent bildbaserade PDF:er saknar textlager; resultatet förblir tomt - använd PDF OCR i stället. Lösenordsskyddade PDF:er måste låsas upp först. Endast texten läses (pdf.js getTextContent); inbäddade bilder tas inte med i Markdown.
Vanliga frågor
Hur identifieras rubriker?
Via teckenstorlek: rader som är märkbart större än brödtexten omvandlas - beroende på förhållandet - till #, ## eller ###.
Bevaras tabeller och kolumner?
Nej. Konverteringen är en strukturapproximation; tabeller och flerspaltige layouter approximeras endast linjärt och rekonstrueras inte exakt.
Varför är min Markdown tom?
Din PDF är troligen en skanning eller består av bilder och saknar textlager. Använd PDF OCR, som känner igen text från pixlarna.
Laddas PDF:en upp?
Nej. Konverteringen sker helt lokalt i webbläsaren via pdf.js; filen lämnar inte din enhet.
Endast med ditt samtycke mäter vi användningen anonymiserat via cookies för att förbättra gottrix. Dina filer stannar alltid lokalt, på din enhet. Integritet