Er vindt geen verwerking van je bestandsinhoud op een server plaats. Je hebt geen verwerkersovereenkomst met gottrix nodig om vertrouwelijke of zakelijke documenten te bewerken.
Hosted in GermanyGlobal Content Delivery
Origin-servers bij Hetzner in Duitsland, wereldwijde levering via een content delivery network (CDN). De inhoud van je bestanden wordt daarbij nooit verzonden - die verlaat je apparaat niet.
Markdown is het formaat voor notities, wiki's, statische websites en AI-tools: eenvoudig, versiebeheerbaar en overal leesbaar. Wie de inhoud van een PDF daarin wil hergebruiken, moest dat tot nu toe moeizaam kopiëren. Dit hulpmiddel leest de tekstlaag van de PDF uit en geeft die terug als Markdown, met de grove structuur al op zijn plek - koppen, opsommingen en alinea's in plaats van één grote muur van tekst.
De structuur wordt herkend via een heuristiek: regels met een duidelijk groter lettertype dan de lopende tekst worden koppen (#, ## of ###), regels die beginnen met een opsomming of cijfer worden Markdown-lijsten, en een groter verticaal tussenruimte markeert een nieuwe alinea. Zo ontstaat uit de ruwe tekstposities een leesbaar, herbruikbaar Markdown-document - een ideaal startpunt dat je verder verfijnt in je editor.
Eerlijk en belangrijk: dit is een structuurbenadering, geen getrouwe lay-outreconstructie. Tabellen, meerkolomspagina's en fijne opmaak kunnen niet verliesvrij uit de tekstlaag worden afgeleid. Net als bij gewone tekstextractie geldt: een gescande of puur beeldgebaseerde PDF heeft geen tekstlaag - daar blijft het resultaat leeg, en je hebt dan PDF OCR nodig. Alles draait lokaal in de browser via pdf.js; jouw bestand verlaat je apparaat niet.
Beperkingen: Zet de bestaande tekstlaag van een PDF om naar Markdown (UTF-8 .md). Koppen, lijsten en alinea's worden heuristisch herkend op basis van lettergrootte en afstanden - een structuurbenadering, geen exacte lay-outreconstructie. Tabellen en meerkolomspagina's worden alleen lineair benaderd. Gescande of puur beeldgebaseerde PDF's hebben geen tekstlaag; het resultaat blijft dan leeg - gebruik in dat geval PDF OCR. Beveiligde PDF's eerst ontgrendelen. Alleen de tekst wordt gelezen (getTextContent van pdf.js); ingesloten afbeeldingen worden niet in de Markdown overgenomen.
Veelgestelde vragen
Hoe worden koppen herkend?
Op basis van lettergrootte: regels die duidelijk groter zijn dan de lopende tekst worden - afhankelijk van de verhouding - omgezet naar #, ## of ###.
Blijven tabellen en kolommen behouden?
Nee. De omzetting is een structuurbenadering; tabellen en meerkolomslay-outs worden alleen lineair benaderd, niet getrouw nagebouwd.
Waarom is mijn Markdown leeg?
Waarschijnlijk is je PDF een scan of bestaat hij uit afbeeldingen en heeft hij geen tekstlaag. Gebruik dan PDF OCR, dat tekst herkent uit de pixels.
Wordt de PDF geüpload?
Nee. De omzetting verloopt volledig lokaal in de browser via pdf.js; het bestand verlaat je apparaat niet.
Alleen met je toestemming meten we het gebruik geanonimiseerd via cookies om gottrix te verbeteren. Je bestanden blijven altijd lokaal, op jouw apparaat. Privacy