nl

PDF naar tekst

Haal de tekstlaag van een PDF eruit als een eenvoudig .txt-bestand, om te kopiëren, hergebruiken of doorzoeken. Lokaal, zonder upload.

Verwerkt lokaal op je apparaat ...

Jouw bestanden

    Verwerkt lokaal op je apparaat ...

    0%

    Wordt mijn bestand geüpload?

    Nee. Alles draait in je browser - je bestand verlaat je apparaat nooit. Zo is dat verifieerbaar

    Geen upload100% lokaal
    Inhoud blijft bij jougeen toegang voor derden
    Hosted in GermanyGlobal Content Delivery
    Onafhankelijk getoetstTLS A+ · HTTP-headers A+

    De volgorde wordt pagina voor pagina gereconstrueerd: tekstfragmenten op dezelfde hoogte vormen samen één regel, gelezen van boven naar beneden en van links naar rechts. Pagina's worden gescheiden door een lege regel, zodat de uitvoer zich goed laat verwerken, importeren of doorzoeken.

    Technische gegevens

    Technische gegevens
    InvoerformatenPDF
    Automatische conversiePNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    UitvoerformaatTXT
    BatchverwerkingNee
    VerwerkingLokaal in de browser (JavaScript)
    BestandsuploadGeen

    In 3 stappen

    1. Sleep je PDF erin.
    2. Tekst wordt automatisch geëxtraheerd.
    3. Download de tekst als .txt.

    Beperkingen: Haalt de bestaande tekstlaag van een PDF eruit en geeft die terug als .txt-bestand in UTF-8; regels worden uit de tekstposities opnieuw opgebouwd. Gescande of louter-beeld-PDF's hebben geen tekstlaag, daar blijft de uitvoer leeg: gebruik dan PDF OCR. Lettertypen, afbeeldingen, kleuren en de exacte opmaak (pagina's met meerdere kolommen, tabellen) gaan verloren of worden alleen lineair benaderd. Ontgrendel met een wachtwoord beveiligde PDF's eerst met PDF ontgrendelen.

    Veelgestelde vragen

    Waarom is mijn tekstbestand leeg?

    Waarschijnlijk is je PDF een scan of bestaat hij uit afbeeldingen en heeft hij geen tekstlaag. Gebruik dan PDF OCR, dat tekst uit de pixels herkent.

    Blijft de opmaak behouden?

    Nee. Je krijgt pure tekst in leesvolgorde. Lettertypen, afbeeldingen, kolommen en tabellen worden niet getrouw weergegeven.

    In welke codering is het bestand?

    In UTF-8, zodat ook accenten en speciale tekens correct behouden blijven.

    Hoe worden meerdere pagina's gescheiden?

    Door een lege regel tussen de pagina's.

    Wordt de PDF geüpload?

    Nee, de tekstextractie gebeurt volledig lokaal in de browser.

    Gerelateerde tools

    PDF OCR doorzoekbaar · PDF naar Word · PDF-pagina's extraheren · PDF naar Markdown · DOCX naar HTML · DOCX naar Markdown