ca

PDF a text

Extreu la capa de text d'un PDF com un fitxer .txt senzill, per copiar, reutilitzar o cercar. En local, sense pujades.

Processant en local al teu dispositiu ...

Els teus fitxers

    Processant en local al teu dispositiu ...

    0%

    Es puja el meu fitxer?

    No. Tot s'executa al teu navegador - el teu fitxer no surt mai del dispositiu. Per què és verificable

    Sense pujar res100% local
    El contingut es queda amb tusense accés de tercers
    Hosted in GermanyGlobal Content Delivery
    Auditat de manera independentTLS A+ · Capçaleres A+

    L'ordre es reconstrueix pàgina per pàgina: els fragments de text a la mateixa alçada formen una línia, llegida de dalt a baix i d'esquerra a dreta. Les pàgines se separen amb una línia en blanc, de manera que el resultat és fàcil de reutilitzar, importar o cercar.

    Fitxa tècnica

    Fitxa tècnica
    Formats d'entradaPDF
    Conversió automàticaPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Format de sortidaTXT
    Processament per lotsNo
    ProcessamentEn local al navegador (JavaScript)
    Càrrega de fitxersCap

    En 3 passos

    1. Deixa-hi anar el teu PDF.
    2. El text s'extreu automàticament.
    3. Baixa el text com a .txt.

    Límits: Extreu la capa de text existent d'un PDF i la retorna com a fitxer .txt en UTF-8; les línies es reconstrueixen a partir de les posicions del text. Els PDF escanejats o només d'imatge no tenen capa de text, allà la sortida queda buida: fes servir aleshores PDF OCR. Les tipografies, imatges, colors i la disposició exacta (pàgines amb diverses columnes, taules) es perden o només s'aproximen de manera lineal. Desbloqueja abans els PDF protegits amb contrasenya amb Desbloquejar un PDF.

    Preguntes freqüents

    Per què el meu fitxer de text està buit?

    Probablement el teu PDF és un escaneig o està format per imatges i no té capa de text. Fes servir aleshores PDF OCR, que reconeix el text a partir dels píxels.

    Es conserva la disposició?

    No. Obtens text pur en ordre de lectura. Les tipografies, imatges, columnes i taules no es reprodueixen de manera fidel.

    En quina codificació està el fitxer?

    En UTF-8, de manera que els accents, la ce trencada i els caràcters especials es conserven correctament.

    Com se separen diverses pàgines?

    Amb una línia en blanc entre pàgines.

    Es puja el PDF?

    No, l'extracció de text passa del tot en local al navegador.

    Eines relacionades

    PDF OCR cercable · De PDF a Word · Extreu pàgines de PDF · Convertir PDF a Markdown · DOCX cap a HTML · DOCX cap a Markdown