es

PDF a texto

Extrae la capa de texto de un PDF como un archivo .txt sencillo, para copiar, reutilizar o buscar. En local, sin subir nada.

Procesando localmente en tu dispositivo ...

Tus archivos

    Procesando localmente en tu dispositivo ...

    0%

    ¿Se sube mi archivo?

    No. Todo se ejecuta en tu navegador: tu archivo nunca sale de tu dispositivo. Cómo se puede comprobar

    Sin subidas100% local
    Tus datos son tuyossin acceso de terceros
    Hosted in GermanyGlobal Content Delivery
    Auditoría externaTLS A+ · Cabeceras A+

    El orden se reconstruye página por página: los fragmentos de texto a la misma altura forman una línea, leída de arriba abajo y de izquierda a derecha. Las páginas se separan con una línea en blanco, de modo que el resultado es fácil de reutilizar, importar o buscar.

    Ficha técnica

    Ficha técnica
    Formatos de entradaPDF
    Conversión automáticaPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Formato de salidaTXT
    Procesamiento por lotesNo
    ProcesamientoLocal en el navegador (JavaScript)
    Subida de archivosNinguna

    En 3 pasos

    1. Suelta tu PDF.
    2. El texto se extrae automáticamente.
    3. Descarga el texto como .txt.

    Límites: Extrae la capa de texto existente de un PDF y la devuelve como archivo .txt en UTF-8; las líneas se reconstruyen a partir de las posiciones del texto. Los PDF escaneados o de solo imagen no tienen capa de texto, ahí la salida queda vacía: usa entonces PDF OCR. Las tipografías, imágenes, colores y el diseño exacto (páginas a varias columnas, tablas) se pierden o solo se aproximan de forma lineal. Desbloquea antes los PDF protegidos con contraseña con Desbloquear PDF.

    Preguntas frecuentes

    ¿Por qué mi archivo de texto está vacío?

    Probablemente tu PDF es un escaneo o está formado por imágenes y no tiene capa de texto. Usa entonces PDF OCR, que reconoce el texto a partir de los píxeles.

    ¿Se conserva el diseño?

    No. Obtienes texto puro en orden de lectura. Las tipografías, imágenes, columnas y tablas no se reproducen de forma fiel.

    ¿En qué codificación está el archivo?

    En UTF-8, de modo que las tildes, la eñe y los caracteres especiales se conservan correctamente.

    ¿Cómo se separan varias páginas?

    Con una línea en blanco entre páginas.

    ¿Se sube el PDF?

    No, la extracción de texto ocurre por completo en local en el navegador.

    Herramientas relacionadas

    PDF OCR buscable · PDF a Word · Extraer páginas de PDF · PDF a Markdown · DOCX a HTML · DOCX a Markdown