pt

PDF para texto

Extraia a camada de texto de um PDF como um arquivo .txt simples, para copiar, reutilizar ou pesquisar. Localmente, sem envio.

Processando localmente no seu dispositivo ...

Seus arquivos

    Processando localmente no seu dispositivo ...

    0%

    Meu arquivo é enviado?

    Não. Tudo roda no seu navegador - o seu arquivo nunca sai do seu dispositivo. Como isso é verificável

    Sem envio100% local
    O conteúdo fica consigosem acesso de terceiros
    Hosted in GermanyGlobal Content Delivery
    Auditado externamenteTLS A+ · Cabeçalhos A+

    A ordem é reconstruída página a página: os fragmentos de texto à mesma altura formam uma linha, lida de cima para baixo e da esquerda para a direita. As páginas são separadas por uma linha em branco, para que o resultado seja fácil de reutilizar, importar ou pesquisar.

    Ficha técnica

    Ficha técnica
    Formatos de entradaPDF
    Conversão automáticaPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Formato de saídaTXT
    Processamento em loteNão
    ProcessamentoLocalmente no navegador (JavaScript)
    Upload de arquivosNenhum

    Em 3 passos

    1. Largue o seu PDF.
    2. O texto é extraído automaticamente.
    3. Transfira o texto como .txt.

    Limites: Extrai a camada de texto existente de um PDF e devolve-a como arquivo .txt em UTF-8; as linhas são reconstruídas a partir das posições do texto. Os PDF digitalizados ou só de imagem não têm camada de texto, aí a saída fica vazia: use então PDF OCR. Os fontes, imagens, cores e a disposição exata (páginas com várias colunas, tabelas) perdem-se ou são apenas aproximados de forma linear. Desbloqueie primeiro os PDF protegidos por senha com Desbloquear PDF.

    Perguntas frequentes

    Por que meu arquivo de texto está vazio?

    Provavelmente o seu PDF é uma digitalização ou é composto por imagens e não tem camada de texto. Use então PDF OCR, que reconhece o texto a partir dos pixels.

    A disposição é mantida?

    Não. Você obtém texto puro na ordem de leitura. Tipos de letra, imagens, colunas e tabelas não são reproduzidos com fidelidade.

    Em que codificação está o arquivo?

    Em UTF-8, de modo que acentos e caracteres especiais se conservam corretamente.

    Como são separadas várias páginas?

    Com uma linha em branco entre páginas.

    O PDF é enviado?

    Não, a extração de texto acontece inteiramente localmente no navegador.

    Ferramentas relacionadas

    PDF OCR pesquisável · PDF para Word · Extrair páginas do PDF · PDF para Markdown · DOCX para HTML · DOCX para Markdown