pt

PDF para Markdown

Converta a camada de texto de um PDF em Markdown localmente - títulos, listas e parágrafos são detectados pela estrutura. Sem envio.

Processando localmente no seu dispositivo ...

Seus arquivos

    Processando localmente no seu dispositivo ...

    0%

    Meu arquivo é enviado?

    Não. Tudo roda no seu navegador - o seu arquivo nunca sai do seu dispositivo. Como isso é verificável

    Sem envio100% local
    O conteúdo fica consigosem acesso de terceiros
    Hosted in GermanyGlobal Content Delivery
    Auditado externamenteTLS A+ · Cabeçalhos A+

    Markdown é o formato de referência para notas, wikis, sites estáticos e ferramentas de IA: simples, versionável e legível em qualquer lugar. Quem quer reutilizar o conteúdo de um PDF tem de o copiar laboriosamente. Esta ferramenta lê a camada de texto do PDF e devolve-a como Markdown com a estrutura geral já definida - títulos, listas e parágrafos em vez de um único bloco de texto.

    A estrutura é detectada por heurística: as linhas com um tamanho de fonte notavelmente maior do que o corpo do texto tornam-se títulos (#, ## ou ###), as linhas que começam com um marcador ou número são convertidas em listas Markdown, e um espaçamento vertical maior entre linhas indica um novo parágrafo. A partir das posições do texto bruto obtém-se um documento Markdown legível e reutilizável - um ponto de partida ideal a aperfeiçoar no seu editor.

    Honesto e importante: trata-se de uma aproximação estrutural, não de uma reconstrução fiel do layout. Tabelas, páginas com múltiplas colunas e formatações detalhadas não podem ser derivadas sem perda da camada de texto. Como na extração de texto simples: um PDF digitalizado ou composto apenas por imagens não tem camada de texto - o resultado ficará vazio e será necessário usar o reconhecimento de texto PDF OCR. Tudo é executado localmente no navegador via pdf.js; o seu arquivo não sai do seu dispositivo.

    Ficha técnica

    Ficha técnica
    Formatos de entradaPDF
    Conversão automáticaPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Formato de saídaMD
    Processamento em loteNão
    ProcessamentoLocalmente no navegador (JavaScript)
    Upload de arquivosNenhum

    Em 3 passos

    1. Arraste ou carregue o seu PDF.
    2. A estrutura é detectada automaticamente.
    3. Transfira o Markdown como .md.

    Limites: Converte a camada de texto existente de um PDF em Markdown (UTF-8 .md). Títulos, listas e parágrafos são detectados heuristicamente pelo tamanho da fonte e espaçamento - uma aproximação estrutural, não uma reconstrução exata do layout. Tabelas e páginas com múltiplas colunas são apenas aproximadas linearmente. PDFs digitalizados ou compostos apenas por imagens não têm camada de texto; o resultado fica vazio, use PDF OCR. Desbloqueie primeiro os PDFs protegidos por senha. Somente o texto é lido (getTextContent do pdf.js); imagens incorporadas não são levadas para o Markdown.

    Perguntas frequentes

    Como são detectados os títulos?

    Pelo tamanho da fonte: as linhas notavelmente maiores do que o corpo do texto tornam-se #, ## ou ### conforme a proporção.

    As tabelas e colunas são preservadas?

    Não. A conversão é uma aproximação estrutural; tabelas e layouts com múltiplas colunas são apenas aproximados linearmente, sem reconstrução fiel.

    Por que está vazio meu Markdown?

    O seu PDF é provavelmente uma digitalização ou é composto por imagens e não tem camada de texto. Use PDF OCR, que reconhece o texto a partir dos pixels.

    O PDF é enviado para um servidor?

    Não. A conversão é executada inteiramente de forma local no navegador via pdf.js; o arquivo não sai do seu dispositivo.

    Ferramentas relacionadas

    PDF para texto · PDF OCR pesquisável · HTML para Markdown · Markdown para PDF · Extrair tabelas PDF · PDF para Word