ca

Convertir PDF a Markdown

Converteix la capa de text d'un PDF a Markdown localment - es detecten encapçalaments, llistes i paràgrafs a partir de l'estructura. Sense pujada.

Processant en local al teu dispositiu ...

Els teus fitxers

    Processant en local al teu dispositiu ...

    0%

    Es puja el meu fitxer?

    No. Tot s'executa al teu navegador - el teu fitxer no surt mai del dispositiu. Per què és verificable

    Sense pujar res100% local
    El contingut es queda amb tusense accés de tercers
    Hosted in GermanyGlobal Content Delivery
    Auditat de manera independentTLS A+ · Capçaleres A+

    Markdown és el format de referència per a notes, wikis, llocs estàtics i eines d'IA: senzill, versionable i llegible arreu. Qui vol reutilitzar el contingut d'un PDF ho ha de copiar laboriosament. Aquesta eina llegeix la capa de text del PDF i la retorna com a Markdown amb l'estructura general ja aplicada - encapçalaments, llistes i paràgrafs en lloc d'un únic bloc de text.

    L'estructura es detecta per heurística: les línies amb una mida de lletra notablement més gran que el cos del text esdevenen encapçalaments (#, ## o ###), les línies que comencen amb un símbol de llista o un número es converteixen en llistes Markdown, i un espaiat vertical major entre línies indica un nou paràgraf. A partir de les posicions del text en brut s'obté un document Markdown llegible i reutilitzable - un punt de partida ideal que pots perfeccionar al teu editor.

    Honest i important: es tracta d'una aproximació estructural, no d'una reconstrucció fidel del disseny. Les taules, les pàgines amb múltiples columnes i els formats detallats no es poden derivar sense pèrdua des de la capa de text. Com en l'extracció de text simple: un PDF escanejat o compost únicament d'imatges no té capa de text - el resultat quedarà buit i caldrà utilitzar el reconeixement de text PDF OCR. Tot s'executa localment al navegador via pdf.js; el teu fitxer no surt del teu dispositiu.

    Fitxa tècnica

    Fitxa tècnica
    Formats d'entradaPDF
    Conversió automàticaPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Format de sortidaMD
    Processament per lotsNo
    ProcessamentEn local al navegador (JavaScript)
    Càrrega de fitxersCap

    En 3 passos

    1. Deixa-hi anar o carrega el teu PDF.
    2. L'estructura es detecta automàticament.
    3. Baixa el Markdown com a .md.

    Límits: Converteix la capa de text existent d'un PDF a Markdown (UTF-8 .md). Els encapçalaments, les llistes i els paràgrafs es detecten heurísticament a partir de la mida de la lletra i l'espaiat - una aproximació estructural, no una reconstrucció exacta del disseny. Les taules i les pàgines amb múltiples columnes només s'aproximen de manera lineal. Els PDFs escanejats o compostos únicament d'imatges no tenen capa de text; el resultat queda buit, fes servir PDF OCR. Desbloqueja primer els PDFs protegits amb contrasenya. Només es llegeix el text (getTextContent de pdf.js); les imatges incrustades no es porten al Markdown.

    Preguntes freqüents

    Com es detecten els encapçalaments?

    Per la mida de la lletra: les línies notablement més grans que el cos del text es converteixen en #, ## o ### segons la proporció.

    Es conserven les taules i les columnes?

    No. La conversió és una aproximació estructural; les taules i els dissenys amb múltiples columnes només s'aproximen de manera lineal, sense reconstrucció fidel.

    Per què el meu Markdown és buit?

    El teu PDF probablement és un escanejat o està compost d'imatges i no té capa de text. Fes servir PDF OCR, que reconeix el text a partir dels píxels.

    Es puja el PDF a un servidor?

    No. La conversió s'executa completament en local al navegador via pdf.js; el fitxer no surt del teu dispositiu.

    Eines relacionades

    PDF a text · PDF OCR cercable · HTML cap a Markdown · Convertir Markdown a PDF · Extreu taules PDF · De PDF a Word