El contingut es queda amb tusense accés de tercers
No hi ha cap tractament del contingut dels teus fitxers en cap servidor. No et cal cap contracte d'encàrrec de tractament amb gottrix per treballar amb documents confidencials o de feina.
Hosted in GermanyGlobal Content Delivery
Servidors d'origen a Hetzner, a Alemanya, amb lliurament mundial mitjançant una xarxa de distribució de continguts (CDN). El contingut dels teus fitxers no es transmet mai en aquest procés - no surt mai del teu dispositiu.
Markdown és el format de referència per a notes, wikis, llocs estàtics i eines d'IA: senzill, versionable i llegible arreu. Qui vol reutilitzar el contingut d'un PDF ho ha de copiar laboriosament. Aquesta eina llegeix la capa de text del PDF i la retorna com a Markdown amb l'estructura general ja aplicada - encapçalaments, llistes i paràgrafs en lloc d'un únic bloc de text.
L'estructura es detecta per heurística: les línies amb una mida de lletra notablement més gran que el cos del text esdevenen encapçalaments (#, ## o ###), les línies que comencen amb un símbol de llista o un número es converteixen en llistes Markdown, i un espaiat vertical major entre línies indica un nou paràgraf. A partir de les posicions del text en brut s'obté un document Markdown llegible i reutilitzable - un punt de partida ideal que pots perfeccionar al teu editor.
Honest i important: es tracta d'una aproximació estructural, no d'una reconstrucció fidel del disseny. Les taules, les pàgines amb múltiples columnes i els formats detallats no es poden derivar sense pèrdua des de la capa de text. Com en l'extracció de text simple: un PDF escanejat o compost únicament d'imatges no té capa de text - el resultat quedarà buit i caldrà utilitzar el reconeixement de text PDF OCR. Tot s'executa localment al navegador via pdf.js; el teu fitxer no surt del teu dispositiu.
Límits: Converteix la capa de text existent d'un PDF a Markdown (UTF-8 .md). Els encapçalaments, les llistes i els paràgrafs es detecten heurísticament a partir de la mida de la lletra i l'espaiat - una aproximació estructural, no una reconstrucció exacta del disseny. Les taules i les pàgines amb múltiples columnes només s'aproximen de manera lineal. Els PDFs escanejats o compostos únicament d'imatges no tenen capa de text; el resultat queda buit, fes servir PDF OCR. Desbloqueja primer els PDFs protegits amb contrasenya. Només es llegeix el text (getTextContent de pdf.js); les imatges incrustades no es porten al Markdown.
Preguntes freqüents
Com es detecten els encapçalaments?
Per la mida de la lletra: les línies notablement més grans que el cos del text es converteixen en #, ## o ### segons la proporció.
Es conserven les taules i les columnes?
No. La conversió és una aproximació estructural; les taules i els dissenys amb múltiples columnes només s'aproximen de manera lineal, sense reconstrucció fidel.
Per què el meu Markdown és buit?
El teu PDF probablement és un escanejat o està compost d'imatges i no té capa de text. Fes servir PDF OCR, que reconeix el text a partir dels píxels.
Es puja el PDF a un servidor?
No. La conversió s'executa completament en local al navegador via pdf.js; el fitxer no surt del teu dispositiu.
Només amb el teu consentiment mesurem l'ús de manera anonimitzada mitjançant galetes per millorar gottrix. Els teus fitxers sempre romanen en local, al teu dispositiu. Privadesa