it

PDF in testo

Estrai il livello di testo di un PDF come semplice file .txt, per copiare, riutilizzare o cercare. In locale, senza upload.

Elaborazione in locale sul tuo dispositivo ...

I tuoi file

    Elaborazione in locale sul tuo dispositivo ...

    0%

    Il mio file viene caricato?

    No. Tutto avviene nel tuo browser - il tuo file non lascia mai il dispositivo. Perché è verificabile

    Nessun caricamento100% in locale
    I contenuti restano tuoinessun accesso di terzi
    Hosted in GermanyGlobal Content Delivery
    Verificato esternamenteTLS A+ · Intestazioni A+

    L'ordine viene ricostruito pagina per pagina: i frammenti di testo alla stessa altezza formano una riga, letta dall'alto verso il basso e da sinistra a destra. Le pagine sono separate da una riga vuota, così il risultato è facile da riutilizzare, importare o cercare.

    Scheda tecnica

    Scheda tecnica
    Formati di inputPDF
    Conversione automaticaPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Formato di outputTXT
    Elaborazione in batchNo
    ElaborazioneIn locale nel browser (JavaScript)
    Caricamento fileNessuno

    In 3 passaggi

    1. Trascina il tuo PDF.
    2. Il testo viene estratto automaticamente.
    3. Scarica il testo come .txt.

    Limiti: Estrae il livello di testo esistente di un PDF e lo restituisce come file .txt in UTF-8; le righe vengono ricostruite dalle posizioni del testo. I PDF scansionati o di sola immagine non hanno un livello di testo, lì l'output resta vuoto: usa allora PDF OCR. Caratteri tipografici, immagini, colori e il layout esatto (pagine a più colonne, tabelle) vanno persi o vengono solo approssimati in modo lineare. Sblocca prima i PDF protetti da password con Sblocca PDF.

    Domande frequenti

    Perché il mio file di testo è vuoto?

    Probabilmente il tuo PDF è una scansione o è composto da immagini e non ha un livello di testo. Usa allora PDF OCR, che riconosce il testo dai pixel.

    Il layout viene mantenuto?

    No. Ottieni testo puro nell'ordine di lettura. Caratteri, immagini, colonne e tabelle non vengono riprodotti in modo fedele.

    In quale codifica è il file?

    In UTF-8, così anche lettere accentate e caratteri speciali si conservano correttamente.

    Come vengono separate più pagine?

    Con una riga vuota tra le pagine.

    Il PDF viene caricato?

    No, l'estrazione del testo avviene interamente in locale nel browser.

    Strumenti correlati

    PDF OCR ricercabile · PDF in Word · Estrai pagine PDF · Da PDF a Markdown · DOCX in HTML · DOCX in Markdown