it

Estrai tabelle PDF

Rileva le tabelle in un PDF ed esportale come CSV, Excel (XLSX) o JSON, con o senza bordi. In locale nel browser, senza caricamenti.

Elaborazione in locale sul tuo dispositivo ...

Formato di uscita Il formato di destinazione del file di output.
  • CSV
  • Excel (XLSX)
  • JSON
Rilevamento tabelle
  • Automatico
  • Con bordi (griglia)
  • Senza bordi (spazi)
Separatore
  • Virgola
  • Punto e virgola
  • Tabulazione

I tuoi file

    Elaborazione in locale sul tuo dispositivo ...

    0%

    Il mio file viene caricato?

    No. Tutto avviene nel tuo browser - il tuo file non lascia mai il dispositivo. Perché è verificabile

    Nessun caricamento100% in locale
    I contenuti restano tuoinessun accesso di terzi
    Hosted in GermanyGlobal Content Delivery
    Verificato esternamenteTLS A+ · Intestazioni A+

    I numeri restano spesso bloccati proprio dove non si possono usare: nelle tabelle di un PDF. Fatture, report, estratti conto, studi: chi vuole quei valori in Excel, in un database o in uno script finora li ricopiava a mano o lottava con colonne che si sfaldano al copia-incolla. Questo strumento riconosce automaticamente le tabelle nel PDF e le esporta mantenendone la struttura: come CSV per fogli di calcolo e importazioni, come cartella di lavoro Excel (XLSX) con un foglio per tabella o come JSON con le coordinate per l'elaborazione nel codice.

    Il rilevamento usa le stesse due tecniche degli strumenti specializzati più noti: le tabelle con bordi vengono riconosciute dalle linee realmente disegnate sulla pagina (modalità griglia); le linee formano la griglia delle celle e ogni testo viene assegnato alla sua cella. Le tabelle senza bordi vengono riconosciute dall'allineamento (modalità spazi): i blocchi di testo che compaiono nelle stesse posizioni di colonna su più righe formano le colonne, e i vuoti continui ne segnano i confini. La modalità automatica cerca prima le linee e altrimenti passa all'analisi degli spazi; entrambe le modalità possono anche essere forzate. Sono supportati più tabelle e PDF di più pagine: ogni tabella rilevata viene esportata separatamente.

    Onesto e importante: il rilevamento legge il livello di testo del PDF. Un PDF scansionato o fatto solo di immagini non ha questo livello; in quel caso lo strumento lo dice apertamente invece di produrre tabelle vuote o inventate. Converti prima le scansioni con "PDF OCR" e poi estrai le tabelle. Anche i layout complessi hanno dei limiti: celle unite o tabelle annidate vengono approssimate, non ricostruite al pixel. Tutto avviene in locale nel browser tramite pdf.js; il tuo file non lascia mai il dispositivo.

    Scheda tecnica

    Scheda tecnica
    Formati di inputPDF
    Conversione automaticaPNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
    Formati di outputCSV, XLSX, JSON
    Elaborazione in batchNo
    ElaborazioneIn locale nel browser (JavaScript)
    Caricamento fileNessuno

    In 3 passaggi

    1. Trascina il tuo PDF.
    2. Scegli formato di uscita e rilevamento.
    3. Scarica le tabelle come CSV, XLSX o JSON.

    Limiti: Rileva le tabelle tramite le linee dei bordi (griglia) o l'allineamento del testo (spazi) e le esporta come CSV (un file per tabella, più tabelle in un ZIP), XLSX (un foglio per tabella) o JSON (con pagina, celle e posizioni in punti PDF). Richiede un vero livello di testo: converti prima i PDF scansionati con "PDF OCR". Le celle unite e i layout complessi vengono approssimati; in Excel solo i numeri non ambigui (decimale con punto) diventano celle numeriche. Apri prima i PDF protetti con "Sblocca PDF".

    Domande frequenti

    Come vengono rilevate le tabelle?

    Con due tecniche: nelle tabelle con bordi, le linee disegnate formano la griglia delle celle (modalità griglia). Nelle tabelle senza bordi, le colonne vengono riconosciute dall'allineamento del testo e dai vuoti continui (modalità spazi). La modalità automatica sceglie da sola la tecnica adatta.

    Perché non trova tabelle nella mia scansione?

    Una scansione è fatta solo di pixel, senza livello di testo leggibile. Converti prima il PDF in testo con "PDF OCR" e poi estrai le tabelle.

    Posso esportare più tabelle e pagine in una volta?

    Sì. Tutte le pagine vengono analizzate e ogni tabella rilevata viene esportata separatamente: come file CSV a sé (più file raccolti in un ZIP), come foglio separato di un file Excel o come voce nel JSON.

    Cosa contiene l'esportazione JSON?

    La struttura completa: per ogni tabella pagina, modalità di rilevamento e posizione; per ogni cella testo e riquadro in punti PDF (origine in basso a sinistra). Ideale per script e pipeline di dati.

    Perché le celle unite non risultano esatte?

    Una cella unita su più colonne non ha una posizione univoca nella griglia; il suo contenuto finisce in una delle celle coinvolte e le altre restano vuote. È un'approssimazione onesta: nemmeno gli strumenti desktop specializzati la risolvono senza errori.

    Il PDF viene caricato online?

    No. Rilevamento ed esportazione avvengono interamente in locale nel browser tramite pdf.js; il file non lascia mai il tuo dispositivo.

    L'estrazione delle tabelle funziona anche su smartphone o Chromebook?

    Sì, su qualsiasi dispositivo con un browser aggiornato - Windows, Mac, Linux, Chromebook o smartphone. I PDF molto grandi richiedono solo più tempo e memoria sui dispositivi mobili.

    Strumenti correlati

    PDF in testo · PDF OCR ricercabile · XLSX in CSV · CSV in XLSX · CSV in JSON · Da PDF a Markdown