Da PDF a Excel

Report finanziari. Dataset di ricerca. Archivi pubblici.
Certe tabelle non dovrebbero lasciare il tuo dispositivo. Estraile nel browser — non viene caricato nulla.

Trascina qui il PDF da cui estrarre le tabelle
Max 25 MB per file

Informazioni sull'estrazione di tabelle dai PDF

Che cosa estrae questo strumento

Tabelle ben allineate, tabelle senza bordi (l'algoritmo usa la geometria del testo, non le linee visibili) e tabelle che proseguono su più pagine (quando gli ancoraggi delle colonne e le intestazioni coincidono tra una pagina e l'altra). Le tabelle rilevate compaiono con livelli di affidabilità — alta, media o bassa — così puoi valutare ciascuna prima di usarla.

Quando usarlo

Report finanziari, dataset di ricerca, registri pubblici raccolti, archivi della pubblica amministrazione, esportazioni interne di dati — qualsiasi caso in cui il PDF di partenza è abbastanza delicato da rendere sbagliato l'invio a un convertitore di terze parti, ma abbastanza strutturato da rendere sbagliato anche il riscrivere le tabelle a mano.

L'inquadramento sulla privacy

Dalla nostra ricerca, ogni concorrente raggiungibile per la conversione PDF→Excel (Smallpdf, iLovePDF, PDFCandy, PDF24, Convertio) elabora i contenuti sui propri server o usa una formula ambigua di «elaborazione nel browser». Adobe Acrobat mette la funzione dietro abbonamento. Il quadrante «solo nel browser» resta libero. Da PDF a Excel gira interamente sul tuo dispositivo tramite pdf.js e SheetJS — report finanziari, dataset di ricerca e archivi pubblici restano nel tuo browser.

Gli indicatori di affidabilità

L'estrazione di tabelle dai PDF è statistica, non deterministica. Questo strumento mostra un livello di affidabilità per ogni tabella (alta / media / bassa) basato sull'allineamento delle colonne, sulla percentuale di celle vuote e sul numero di righe. Nessun concorrente raggiungibile dichiara un'affidabilità — tutti promettono «struttura preservata» senza riconoscere le perdite insite in un'estrazione basata sulla posizione del testo. Questa trasparenza è, insieme alla privacy, il secondo elemento di differenziazione.

Cosa non gestiamo e perché

I PDF scansionati richiedono prima l'OCR — usa OCR PDF per aggiungere un livello di testo, poi torna qui. Per i PDF cifrati serve rimuovere prima la password, nel tuo software PDF. I PDF danneggiati vanno prima riparati — vedi Ripara PDF. Le tabelle a bassa affidabilità vengono segnalate esplicitamente; per dati critici restano valide la revisione manuale o strumenti alternativi.

Dopo l'estrazione

Aggiungi una password al foglio estratto prima di condividerlo con Proteggi PDF — così le esportazioni finanziarie e di ricerca restano cifrate a riposo.

Converti PDF in Excel senza caricarlo — i tuoi file non lasciano mai il dispositivo

A differenza della maggior parte degli strumenti online, la conversione del tuo PDF in Excel avviene interamente nel browser. Il file non viene mai caricato su un server, mai archiviato e non lascia mai il tuo dispositivo — così contratti, documenti finanziari e altri file delicati restano privati.

Domande frequenti

I miei file vengono caricati?
No. Non viene caricato nulla — la conversione avviene interamente nel tuo browser, quindi il file non raggiunge mai un server e non lascia mai il tuo dispositivo. Non possiamo vederlo perché non lo riceviamo mai.
Con quali PDF funziona meglio?
PDF testuali ben allineati (esportazioni da Excel, report generati, dati della pubblica amministrazione). Le tabelle senza bordi funzionano — l'algoritmo usa la geometria del testo, non le linee visibili. Le pagine con più tabelle producono un foglio per tabella. I PDF scansionati richiedono prima l'OCR tramite lo strumento OCR PDF.
Perché la mia tabella sembra sbagliata?
L'estrazione di tabelle dai PDF è statistica. L'algoritmo raggruppa gli elementi di testo per posizione per dedurre righe e colonne. Le tabelle ben allineate danno estrazioni ad alta affidabilità; quelle con celle unite, contenuti su più righe o impaginazioni insolite possono dare affidabilità media o bassa, con avviso visibile. Per dati critici, rivedi manualmente le tabelle a bassa affidabilità oppure sistemale in Excel / LibreOffice.
Posso estrarre tabelle da PDF scansionati?
No. Questo strumento richiede PDF con testo selezionabile. Per i PDF scansionati (solo immagine), esegui prima OCR PDF per aggiungere un livello di testo, poi torna a Da PDF a Excel. Nella v1 non integriamo l'OCR — lo strumento OCR PDF già esistente copre il caso senza costi aggiuntivi.
Posso estrarre tabelle da PDF protetti da password?
No. La v1 rifiuta la decifratura. Rimuovi prima la password nel tuo software PDF, poi torna a Da PDF a Excel. Non facciamo passare la tua password attraverso pdfmundo.
I miei PDF vengono caricati sui vostri server?
No. Tutta l'estrazione avviene nel tuo browser tramite pdf.js e SheetJS. Report finanziari, dataset di ricerca e archivi pubblici non lasciano mai il tuo dispositivo. Non abbiamo server che ricevano il contenuto.
Meglio XLSX o CSV?
XLSX mantiene la struttura con più tabelle (un foglio per tabella rilevata), i suggerimenti di formattazione delle intestazioni e i metadati di affidabilità. Usa XLSX per proseguire in Excel / LibreOffice. Usa CSV quando alimenti una pipeline di dati (Pandas, R, Python) che preferisce testo semplice; con più tabelle l'output viene raccolto in un archivio ZIP.

Estrai da un altro PDF

Oppure esplora il resto del catalogo.

Torna alla home →