Da PDF a Excel
Report finanziari. Dataset di ricerca. Archivi pubblici.
Certe tabelle non dovrebbero lasciare il tuo dispositivo. Estraile nel browser — non viene caricato nulla.
Rilevamento delle tabelle…
{tableCount} tabella/e estratta/e
Riuscita
Le tue tabelle sono state estratte. Scarica qui sotto.
{tableCount} tabella/e estratta/e, con note
Riuscita con note
Estrazione completata. Vedi le note qui sotto per i dettagli sui livelli di affidabilità e sui contenuti saltati.
Note sull'estrazione
Affidabilità per tabella
L'estrazione di tabelle dai PDF è statistica. Ogni tabella rilevata riceve un livello di affidabilità — alta (ben allineata), media (qualche ambiguità strutturale) o bassa (ambiguità marcata; si consiglia una verifica).
Informazioni sull'estrazione di tabelle dai PDF
Che cosa estrae questo strumento
Tabelle ben allineate, tabelle senza bordi (l'algoritmo usa la geometria del testo, non le linee visibili) e tabelle che proseguono su più pagine (quando gli ancoraggi delle colonne e le intestazioni coincidono tra una pagina e l'altra). Le tabelle rilevate compaiono con livelli di affidabilità — alta, media o bassa — così puoi valutare ciascuna prima di usarla.
Quando usarlo
Report finanziari, dataset di ricerca, registri pubblici raccolti, archivi della pubblica amministrazione, esportazioni interne di dati — qualsiasi caso in cui il PDF di partenza è abbastanza delicato da rendere sbagliato l'invio a un convertitore di terze parti, ma abbastanza strutturato da rendere sbagliato anche il riscrivere le tabelle a mano.
L'inquadramento sulla privacy
Dalla nostra ricerca, ogni concorrente raggiungibile per la conversione PDF→Excel (Smallpdf, iLovePDF, PDFCandy, PDF24, Convertio) elabora i contenuti sui propri server o usa una formula ambigua di «elaborazione nel browser». Adobe Acrobat mette la funzione dietro abbonamento. Il quadrante «solo nel browser» resta libero. Da PDF a Excel gira interamente sul tuo dispositivo tramite pdf.js e SheetJS — report finanziari, dataset di ricerca e archivi pubblici restano nel tuo browser.
Gli indicatori di affidabilità
L'estrazione di tabelle dai PDF è statistica, non deterministica. Questo strumento mostra un livello di affidabilità per ogni tabella (alta / media / bassa) basato sull'allineamento delle colonne, sulla percentuale di celle vuote e sul numero di righe. Nessun concorrente raggiungibile dichiara un'affidabilità — tutti promettono «struttura preservata» senza riconoscere le perdite insite in un'estrazione basata sulla posizione del testo. Questa trasparenza è, insieme alla privacy, il secondo elemento di differenziazione.
Cosa non gestiamo e perché
I PDF scansionati richiedono prima l'OCR — usa OCR PDF per aggiungere un livello di testo, poi torna qui. Per i PDF cifrati serve rimuovere prima la password, nel tuo software PDF. I PDF danneggiati vanno prima riparati — vedi Ripara PDF. Le tabelle a bassa affidabilità vengono segnalate esplicitamente; per dati critici restano valide la revisione manuale o strumenti alternativi.
Dopo l'estrazione
Aggiungi una password al foglio estratto prima di condividerlo con Proteggi PDF — così le esportazioni finanziarie e di ricerca restano cifrate a riposo.
Converti PDF in Excel senza caricarlo — i tuoi file non lasciano mai il dispositivo
A differenza della maggior parte degli strumenti online, la conversione del tuo PDF in Excel avviene interamente nel browser. Il file non viene mai caricato su un server, mai archiviato e non lascia mai il tuo dispositivo — così contratti, documenti finanziari e altri file delicati restano privati.
Domande frequenti
- I miei file vengono caricati?
- No. Non viene caricato nulla — la conversione avviene interamente nel tuo browser, quindi il file non raggiunge mai un server e non lascia mai il tuo dispositivo. Non possiamo vederlo perché non lo riceviamo mai.
- Con quali PDF funziona meglio?
- PDF testuali ben allineati (esportazioni da Excel, report generati, dati della pubblica amministrazione). Le tabelle senza bordi funzionano — l'algoritmo usa la geometria del testo, non le linee visibili. Le pagine con più tabelle producono un foglio per tabella. I PDF scansionati richiedono prima l'OCR tramite lo strumento OCR PDF.
- Perché la mia tabella sembra sbagliata?
- L'estrazione di tabelle dai PDF è statistica. L'algoritmo raggruppa gli elementi di testo per posizione per dedurre righe e colonne. Le tabelle ben allineate danno estrazioni ad alta affidabilità; quelle con celle unite, contenuti su più righe o impaginazioni insolite possono dare affidabilità media o bassa, con avviso visibile. Per dati critici, rivedi manualmente le tabelle a bassa affidabilità oppure sistemale in Excel / LibreOffice.
- Posso estrarre tabelle da PDF scansionati?
- No. Questo strumento richiede PDF con testo selezionabile. Per i PDF scansionati (solo immagine), esegui prima OCR PDF per aggiungere un livello di testo, poi torna a Da PDF a Excel. Nella v1 non integriamo l'OCR — lo strumento OCR PDF già esistente copre il caso senza costi aggiuntivi.
- Posso estrarre tabelle da PDF protetti da password?
- No. La v1 rifiuta la decifratura. Rimuovi prima la password nel tuo software PDF, poi torna a Da PDF a Excel. Non facciamo passare la tua password attraverso pdfmundo.
- I miei PDF vengono caricati sui vostri server?
- No. Tutta l'estrazione avviene nel tuo browser tramite pdf.js e SheetJS. Report finanziari, dataset di ricerca e archivi pubblici non lasciano mai il tuo dispositivo. Non abbiamo server che ricevano il contenuto.
- Meglio XLSX o CSV?
- XLSX mantiene la struttura con più tabelle (un foglio per tabella rilevata), i suggerimenti di formattazione delle intestazioni e i metadati di affidabilità. Usa XLSX per proseguire in Excel / LibreOffice. Usa CSV quando alimenti una pipeline di dati (Pandas, R, Python) che preferisce testo semplice; con più tabelle l'output viene raccolto in un archivio ZIP.