Converti PDF in testo
Estrai il testo di ogni pagina in un unico file .txt UTF-8 — direttamente nel browser.
Intervalli di pagine supportati, nessun caricamento, output pronto da copiare e incollare.
Opzioni di estrazione
Scegli un intervallo di pagine o lascia vuoto per estrarre il testo da tutte le pagine.
Trascina altri PDF per metterli in coda.
Estrai documenti più grandi e in blocco con Pro
Il piano gratuito estrae fino a 50 pagine per file; Pro sblocca documenti più grandi e l'estrazione in blocco da più PDF insieme. La stessa chiave sblocca ogni strumento Pro.
Passa a ProHai già una chiave Pro? Incollala qui
Informazioni sull'estrazione di testo dal PDF
Da PDF a Testo legge il livello di testo del tuo PDF e produce un file .txt in UTF-8. Il piano gratuito gestisce fino a 50 pagine; Pro sblocca documenti più grandi e la conversione in blocco. A differenza di alcuni convertitori online che caricano il tuo PDF su un server per analizzarlo, pdfmundo estrae il testo in locale con pdf.js di Mozilla — il file non lascia mai la scheda del browser. I PDF su più colonne (giornali, articoli accademici a due colonne) possono produrre testo con le colonne intrecciate; per un'estrazione che rispetti l'impaginazione usa PDF → Word. I PDF scansionati senza livello di testo non restituiranno nulla — usa prima OCR PDF per aggiungere un livello di testo.
Domande frequenti
- Dove viene elaborato il mio PDF?
- Interamente nella scheda del tuo browser. Usiamo pdf.js di Mozilla per leggere il livello di testo del PDF. Nulla viene caricato sul nostro server.
- Perché il mio PDF a più colonne produce testo intrecciato?
- pdf.js restituisce gli elementi di testo nell'ordine in cui compaiono nel flusso interno del PDF, il che nelle impaginazioni a colonne può intrecciarli in base alla posizione verticale. Per un'estrazione che rispetti l'ordine di lettura delle colonne usa PDF → Word — dispone di una logica dedicata al riconoscimento delle colonne.
- E se il mio PDF è un'immagine scansionata senza livello di testo?
- Allora non c'è testo da estrarre. Lo rileviamo e ti proponiamo un link al nostro strumento OCR PDF, che aggiunge un livello di testo ai PDF composti solo da immagini. Esegui prima l'OCR, poi torna qui per estrarre il testo.
- E se il mio PDF è protetto da password?
- Lo strumento te lo segnalerà. Rimuovi prima la password nel tuo software PDF, poi estrai il testo.
- La formattazione verrà mantenuta?
- No. L'output in testo semplice è privo di formattazione: niente grassetto, corsivo, dimensioni dei caratteri o titoli. Per un'estrazione che mantenga impaginazione e formattazione usa PDF → Word.
- Quale codifica usa l'output?
- Sempre UTF-8. Senza perdita per qualsiasi PDF con contenuti Unicode, inclusi emoji, CJK, cirillico, greco, arabo ecc.
- Qual è la dimensione massima?
- 50 MB e 50 pagine nel piano gratuito; 250 MB e 5.000 pagine con Pro.
- Serve un account?
- No. Lo strumento è completamente gratuito e non richiede registrazione.
Altri strumenti PDF
Ottenuto il testo semplice, puoi prima applicare l'OCR a un PDF scansionato per aggiungere un livello di testo, convertire mantenendo l'impaginazione con PDF → Word o estrarre le immagini delle pagine con PDF → JPG.
Vedi tutti gli strumenti