Convertește PDF în text

Extrage textul fiecărei pagini într-un singur fișier .txt UTF-8 — direct în browser.
Intervale de pagini acceptate, fără încărcare, rezultat gata de copiat.

Trage aici PDF-ul din care extragi textul
Gratuit · Până la 50 MB · Pro până la 250 MB · Procesat în browserul tău

Despre extragerea textului din PDF

PDF în text citește stratul de text al PDF-ului tău și produce un fișier .txt în UTF-8. Planul gratuit procesează până la 50 de pagini; Pro deblochează documente mai mari și conversia în lot. Spre deosebire de unele convertoare online care îți încarcă PDF-ul pe un server pentru analiză, pdfmundo extrage textul local cu pdf.js de la Mozilla — fișierul nu părăsește niciodată fila browserului. PDF-urile pe mai multe coloane (ziare, articole academice pe două coloane) pot produce text în care coloanele se întrepătrund; pentru o extragere care păstrează aspectul, folosește PDF → Word. PDF-urile scanate fără strat de text nu vor returna niciun text — folosește mai întâi OCR PDF ca să adaugi un strat de text.

Întrebări frecvente

Unde este procesat PDF-ul meu?
Integral în fila browserului tău. Folosim pdf.js de la Mozilla pentru a citi stratul de text al PDF-ului. Nimic nu ajunge pe serverul nostru.
De ce PDF-ul meu pe mai multe coloane produce text întrepătruns?
pdf.js returnează elementele de text în ordinea în care apar în fluxul intern al PDF-ului, ceea ce la formatele pe coloane le poate întrepătrunde după poziția verticală. Pentru o extragere care respectă ordinea de citire a coloanelor, folosește PDF → Word — are o logică dedicată de detectare a coloanelor.
Ce fac dacă PDF-ul meu este o imagine scanată fără strat de text?
Atunci nu există text de extras. Detectăm acest lucru și îți oferim un link către instrumentul nostru OCR PDF, care adaugă un strat de text PDF-urilor formate doar din imagini. Rulează întâi OCR, apoi revino ca să extragi textul.
Ce fac dacă PDF-ul meu este protejat cu parolă?
Instrumentul te va anunța. Elimină mai întâi parola din programul tău PDF, apoi extrage textul.
Se păstrează formatarea?
Nu. Rezultatul în text simplu este neformatat: fără aldin, cursiv, mărimi de font sau titluri. Pentru o extragere care păstrează aspectul și formatarea, folosește PDF → Word.
Ce codificare are rezultatul?
Întotdeauna UTF-8. Fără pierderi pentru orice PDF cu conținut Unicode, inclusiv emoji, CJK, chirilic, greacă, arabă etc.
Care este dimensiunea maximă a fișierului?
50 MB și 50 de pagini în planul gratuit; 250 MB și 5.000 de pagini cu Pro.
Am nevoie de cont?
Nu. Instrumentul este complet gratuit și nu necesită înregistrare.

Mai multe instrumente PDF

După ce ai textul simplu, poți aplica mai întâi OCR pe un PDF scanat ca să adaugi un strat de text, poți converti păstrând aspectul cu PDF → Word sau poți extrage imaginile paginilor cu PDF → JPG.

Vezi toate instrumentele