PDF in Text umwandeln

Extrahieren Sie den Text aller Seiten als eine UTF-8-.txt-Datei — direkt im Browser.
Seitenbereiche möglich, kein Upload, direkt zum Kopieren und Einfügen.

PDF zum Extrahieren des Texts hier ablegen
Kostenlos · Bis zu 50 MB · Pro bis zu 250 MB · Verarbeitung in Ihrem Browser

Über die Textextraktion aus PDFs

„PDF in Text“ liest die Textebene Ihres PDFs und erzeugt eine UTF-8-.txt-Datei. Der kostenlose Tarif verarbeitet bis zu 50 Seiten; Pro schaltet größere Dokumente und die Stapelverarbeitung frei. Anders als manche Online-Konverter, die Ihr PDF zum Auswerten auf einen Server hochladen, extrahiert pdfmundo den Text lokal mit Mozillas pdf.js — Ihre Datei verlässt den Browser-Tab nie. Mehrspaltige PDFs (Zeitungen, zweispaltige wissenschaftliche Arbeiten) können Text liefern, bei dem sich die Spalten verschränken; für eine layouttreue Extraktion nutzen Sie PDF → Word. Gescannte PDFs ohne Textebene liefern keinen Text — verwenden Sie zuerst OCR PDF, um eine Textebene hinzuzufügen.

Häufig gestellte Fragen

Wo wird mein PDF verarbeitet?
Vollständig in Ihrem Browser-Tab. Wir nutzen Mozillas pdf.js, um die Textebene des PDFs zu lesen. Nichts wird auf unseren Server hochgeladen.
Warum liefert mein mehrspaltiges PDF verschränkten Text?
pdf.js gibt Textelemente in der Reihenfolge zurück, in der sie im internen Datenstrom des PDFs stehen; bei mehrspaltigen Layouts kann das die Spalten nach vertikaler Position verschränken. Für eine layouttreue Extraktion (mit korrekter Spaltenlesefolge) nutzen Sie PDF → Word — dort gibt es eine eigene Spaltenerkennung.
Was, wenn mein PDF ein gescanntes Bild ohne Textebene ist?
Dann gibt es keinen Text zum Extrahieren. Wir erkennen das und bieten einen Link zu unserem OCR-PDF-Tool an, das bildbasierten PDFs eine Textebene hinzufügt. Führen Sie zuerst OCR aus und kommen Sie dann zum Extrahieren zurück.
Was, wenn mein PDF passwortgeschützt ist?
Das Tool weist Sie darauf hin. Entfernen Sie das Passwort zuerst in Ihrer PDF-Software und extrahieren Sie dann den Text.
Bleibt die Formatierung erhalten?
Nein. Die Ausgabe als reiner Text ist unformatiert: kein Fett, kein Kursiv, keine Schriftgrößen, keine Überschriften. Für eine layouttreue Extraktion mit Formatierung nutzen Sie PDF → Word.
Welche Kodierung hat die Ausgabe?
Immer UTF-8. Verlustfrei für jedes PDF mit Unicode-Inhalten, einschließlich Emoji, CJK, Kyrillisch, Griechisch, Arabisch usw.
Wie groß darf die Datei höchstens sein?
50 MB und 50 Seiten im kostenlosen Tarif; 250 MB und 5.000 Seiten mit Pro.
Brauche ich ein Konto?
Nein. Das Tool ist völlig kostenlos und ohne Anmeldung nutzbar.

Weitere PDF-Tools

Wenn Sie reinen Text haben, können Sie ein gescanntes PDF zuerst per OCR mit einer Textebene versehen, mit PDF → Word layouttreu konvertieren oder mit PDF → JPG Seitenbilder gewinnen.

Alle Tools ansehen