OCR für ein gescanntes PDF

Machen Sie Ihre Scans durchsuchbar oder extrahieren Sie reinen Text — alles in Ihrem Browser.
Dateien verlassen Ihr Gerät nie.

Gescanntes PDF hier ablegen
Kostenlos · Bis zu 10 MB · Verarbeitung in Ihrem Browser

OCR für ein PDF in Ihrem Browser

Die optische Zeichenerkennung (OCR) macht gescannte Dokumente durchsuchbar. Legen Sie ein gescanntes PDF ab, wählen Sie die Sprache und entscheiden Sie, ob Sie ein durchsuchbares PDF (sichtbares Original + auswählbarer Text darunter) oder einen reinen Textauszug möchten. Alles läuft in Ihrem Browser — Ihre Datei verlässt Ihr Gerät nie.

OCR für Ihr PDF ohne Upload — Ihre Dateien verlassen Ihr Gerät nie

Anders als bei den meisten Online-Tools läuft die OCR für Ihr PDF vollständig in Ihrem Browser ab. Die Datei wird nie auf einen Server hochgeladen, nie gespeichert und verlässt nie Ihr Gerät — Verträge, Finanzunterlagen und andere sensible Dokumente bleiben also privat.

Häufig gestellte Fragen

Werden meine Dateien hochgeladen?
Nein. Es wird nichts hochgeladen — die OCR läuft vollständig in Ihrem Browser, Ihre Datei erreicht also nie einen Server und verlässt nie Ihr Gerät. Wir können sie nicht sehen, weil wir sie nie erhalten.
Was bedeutet „durchsuchbares PDF“?
Das Ergebnis sieht genauso aus wie Ihr Scan, aber Strg-F (Cmd-F) findet Wörter. Tesseract.js erkennt den Text im Bild und bettet ihn als unsichtbare Ebene unter dem sichtbaren Bild ein. Markieren und Kopieren liefert den erkannten Text.
Was ist der Unterschied zwischen durchsuchbarem PDF und Textextraktion?
Das durchsuchbare PDF behält das sichtbare Erscheinungsbild und ergänzt eine auswählbare Textebene. Die Textextraktion liefert eine reine .txt-Datei mit nur den erkannten Wörtern.
Welche Sprachen werden unterstützt?
Englisch, Spanisch, Portugiesisch und Polnisch in v1. Wählen Sie die Sprache Ihres Dokuments für die beste Genauigkeit. Deutsch, Französisch und weitere sind je nach Nachfrage für v1.1 geplant.
Wie genau ist die OCR?
Tesseract funktioniert am besten mit klarem, maschinengeschriebenem Text in guter Auflösung. Schiefe Scans, geringer Kontrast oder Handschrift können unzuverlässige Ergebnisse liefern. Versuchen Sie bei schlechtem Ergebnis einen Scan mit höherer Auflösung oder eine andere Sprache.
Warum ist der erste Durchlauf langsam?
Beim ersten Durchlauf lädt Ihr Browser die OCR-Engine (~3 MB) und das Sprachpaket (~1-2 MB je Sprache). Beides wird zwischengespeichert — spätere Durchläufe starten sofort. Lassen Sie diesen Tab im Vordergrund, während die OCR läuft.
Wie groß darf die Datei höchstens sein?
10 MB im kostenlosen Tarif, 25 MB mit Pro. Die tatsächliche Grenze ist der Speicher Ihres Geräts.
Was steckt hinter dem Pro-Tarif?
Im kostenlosen Tarif verarbeiten Sie Dateien bis 10 MB per OCR. Mit Pro erhalten Sie 25 MB Kapazität und — sobald verfügbar — Stapelverarbeitung und API-Zugang. $1,99 Tagespass, $4,99 Credits, $5,99/Mon. Pro oder $49/Jahr Pro jährlich.
Laden Sie meine Dateien hoch?
Nein. Die OCR läuft vollständig in Ihrem Browser über WebAssembly. Ihre Dateien und der erkannte Text bleiben auf Ihrem Gerät.

Weitere PDF-Tools

29 Tools — komprimieren, zusammenfügen, teilen, drehen, konvertieren, signieren und mehr. Alle kostenlos zum Ausprobieren.

Zurück zur Startseite →