OCR zeskanowanego PDF-a

Spraw, by Twoje skany były przeszukiwalne, albo wyodrębnij czysty tekst — wszystko w przeglądarce.
Pliki nigdy nie opuszczają Twojego urządzenia.

Upuść tutaj zeskanowany PDF
Za darmo · Do 10 MB · Przetwarzane w Twojej przeglądarce

OCR PDF-a w Twojej przeglądarce

Optyczne rozpoznawanie znaków (OCR) sprawia, że zeskanowane dokumenty stają się przeszukiwalne. Upuść zeskanowany PDF, wybierz język i zdecyduj, czy chcesz przeszukiwalny PDF (widoczny oryginał + zaznaczalny tekst pod spodem), czy wyciąg w postaci czystego tekstu. Wszystko działa w Twojej przeglądarce — plik nigdy nie opuszcza Twojego urządzenia.

Zastosuj OCR do PDF-a bez wysyłania — Twoje pliki nie opuszczają urządzenia

W odróżnieniu od większości narzędzi online OCR Twojego PDF-a odbywa się w całości w przeglądarce. Plik nigdy nie jest wysyłany na serwer, nigdy przechowywany i nigdy nie opuszcza urządzenia — umowy, dokumenty finansowe i inne wrażliwe materiały pozostają prywatne.

Najczęstsze pytania

Czy moje pliki są wysyłane?
Nie. Nic nie jest wysyłane — OCR działa w całości w Twojej przeglądarce, więc plik nigdy nie trafia na serwer i nie opuszcza urządzenia. Nie widzimy go, bo nigdy go nie otrzymujemy.
Co oznacza „przeszukiwalny PDF”?
Wynik wygląda identycznie jak Twój skan, ale Ctrl-F (Cmd-F) znajduje słowa. Tesseract.js rozpoznaje tekst na obrazie i osadza go jako niewidoczną warstwę pod widocznym obrazem. Zaznaczenie i skopiowanie zwraca rozpoznany tekst.
Czym różni się przeszukiwalny PDF od wyodrębnienia tekstu?
Przeszukiwalny PDF zachowuje widoczny wygląd i dodaje warstwę zaznaczalnego tekstu. Wyodrębnienie tekstu daje zwykły plik .txt zawierający wyłącznie rozpoznane słowa.
Jakie języki są obsługiwane?
W wersji 1: angielski, hiszpański, portugalski i polski. Wybierz język zgodny z dokumentem, aby uzyskać najlepszą dokładność. Niemiecki, francuski i kolejne są planowane w wersji 1.1 w zależności od zapotrzebowania.
Jak dokładny jest OCR?
Tesseract działa najlepiej przy wyraźnym, maszynowym tekście w dobrej rozdzielczości. Krzywe skany, niski kontrast lub pismo odręczne mogą dawać niepewne wyniki. Jeśli wynik jest słaby, spróbuj skanu w wyższej rozdzielczości albo innego języka.
Dlaczego pierwsze uruchomienie jest wolne?
Przy pierwszym uruchomieniu przeglądarka pobiera silnik OCR (~3 MB) i pakiet językowy (~1-2 MB na język). Oba są zapisywane w pamięci podręcznej — kolejne uruchomienia są natychmiastowe. Podczas działania OCR trzymaj tę kartę na wierzchu.
Jaki jest limit rozmiaru?
10 MB w planie darmowym, 25 MB w Pro. Faktycznym limitem jest pamięć Twojego urządzenia.
Co daje plan Pro?
W planie darmowym OCR obsługuje pliki do 10 MB. Pro daje 25 MB pojemności oraz — gdy będą dostępne — operacje wsadowe i dostęp do API. Karnet dzienny $1,99, kredyty $4,99, Pro $5,99/mies. lub Pro roczne $49.
Czy wysyłacie moje pliki?
Nie. OCR działa w całości w Twojej przeglądarce dzięki WebAssembly. Twoje pliki i rozpoznany tekst zostają na Twoim urządzeniu.

Więcej narzędzi PDF

29 narzędzi — kompresja, łączenie, dzielenie, obracanie, konwersja, podpisywanie i więcej. Wszystkie za darmo do wypróbowania.

Powrót na stronę główną →