OCR zeskanowanego PDF-a
Spraw, by Twoje skany były przeszukiwalne, albo wyodrębnij czysty tekst — wszystko w przeglądarce.
Pliki nigdy nie opuszczają Twojego urządzenia.
Wczytywanie pakietu językowego: Angielski
Pobieranie 3 MB. Tylko za pierwszym razem — kolejne uruchomienia są natychmiastowe.
Zachowuje widoczny wygląd i dodaje pod spodem zaznaczalny tekst. Ctrl-F znajduje słowa.
Otrzymujesz zwykły plik .txt z rozpoznanymi słowami.
Darmowy podgląd
Plan darmowy przetwarza pierwszą stronę. Pro przetwarza cały dokument.
Przejdź na Pro — $5,99/mies.Masz klucz Pro?
OCR PDF-a w Twojej przeglądarce
Optyczne rozpoznawanie znaków (OCR) sprawia, że zeskanowane dokumenty stają się przeszukiwalne. Upuść zeskanowany PDF, wybierz język i zdecyduj, czy chcesz przeszukiwalny PDF (widoczny oryginał + zaznaczalny tekst pod spodem), czy wyciąg w postaci czystego tekstu. Wszystko działa w Twojej przeglądarce — plik nigdy nie opuszcza Twojego urządzenia.
Zastosuj OCR do PDF-a bez wysyłania — Twoje pliki nie opuszczają urządzenia
W odróżnieniu od większości narzędzi online OCR Twojego PDF-a odbywa się w całości w przeglądarce. Plik nigdy nie jest wysyłany na serwer, nigdy przechowywany i nigdy nie opuszcza urządzenia — umowy, dokumenty finansowe i inne wrażliwe materiały pozostają prywatne.
Najczęstsze pytania
- Czy moje pliki są wysyłane?
- Nie. Nic nie jest wysyłane — OCR działa w całości w Twojej przeglądarce, więc plik nigdy nie trafia na serwer i nie opuszcza urządzenia. Nie widzimy go, bo nigdy go nie otrzymujemy.
- Co oznacza „przeszukiwalny PDF”?
- Wynik wygląda identycznie jak Twój skan, ale Ctrl-F (Cmd-F) znajduje słowa. Tesseract.js rozpoznaje tekst na obrazie i osadza go jako niewidoczną warstwę pod widocznym obrazem. Zaznaczenie i skopiowanie zwraca rozpoznany tekst.
- Czym różni się przeszukiwalny PDF od wyodrębnienia tekstu?
- Przeszukiwalny PDF zachowuje widoczny wygląd i dodaje warstwę zaznaczalnego tekstu. Wyodrębnienie tekstu daje zwykły plik .txt zawierający wyłącznie rozpoznane słowa.
- Jakie języki są obsługiwane?
- W wersji 1: angielski, hiszpański, portugalski i polski. Wybierz język zgodny z dokumentem, aby uzyskać najlepszą dokładność. Niemiecki, francuski i kolejne są planowane w wersji 1.1 w zależności od zapotrzebowania.
- Jak dokładny jest OCR?
- Tesseract działa najlepiej przy wyraźnym, maszynowym tekście w dobrej rozdzielczości. Krzywe skany, niski kontrast lub pismo odręczne mogą dawać niepewne wyniki. Jeśli wynik jest słaby, spróbuj skanu w wyższej rozdzielczości albo innego języka.
- Dlaczego pierwsze uruchomienie jest wolne?
- Przy pierwszym uruchomieniu przeglądarka pobiera silnik OCR (~3 MB) i pakiet językowy (~1-2 MB na język). Oba są zapisywane w pamięci podręcznej — kolejne uruchomienia są natychmiastowe. Podczas działania OCR trzymaj tę kartę na wierzchu.
- Jaki jest limit rozmiaru?
- 10 MB w planie darmowym, 25 MB w Pro. Faktycznym limitem jest pamięć Twojego urządzenia.
- Co daje plan Pro?
- W planie darmowym OCR obsługuje pliki do 10 MB. Pro daje 25 MB pojemności oraz — gdy będą dostępne — operacje wsadowe i dostęp do API. Karnet dzienny $1,99, kredyty $4,99, Pro $5,99/mies. lub Pro roczne $49.
- Czy wysyłacie moje pliki?
- Nie. OCR działa w całości w Twojej przeglądarce dzięki WebAssembly. Twoje pliki i rozpoznany tekst zostają na Twoim urządzeniu.
Więcej narzędzi PDF
29 narzędzi — kompresja, łączenie, dzielenie, obracanie, konwersja, podpisywanie i więcej. Wszystkie za darmo do wypróbowania.
Powrót na stronę główną →