OCR naskenovaného PDF

Zpřístupněte své skeny vyhledávání nebo z nich získejte prostý text — vše ve vašem prohlížeči.
Soubory nikdy neopustí vaše zařízení.

Přetáhněte sem naskenované PDF
Zdarma · Až 10 MB · Zpracováno ve vašem prohlížeči

OCR pro PDF ve vašem prohlížeči

Optické rozpoznávání znaků (OCR) zpřístupní naskenované dokumenty vyhledávání. Přetáhněte naskenované PDF, zvolte jazyk a rozhodněte se, zda chcete prohledávatelné PDF (viditelný originál + vybíratelný text pod ním), nebo výtah v prostém textu. Vše běží ve vašem prohlížeči — váš soubor nikdy neopustí vaše zařízení.

Použijte OCR na své PDF bez nahrávání — vaše soubory neopustí zařízení

Na rozdíl od většiny online nástrojů probíhá OCR vašeho PDF výhradně ve vašem prohlížeči. Soubor se nikdy nenahrává na server, nikdy neukládá a nikdy neopustí vaše zařízení — smlouvy, finanční doklady i další citlivé dokumenty tak zůstávají soukromé.

Časté dotazy

Nahrávají se moje soubory?
Ne. Nic se nenahrává — OCR běží výhradně ve vašem prohlížeči, takže váš soubor nikdy nedorazí na server a neopustí vaše zařízení. Nevidíme ho, protože ho nikdy nedostaneme.
Co znamená „prohledávatelné PDF“?
Výsledek vypadá stejně jako váš sken, ale Ctrl-F (Cmd-F) v něm najde slova. Tesseract.js rozpozná text v obrázku a vloží ho jako neviditelnou vrstvu pod viditelný obrázek. Označení a zkopírování vrátí rozpoznaný text.
Jaký je rozdíl mezi prohledávatelným PDF a extrakcí textu?
Prohledávatelné PDF zachová viditelný vzhled a doplní vybíratelnou textovou vrstvu. Extrakce textu vám dá prostý soubor .txt jen s rozpoznanými slovy.
Jaké jazyky jsou podporovány?
Ve verzi 1 angličtina, španělština, portugalština a polština. Pro nejlepší přesnost zvolte jazyk odpovídající dokumentu. Němčina, francouzština a další jsou plánovány pro verzi 1.1 podle zájmu.
Jak přesné je OCR?
Tesseract funguje nejlépe u čistého strojově psaného textu v dobrém rozlišení. Nakřivo naskenované, málo kontrastní nebo ručně psané předlohy mohou dávat nespolehlivé výsledky. Při špatném výsledku zkuste sken ve vyšším rozlišení nebo jiný jazyk.
Proč je první spuštění pomalé?
Při prvním spuštění si prohlížeč stáhne OCR engine (~3 MB) a jazykový balíček (~1-2 MB na jazyk). Obojí se uloží do mezipaměti — další spuštění jsou okamžitá. Během OCR nechte tento panel v popředí.
Jaký je limit velikosti?
10 MB v tarifu zdarma, 25 MB s Pro. Skutečným limitem je paměť vašeho zařízení.
Co přináší tarif Pro?
V tarifu zdarma zpracujete pomocí OCR soubory do 10 MB. S Pro získáte kapacitu 25 MB a — až budou k dispozici — dávkové operace a přístup k API. Denní vstupenka $1,99, kredity $4,99, Pro $5,99/měs. nebo Pro ročně $49.
Nahráváte moje soubory?
Ne. OCR běží výhradně ve vašem prohlížeči přes WebAssembly. Vaše soubory i rozpoznaný text zůstávají ve vašem zařízení.

Další nástroje pro PDF

29 nástrojů — komprese, slučování, dělení, otáčení, převody, podpis a další. Všechny zdarma k vyzkoušení.

Zpět na úvodní stránku →