OCR naskenovaného PDF
Zpřístupněte své skeny vyhledávání nebo z nich získejte prostý text — vše ve vašem prohlížeči.
Soubory nikdy neopustí vaše zařízení.
Načítám jazykový balíček Angličtina
Stahuji 3 MB. Jen poprvé — další spuštění jsou okamžitá.
Zachová viditelný vzhled a pod něj doplní vybíratelný text. Ctrl-F najde slova.
Získáte prostý soubor .txt s rozpoznanými slovy.
Náhled zdarma
Tarif zdarma zpracuje první stránku. Pro zpracuje celý dokument.
Přejít na Pro — $5,99/měs.Máte klíč Pro?
OCR pro PDF ve vašem prohlížeči
Optické rozpoznávání znaků (OCR) zpřístupní naskenované dokumenty vyhledávání. Přetáhněte naskenované PDF, zvolte jazyk a rozhodněte se, zda chcete prohledávatelné PDF (viditelný originál + vybíratelný text pod ním), nebo výtah v prostém textu. Vše běží ve vašem prohlížeči — váš soubor nikdy neopustí vaše zařízení.
Použijte OCR na své PDF bez nahrávání — vaše soubory neopustí zařízení
Na rozdíl od většiny online nástrojů probíhá OCR vašeho PDF výhradně ve vašem prohlížeči. Soubor se nikdy nenahrává na server, nikdy neukládá a nikdy neopustí vaše zařízení — smlouvy, finanční doklady i další citlivé dokumenty tak zůstávají soukromé.
Časté dotazy
- Nahrávají se moje soubory?
- Ne. Nic se nenahrává — OCR běží výhradně ve vašem prohlížeči, takže váš soubor nikdy nedorazí na server a neopustí vaše zařízení. Nevidíme ho, protože ho nikdy nedostaneme.
- Co znamená „prohledávatelné PDF“?
- Výsledek vypadá stejně jako váš sken, ale Ctrl-F (Cmd-F) v něm najde slova. Tesseract.js rozpozná text v obrázku a vloží ho jako neviditelnou vrstvu pod viditelný obrázek. Označení a zkopírování vrátí rozpoznaný text.
- Jaký je rozdíl mezi prohledávatelným PDF a extrakcí textu?
- Prohledávatelné PDF zachová viditelný vzhled a doplní vybíratelnou textovou vrstvu. Extrakce textu vám dá prostý soubor .txt jen s rozpoznanými slovy.
- Jaké jazyky jsou podporovány?
- Ve verzi 1 angličtina, španělština, portugalština a polština. Pro nejlepší přesnost zvolte jazyk odpovídající dokumentu. Němčina, francouzština a další jsou plánovány pro verzi 1.1 podle zájmu.
- Jak přesné je OCR?
- Tesseract funguje nejlépe u čistého strojově psaného textu v dobrém rozlišení. Nakřivo naskenované, málo kontrastní nebo ručně psané předlohy mohou dávat nespolehlivé výsledky. Při špatném výsledku zkuste sken ve vyšším rozlišení nebo jiný jazyk.
- Proč je první spuštění pomalé?
- Při prvním spuštění si prohlížeč stáhne OCR engine (~3 MB) a jazykový balíček (~1-2 MB na jazyk). Obojí se uloží do mezipaměti — další spuštění jsou okamžitá. Během OCR nechte tento panel v popředí.
- Jaký je limit velikosti?
- 10 MB v tarifu zdarma, 25 MB s Pro. Skutečným limitem je paměť vašeho zařízení.
- Co přináší tarif Pro?
- V tarifu zdarma zpracujete pomocí OCR soubory do 10 MB. S Pro získáte kapacitu 25 MB a — až budou k dispozici — dávkové operace a přístup k API. Denní vstupenka $1,99, kredity $4,99, Pro $5,99/měs. nebo Pro ročně $49.
- Nahráváte moje soubory?
- Ne. OCR běží výhradně ve vašem prohlížeči přes WebAssembly. Vaše soubory i rozpoznaný text zůstávají ve vašem zařízení.
Další nástroje pro PDF
29 nástrojů — komprese, slučování, dělení, otáčení, převody, podpis a další. Všechny zdarma k vyzkoušení.
Zpět na úvodní stránku →