OCR PDF: vytvořit prohledávatelné PDF
OCR PDF: rozpoznejte skenované PDF a přidejte vybíratelný text v češtině, angličtině, španělštině nebo ruštině. Limity: až 10 stránek a 10 MiB na soubor. Soubory zůstávají ve vašem prohlížeči.
Soubory pro rozpoznávání ≈ 26 MB při prvním použití, plus jazyková data.
Rozpoznaný text
Byl tento nástroj užitečný?
Vyzkoušet příklad
Stáhnout ukázkuNechte vybraný jazyk Čeština. Stáhněte PDF a vyhledejte FAKTURA, 148,50, Dvořák, DODÁVKA a 2048. Obě stránky by měly vypadat jako ukázka, s textem, který lze vybírat a kopírovat; háčky a čárky zůstanou zachovány.
Co očekávat
Každá stránka se rozpozná jako obrázek, postupně za sebou. K dispozici je rozpoznávání angličtiny, ruštiny a smíšených textů. OCR může špatně přečíst písmena, čísla, sloupce a tabulky: zkontrolujte výsledek. Tím vznikne nové PDF z vykreslených obrázků stránek a neviditelné textové vrstvy. Viditelná velikost stránky a otočení se zachovají; formuláře, odkazy, záložky, přílohy a digitální podpisy se nezachovají. Stávající text se rozpozná znovu; kvalita obrázku je omezena rozlišením vykreslení.
Stránky se vykreslují až ve 4 megapixelech. Načítání i každý krok zpracování mohou trvat až 90 sekund; celá úloha se zastaví po 10 minutách. Prázdné stránky jsou v textu označeny. Pokud zpracování selže nebo se nerozpozná žádný text, stažení se nenabídne.
PDF chráněné heslem?Nejprve je odemkněte jeho heslem.
Při prvním spuštění se mohou stáhnout soubory převodníku, což chvíli potrvá. Pokud se to nezdaří, zkontrolujte připojení nebo zkuste menší soubor. Tlačítko „Zrušit“ zastaví probíhající zpracování; můžete vybrat jiný soubor a zkusit to znovu.
Praktický návod
Sken na vstupu, prohledávatelné PDF na výstupu.
- Vyberte skenované PDF do 10 stránek a 10 MiB.
- Zvolte češtinu, angličtinu, španělštinu nebo ruštinu.
- Vyhledejte ve výsledném PDF známé slovo, abyste ověřili textovou vrstvu.
Vyzkoušet tento příklad
Rozpoznejte skenovanou fakturu o 2 stránkách v češtině; hledání čísla faktury by ho mělo ve výsledném PDF najít zvýrazněné.
Než začnete: Podporována je jen čeština, angličtina, španělština a ruština, v mezích 10 stránek a 10 MiB; přesnost rozpoznání klesá u skenů nízké kvality.