Text z obrázku (OCR)
Přepíše text z fotky, skenu i PDF do editovatelné podoby.
Přetáhněte fotku, sken nebo PDF s textem
nebo klikněte a vyberte (.jpg, .jpeg, .png, .webp, .bmp, .pdf). Max 25 MB na soubor.
Správný jazyk je u diakritiky rozdíl mezi „příště“ a „pristé“.
Zalomení uvnitř odstavce vzniklo šířkou stránky, ne autorem.
Rozpoznávání počítá váš prohlížeč, dokument se nikam neodesílá. Poprvé se stáhne asi 10 MB jádra a jazyka, pak už jede vše bez čekání.
- Zpracování probíhá přímo ve vašem prohlížeči
- Zdarma bez registrace
Více o nástroji Text z obrázku (OCR)
Jak vytáhnout text z obrázku nebo skenu
Nahrajte fotku, screenshot nebo skenované PDF, vyberte jazyk a spusťte rozpoznávání. Text se objeví v poli, odkud si ho zkopírujete nebo stáhnete jako TXT. Můžete ho rovnou i opravit.
Rozpoznávání běží přes Tesseract přeložený do WebAssembly, tedy přímo ve vašem prohlížeči. Smlouva ani účtenka neopustí váš počítač, což u dokumentů s osobními údaji není detail.
- Umí česky i anglicky, včetně háčků a čárek.
- U skenovaného PDF vykreslí stránky a rozpozná je po jedné, nejvýš dvacet.
- Poprvé se stáhne asi 10 MB jádra a jazykových dat, pak už jede vše bez čekání.
Jak zlepšit výsledek
Rozpoznávání stojí a padá s předlohou. Foťte stránku zarovnaně shora, ne šikmo, a hlídejte ostrost. Stín přes půlku stránky nebo focení z ruky za šera udělá z výsledku nečitelnou změť.
Časté otázky
Zvládne to psací písmo?
Ne. Tesseract je určený pro tištěný text. Ručně psané poznámky rozpozná jen náhodně.
Proč jsou v textu překlepy?
U nízké jistoty rozpoznání pomůže ostřejší sken, vyšší kontrast nebo správně zvolený jazyk. Češtinu s anglickým modelem rozpozná nástroj bez diakritiky.
Zachová se rozvržení a tabulky?
Ne, výstupem je prostý text. Sloupce a tabulky se rozpadnou do řádků, takže je obvykle potřeba je poskládat ručně.
Funguje to i na běžné PDF s textem?
Funguje, ale zbytečně. Pokud PDF text obsahuje (jde v něm vyhledávat), použijte nástroj PDF do Wordu, výsledek bude přesnější.