Text z obrázku (OCR)
Přepíše text z fotky, skenu i PDF do editovatelné podoby.
Přetáhněte fotku, sken nebo PDF s textem
nebo klikněte a vyberte (.jpg, .jpeg, .png, .webp, .bmp, .pdf), nebo vložte ze schránky (Ctrl+V). Max 10 MB na soubor.
Zalomení uvnitř odstavce vzniklo šířkou stránky, ne autorem.
Rozpoznávání počítá přesnější model na našem serveru. Dokument se zpracuje v paměti a hned po odeslání výsledku se maže, nikde se neukládá.
- Zpracování probíhá na našem serveru
- Zdarma bez registrace
Více o nástroji Text z obrázku (OCR)
Jak vytáhnout text z obrázku nebo skenu
Nahrajte fotku, screenshot nebo skenované PDF a spusťte rozpoznávání. Text se objeví v poli, odkud si ho zkopírujete nebo stáhnete jako TXT. Můžete ho rovnou i opravit.
Rozpoznávání počítá model PaddleOCR na našem serveru: na fotkách dokumentů je znatelně přesnější než rozpoznávání v prohlížeči. Dokument se zpracuje v paměti a hned po odeslání výsledku se maže, nikde se neukládá.
- Umí česky i anglicky najednou, včetně háčků a čárek, bez volby jazyka.
- U skenovaného PDF vykreslí stránky a rozpozná je po jedné, nejvýš dvacet.
- Vícestránkové PDF se počítá jako jedno použití denního limitu.
Jak zlepšit výsledek
Rozpoznávání stojí a padá s předlohou. Foťte stránku zarovnaně shora, ne šikmo, a hlídejte ostrost. Stín přes půlku stránky nebo focení z ruky za šera udělá z výsledku nečitelnou změť.
Časté otázky
Zvládne to psací písmo?
Ne. Tesseract je určený pro tištěný text. Ručně psané poznámky rozpozná jen náhodně.
Proč jsou v textu překlepy?
U nízké jistoty rozpoznání pomůže ostřejší sken, vyšší kontrast nebo správně zvolený jazyk. Češtinu s anglickým modelem rozpozná nástroj bez diakritiky.
Zachová se rozvržení a tabulky?
Ne, výstupem je prostý text. Sloupce a tabulky se rozpadnou do řádků, takže je obvykle potřeba je poskládat ručně.
Funguje to i na běžné PDF s textem?
Funguje, ale zbytečně. Pokud PDF text obsahuje (jde v něm vyhledávat), použijte nástroj PDF do Wordu, výsledek bude přesnější.