Přeskočit na obsah
nastroje.io

Text z obrázku (OCR)

Přepíše text z fotky, skenu i PDF do editovatelné podoby.

Přetáhněte fotku, sken nebo PDF s textem

nebo klikněte a vyberte (.jpg, .jpeg, .png, .webp, .bmp, .pdf). Max 25 MB na soubor.

Správný jazyk je u diakritiky rozdíl mezi „příště“ a „pristé“.

Zalomení uvnitř odstavce vzniklo šířkou stránky, ne autorem.

Rozpoznávání počítá váš prohlížeč, dokument se nikam neodesílá. Poprvé se stáhne asi 10 MB jádra a jazyka, pak už jede vše bez čekání.

Více o nástroji Text z obrázku (OCR)

Jak vytáhnout text z obrázku nebo skenu

Nahrajte fotku, screenshot nebo skenované PDF, vyberte jazyk a spusťte rozpoznávání. Text se objeví v poli, odkud si ho zkopírujete nebo stáhnete jako TXT. Můžete ho rovnou i opravit.

Rozpoznávání běží přes Tesseract přeložený do WebAssembly, tedy přímo ve vašem prohlížeči. Smlouva ani účtenka neopustí váš počítač, což u dokumentů s osobními údaji není detail.

  • Umí česky i anglicky, včetně háčků a čárek.
  • U skenovaného PDF vykreslí stránky a rozpozná je po jedné, nejvýš dvacet.
  • Poprvé se stáhne asi 10 MB jádra a jazykových dat, pak už jede vše bez čekání.

Jak zlepšit výsledek

Rozpoznávání stojí a padá s předlohou. Foťte stránku zarovnaně shora, ne šikmo, a hlídejte ostrost. Stín přes půlku stránky nebo focení z ruky za šera udělá z výsledku nečitelnou změť.

Časté otázky

Zvládne to psací písmo?

Ne. Tesseract je určený pro tištěný text. Ručně psané poznámky rozpozná jen náhodně.

Proč jsou v textu překlepy?

U nízké jistoty rozpoznání pomůže ostřejší sken, vyšší kontrast nebo správně zvolený jazyk. Češtinu s anglickým modelem rozpozná nástroj bez diakritiky.

Zachová se rozvržení a tabulky?

Ne, výstupem je prostý text. Sloupce a tabulky se rozpadnou do řádků, takže je obvykle potřeba je poskládat ručně.

Funguje to i na běžné PDF s textem?

Funguje, ale zbytečně. Pokud PDF text obsahuje (jde v něm vyhledávat), použijte nástroj PDF do Wordu, výsledek bude přesnější.

Podobné nástroje