Přeskočit na obsah
nastroje.io

Text z obrázku (OCR)

Přepíše text z fotky, skenu i PDF do editovatelné podoby.

Přetáhněte fotku, sken nebo PDF s textem

nebo klikněte a vyberte (.jpg, .jpeg, .png, .webp, .bmp, .pdf), nebo vložte ze schránky (Ctrl+V). Max 10 MB na soubor.

Zalomení uvnitř odstavce vzniklo šířkou stránky, ne autorem.

Rozpoznávání počítá přesnější model na našem serveru. Dokument se zpracuje v paměti a hned po odeslání výsledku se maže, nikde se neukládá.

Více o nástroji Text z obrázku (OCR)

Jak vytáhnout text z obrázku nebo skenu

Nahrajte fotku, screenshot nebo skenované PDF a spusťte rozpoznávání. Text se objeví v poli, odkud si ho zkopírujete nebo stáhnete jako TXT. Můžete ho rovnou i opravit.

Rozpoznávání počítá model PaddleOCR na našem serveru: na fotkách dokumentů je znatelně přesnější než rozpoznávání v prohlížeči. Dokument se zpracuje v paměti a hned po odeslání výsledku se maže, nikde se neukládá.

  • Umí česky i anglicky najednou, včetně háčků a čárek, bez volby jazyka.
  • U skenovaného PDF vykreslí stránky a rozpozná je po jedné, nejvýš dvacet.
  • Vícestránkové PDF se počítá jako jedno použití denního limitu.

Jak zlepšit výsledek

Rozpoznávání stojí a padá s předlohou. Foťte stránku zarovnaně shora, ne šikmo, a hlídejte ostrost. Stín přes půlku stránky nebo focení z ruky za šera udělá z výsledku nečitelnou změť.

Časté otázky

Zvládne to psací písmo?

Ne. Tesseract je určený pro tištěný text. Ručně psané poznámky rozpozná jen náhodně.

Proč jsou v textu překlepy?

U nízké jistoty rozpoznání pomůže ostřejší sken, vyšší kontrast nebo správně zvolený jazyk. Češtinu s anglickým modelem rozpozná nástroj bez diakritiky.

Zachová se rozvržení a tabulky?

Ne, výstupem je prostý text. Sloupce a tabulky se rozpadnou do řádků, takže je obvykle potřeba je poskládat ručně.

Funguje to i na běžné PDF s textem?

Funguje, ale zbytečně. Pokud PDF text obsahuje (jde v něm vyhledávat), použijte nástroj PDF do Wordu, výsledek bude přesnější.

Podobné nástroje