Text, který je součástí obrázku nebo naskenované stránky, se na první pohled chová úplně jinak než běžný napsaný text v dokumentu. Nelze ho jednoduše označit a zkopírovat, protože počítač ho zpočátku vnímá pouze jako obrázek, nikoli jako skutečná písmena a slova.
Naštěstí existují nástroje, které dokážou takový text v obrázku rozpoznat a převést ho zpět na běžný, kopírovatelný text. Tento proces funguje tím lépe, čím je obrázek nebo sken kvalitnější, ostřejší a bez rušivých stínů či rozmazaných částí textu.
Kvalitní obrázek usnadňuje celý proces
Před samotným rozpoznáváním textu se vyplatí zkontrolovat, zda je celý dokument dobře čitelný i pro lidské oko, protože přesně to samé ovlivňuje i úspěšnost automatického rozpoznávání. Rozmazaný nebo příliš tmavý sken často vede k chybám v převedeném textu.
Po rozpoznání textu je dobré výsledek ještě jednou pečlivě projít, protože i ten nejlepší nástroj občas udělá drobnou chybu, zvláště u méně obvyklých slov nebo speciálních znaků. Krátká kontrola zabrání tomu, aby se chyba později objevila v důležitém dokumentu.
Tato schopnost převádět text z obrázků zpět na běžný text šetří spoustu času při práci se staršími dokumenty, které existují jen v papírové podobě. Místo zdlouhavého přepisování stačí dokument naskenovat a nechat text rozpoznat během několika okamžiků.
Tento postup se hodí i pro starší rodinné dokumenty nebo poznámky, které by jinak zůstaly uložené jen jako fotografie bez možnosti další úpravy. Jakmile se jednou převedou na běžný text, dá se s nimi dál pracovat úplně stejně jako s čímkoli napsaným přímo na počítači.
Vyzkoušet tento způsob poprvé na kratším a jednoduchém textu pomáhá získat představu, jak dobře nástroj vlastně funguje, než se použije na něco skutečně důležitého. Tato malá zkouška předem ušetří případné zklamání u dokumentu, na kterém opravdu záleží.