| Verze | 1.0 |
|---|---|
| Vydavatel | Luigi Rosa |
| Datum vydání | 19. 11. 2012 |
| Datum přidáno | 19. 11. 2012 |
| Os požadavky | Windows 2003, Windows Vista, Windows 98, Windows Me, Windows, Windows NT, Windows 2000, Windows 8, Windows Server 2008, Windows 7, Windows XP |
| Požadavky | Matlab |
| Celkový počet stažení | 691 |
| Stahování za týden | 1 |
| Cena | Free |
Popis
Optické rozpoznávání znaků (OCR) je překlad opticky naskenovaných bitmap tištěných nebo psaných textových znaků do znakových kódů, jako je ASCII. Jedná se o efektivní způsob, jak přeměnit tištěné materiály na datové soubory, které lze upravovat a jinak s nimi manipulovat v počítači. Jedná se o technologii dlouho používanou knihovnami a vládními agenturami k rychlému elektronickému zpřístupnění dlouhých dokumentů. Pokroky v technologii OCR podnítily její rostoucí využití v podnicích. Pro mnoho úloh vkládání dokumentů je OCR cenově nejefektivnější a nejrychlejší dostupná metoda. A každý rok tato technologie uvolní akry úložného prostoru, který byl předán kartotékám a krabicím plným papírových dokumentů. Než lze použít OCR, musí být zdrojový materiál naskenován pomocí optického skeneru (a někdy i specializované desky plošných spojů v počítači), aby se stránka přečetla jako bitmapa (vzor teček). Vyžaduje se také software pro rozpoznání obrázků.
Náš softwarový balík navrhuje vyřešit klasifikaci izolovaných ručně psaných znaků a číslic datové sady znaků pera UJI pomocí neuronových sítí. Data se skládají ze vzorků 26 znaků a 10 číslic zapsaných 11 zapisovači na počítači Tablet PC. Znaky (ve standardním formátu UNIPEN) jsou psány jak velkými, tak malými písmeny a na jeden zapisovač připadá celá dvě sada znaků. Výstup by tedy měl být v jedné z 35 tříd. Konečným cílem je vytvořit pro každou postavu model nezávislý na spisovateli.
Výběr hodnotných funkcí je při rozpoznávání znaků zásadní, a proto je přijata nová a smysluplná sada funkcí, Uniform Differential Normalized Coordinates (UDNC), kterou zavedl C. Agell. Ukázalo se, že tyto funkce zlepšují rychlost rozpoznávání pomocí jednoduchých klasifikačních algoritmů, takže se používají k trénování neuronové sítě a testování jejího výkonu na datové sadě znaků pera UJI.
Pojmy indexu: Matlab, zdroj, kód, ocr, optické rozpoznávání znaků, naskenovaný text, psaný text, ascii, izolovaný znak.