Přeskočit na obsah
OC

Optical Character Recognition System

Vydavatel: Luigi Rosa
Prohledáno na viry Windows Free
Stažení v1.0 691 stažení
Verze1.0
Vydavatel Luigi Rosa
Datum vydání19. 11. 2012
Datum přidáno19. 11. 2012
Os požadavkyWindows 2003, Windows Vista, Windows 98, Windows Me, Windows, Windows NT, Windows 2000, Windows 8, Windows Server 2008, Windows 7, Windows XP
PožadavkyMatlab
Celkový počet stažení691
Stahování za týden1
CenaFree

Popis

Optické rozpoznávání znaků (OCR) je překlad opticky naskenovaných bitmap tištěných nebo psaných textových znaků do znakových kódů, jako je ASCII. Jedná se o efektivní způsob, jak přeměnit tištěné materiály na datové soubory, které lze upravovat a jinak s nimi manipulovat v počítači. Jedná se o technologii dlouho používanou knihovnami a vládními agenturami k rychlému elektronickému zpřístupnění dlouhých dokumentů. Pokroky v technologii OCR podnítily její rostoucí využití v podnicích. Pro mnoho úloh vkládání dokumentů je OCR cenově nejefektivnější a nejrychlejší dostupná metoda. A každý rok tato technologie uvolní akry úložného prostoru, který byl předán kartotékám a krabicím plným papírových dokumentů. Než lze použít OCR, musí být zdrojový materiál naskenován pomocí optického skeneru (a někdy i specializované desky plošných spojů v počítači), aby se stránka přečetla jako bitmapa (vzor teček). Vyžaduje se také software pro rozpoznání obrázků.

Náš softwarový balík navrhuje vyřešit klasifikaci izolovaných ručně psaných znaků a číslic datové sady znaků pera UJI pomocí neuronových sítí. Data se skládají ze vzorků 26 znaků a 10 číslic zapsaných 11 zapisovači na počítači Tablet PC. Znaky (ve standardním formátu UNIPEN) jsou psány jak velkými, tak malými písmeny a na jeden zapisovač připadá celá dvě sada znaků. Výstup by tedy měl být v jedné z 35 tříd. Konečným cílem je vytvořit pro každou postavu model nezávislý na spisovateli.

Výběr hodnotných funkcí je při rozpoznávání znaků zásadní, a proto je přijata nová a smysluplná sada funkcí, Uniform Differential Normalized Coordinates (UDNC), kterou zavedl C. Agell. Ukázalo se, že tyto funkce zlepšují rychlost rozpoznávání pomocí jednoduchých klasifikačních algoritmů, takže se používají k trénování neuronové sítě a testování jejího výkonu na datové sadě znaků pera UJI.

Pojmy indexu: Matlab, zdroj, kód, ocr, optické rozpoznávání znaků, naskenovaný text, psaný text, ascii, izolovaný znak.

Podobné programy

Alternativy

Více od tohoto vydavatele