| Útgáfa | 1.0 |
|---|---|
| Útgefandi | Luigi Rosa |
| Útgáfudagur | 19. nóv. 2012 |
| Dagsetning bætt við | 19. nóv. 2012 |
| Os kröfur | Windows 2003, Windows Vista, Windows 98, Windows Me, Windows, Windows NT, Windows 2000, Windows 8, Windows Server 2008, Windows 7, Windows XP |
| Kröfur | Matlab |
| Niðurhal alls | 691 |
| Niðurhal á viku | 1 |
| Verð | Free |
Lýsing
Optical character recognition (OCR) er þýðing á sjónskönnuðum punktamyndum af prentuðum eða skrifuðum textastöfum í stafakóða, eins og ASCII. Þetta er skilvirk leið til að breyta prentuðu efni í gagnaskrár sem hægt er að breyta og meðhöndla á annan hátt á tölvu. Þetta er tæknin sem bókasöfn og ríkisstofnanir hafa lengi notað til að gera löng skjöl fljótt aðgengileg rafrænt. Framfarir í OCR tækni hafa ýtt undir aukna notkun þess hjá fyrirtækjum. Fyrir mörg skjalainnsláttarverkefni er OCR hagkvæmasta og fljótlegasta aðferðin sem völ er á. Og á hverju ári losar tæknin hektara af geymsluplássi þegar það er gefið í skjalaskápa og kassa fulla af pappírsskjölum. Áður en hægt er að nota OCR verður að skanna upprunaefnið með því að nota sjónskanni (og stundum sérhæft hringrásarborð í tölvunni) til að lesa á síðuna sem bitmap (mynstur punkta). Einnig þarf hugbúnað til að þekkja myndirnar.
Hugbúnaðarpakkinn okkar leggur til að leysa flokkun einangraðra handskrifaðra stafa og tölustafa í UJI Pen Characters Data Set með því að nota taugakerfi. Gögnin samanstanda af sýnishornum af 26 stöfum og 10 tölustöfum skrifuð af 11 rithöfundum á spjaldtölvu. Persónurnar (á venjulegu UNIPEN sniði) eru skrifaðar bæði með hástöfum og lágstöfum og það eru heil tvö sett af stöfum á hvern skrifara. Þannig að framleiðslan ætti að vera í einum af 35 flokkunum. Lokamarkmiðið er að byggja upp sjálfstæða fyrirmynd fyrir hverja persónu.
Val á verðmætum eiginleikum skiptir sköpum fyrir persónuþekkingu, því er nýtt og þýðingarmikið safn eiginleika, Uniform Differential Normalized Coordinates (UDNC), kynnt af C. Agell, tekið upp. Sýnt er að þessir eiginleikar bæta auðkenningarhraðann með því að nota einföld flokkunaralgrím svo þeir eru notaðir til að þjálfa tauganet og prófa frammistöðu þess á UJI Pen Characters Data Set.
Index Skilmálar: Matlab, frumefni, kóði, ocr, sjónræn tákngreining, skannnaður texti, skrifaður texti, ascii, einangraður stafur.