Pärast kolme aastat alates eelmist väljaandmist on välja antud Ocrad 0.28 (Optiline Tähemärkide Tuvastus) tekstituvastussüsteemi versioon, mille arendamisega tegeleb GNU projekt. Ocrad’i saab kasutada nii raamatukoguna, et integreerida OCR-funktsioone teistele rakendustele, kui ka iseseisva tööriistana, mis genereerib sisendpildi põhjal teksti UTF-8 või 8-bitiste kodeeringute vormis.
Ocrad'is kasutatakse optilise tuvastamise meetodit, mida tuntakse tunnuste väljatoomise (feature extraction) nime all. Komplektsusesse kuulub lehe paigutuse analüsaator, mis võimaldab õigesti eraldada veerge ja tekstiblokke trükistes. Tuvastamine toetab ainult 'ascii', 'iso-8859-9' ja 'iso-8859-15' kodeeringute tähestikke (kiri kirjutamine ei ole toetatud).
Tuleb märkida, et uude väljaandesse on kaasatud palju väikeseid parandusi ja täiendusi. Kõige olulisem muudatus on PNG pildiformaadi tugi, mis on rakendatud libpng teegi abil, mis on oluliselt lihtsustanud programmi kasutamist, kuna varem võidi sisendiks võtta ainult PNM formaadis pilte.
Allikas: opennet.ru
