PĂ€rast kolme aastat alates eelmist vĂ€ljaandmist on vĂ€lja antud Ocrad 0.28 (Optiline TĂ€hemĂ€rkide Tuvastus) tekstituvastussĂŒsteemi versioon, mille arendamisega tegeleb GNU projekt. Ocradâi saab kasutada nii raamatukoguna, et integreerida OCR-funktsioone teistele rakendustele, kui ka iseseisva tööriistana, mis genereerib sisendpildi pĂ”hjal teksti UTF-8 vĂ”i 8-bitiste kodeeringute vormis.
Ocrad'is kasutatakse optilise tuvastamise meetodit, mida tuntakse tunnuste vĂ€ljatoomise (feature extraction) nime all. Komplektsusesse kuulub lehe paigutuse analĂŒsaator, mis vĂ”imaldab Ă”igesti eraldada veerge ja tekstiblokke trĂŒkistes. Tuvastamine toetab ainult 'ascii', 'iso-8859-9' ja 'iso-8859-15' kodeeringute tĂ€hestikke (kiri kirjutamine ei ole toetatud).
Tuleb mÀrkida, et uude vÀljaandesse on kaasatud palju vÀikeseid parandusi ja tÀiendusi. KÔige olulisem muudatus on PNG pildiformaadi tugi, mis on rakendatud libpng teegi abil, mis on oluliselt lihtsustanud programmi kasutamist, kuna varem vÔidi sisendiks vÔtta ainult PNM formaadis pilte.
Allikas: opennet.ru
