Kolme aastat pĂ€rast eelmise vĂ€ljaande ilmumist on vĂ€lja antud Ocrad 0.28 (Optical Character Recognition) tekstituvastussĂŒsteem, mida arendatakse GNU projekti all. Ocrad vĂ”ib kasutada nii teeki rakenduste OCR-funktsioonide integreerimiseks kui ka iseseisva utiliidina, mis vĂ€ljastab tekstina UTF-8 vĂ”i 8-bitistes kodeeringutes saadud pildi pĂ”hjal.
Optilise tunnustamise jaoks Ocradis kasutatakse omaduste vĂ€ljatoomise meetodit (feature extraction). Koosseisu kuulub lehe paigutuse analĂŒsaator, mis vĂ”imaldab Ă”igesti eraldada veerge ja tekstiplokke trĂŒkitud dokumentides. Tuvastus toetab ainult sĂŒmboleid kodeeringutest «ascii», «iso-8859-9» ja «iso-8859-15» (kirillitsat ei toetata).
Uues vÀljaandes on mÀrkimisvÀÀrne hulk vÀikseid parandusi ja tÀiustusi. KÔige olulisem muudatus on toe lisamine PNG pildiformaadile, mis on ellu viidud libpng teegi abil, mistÔttu on programmi kasutamine oluliselt lihtsamaks muutunud, kuna varem sai sisendiks kasutada ainult PNM-formaadis pilte.
Allikas: opennet.ru
