PĂ€rast kahe aasta arendust on vĂ€lja antud tekstituvastussĂŒsteemi Ocrad 0.29 (Optical Character Recognition) versioon, mida arendatakse GNU projekti eestvedamisel. Ocrad vĂ”ib olla kasutusel kas teegina, et integreerida OCR funktsioone teistesse rakendustesse, vĂ”i iseseisva utiliidina, mis vĂ”tab sisendiks edastatud pildi ja annab vĂ€lja teksti UTF-8 vĂ”i 8-bitistes kodeeringutes.
Optilise tunnustamise jaoks Ocradis kasutatakse omaduste vĂ€ljatoomise meetodit (feature extraction). Koosseisu kuulub lehe paigutuse analĂŒsaator, mis vĂ”imaldab Ă”igesti eraldada veerge ja tekstiplokke trĂŒkitud dokumentides. Tuvastus toetab ainult sĂŒmboleid kodeeringutest «ascii», «iso-8859-9» ja «iso-8859-15» (kirillitsat ei toetata).
Uues versioonis:
- Parandatud on koosluse tunnustamine tÀhe «L» kaldega paremas osas.
- Valiku â-oâ (ââoutputâ) kasutamisel on tagatud puuduvate vahekaustade loomine, mis on mÀÀratud failipunkti teel.
- Kogumifaili configure ja Makefile.in on lisatud muutuja MAKEINFO.
- Failioperatsioonidega seotud diagnostikateated on muudetud vormingusse âPROGRAM: FILE: MESSAGEâ.
- KĂ€skude rea vigaste argumentide kasutamisel on tagatud argumentide ja valiku nime uurimine.
Allikas: opennet.ru
