PĂ€rast kaheaastast arendustööd on vĂ€lja antud tekstituvastussĂŒsteemi Ocrad 0.29 (Optical Character Recognition) versioon, mida arendatakse GNU projekti kĂ€e all. Ocrad saab kasutada nii raamatukoguna, et integreerida OCR-funktsioone teistesse rakendustesse, kui ka eraldi utiliidina, mis vĂ€ljastab antud pildist teksti UTF-8 vĂ”i 8-bitistes kodeeringutes.
Ocrad'is kasutatakse optilise tuvastamise meetodit, mida tuntakse tunnuste vĂ€ljatoomise (feature extraction) nime all. Komplektsusesse kuulub lehe paigutuse analĂŒsaator, mis vĂ”imaldab Ă”igesti eraldada veerge ja tekstiblokke trĂŒkistes. Tuvastamine toetab ainult 'ascii', 'iso-8859-9' ja 'iso-8859-15' kodeeringute tĂ€hestikke (kiri kirjutamine ei ole toetatud).
Uues versioonis:
- Parandatud on tÀhe «L» kallutatud parempoolse osa tuvastamist.
- Valikuga â-oâ (ââoutputâ) on tagatud puuduvate vahekaustade loomine, mis on nĂ€idatud failitee.
- Seadistust faili configure ja Makefile.in on lisatud muutuja MAKEINFO.
- Failitegevustega seotud diagnostikateated on muudetud vormi âPROGRAM: FAIL: SĂNUMâ.
- KÀskuandmete vigaste argumentide kasutamise puhul tagatakse argumentide ja valiku nime korrektne vÀljund.
Allikas: opennet.ru
