GNU Ocrad 0.29 tekstituvastus sĂŒsteemi vĂ€ljalase.

PĂ€rast kaheaastast arendustööd on vĂ€lja antud tekstituvastussĂŒsteemi Ocrad 0.29 (Optical Character Recognition) versioon, mida arendatakse GNU projekti kĂ€e all. Ocrad saab kasutada nii raamatukoguna, et integreerida OCR-funktsioone teistesse rakendustesse, kui ka eraldi utiliidina, mis vĂ€ljastab antud pildist teksti UTF-8 vĂ”i 8-bitistes kodeeringutes.

Ocrad'is kasutatakse optilise tuvastamise meetodit, mida tuntakse tunnuste vĂ€ljatoomise (feature extraction) nime all. Komplektsusesse kuulub lehe paigutuse analĂŒsaator, mis vĂ”imaldab Ă”igesti eraldada veerge ja tekstiblokke trĂŒkistes. Tuvastamine toetab ainult 'ascii', 'iso-8859-9' ja 'iso-8859-15' kodeeringute tĂ€hestikke (kiri kirjutamine ei ole toetatud).

Uues versioonis:

  • Parandatud on tĂ€he «L» kallutatud parempoolse osa tuvastamist.
  • Valikuga ‘-o’ (‘—output’) on tagatud puuduvate vahekaustade loomine, mis on nĂ€idatud failitee.
  • Seadistust faili configure ja Makefile.in on lisatud muutuja MAKEINFO.
  • Failitegevustega seotud diagnostikateated on muudetud vormi ‘PROGRAM: FAIL: SÕNUM’.
  • KĂ€skuandmete vigaste argumentide kasutamise puhul tagatakse argumentide ja valiku nime korrektne vĂ€ljund.

Allikas: opennet.ru

Osta usaldusvÀÀrne veebihosting DDoS kaitsega, VPS VDS serverid đŸ”„ Osta usaldusvÀÀrne veebihosting DDoS kaitsega, VPS VDS serverid | ProHoster