După doi ani de dezvoltare, a fost lansată versiunea 0.29 a sistemului de recunoaștere a caracterelor Ocrad (Optical Character Recognition), dezvoltat sub egida proiectului GNU. Ocrad poate fi utilizat atât ca o bibliotecă pentru integrarea funcțiilor OCR în alte aplicații, cât și ca un utilitar separat care produce text în UTF-8 sau codificări pe 8 biți pe baza imaginii de intrare.
Pentru recunoașterea optică, Ocrad folosește metoda extragerii caracteristicilor (feature extraction). Include un analizor de configurare a paginii, care permite separarea corectă a coloanelor și blocurilor de text în documentele tipărite. Recunoașterea este suportată doar pentru caractere din codificările „ascii”, „iso-8859-9” și „iso-8859-15” (nu se suportă chirilica).
În noua versiune:
- Recunoașterea formei literei „L” cu partea dreaptă înclinat a fost îmbunătățită.
- Prin utilizarea opțiunii ‘-o’ (‘—output’), a fost asigurată crearea directoarelor intermediare lipsă specificate în calea fișierului.
- Variabila MAKEINFO a fost adăugată în fișierul de configurare configure și în Makefile.in.
- Mesajele de diagnosticare legate de operațiunile cu fișiere au fost transformate în forma ‘PROGRAM: FILE: MESSAGE’.
- În mesajele de utilizare a argumentelor incorecte din linia de comandă, a fost asigurat numele argumentului și opțiunea.
Sursa: opennet.ro
