După trei ani de la ultima versiune, a fost lansată versiunea 0.28 a sistemului de recunoaștere optică a caracterelor Ocrad, dezvoltat sub egida proiectului GNU. Ocrad poate fi utilizat atât ca bibliotecă pentru integrarea funcțiilor OCR în alte aplicații, cât și ca utilitar dedicat, care, pe baza imaginii trimise ca input, produce text în format UTF-8 sau codificări pe 8 biți.
Pentru recunoașterea optică, Ocrad folosește metoda extragerii caracteristicilor (feature extraction). Include un analizor de configurare a paginii, care permite separarea corectă a coloanelor și blocurilor de text în documentele tipărite. Recunoașterea este suportată doar pentru caractere din codificările „ascii”, „iso-8859-9” și „iso-8859-15” (nu se suportă chirilica).
Se menționează că noua versiune include o mulțime de corecții și îmbunătățiri minore. Cea mai semnificativă schimbare a fost adăugarea suportului pentru formatul de imagine PNG, realizat cu ajutorul bibliotecii libpng, ceea ce a simplificat semnificativ utilizarea programului, deoarece anterior puteau fi acceptate doar imagini în formate PNM.
Sursa: opennet.ro
