Dopo tre anni dalla precedente versione, è stato rilasciato il sistema di riconoscimento ottico dei caratteri Ocrad 0.28, sviluppato sotto l'egida del progetto GNU. Ocrad può essere utilizzato sia come libreria per integrare le funzionalità OCR in altre applicazioni, sia come utilità autonoma, che in base all'immagine fornita restituisce testo in UTF-8 o in codifiche a 8 bit.
Per il riconoscimento ottico, Ocrad utilizza un metodo di estrazione delle caratteristiche. Include un analizzatore del layout della pagina, che consente di separare correttamente colonne e blocchi di testo nei documenti stampati. Il riconoscimento è supportato solo per i caratteri nelle codifiche «ascii», «iso-8859-9» e «iso-8859-15» (il supporto per il cirillico è assente).
Si segnala che nel nuovo rilascio è stata inclusa una vasta gamma di piccole correzioni e miglioramenti. La modifica più significativa è stata l'aggiunta del supporto per il formato delle immagini PNG, implementato tramite la libreria libpng, il che ha semplificato notevolmente l'utilizzo del programma, poiché in precedenza era possibile fornire solo immagini nei formati PNM.
Fonte: opennet.ru
