Pas tre vites nga dalja e fundit, është formuar një version i ri i sistemit të njohjes së tekstit Ocrad 0.28 (Optical Character Recognition), i zhvilluar nën mbështetje të projektit GNU. Ocrad mund të përdoret si në formën e një biblioteke për integrimin e funksioneve OCR në aplikacione të tjera, ashtu edhe si një utilitar të veçantë, i cili, në bazë të imazhit të dhënë si input, jep tekst në formate UTF-8 ose kodime 8-bitësh.
Për njohjen optike në Ocrad përdoret metoda e përzgjedhjes së karakteristikave (feature extraction). Në përbërje përfshihet një analizer i skemës së faqes, që lejon ndarjen e drejtë të kolonave dhe blloqeve të tekstit në dokumentet e shtypura. Njohja mbështetet vetëm për karakteret në kodet 'ascii', 'iso-8859-9' dhe 'iso-8859-15' (mbështetje për cirilikun mungon).
Vërehet se në versionin e ri janë përfshirë shumë korrigjime dhe përmirësime të vogla. Ndryshimi më i rëndësishëm është mbështetja e formatit të imazheve PNG, e realizuar me bibliotekën libpng, e cila ka thjeshtuar ndjeshëm punën me programin, pasi më parë mund të pranoheshin vetëm imazhe në formatet PNM.
Burimi: opennet.ru
