Pas tre vjetĂ«sh nga ĐČŃĐżŃŃĐșаi i kaluar, Ă«shtĂ« formuar rilizimi i sistemit tĂ« njohjes sĂ« tekstit Ocrad 0.28 (Optical Character Recognition), e zhvilluar nĂ«n egidĂ«n e projektit GNU. Ocrad mund tĂ« pĂ«rdoret si njĂ« bibliotekĂ« pĂ«r integrimin e funksioneve OCR nĂ« aplikacione tĂ« tjera, ashtu si dhe si njĂ« utilitiet tĂ« veçantĂ«, i cili nĂ« bazĂ« tĂ« imazheve tĂ« dhĂ«na nĂ« input tĂ« jep tekst nĂ« UTF-8 ose nĂ« kode 8-bitĂ«she.
Për njohjen optike në Ocrad përdoret metoda e nxjerrjes së veçorive (feature extraction). Paketa përfshin një analizues të strukturës së faqes, që lejon ndarjen e saktë të kolonave dhe blloqeve të tekstit në dokumentet e shtypura. Njohja mbështetet vetëm për simbolet nga kodimet «ascii», «iso-8859-9» dhe «iso-8859-15» (mbështetja për cirilikun mungon).
Vihet re se në rilizimin e ri është përfshirë një sasi e madhe rregullimesh dhe përmirësimesh të vogla. Ndryshimi më i rëndësishëm është mbështetja e formatit të imazheve PNG, e realizuar me ndihmën e bibliotekës libpng, e cila e ka thjeshtuar në mënyrë të konsiderueshme punën me programin, pasi më herët mund të prokuroheshin vetëm imazhe në formate PNM.
Burimi: opennet.ru
