Dalja e sistemit të njohjes së tekstit GNU Ocrad 0.28

Pas tre vjetĂ«sh nga ĐČыпусĐșаi i kaluar, Ă«shtĂ« formuar rilizimi i sistemit tĂ« njohjes sĂ« tekstit Ocrad 0.28 (Optical Character Recognition), e zhvilluar nĂ«n egidĂ«n e projektit GNU. Ocrad mund tĂ« pĂ«rdoret si njĂ« bibliotekĂ« pĂ«r integrimin e funksioneve OCR nĂ« aplikacione tĂ« tjera, ashtu si dhe si njĂ« utilitiet tĂ« veçantĂ«, i cili nĂ« bazĂ« tĂ« imazheve tĂ« dhĂ«na nĂ« input tĂ« jep tekst nĂ« UTF-8 ose nĂ« kode 8-bitĂ«she.

Për njohjen optike në Ocrad përdoret metoda e nxjerrjes së veçorive (feature extraction). Paketa përfshin një analizues të strukturës së faqes, që lejon ndarjen e saktë të kolonave dhe blloqeve të tekstit në dokumentet e shtypura. Njohja mbështetet vetëm për simbolet nga kodimet «ascii», «iso-8859-9» dhe «iso-8859-15» (mbështetja për cirilikun mungon).

Vihet re se në rilizimin e ri është përfshirë një sasi e madhe rregullimesh dhe përmirësimesh të vogla. Ndryshimi më i rëndësishëm është mbështetja e formatit të imazheve PNG, e realizuar me ndihmën e bibliotekës libpng, e cila e ka thjeshtuar në mënyrë të konsiderueshme punën me programin, pasi më herët mund të prokuroheshin vetëm imazhe në formate PNM.

Burimi: opennet.ru

Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster