Lëshimi i sistemit të njohjes së tekstit Tesseract 5.4.0
ĂshtĂ« publikuar versioni i sistemit tĂ« njohjes optike tĂ« tekstit Tesseract 5.4.0, i cili mbĂ«shtet njohjen e karaktereve UTF-8 dhe teksteve nĂ« mĂ« shumĂ« se 100 gjuhĂ«, duke pĂ«rfshirĂ« rusisht, kazakisht, bjellorusisht dhe ukrainisht. Rezultati mund tĂ« ruhet si tekst i zakonshĂ«m ashtu edhe nĂ« formate HTML (hOCR), ALTO (XML), PDF dhe TSV. NĂ« fillim, sistemi u krijua nga 1985 deri nĂ« 1995 nĂ« laboratorin e kompanisĂ« Hewlett Packard, nĂ« […]
