Lëshimi i sistemit të njohjes së tekstit Tesseract 4.1
Është përgatitur lëshimi i sistemit të njohjes optike të tekstit Tesseract 4.1, që mbështet njohjen e karaktereve UTF-8 dhe teksteve në më shumë se 100 gjuhë, duke përfshirë rusisht, kazakisht, bjellorusisht dhe ukrainisht. Rezultati mund të ruhet si tekst i hapur ashtu edhe në formatet HTML (hOCR), ALTO (XML), PDF dhe TSV. Fillimisht, sistemi u krijua në vitet 1985-1995 në laboratorin e kompanisë Hewlett Packard, në […]
