Tesseract 4.1 tekstituvastussüsteemi väljalaskmine.
Valmis on saanud optilise tekstituvastuse süsteemi Tesseract 4.1 väljaanne, mis toetab UTF-8 sümbolite tuvastamist ja tekste rohkem kui 100 keeles, sealhulgas vene, kasahhi, valgevene ja ukraina keeles. Tulemus võib salvestuda nii avatekstina kui ka formaatides HTML (hOCR), ALTO (XML), PDF ja TSV. Algul loodi süsteem aastatel 1985–1995 Hewlett Packardi laboratooriumis, […]
