Tesseract 5.4.0 tekstituvastussüsteemi väljaanne
Avaldatud on Tesseract 5.4.0 optilise tekstituvastuse süsteemi versioon, mis toetab UTF-8 tähemärkide tuvastamist ja rohkem kui 100 keeles, sealhulgas vene, kasahhi, valgevene ja ukraina keeles. Tulemused võivad olla salvestatud nii avatud tekstina kui ka HTML (hOCR), ALTO (XML), PDF ja TSV formaatides. Algne süsteem loodi aastatel 1985-1995 Hewlett Packardi laboris, [•]
