Rilascio del sistema di riconoscimento del testo Tesseract 4.1
È stato rilasciato il sistema di riconoscimento ottico dei caratteri Tesseract 4.1, che supporta il riconoscimento di caratteri UTF-8 e testi in oltre 100 lingue, tra cui russo, kazako, bielorusso e ucraino. I risultati possono essere salvati sia come testo semplice che nei formati HTML (hOCR), ALTO (XML), PDF e TSV. Inizialmente il sistema è stato creato tra il 1985 e il 1995 nel laboratorio della Hewlett Packard, in […]
