Rilascio del sistema di riconoscimento testi Tesseract 5.4.0
È stata pubblicata la versione del sistema di riconoscimento ottico dei caratteri Tesseract 5.4.0, che supporta il riconoscimento dei simboli UTF-8 e testi in oltre 100 lingue, tra cui russo, kazako, bielorusso e ucraino. Il risultato può essere salvato sia come testo semplice che nei formati HTML (hOCR), ALTO (XML), PDF e TSV. Inizialmente, il sistema è stato creato tra il 1985 e il 1995 nel laboratorio della Hewlett Packard, in […]
