Wydanie systemu rozpoznawania tekstu Tesseract 4.1
Przygotowano wydanie systemu optycznego rozpoznawania tekstu Tesseract 4.1, wspierającego rozpoznawanie znaków UTF-8 oraz tekstów w ponad 100 językach, w tym rosyjskim, kazachskim, białoruskim i ukraińskim. Wynik może być zapisywany zarówno jako tekst otwarty, jak i w formatach HTML (hOCR), ALTO (XML), PDF i TSV. System pierwotnie stworzono w latach 1985-1995 w laboratorium firmy Hewlett Packard, w […]
