Wydanie systemu rozpoznawania tekstu Tesseract 5.5.0
Opublikowano wersję systemu optycznego rozpoznawania tekstu Tesseract 5.5.0, wspierającego Unicode i rozpoznawania tekstów w ponad 100 językach, w tym rosyjskim, kazachskim, białoruskim i ukraińskim. Wynik może być zapisywany jako zwykły tekst lub w formatach HTML (hOCR), ALTO (XML), PDF i TSV. System został pierwotnie stworzony w latach 1985-1995 w laboratorium firmy Hewlett-Packard, w 2005 […]
