ĂshtĂ« publikuar versioni i sistemit tĂ« njohjes optike tĂ« tekstit Tesseract 4.1, i cili mbĂ«shtet njohjen e simboleve UTF-8 dhe teksteve nĂ« mĂ« shumĂ« se 100 gjuhĂ«, duke pĂ«rfshirĂ« rusisht, kazakisht, bjellorusisht dhe ukrainisht. Rezultati mund tĂ« ruhet si tekst i hapur, ashtu edhe nĂ« formate HTML (hOCR), ALTO (XML), PDF dhe TSV. Sistemi u krijua fillimisht nĂ« vitet 1985-1995 nĂ« laboratorin e kompanisĂ« Hewlett Packard, nĂ« vitin 2005 kodi u hap nĂ«n licencĂ«n Apache dhe mĂ« pas u zhvillua me pjesĂ«marrjen e punonjĂ«sve tĂ« kompanisĂ« Google. Tekstet burimore tĂ« projektit shpĂ«rndahen nĂ«n licencĂ«n Apache 2.0.
Tesseract përfshin një utilitar të konsolës dhe bibliotekën libtesseract për të integruar funksionet e njohjes së tekstit në aplikacione të tjera. Disa nga GUI-të e treta që mbështesin Tesseract janë gImageReader, VietOCR dhe YAGF. Ofron dy motorë njohjeje: klasik, që njeh tekstin në nivelin e shablloneve të karaktereve individuale, dhe një të ri, i bazuar në sistemin e mësimit të makinerisë me rrjetin nervor rekurent LSTM, i optimizuar për të njohur rreshta të tërë dhe që lejon një rritje të konsiderueshme të saktësisë. Modelet e trajnuara janë publikuar për 123 gjuhë. Për të optimizuar performancën, ofrohen module që përdorin OpenMP dhe instruksione SIMD AVX2, AVX, NEON, ose SSE4.1.
Përmirësimet kryesore në Tesseract 5.0:
- Ndryshimi i rëndësishëm i numrit të versionit është i lidhur me ndryshimet në API që shkelin përputhshmërinë. Në veçanti, API-ja publike e libtesseract nuk është më e lidhur me llojet e të dhënave pronarake GenericVector dhe STRING, në vend të të cilave në kod janë përdorur std::string dhe std::vector.
- Eshte kryer një riorganizim i pemës së tekstit të burimeve. Skedarët publikë të titujve janë zhvendosur në katalogun include/tesseract.
- Menaxhimi i kujtesĂ«s Ă«shtĂ« pĂ«rmirĂ«suar, tĂ« gjitha thirrjet malloc dhe free janĂ« zĂ«vendĂ«suar me kod C++. ĂshtĂ« realizuar njĂ« modernizim i pĂ«rgjithshĂ«m i kodit.
- JanĂ« shtuar optimizime pĂ«r arkitekturĂ«n ARM dhe ARM64, duke pĂ«rdorur instruksione ARM NEON pĂ«r tĂ« pĂ«rshpejtuar llogaritjet. ĂshtĂ« bĂ«rĂ« optimizimi i performancĂ«s pĂ«r tĂ« gjitha arkitekturat.
- Janë implementuar modalitete të reja për trajnimin e modeleve dhe njohjen e teksteve, të bazuara në përdorimin e llogaritjeve me presje lëvizëse. Modalitetet e reja ofrojnë performancë më të lartë dhe reduktim të konsumit të kujtesës. Në motorin LSTM, modaliteti i shpejtë float32 është aktivizuar si parazgjedhje.
- ĂshtĂ« arritur kalimi nĂ« pĂ«rdorimin e normalizimit Unicode me formĂ«n NFC (Normalizimi Form Canonical).
- ĂshtĂ« shtuar njĂ« opsion pĂ«r konfigurimin e detajizimit tĂ« logĂ«ve (âloglevel).
- Sistemi i ndërtimit të bazuar në Autotools është riorganizuar, duke u kaluar në ndërtim në mënyrë jo-rekursive.
- Dega 'master' në Git është rinovuar në 'main'.
- ĂshtĂ« shtuar mbĂ«shtetje pĂ«r lĂ«shimet e reja tĂ« macOS dhe sistemet Apple tĂ« bazuara nĂ« çipin M1.
Burimi: opennet.ru
