ĂshtĂ« publikuar versioni 4.1 i sistemit tĂ« njohjes optike tĂ« tekstit Tesseract, i cili mbĂ«shtet njohjen e karaktereve UTF-8 dhe tĂ« teksteve nĂ« mĂ« shumĂ« se 100 gjuhĂ«, pĂ«rfshirĂ« rusishten, kazakishten, bjellorusishten dhe ukrainishten. Rezultati mund tĂ« ruhet si tekst i thjeshtĂ«, ashtu edhe nĂ« formatet HTML (hOCR), ALTO (XML), PDF dhe TSV. Fillimisht, sistemi u krijua nĂ« vitet 1985-1995 nĂ« laboratorin e Hewlett Packard; nĂ« vitin 2005, kodi u hap nĂ«n licencĂ«n Apache dhe mĂ« pas u zhvillua me pjesĂ«marrjen e punonjĂ«sve tĂ« Google. Kodet burimore tĂ« projektit shpĂ«rndahen nĂ«n licencĂ«n Apache 2.0.
Tesseract përfshin një mjet konzole dhe bibliotekën libtesseract për integrimin e funksioneve të njohjes së tekstit në aplikacione të tjera. Ndër ndërfaqet GUI të palëve të treta që mbështesin Tesseract mund të veçohen gImageReader, VietOCR dhe YAGF. Ofrohen dy motorë njohjeje: ai klasik, që njeh tekstin në nivelin e modeleve të karaktereve individuale, dhe një i ri, i bazuar në përdorimin e një sistemi të mësimit makinerik me rrjet nervor rekurent LSTM, i optimizuar për njohjen e rreshtave të plotë dhe që mundëson rritje të ndjeshme të saktësisë. Janë publikuar modele të gatshme të trajnuara për 123 gjuhë. Për optimizimin e performancës ofrohen module që përdorin OpenMP dhe instruksionet SIMD AVX2, AVX, NEON ose SSE4.1.
Përmirësimet kryesore në Tesseract 5.0:
- Ndryshimi i ndjeshëm i numrit të versionit lidhet me futjen e ndryshimeve në API që cenojnë përputhshmërinë. Në veçanti, API publike e libtesseract nuk është më e lidhur me llojet pronësore të të dhënave GenericVector dhe STRING, të cilat në kod janë zëvendësuar me std::string dhe std::vector.
- ĂshtĂ« riorganizuar pema e kodeve burimore. SkedarĂ«t publikĂ« tĂ« header-it janĂ« zhvendosur nĂ« direktorinĂ« include/tesseract.
- ĂshtĂ« ripunuar menaxhimi i memories; tĂ« gjitha thirrjet malloc dhe free janĂ« zĂ«vendĂ«suar me kod C++. ĂshtĂ« kryer njĂ« modernizim i pĂ«rgjithshĂ«m i kodit.
- JanĂ« shtuar optimizime pĂ«r arkitekturat ARM dhe ARM64; pĂ«r pĂ«rshpejtimin e llogaritjeve pĂ«rdoren instruksionet ARM NEON. ĂshtĂ« kryer njĂ« optimizim i pĂ«rgjithshĂ«m i performancĂ«s pĂ«r tĂ« gjitha arkitekturat.
- Janë zbatuar mënyra të reja për trajnimin e modeleve dhe njohjen e tekstit, të bazuara në përdorimin e llogaritjeve me presje lëvizëse. Këto mënyra të reja ofrojnë performancë më të lartë dhe konsum më të ulët të memories. Në motorin LSTM, mënyra e shpejtë float32 është e aktivizuar si parazgjedhje.
- ĂshtĂ« kryer kalimi nĂ« pĂ«rdorimin e normalizimit Unicode me formĂ«n NFC (Normalization Form Canonical).
- ĂshtĂ« shtuar njĂ« opsion pĂ«r konfigurimin e nivelit tĂ« detajimit tĂ« logeve (âloglevel).
- Sistemi i build-it i bazuar në Autotools është ripunuar dhe është kaluar në build jo-rekursiv.
- Dega «master» në Git është riemërtuar në «main».
- ĂshtĂ« shtuar mbĂ«shtetja pĂ«r versionet e reja tĂ« macOS dhe pĂ«r sistemet Apple tĂ« bazuara nĂ« çipin M1.
Burimi: opennet.ru
