Projekti po zhvillohet një sistem i ri i njohjes optike të tekstit, që mbështet më shumë se 40 gjuhë, duke përfshirë anglishten, gjermanishten, frëngjishten, japonishten, kinezishten, koreane, uzbekishten, azere dhe letoneze. Gjuha që bazohet në cirilik për momentin nuk mbështetet, por është e planifikuar të shtohet. Kodi është shkruar në gjuhën Python duke përdorur kornizën dhe në licencën Apache 2.0. Për shkarkim modele të gatshme për gjuhët e bazuara në alfabetin latin dhe hieroglifët.
Për të identifikuar dhe njohur tekstin në një imazh përdoren metoda të mësimit të makinës. Për identifikimin e tekstit përdoret algoritmi i mësimit të makinës (Character-Region Awareness For Text) në për PyTorch, i aftë për të ekskruar tekstin në objekte të ndryshme, duke përfshirë etiketat, tabelat informative dhe shenjat e rrugës. Për njohjen e sekuencave të simboleve përdoret një rrjet nervor konvolucioni-rekurent (Convolutional Recurrent Neural Network, kombinim DCNN dhe RNN) dhe algoritmi CTC BeamSearch (Connectionist Temporal Classification) për dekodimin e të dhënave të daljes së rrjetit nervor në një përfaqësim tekstual.
Burimi: opennet.ru
