Projektit polet një sistem të ri të njohjes optike të tekstit, i cili mbështet më shumë se 40 gjuhë, përfshirë anglishten, gjermanishten, frëngjishten, japonishten, kinezishten, koreanishten, uzbekishten, azerbaijanishten dhe litvanishten. Gjuha që bazohet në cirilik tani nuk mbështetet, por është e planifikuar të shtohet në listë. Kodi është shkruar në gjuhën Python duke përdorur frameworkun dhe me licencë Apache 2.0. Për të shkarkuar modelet e plota për gjuhët që bazohen në alfabetin latin dhe hieroglifet.
Për të identifikuar dhe njohur tekstin në imazhe, përdoren metoda të mësimit të makinerive. Për identifikimin e tekstit përdoret algoritmi i mësimit të makinerive (Character-Region Awareness For Text) në për PyTorch, i aftë për të nxjerrë tekstin nga objekte të rastësishme, duke përfshirë etiketat, tabelat informative dhe shenjat e trafikut. Për njohjen e sekvencave të simboleve përdoret një rrjet nervor konvolucional-rekurent (Rrjeti Nervor Konvolucional Rekurent, një kombinim DCNN dhe RNN) dhe algoritmi CTC BeamSearch (Klasifikimi Temporal Konneksionar) për dekodimin e të dhënave të daljes së rrjetit nervor në një përfaqësim tekstual.
Burimi: opennet.ru
