Nowy system optycznego rozpoznawania tekstu EasyOCR

Projekt EasyOCR rozwija nowy system optycznego rozpoznawania tekstu, wspierający ponad 40 języków, w tym angielski, niemiecki, francuski, japoński, chiński, koreański, uzbecki, azerski i litewski. Języki oparte na cyrylicy na razie nie są obsługiwane, ale ich dodanie jest planowane. Kod został napisany w języku Python z wykorzystaniem frameworka PyTorch i rozpowszechniany na licencji Apache 2.0. Do pobrania gotowe modele dla języków opartych na alfabecie łacińskim oraz znakach graficznych.

Do określania i rozpoznawania tekstu na obrazie stosowane są metody uczenia maszynowego. Do wykrywania tekstu używany jest algorytm uczenia maszynowego CRAFT (Character-Region Awareness For Text) w implementacji dla PyTorch, zdolny do wydobywania tekstu z różnych obiektów, w tym etykiet, tablic informacyjnych i znaków drogowych. Do rozpoznawania sekwencji znaków stosowana jest sieć neuronowa z konwolucją i rekurencją CRNN (Convolutional Recurrent Neural Network, połączenie DCNN i RNN) oraz algorytm CTC BeamSearch CTC BeamSearch (Connectionist Temporal Classification) do dekodowania wyjściowych danych sieci neuronowej na reprezentację tekstową.

Źródło: opennet.ru

Kup solidny hosting stron z ochroną przed DDoS, serwery VPS VDS 🔥 Kup solidny hosting stron z ochroną przed DDoS, serwery VPS VDS | ProHoster