Uus optilise tekstituvastuse süsteem EasyOCR

Projekt EasyOCR arendab uus optilise teksti tuvastamise süsteem, mis toetab enam kui 40 keelt, sealhulgas inglise, saksa, prantsuse, jaapani, hiina, korea, usbeki, azerbaidžaani ja leedu keeli. Kirillitsale põhinevaid keeli ei toetata veel, kuid nende lisamine on plaanis. Kood on kirjutatud Pythonis, kasutades raamistikku PyTorch ja GNU Üldine Avaliku litsentsi alusel. Apache 2.0 litsentsi alusel. Laadimiseks pakutakse saadaval mudelid ladina tähestikku ja hiina kirjadele.

Teksti määramiseks ja tuvastamiseks piltidel kasutatakse masinõppe meetodeid. Teksti määramiseks kasutatakse masinõppe algoritmi CRAFT (Character-Region Awareness For Text) raamistikus rakenduste PyTorch, mis suudab tuvastada teksti juhuslikel objektidel, sealhulgas etikettidel, informatsioonitahvlitel ja liiklusmärkidel. Tähestike järjestuse tuvastamiseks kasutatakse konvolutsioonilist-rekurne, närvivõrku CRNN (Convolutional Recurrent Neural Network, DCNN ja RNN kombinatsioon) ning algoritmi CTC BeamSearch CTC BeamSearch (Connectionist Temporal Classification) närvivõrgu väljundite dekodeerimiseks tekstivormingusse.

Allikas: opennet.ru

Osta usaldusväärne veebihosting DDoS kaitsega, VPS VDS serverid 🔥 Osta usaldusväärne veebihosting DDoS kaitsega, VPS VDS serverid | ProHoster