Nuevo sistema de reconocimiento óptico de caracteres EasyOCR

Proyecto EasyOCR desarrolla un nuevo sistema de reconocimiento óptico de caracteres que admite más de 40 idiomas, incluidos inglés, alemán, francés, japonés, chino, coreano, uzbeko, azerbaiyano y lituano. Actualmente, los idiomas basados en cirílico no son compatibles, pero su inclusión está en los planes. El código está escrito en Python utilizando el marco PyTorch y se distribuye bajo la licencia Apache 2.0. Para descargar se proporcionan modelos listos para los idiomas basados en el alfabeto latino y los caracteres chinos.

Para detectar y reconocer texto en una imagen, se aplican métodos de aprendizaje automático. Para la detección de texto se utiliza un algoritmo de aprendizaje automático CRAFT (Character-Region Awareness For Text) en implementación para PyTorch, capaz de resaltar texto en objetos arbitrarios, incluyendo etiquetas, paneles informativos y señales de tráfico. Para el reconocimiento de secuencias de caracteres se utiliza una red neuronal convolucional-recurrente CRNN (Convolutional Recurrent Neural Network, combinación de DCNN y RNN) y el algoritmo CTC BeamSearch CTC BeamSearch (Clasificación Temporal Conexionista) para decodificar la salida de la red neuronal en representación textual.

Fuente: opennet.ru

Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS 🔥 Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS | ProHoster