Sortie du système de reconnaissance de texte GNU Ocrad 0.28

Après trois ans depuis la dernière version, la publication du système de reconnaissance de texte Ocrad 0.28 (Reconnaissance Optique de Caractères), développée sous l'égide du projet GNU, a été formée. Ocrad peut être utilisé à la fois sous forme de bibliothèque pour intégrer les fonctions OCR dans d'autres applications et sous forme d'utilitaire autonome, qui, sur la base de l'image donnée en entrée, produit du texte en UTF-8 ou dans des codages 8 bits.

Pour la reconnaissance optique, Ocrad utilise une méthode d'extraction des caractéristiques. Il comprend un analyseur de mise en page de page, permettant de bien séparer les colonnes et les blocs de texte dans les documents imprimés. La reconnaissance ne prend en charge que les caractères des encodages « ascii », « iso-8859-9 » et « iso-8859-15 » (le support du cyrillique est absent).

Il est à noter que cette nouvelle version comprend un grand nombre de corrections et d'améliorations mineures. Le changement le plus significatif a été la prise en charge du format d'image PNG, réalisée grâce à la bibliothèque libpng, ce qui a considérablement simplifié l'utilisation du programme, car auparavant, seules les images au format PNM pouvaient être utilisées.

Source : opennet.ru

Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS 🔥 Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS | ProHoster