Publication du système de reconnaissance de texte GNU Ocrad 0.29

Après deux ans de développement, la version du système de reconnaissance de texte Ocrad 0.29 (Reconnaissance Optique de Caractères), développée sous l'égide du projet GNU, a été publiée. Ocrad peut être utilisé comme une bibliothèque pour intégrer des fonctions OCR dans d'autres applications ou comme un utilitaire autonome qui, à partir d'une image fournie en entrée, génère du texte en UTF-8 ou dans des encodages à 8 bits.

Pour la reconnaissance optique, Ocrad utilise une méthode d'extraction des caractéristiques. Il comprend un analyseur de mise en page de page, permettant de bien séparer les colonnes et les blocs de texte dans les documents imprimés. La reconnaissance ne prend en charge que les caractères des encodages « ascii », « iso-8859-9 » et « iso-8859-15 » (le support du cyrillique est absent).

Dans la nouvelle version :

  • La reconnaissance de la forme de la lettre « L » avec une partie droite inclinée a été améliorée.
  • Avec l'option ‘-o’ (‘—output’), la création des répertoires intermédiaires manquants spécifiés dans le chemin du fichier a été assurée.
  • Une variable MAKEINFO a été ajoutée au fichier de configuration et au Makefile.in.
  • Les messages de diagnostic liés aux opérations de fichiers ont été transformés au format ‘PROGRAM: FILE: MESSAGE’.
  • Les messages concernant l'utilisation d'arguments incorrects sur la ligne de commande incluent désormais le nom de l'argument et de l'option.

Source : opennet.ru

Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS 🔥 Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS | ProHoster