Veröffentlichung des Textverarbeitungssystems GNU Ocrad 0.29

Nach zwei Jahren Entwicklung wurde die Version 0.29 des Textverarbeitungssystems Ocrad (Optical Character Recognition), das unter dem GNU-Projekt entwickelt wird, veröffentlicht. Ocrad kann sowohl als Bibliothek zur Integration von OCR-Funktionen in andere Anwendungen als auch als eigenständiges Tool verwendet werden, das basierend auf dem übergebenen Eingabebild Text im UTF-8- oder 8-Bit-Codierungen ausgibt.

Für die optische Erkennung nutzt Ocrad das Verfahren der Merkmalsauswahl (feature extraction). Bestandteil ist ein Layout-Analyse-Tool, das es ermöglicht, Spalten und Textblöcke in gedruckten Dokumenten korrekt zu trennen. Die Erkennung wird nur für Zeichen aus den Codierungen „ascii“, „iso-8859-9“ und „iso-8859-15“ unterstützt (Unterstützung für Kyrillisch fehlt).

In der neuen Version:

  • Die Erkennung der Zeichenschrift des Buchstaben „L“ mit geneigtem rechten Teil wurde verbessert.
  • Bei Verwendung der Option ‘-o’ (‘—output’) wird sichergestellt, dass fehlende Zwischenverzeichnisse, die im angegebenen Pfad zur Datei angegeben sind, erstellt werden.
  • Die Variable MAKEINFO wurde zur Konfigurationsdatei und zu Makefile.in hinzugefügt.
  • Diagnosemeldungen, die mit Dateioperationen in Verbindung stehen, wurden in das Format ‘PROGRAM: FILE: MESSAGE’ umgewandelt.
  • In den Meldungen über die Verwendung ungültiger Argumente der Befehlszeile wird nun das Argument und der Name der Option bereitgestellt.

Quelle: opennet.ru

60GB SSD 8Gb DDR4