Nach zwei Jahren Entwicklung wurde die Version 0.29 des Textverarbeitungssystems Ocrad (Optical Character Recognition), das unter dem GNU-Projekt entwickelt wird, veröffentlicht. Ocrad kann sowohl als Bibliothek zur Integration von OCR-Funktionen in andere Anwendungen als auch als eigenstĂ€ndiges Tool verwendet werden, das basierend auf dem ĂŒbergebenen Eingabebild Text im UTF-8- oder 8-Bit-Codierungen ausgibt.
FĂŒr die optische Erkennung nutzt Ocrad das Verfahren der Merkmalsauswahl (feature extraction). Bestandteil ist ein Layout-Analyse-Tool, das es ermöglicht, Spalten und Textblöcke in gedruckten Dokumenten korrekt zu trennen. Die Erkennung wird nur fĂŒr Zeichen aus den Codierungen âasciiâ, âiso-8859-9â und âiso-8859-15â unterstĂŒtzt (UnterstĂŒtzung fĂŒr Kyrillisch fehlt).
In der neuen Version:
- Die Erkennung der Zeichenschrift des Buchstaben âLâ mit geneigtem rechten Teil wurde verbessert.
- Bei Verwendung der Option â-oâ (ââoutputâ) wird sichergestellt, dass fehlende Zwischenverzeichnisse, die im angegebenen Pfad zur Datei angegeben sind, erstellt werden.
- Die Variable MAKEINFO wurde zur Konfigurationsdatei und zu Makefile.in hinzugefĂŒgt.
- Diagnosemeldungen, die mit Dateioperationen in Verbindung stehen, wurden in das Format âPROGRAM: FILE: MESSAGEâ umgewandelt.
- In den Meldungen ĂŒber die Verwendung ungĂŒltiger Argumente der Befehlszeile wird nun das Argument und der Name der Option bereitgestellt.
Quelle: opennet.ru
