След две години разработка бе формализирано издание на системата за разпознаване на текст Ocrad 0.29 (Optical Character Recognition), развивана под егидата на проекта GNU. Ocrad може да се използва както под формата на библиотека за интегриране на OCR функции в други приложения, така и като отделна утилита, която на база на предоставеното входно изображение генерира текст в UTF-8 или 8-битови кодировки.
За оптично разпознаване в Ocrad се използва методът на извличане на черти (feature extraction). Включен е анализатор на макета на страницата, позволяващ коректно разделяне на колони и блокове текст в печатни документи. Разпознаването се поддържа само за символи от кодировките „ascii“, „iso-8859-9“ и „iso-8859-15“ (поддръжка на кирилица не съществува).
В новата версия:
- Подобрено е разпознаването на формата на буквата „L“ с наклонена дясна част.
- При използване на опцията ‘-o’ (‘—output’) е осигурено създаването на липсващи междинни директории, посочени в зададения път до файла.
- В сборния файл configure и в Makefile.in е добавена променлива MAKEINFO.
- Диагностичните съобщения, свързани с файловите операции, са преобразувани в форма ‘PROGRAM: FILE: MESSAGE’.
- В съобщенията за неправилно използвани аргументи на командния ред е осигурен аргумента и името на опцията.
Източник: opennet.ru
