Po trzech latach od ostatniego wydania, przygotowano wydanie systemu rozpoznawania tekstu Ocrad 0.28 (Optical Character Recognition), rozwijanego pod egidą projektu GNU. Ocrad może być używany zarówno jako biblioteka do integracji funkcji OCR w innych aplikacjach, jak i jako samodzielne narzędzie, które na podstawie przesłanego obrazu wydobywa tekst w kodowaniu UTF-8 lub 8-bitowych.
Do optycznego rozpoznawania w Ocrad zastosowano metodę ekstrakcji cech (feature extraction). W skład systemu wchodzi analizator układu strony, umożliwiający poprawne oddzielanie kolumn i bloków tekstu w dokumentach drukowanych. Rozpoznawanie jest wspierane tylko dla znaków z kodowań „ascii”, „iso-8859-9” i „iso-8859-15” (brak wsparcia dla cyrylicy).
Zauważa się, że nowa wersja zawiera dużą ilość drobnych poprawek i ulepszeń. Najważniejszą zmianą był dodatek wsparcia dla formatu obrazów PNG, zrealizowanego przy pomocy biblioteki libpng, co znacznie ułatwiło pracę z programem, ponieważ wcześniej można było przesyłać jedynie obrazy w formacie PNM.
Źródło: opennet.ru
