Rilascio del sistema di riconoscimento del testo GNU Ocrad 0.29

Dopo due anni di sviluppo, è stato rilasciato il sistema di riconoscimento del testo Ocrad 0.29 (Riconoscimento Ottico dei Caratteri), sviluppato sotto l'egida del progetto GNU. Ocrad può essere utilizzato sia come libreria per integrare funzioni OCR in altre applicazioni, sia come un'utilità autonoma che, sulla base di un'immagine fornita in input, restituisce testo in UTF-8 o in codifiche a 8 bit.

Per il riconoscimento ottico, Ocrad utilizza un metodo di estrazione delle caratteristiche. Include un analizzatore del layout della pagina, che consente di separare correttamente colonne e blocchi di testo nei documenti stampati. Il riconoscimento è supportato solo per i caratteri nelle codifiche «ascii», «iso-8859-9» e «iso-8859-15» (il supporto per il cirillico è assente).

Nella nuova versione:

  • Migliorato il riconoscimento della forma della lettera «L» con parte destra inclinata.
  • Quando si utilizza l'opzione ‘-o’ (‘—output’), è stata garantita la creazione delle directory intermedie mancanti indicate nel percorso del file specificato.
  • Nel file di configurazione e nel Makefile.in è stata aggiunta la variabile MAKEINFO.
  • I messaggi diagnostici relativi alle operazioni su file sono stati trasformati nella forma ‘PROGRAM: FILE: MESSAGE’.
  • Nei messaggi di utilizzo di argomenti non corretti della riga di comando, è stata garantita la corretta visualizzazione dell'argomento e del nome dell'opzione.

Fonte: opennet.ru

Acquista un hosting affidabile per siti web con protezione DDoS, VPS VDS server 🔥 Acquista un hosting affidabile per siti web con protezione DDoS, VPS VDS server | ProHoster