Mozilla on vĂ€rskendanud Common Voice'i hÀÀltandmete komplekte, mis sisaldavad rohkem kui 200 000 inimese hÀÀleproove. Andmed on avaldatud avaliku domeeni alla (CC0). Pakutavaid komplekte saab kasutada masinĂ”ppes kĂ”ne tuvastamise ja sĂŒnteesi mudelite loomiseks.
VĂ”rreldes eelmise uuendusega on kĂ”nematerjali maht kollektsioonis suurenenud 23,8 tuhandelt 25,8 tuhandeni. Inglise keeles osales ĂŒle 88 000 inimese, kes dikteerisid 3161 tunni kĂ”net (oll olnud 84 000 osalejat ja 3098 tundi). Valgevene keele komplekt katab 7903 osalejat ja 1419 tunni kĂ”nematerjali (oll olnud 6965 osalejat ja 1217 tundi), vene keele kohta â 2815 osalejat ja 229 tundi (oll olnud 2731 osalejat ja 215 tundi), usbeki â 2092 osalejat ja 262 tundi (oll olnud 2025 osalejat ja 258 tundi), Ukraina keele kohta â 780 osalejat ja 87 tundi (oll olnud 759 osalejat ja 87 tundi).
Common Voice projekt on suunatud koostöö korraldamisele hÀÀleĆĄabloonide andmebaasi kogumisel, arvestades erinevaid hÀÀli ja kĂ”nemaneere. Kasutajatele pakutakse ekraanile kuvatud fraaside hÀÀldamist vĂ”i teiste kasutajate lisatud andmete kvaliteedi hindamist. Kogutud andmebaasi, mis sisaldab erinevate hÀÀldustega tĂŒĂŒpfraaside salvestisi, saab piiranguteta kasutada masinĂ”ppe sĂŒsteemides ja uurimisprojektides.
Allikas: opennet.ru
