Përditësimi i të dhënave zvogëluese Mozilla Common Voice 12.0

Kompania Mozilla ka përmirësuar setet e të dhënave të zërit Common Voice, duke përfshirë mostra shqiptimi nga më shumë se 200,000 njerëz. Të dhënat janë publikuar si pronë publike (CC0). Setet e propozuara mund të përdoren në sistemet e mësimit të makinerive për të ndërtuar modele njohjeje dhe sintetizimi të zërit.

NĂ« krahasim me pĂ«rmirĂ«simin e kaluar, sasia e materialit tĂ« zĂ«rit nĂ« koleksion Ă«shtĂ« rritur nga 23.8 nĂ« 25.8 mijĂ« orĂ« zĂ«. NĂ« pĂ«rgatitjen e materialeve nĂ« gjuhĂ«n angleze morĂ«n pjesĂ« mĂ« shumĂ« se 88,000 njerĂ«z, tĂ« cilĂ«t regjistruan 3161 orĂ« zĂ« (ishin 84,000 pjesĂ«marrĂ«s dhe 3098 orĂ«). Seti pĂ«r gjuhĂ«n belaruse pĂ«rfshin 7903 pjesĂ«marrĂ«s dhe 1419 orĂ« material zĂ«ri (ishin 6965 pjesĂ«marrĂ«s dhe 1217 orĂ«), pĂ«r gjuhĂ«n ruse — 2815 pjesĂ«marrĂ«s dhe 229 orĂ« (ishin 2731 pjesĂ«marrĂ«s dhe 215 orĂ«), pĂ«r gjuhĂ«n uzbeke — 2092 pjesĂ«marrĂ«s dhe 262 orĂ« (ishin 2025 pjesĂ«marrĂ«s dhe 258 orĂ«), pĂ«r gjuhĂ«n ukrainase — 780 pjesĂ«marrĂ«s dhe 87 orĂ« (ishin 759 pjesĂ«marrĂ«s dhe 87 orĂ«).

Projekti Common Voice ka për qëllim organizimin e punës së përbashkët për akumulimin e një baze të shembujve të zërit, duke pasur parasysh të gjithë diversitetin e zërit dhe mënyrave të të folurit. Përdoruesit ofrohen të shqiptojnë frazat e shfaqura në ekran ose të vlerësojnë cilësinë e të dhënave të shtuar nga përdorues të tjerë. Baza e të dhënave e akumuluar me regjistrime të shqiptimit të frazave tipike të të folurit njerëzor, pa kufizime, mund të përdoret në sistemet e mësimit të makinerive dhe në projekte kërkimore.

Burimi: opennet.ru

Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster