Google hat Daten und ein Modell des maschinellen Lernens zur Trennung von GerÀuschen veröffentlicht

Das Unternehmen Google veröffentlicht eine Datenbank mit Referenzmischungen von KlĂ€ngen, die mit Anmerkungen ausgestattet ist und in maschinellen Lernsystemen verwendet werden kann, um beliebige MischgerĂ€usche in einzelne Komponenten zu trennen. Ebenfalls veröffentlicht wurde ein universelles Modell fĂŒr tiefes maschinelles Lernen (TDCN++), das in Tensorflow fĂŒr die GerĂ€uschtrennung verwendet werden kann. Die Daten basieren auf einer Sammlung freesound.org und veröffentlicht unter CC BY 4.0-Lizenz.

Das vorgestellte Projekt FUSS (Free Universal Sound Separation) zielt darauf ab, das Problem der Trennung beliebiger GerÀuschquellen zu lösen, deren Charakter im Voraus nicht bekannt ist. Andere Àhnliche Systeme sind in der Regel auf die Trennung bestimmter GerÀusche beschrÀnkt, zum Beispiel Sprache und Nicht-Sprache oder verschiedene sprechende Personen.

Die Datenbank umfasst etwa 20.000 Mischungen. Das Set enthĂ€lt auch vorab berechnete Impulsantworten fĂŒr den Raum, die mit einem speziell entwickelten Raumsimulator erstellt wurden und die Reflexionen von WĂ€nden, den Standort der Schallquelle und den Standort des Mikrofons berĂŒcksichtigen.

Quelle: opennet.ru

60GB SSD 8Gb DDR4