Die Entwickler des Projekts FFmpeg haben neue Assembler-Optimierungen implementiert, mit denen einige beim Videodecodieren verwendete Operationen durch Anwendung des AVX-512-Befehlssatzes beschleunigt werden konnten. Der Leistungszuwachs des Assembler-Codes mit AVX-512-Befehlen betrug im Vergleich zur Basisimplementierung, die in C ohne Verwendung von SIMD-Befehlen geschrieben wurde, 94, 44, 64 und 4,24 Mal. Im optimierten Assembler-Code mit AVX-2 betrug der Zuwachs 67, 27, 55 und 4,38 Mal, während er mit SSSE3-Befehlen 40, 21, 29 und 2,49 Mal betrug. Die Änderungen wurden in die dav1d-Bibliothek integriert, die einen alternativen Decoder für das Video-Codierungsformat AV1 anbietet. AVX-512-Befehle sind in AMD-Prozessoren mit den Mikroarchitekturen Zen 4 und 5 sowie in Intel-Prozessoren mit Mikroarchitekturen wie Skylake-X, Ice Lake, Tiger Lake und Rocket Lake verfügbar.

Quelle: opennet.ru
