Después de nueve meses de desarrollo paquete multimedia , que incluye un conjunto de aplicaciones y una colección de bibliotecas para operaciones en varios formatos multimedia (grabación, conversión y decodificación de formatos de audio y video). El paquete se distribuye bajo las licencias LGPL y GPL, y el desarrollo de FFmpeg avanza en paralelo con el proyecto .
De , en FFmpeg 4.2, se destacan:
- Se añadió la posibilidad de utilizar Clang para compilar archivos CUDA;
- Se implementó el soporte para la decodificación del formato AV1 usando el decodificador alternativo , desarrollado por los proyectos VideoLAN y FFmpeg. Dav1d está orientado a lograr el máximo rendimiento posible en la decodificación y a asegurar un funcionamiento óptimo en modo multihilo;
- Se añadieron descompresores de contenedores multimedia (demuxer) dhav, hcom y vividas, KUX e IFV;
- Se agregó el codificador PCM-DVD;
- Se añadieron decodificadores VP4, hymt, hcom, ARBC, agm y lscr;
- Se aseguró el soporte para la decodificación de contenido HEVC 4:4:4 utilizando los motores de aceleración de hardware NVIDIA nvdec y cuviddec, así como usando la API VDPAU (Video Decode and Presentation);
- En el empaquetador de contenedores multimedia mov, se aseguró la grabación de pistas sin definición de idioma explícita (anteriormente se indicaba por defecto el idioma inglés);
- N nuevos :
- — reconocimiento automático de voz utilizando el motor PocketSphinx;
- — elimina la lluvia de los videos, utilizando un sistema de aprendizaje automático basado en redes neuronales y modelos ;
- — detección de la falta de cambios en el video (imagen inalterada durante un tiempo determinado);
- — adición de conjuntos de fotogramas al principio o al final del flujo de video;
- — suavizado de artefactos de brillo y color (destellos y arcoíris) en el video;
- — desplazamiento de los componentes de color de los píxeles horizontal y verticalmente;
- — extracción del flujo básico de TrueHD, descartando metadatos de ATMOS;
- — supresión de ruido de banda ancha en el flujo de audio mediante un algoritmo ;
- — creación de una máscara basada en el video de entrada;
- — separación de cuadros en el flujo AV1;
- — desaceleración de cambios de color en píxeles oscuros (aumento del tiempo de visualización de destellos brillantes);
- — recorte de sonido suave (atenuación gradual de la amplitud en lugar de un corte brusco de la señal);
- — eliminación de información sobre todos los colores RGB excepto el especificado;
- — extracción de la intersección promedio de píxeles para varios videos de entrada;
- — conversión de sonido estéreo a video que muestra la interacción espacial entre dos canales de audio;
- — eliminación de distorsiones debido a micrófonos de baja calidad o compresión excesiva al grabar voz (elimina el efecto de sonido metálico).
- Se incluye un parser para imágenes en formato GIF;
- Se ha agregado soporte para subtítulos en codificación ARIB STD-B24 (perfiles A y C), utilizados en la transmisión de flujo MPEG-2 TS. El soporte se ha implementado a través de la aplicación de la biblioteca libaribb24;
- Se ha eliminado la biblioteca libndi-newtek.
Fuente: opennet.ru
