Publicas un podcast con episodios grabados en días distintos, con micrófonos distintos, y al escucharlos seguidos el volumen salta de uno a otro — el oyente tiene que subir o bajar el volumen constantemente. "Normalizar el volumen" suena como la solución obvia, pero la normalización de pico (la que hace la mayoría de herramientas básicas) no resuelve este problema. Hace falta normalización de sonoridad, y ahí es donde entra LUFS.
Por qué normalizar el pico no basta
La normalización de pico busca la muestra más alta del audio y sube (o baja) todo el volumen para que ese pico llegue justo a 0 dB. El problema: dos audios pueden tener el mismo pico máximo y sonar con volúmenes percibidos completamente distintos, porque uno tiene un pico aislado de un segundo y el resto es bajo, y el otro se mantiene fuerte de forma constante. El pico no dice nada sobre cómo lo percibe el oído a lo largo del tiempo.
Qué es LUFS
LUFS (Loudness Units Full Scale) mide la sonoridad percibida, no el pico instantáneo. Es el estándar que define EBU R128, adoptado por plataformas de streaming, TV y podcasts para asegurar que el volumen se sienta consistente entre distintos contenidos. El algoritmo (loudnorm en FFmpeg, que es lo que usa esta herramienta) analiza el audio completo y ajusta la ganancia para que la sonoridad media alcance un objetivo concreto en LUFS.
Los tres parámetros que controlan el resultado
- Sonoridad objetivo (I, en LUFS): el volumen percibido medio al que se ajusta el audio. Más negativo significa más flojo. -14 a -16 LUFS es lo habitual para voz.
- Pico máximo (True Peak, en dBTP): el pico más alto permitido tras la normalización, para evitar clipping (distorsión por saturación). -1 o -2 dBTP es un margen seguro.
- Rango dinámico (LRA, en LU): cuánto puede variar el volumen entre las partes más flojas y las más fuertes. Un valor bajo da un sonido más comprimido y uniforme; uno alto conserva más la dinámica original.
Los tres presets, y por qué son distintos
- Podcast (-16 LUFS): el estándar habitual para contenido hablado, pensado para escucharse con auriculares o en entornos con algo de ruido ambiente.
- Música (-14 LUFS): el objetivo que usan Spotify y YouTube Music para normalizar la reproducción entre canciones distintas.
- Difusión (-23 LUFS): el estándar EBU R128 original para TV y radio, con más margen dinámico porque se asume un entorno de escucha más controlado.
Cada preset rellena los tres parámetros a la vez, pero siguen siendo ajustables — son un punto de partida, no una camisa de fuerza.
Preguntas frecuentes
¿Cuál es la diferencia entre esto y simplemente "subir el volumen"? Subir el volumen (ganancia fija o normalización de pico) no tiene en cuenta cómo varía el volumen a lo largo del audio. LUFS analiza la sonoridad percibida en todo el clip y ajusta en consecuencia.
¿Qué preset debo usar para un podcast? -16 LUFS es el punto de partida estándar; ajusta el True Peak a -1.5 dBTP si vas a distribuir en plataformas que aplican su propia normalización adicional.
¿Por qué mi audio suena "aplastado" tras normalizar? Un LRA (rango dinámico) demasiado bajo comprime mucho la diferencia entre lo flojo y lo fuerte. Sube el valor de LRA si quieres conservar más dinámica.
¿Se procesa en local? Sí, con FFmpeg compilado a WebAssembly corriendo en tu navegador, sin subir el archivo a ningún servidor.
Ajusta el volumen de tu audio al estándar correcto con el normalizador de audio: presets de podcast, música y difusión, o control manual de los tres parámetros LUFS.