Introducción al audio interactivo | Conceptos básicos
- Jonatan Arriaga

- Jun 17
- 4 min read
Updated: Jul 14
El concepto de linearidad del audio es un concepto del cual se derivan las diferencias fundamentales entre el audio para medios como television y cine y el audio interactivo. Los primeros conceptos a analizar son las diferencias básicas del audio lineal y el no lineal.
AUDIO LINEAL
Audio que se encuentra "atado" a un Time Line o 'Línea de tiempo' en el que el material sonoro siempre es el mismo y no es sujeto a cambios en tiempo real. Este presenta una estructura narrativa estática.

AUDIO NO LINEAL
Una de las diferencias fundamentales del audio interactivo es su naturaleza dinámica e impredecible. A este se le cataloga como “Audio No Lineal” y podemos definirlo como:
Audio que responde en tiempo real a los diversos cambios en la atmósfera del juego, los parámetros establecidos por la programación y/o las acciones directas e indirectas del jugador. Este presenta una estructura narrativa dinámica.

El audio no lineal tiene la siguientes características:
Adaptativo: Reacción a las condicionales o estados dentro del sistema interno del juego o del ambiente.
Reactivo: Reacción a las acciones indirectas del jugador, las que se ejecutan sin necesidad de una interacción física, como la cambio de la musica al estar cerca de un enemigo.
Interactivo: Reacción a una acción directa del jugador, regularmente como respuesta al uso de una superficie física.
Dinámico: Cambios en tiempo real a los elementos de la mezcla de audio, también llamado Real-time sound engineering. Un buen ejemplo de esto es la compresión por side chain entre buses.
El objetivo primordial del audio interactivo y de videojuegos es asegurar un sentido de INMERSIÓN para el usuario o jugador.
La aleatoriedad es un elemento clave del diseño sonoro interactivo que nos permite evitar la fatiga auditiva ya que nos ayuda a erradicar la percepción de repetición del material sonoro durante una exposición larga de tiempo en el juego.
Se pueden encontrar dos acercamientos predominantes para implementar audio en un videojuego o proyecto interactivo:
A través de los audio engines nativos de cada game engine como Unity, Unreal Engine o Godot, por mencionar algunos.
A través de middleware especializado como Wwise o FMOD.
AUDIO GAME ENGINES
Un motor de audio es un elemento nativo perteneciente a un Game Engine (Unity, Unreal, Godot, etc) que procesa y organiza todo el audio de un proyecto interactivo. Sus principales funciones son:
Playback - Música, SFX, crossfades, loops, one-shots (sonidos que se ejecutan una sola vez por cada evento).
Lógica básica - Is Playing, Is Not Playing.
Espacialización básica.
Codificación y decodificación del audio digital.
Gestiona datos provenientes del game engine.
Procesamiento básico - Delay, Compresión, Reverb.
MIDDLEWARE
Un Middleware es un software de terceros que presenta una interfaz especializada para la implementación de audio interactivo. Es un software “puente” que está entre el artista sonoro y el game engine.
Nos da la opción de trabajar específicamente en todo lo relevante al audio sin intervenir en el trabajo de otros equipos de desarrollo de un videojuego o aplicación.
Utilizamos Middleware porque se encarga de:
Playback de comportamiento de sistemas musicales reactivos o dinámicos, playback de efectos de sonido - SFX - interactivos y manejo de transiciones dinámicas.
Reproduce audio con comportamientos de aleatoriedad complejos.
Gestión de bancos de audio de manera dinámica.
Espacialización avanzada.
Codificación, decodificación, conversión/compresión, optimización y debugging.
Gestiona la data proveniente del game engine. (C#/Blueprints)
Real Time Digital Signal Procesing (delay, reverb, compresión) lo que hace posible realizar mezcla dinámica y masterización.
NOMBRADO DE ARCHIVOS
Antes de comenzar cualquier proyecto, es importante mencionar que una estructura clara y bien organizada en el nombrado es clave para identificar un archivo entre los posibles miles de archivos de audio que se manejan en un proyecto. El correcto nombrado de archivos de audio es sumamente importante para su posterior localización e implementación.
La convención de nombrado depende de cada estudio y las necesidades específicas de cada proyecto y puede ser tan granular o detallada como sea necesario. Para ello, se utilizan prefijos para organizar los archivos de audio de acuerdo a su categoría.
Categoría de audio | Prefijo |
SFX (Efectos de sonido) | sx |
Música (Track, stem, transición o stinger) | mx |
Diálogo | dx |
Voice Over | vo |
Diálogo:
Cualquier voz que pertenezca algún personaje dentro del espacio en que ocurre la acción y que sea de carácter conversacional.
Voiceover:
Cualquier voz que sea narrada y externa a cualquier personaje dentro de escena.
Una de las estructuras más utilizadas para nombrar archivos es el estilo snake_case, el cual utiliza un guión bajo para separar campos.
Aunque las estructuras de nombrado pueden cambiar de acuerdo a las necesidades y preferencias de cada proyecto o estudio, estructuras y ejemplos de nombre como los que a continuacion se presentan pueden ser encontradas muy comumente en la industria.
Para efectos de sonido:
Prefijo_subcategoría_acción/capa_[sub-acción/sub-capa]_variación
Ejemplo: sx_ambiente_bosque_venado_01
Para Música:
Prefijo_nivel_estado_instrumento_variación_bpm/métrica_duración en compases.
Ejemplo: mx_nivel1_exploracion_bajo_parteA_110bpm4-4_L4
Para Diálogos:
Prefijo_personaje_contexto/ubicación_identificador_variación
Ejemplo: dx_mago_batalla_md010_01
Para Voiceovers:
Prefijo_personaje_acto/nivel_identificador_variación
Ejemplo: vo_enemigo_jefe_castillo014_03
Hasta aquí el primer capitulo. Espero les haya sido de utilidad. No se pierdan el siguiente capitulo.




















Comments