Todo Lo Que Necesitas Saber: Audio
Todo Lo Que Necesitas Saber: Audio
3D
SOBRE
AUDIO
Francisco Bissone
[Link]
Todo lo que Necesitas Saber Sobre 3D Audio Prólogo
Prólogo
Agosto de 2020
[Link]@[Link]
SOBRE NUNO
Es miembro de AES, SMPTE, CAS, MPSE, AMPS, y forma parte el Comité Técnico de
Audio en el Cine de la Audio Engineering Society (AES).
Índice
Prólogo 2
Ambisonics 20
Mid-Side 20
Ambisonics 22
Micrófonos Ambisonics 23
High Order Ambisonics (HOA) / Ambisonics de Ordenes Superiores 24
Las múltiples variantes de Ambisonics 25
Aplicación en RV (Realidad Virtual) 27
Pros y contras 28
Audio binaural 29
Percepción 29
HRTF 30
Personalización de la HRTF 32
Cómo utilizar el audio binaural 34
Pros y contras 34
Conclusión 36
[Link] 3
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en canales
Estéreo
El modo estéreo intenta recrear una imagen
sonora frontal utilizando 2 altavoces. Si
enviamos la misma señal a los dos altavoces,
se genera una imagen fantasma y
percibiremos el sonido como si viniese
directamente de la parte frontal. Si
modificamos la relación de ganancia entre
los dos altavoces, podemos hacer que el
sonido «se mueva» entre los altavoces
derecho e izquierdo.
[Link] 4
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en canales
Altavoz central
En un momento determinado, la industria del
cine decidió añadir un altavoz central entre
los altavoces derecho e izquierdo que
plantea la siguiente cuestión: «Si somos
capaces de generar una imagen sonora
entre un par de altavoces estéreo, ¿por qué
necesitamos un altavoz central adicional?».
Por ejemplo, en una sala de cine, solo unos pocos tienen el privilegio de estar
sentados en el sweet spot. La mayoría de los oyentes estarán demasiado hacia un
lado, demasiado hacia adelante o demasiado hacia atrás. Los altavoces izquierdo y
derecho se colocan detrás de la pantalla de proyección, cerca de los extremos. Como
podrás imaginar, cualquier persona que se siente en las filas delanteras, tendrá un
ángulo izquierda-derecha de más de 60°, lo que puede romper la imagen sonora
frontal y crear un hueco en el centro. Por otra parte, la gente que está sentada en los
laterales estará más cerca de un altavoz que del otro, por lo que habrá una
«distorsión» de la imagen sonora (no una distorsión del sonido, sino una distorsión de
la percepción).
Para todas estas situaciones es necesario un altavoz central que funcionará como un
ancla de referencia que nos ayudará a tener una imagen sonora más definida y
estable, especialmente para las personas que están fuera del sweet spot, es decir, los
sitios no ideales. Y este es el motivo por el cual es tan habitual utilizar el altavoz
central en la industria cinematográfica: dentro de la sala, hay muchísimas personas
que no han tenido la suerte de sentarse en el sweet spot.
[Link] 5
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en canales
¿Por qué se utilizan tantos altavoces en vez de utilizar un solo altavoz a cada lado?
En segundo lugar, el mundo no es perfecto y, una vez más, habrá mucha gente que no
esté sentada en el punto óptimo de escucha (sweet spot). Con este abordaje de
arreglo de altavoces, te sientes donde te sientes, estarás rodeado de varios
[Link] 6
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en canales
altavoces. Si la sala de cine utilizase un solo altavoz para cada canal de audio, habría
grandes huecos que afectarían a algunos espectadores. Por ejemplo, una persona del
fondo de la sala tendría el altavoz de sonido envolvente a los lados (o ligeramente
hacia el frente) y no se estaría reproduciendo nada por detrás; una persona sentada
cerca de los laterales quizá podría tener el sonido del altavoz surround viniendo
desde atrás y sin sonido de la pared trasera, etc.
LFE/Subwoofer
En un momento dado, la industria
cinematográfica también quería aumentar el
impacto del sonido con frecuencias más
bajas en efectos como las explosiones o los
terremotos. El problema de las frecuencias
bajas es que los humanos no son sensibles a
esos rangos de frecuencia, es decir, para
que un humano pueda escuchar frecuencias
por debajo de 80 Hz, estas deben tener un
sonido muy potente, con niveles de SPL1
elevados, para lo cual se necesitan altavoces
Figura 4. Disposición sonido envolvente 5.1
muy potentes que permitan reproducir estos
tipos de frecuencias.
Para reproducir esas frecuencias se necesita mucha potencia y existen dos posibles
maneras de alcanzar el resultado deseado.
[Link] 7
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en canales
En la década de los noventa se creó el SDDS de Sony, que utilizaba una configuración
7.1, pero con 5 altavoces frontales (izquierdo, izquierdo centro, centro, derecho centro,
derecho) y 2 canales de sonido envolvente. Con los altavoces adicionales de la parte
frontal, el SDDS estaba especialmente concebido para salas de cine con pantallas
grandes en las que 3 altavoces no eran suficientes para las filas delanteras.
Posteriormente, Dolby desarrolló el Dolby Digital EX, un formato 6.1 con un altavoz
trasero de sonido envolvente para aumentar la percepción del sonido en la parte de
atrás. Este formato se estrenó con Star Wars: Episodio I.
Figura 5. Disposición Dolby Digital 6.1; disposición Sony 7.1; formato 7.1 actual
[Link] 8
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en canales
Audio inmersivo
La expresión «audio inmersivo» generalmente hace referencia a sistemas de audio
que permiten percibir el sonido proveniente de otras direcciones además del plano
horizontal. En lugar de colocar altavoces solo en el plano horizontal (frontal, lateral y
posterior), los sistemas inmersivos pueden explorar el componente de altura, por
ejemplo, agregando altavoces en el techo o incluso en el suelo.
El abordaje de IMAX 12.0 es ligeramente Figura 6. Auro 13.1 (cedido por Auro
Technologies)
diferente. Parte de 12 canales, entre los que
se encuentran los 7 canales tradicionales del
plano horizontal, más 5 canales elevados para explorar la dimensión de la altura y sin
canales LFE (de ahí el cero de «12.0»).
El NHK 22.2, el formato creado por la televisión pública japonesa, va un paso más
allá: cuenta con 2 canales LFE (izquierdo y derecho), un plano inferior con 3 altavoces
(por debajo del plano horizontal, en la parte frontal, con sonido procedente del suelo),
un plano horizontal con 10 canales (5 en la parte frontal y 5 de sonido envolvente) y
un plano de altura con 8 canales + 1 «voz de Dios» (3.2 + 10 + 8 + 1 = 22.2).
[Link] 9
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en canales
PANEO 3D
Pros y contras
El audio basado en canales tiene sus pros y sus contras. La principal ventaja es que
es el sistema perfecto si sabemos de antemano la disposición exacta de los
altavoces en los que se va a reproducir el sonido. Por ejemplo, saber de antemano
que mi mezcla se va a reproducir en un sistema 5.1, con los altavoces ubicados en una
posición predeterminada, es fantástico. En ese caso, podemos utilizar exactamente
las mismas condiciones en el estudio y hacer una mezcla perfecta.
[Link] 10
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en canales
se estrena en estéreo, 5.1, 7.1, 11.1 y 22.2, necesitará 5 mezclas diferentes, una para
cada formato.
Esto nos hace plantearnos lo siguiente: ¿Se puede crear un formato que no dependa
de la disposición de los canales de salida? ¿Se puede crear un formato en el que una
sola mezcla se pueda adaptar automáticamente a diferentes configuraciones de
altavoces? Efectivamente, con audio basado en objetos y con Ambisonics.
[Link] 11
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en objetos
La base del audio basado en canales es tener una disposición prestablecida de los
altavoces, como, por ejemplo, estéreo o 5.1, lo que significa que sabemos de
antemano la configuración en la que se reproducirá la mezcla. Entonces nuestra
mezcla es creada exclusivamente para esa cantidad y disposición de canales, que
luego se distribuyen (por ejemplo, se transmiten, se almacenan en un archivo o
DVD). Durante la reproducción solo hay que enviar cada señal de audio al altavoz
correspondiente.
En el estudio, todos los sonidos pasan por un panner, que controla la cantidad de
sonido que se va a reproducir en cada canal de salida. Por ejemplo, en una mezcla
5.1, si queremos colocar el sonido entre el altavoz central y el derecho, lo
[Link] 12
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en objetos
Además, la salida de todos los panners se mezcla junta (utilizando un bus) antes de la
distribución: la salida izquierda de todos los panners se mezcla y se coloca en el
canal izquierdo, lo mismo ocurre con el canal derecho y así sucesivamente.
En el estudio seguirá siendo necesario un panner para colocar el sonido, pero esa
información de paneo no se aplica al sonido, ya que únicamente hay que indicar
dónde se quiere ubicar cada sonido. Esa información se distribuye y, durante la
reproducción, dependiendo del sistema de reproducción, esa información de paneo
se aplica al sonido.
Básicamente, lo que se distribuye son las intenciones: «quiero que este sonido se
coloque aquí y que este otro esté allí». Después, durante la reproducción, el sistema
sabe cuántos altavoces tiene y dónde están ubicados. En función de eso, se
asegurará de enviar las señales correctas a los altavoces para satisfacer las
intenciones del autor, todo ello a tiempo real.
Veamos un ejemplo práctico: imaginemos que queremos colocar el sonido, una vez
más, entre el «centro» y la «derecha». Con el audio basado en objetos, se distribuye el
flujo de audio de ese sonido, así como la posición de paneo deseada. Después,
[Link] 13
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en objetos
Por supuesto, cuando se dice que la mezcla solo se termina durante la reproducción,
es obvio que el mezclador de regrabación necesita escuchar lo que se está
haciendo en la sala de mezcla, y tendrá su propio sistema de reproducción que
reproducirá la mezcla.
Objetos
La información de paneo que se distribuye para un sonido concreto no es un valor
estático, sino un valor que puede cambiar en el tiempo. En este ejemplo solo
tenemos un sonido (mono), pero la información de paneo va cambiando con el
tiempo. Por otra parte, además de la posición del sonido, se deben tener en cuenta
otros datos. Por ejemplo, un sistema de audio basado en objetos también podría
utilizar el concepto de «tamaño»: es una especie de sonido puntual (solo 1 o 2
altavoces reproducen ese sonido) o un sonido más amplio que cubra un área mayor
(en una situación extrema, todos los altavoces podrían reproducir ese sonido). De
nuevo, en el ejemplo, en vez de utilizar:
8→7→6→5→4→3→2→1→izquierdo
8765→7654→6543→5432→4321→321izquierdo
[Link] 14
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en objetos
reproducción que elija el altavoz más cercano que haya en una dirección
determinada y que reproduzca el sonido exclusivamente en ese altavoz.
Todos los datos que se distribuyen con cada sonido (p. ej., posición, tamaño, etc.) se
denominan metadatos (los datos sobre los datos). Cada sonido (y sus metadatos
correspondientes) constituye un objeto, ya que representa un objeto de sonido
(mono) que de mueve por el espacio 3D.
Puesto que la mezcla final solo se produce durante la reproducción, se puede permitir
que el oyente habilite o deshabilite ciertos objetos de audio o camas. Esta opción
puede ser interesante en las retransmisiones –y un buen ejemplo de ello son los
eventos deportivos–, ya que permite a los oyentes elegir si quieren escuchar el
partido con o sin comentarios, o incluso seleccionar el sonido según cuál sea su
equipo favorito cambiando entre los micrófonos que están colocados cerca de la
afición del equipo A o cerca de la afición del equipo B.
Dolby Atmos
Uno de los sistemas de audio basado en objetos más famoso es Dolby Atmos, por
lo que nos centraremos en él como ejemplo de audio basado en objetos. No
obstante, existen otros formatos de audio basados en objetos, como MPEG-H,
AuroMax o DTS:X .
Dolby Atmos es compatible tanto con audio basado en objetos (objetos) como con
audio basado en canales (camas). Un objeto tendrá su audio (clip de audio mono) y
sus metadatos correspondientes, pero Dolby Atmos también es compatible con el
audio basado en canales gracias al uso de camas 7.1.2 (7.1 + 2 canales en altura).
Empecemos por los objetos.
Dolby Atmos permite utilizar 128 canales independientes, es decir, podemos tener
hasta 118 objetos de audio más 10 canales reservados para una cama 7.1.2 (más
adelante hablaremos sobre las camas). Durante la reproducción, Dolby Atmos admite
hasta 64 altavoces independientes, lo que implica que en una sala de cine puede
haber hasta 64 altavoces que se controlan de forma independiente, es decir, que
cada altavoz reproduce un audio diferente al del resto de altavoces. La sala puede
llegar a tener incluso más de 64 altavoces, siempre y cuando algunos de ellos
compartan la misma señal de audio.
Como se aprecia en la figura 11, una sala de cine con un sistema Dolby Atmos es
ligeramente diferente a una salda 5.1/7.1 común.
[Link] 15
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en objetos
Figura 11. Diferencias entre una sala 5.1/7.1 y una sala Dolby Atmos
La principal diferencia reside en los altavoces que están en el techo. Con la llegada
de Dolby Atmos, las salas de cine empiezan a tener 2 filas de altavoces en el techo
para empezar a explorar el componente del sonido en altura.
En la parte frontal, seguimos teniendo los altavoces izquierdo, central y derecho, que
están detrás de la pantalla, que permiten instalar 2 altavoces adicionales en las salas
con pantallas de mayores dimensiones, concretamente entre el altavoz central y los
altavoces izquierdo y derecho.
Por último, se instalan altavoces adicionales en los laterales, cerca de la parte frontal.
En las salas tradicionales, los altavoces de sonido envolvente se instalan a 1/3 de la
longitud de la pared lateral, es decir, solo ocupan 2/3 de las paredes laterales y hay
un hueco entre la pantalla y los primeros altavoces de sonido envolvente. Con Dolby
Atmos, ese hueco desaparece y se rellena con altavoces adicionales para asegurar
que el plano horizontal queda totalmente cubierto.
Camas
Durante la producción de una película, puede que parte del contenido de audio se
haya mezclado previamente. Por ejemplo, la partitura de música se puede entregar a
los mezcladores de regrabación ya mezclada, o al menos premezclada en stems (7.1
cuerdas, 7.1 percusión, etc.) o imaginar un efecto de sonido que ya se haya grabado o
editado en 5.1.
[Link] 16
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en objetos
Además de objetos, Dolby Atmos también admite contenido basado en canales que
recibe el nombre de camas de audio. Esto significa que, además de objetos, se puede
incluir audio basado en canales «normales». Dolby Atmos utiliza camas 7.1.2, que
corresponden al tradicional 7.1 (3 canales frontales + 4 canales de sonido envolvente +
LFE) con 2 canales adicionales para el techo (uno en la parte izquierda y otro en la
parte derecha). Por ejemplo, todas las pistas 5.1 y 7.1 se pueden mezclar directamente
a la cama 7.1.2. E incluso sin utilizar objetos, un mezclador puede explorar el
componente del sonido en elevación enviando audio a los altavoces que están por
encima de la cabeza del oyente.
Este sistema no es perfecto (algunos formatos tienen una capa por debajo del plano
horizontal (en el suelo), otros tienen 2 capas por encima de la cabeza, etc.), pero al
menos nos da una ligera idea sobre el sistema de sonido en uso.
Sin embargo, las camas no se usan solo para el material mezclado previamente.
Muchas producciones cinematográficas utilizan cientos de pistas durante la mezcla, y
algunas incluso más de 1000 pistas de audio. Aún recuerdo la primera vez que visité
las instalaciones de posproducción de Universal, donde, en uno de los estudios de
mezcla, alguien dijo «esta es nuestra consola de mezclas de 512 canales para efectos
sonoros y 256 canales para diálogos y música». Aunque Dolby Atmos admite 118
objetos, esta cantidad no sería suficiente para todas las pistas de sonido. Es aquí
donde las camas entran en juego, ya que en ellas se pueden mezclar infinitos
sonidos . Cuando se utilizan objetos, cada sonido tiene que ser independiente para
poder controlar el paneo de cada uno, pero no es así con las camas, ya que se utiliza
un paneo común para distribuir cada sonido. Por este motivo, el mezclador de
regrabación podría utilizar objetos para los sonidos más importantes, en los que la
ubicación es decisiva, y camas para los sonidos secundarios mezclados.
Dolby Atmos incluye una cama 7.1.2, aunque se pueden añadir más camas reduciendo
el número de objetos. Por ejemplo, puede haber 118 objetos + 1 cama, 108 objetos + 2
camas, 98 objetos + 3 camas, etc. No obstante, cabe recordar una vez más que, en
[Link] 17
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en objetos
términos de sonido, utilizar más de una cama no presenta ninguna ventaja particular.
Pros y contras
La principal ventaja del audio basado en objetos es su capacidad de adaptación a
cualquier disposición de altavoces. Cuando se envían «intenciones» al sistema de
reproducción, esas intenciones se adaptan perfectamente a la configuración de
altavoces existente. Además, y muy importante, permite obtener la máxima
resolución espacial del sistema, ya que, cuando se añaden altavoces, se mejora la
precisión espacial de la reproducción.
En cuanto a sus desventajas, también presenta algunas. En primer lugar, hay que
distribuir muchos más canales de audio. En salas de cine, Dolby Atmos puede llegar
a utilizar 128 canales de audio. Sin embargo, si se utilizan otros medios (streaming,
Blu-ray), esos 128 canales de audio son demasiados y obligan a reducir el número de
objetos, lo que implica que muchas objetos se tengan que renderizar como camas y,
por tanto, pierdan sus ventajas. En segundo lugar, los objetos están limitados a un
número determinado . Es cierto que 128 es una cantidad considerable y que la
mayoría de los proyectos no necesita tantos; sin embargo, hay situaciones en las que
ese número se queda corto. Por ejemplo, Sound Particles es capaz de renderizar
escenas de audio con miles de sonidos, literalmente (tenemos renders de hasta un
millón de sonidos sonando en simultáneo). Las producciones de Hollywood también
utilizan más de 1000 pistas. Es cierto que las camas de audio son capaces de superar
gran parte de esas limitaciones, pero en ese caso no estaríamos ante un enfoque de
audio basado en objetos puro.
[Link] 18
Todo lo que Necesitas Saber Sobre 3D Audio Audio basado en objetos
Desde un punto de vista técnico, el sistema utilizaba 4 pistas: 3 pistas con audio
grabado (3 señales sonoras independientes) y 1 pista con señales de control, que
controlaba cómo se iban a reproducir los 3 canales de sonido: en cierto punto, el
canal 1 se podía enviar al altavoz izquierdo; el canal 2, al altavoz derecho, y el canal 3,
a los altavoces de sonido envolvente, para más tarde poder reproducir el canal 1 en
los altavoces frontales; el canal 2, en el techo; el canal 3, en la parte trasera, etc. Sí,
es cierto que era tecnología analógica, pero esto también convierte a Fantasía en la
primera película que utilizó el audio basado en objetos .
Fue la primera película con sonido envolvente, inmersivo y basado en objetos. ¡Hace
80 años! Sin ninguna duda, hay personas realmente visionarias.
[Link] 19
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
Ambisonics
El principal objetivo de Ambisonics era crear un formato de audio que pudiese ser
independiente del formato de reproducción. Es decir, que si algo está grabado en
Ambisonics, no importa cuántos altavoces estén reproduciendo ni su distribución
espacial, porque Ambisonics es capaz de adaptarse.
Aunque Ambisonics se creó en los años setenta (a partir del trabajo de Michael
Gerzon), el interés por este formato ha aumentado significativamente durante la
última década, especialmente asociado a las aplicaciones en RV. Pero antes de
profundizar en el conocimiento de Ambisonics, intentemos comprender cómo
funciona su hermano pequeño: la técnica Mid-Side.
Mid-Side
Aunque mucha gente utiliza la técnica tradicional de grabación estéreo XY, donde se
usan 2 micrófonos cardioides (uno orientado hacia la izquierda y otro hacia la
derecha), algunos profesionales prefieren utilizar la técnica de grabación Mid-Side.
[Link] 20
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
Para crear la salida estéreo final, las señales de los micrófonos se mezclan de la
siguiente manera:
Por tanto, si se utiliza un par Mid-Side y hay un sonido procedente del lado izquierdo,
ese sonido aparecerá en el canal izquierdo (los micros Mid y Side capturan ese
sonido con la misma fase), pero será muy débil en el canal derecho (la señal del micro
Side cancelará la señal de Mid debido a su polaridad opuesta).
3. Por supuesto, esto no funcionaría en un canal puramente mono, porque el canal Side estaría vacío.
[Link] 21
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
Ambisonics
Básicamente, Ambisonics es una técnica Mid-Side mejorada. Imaginemos que, en
vez de utilizar un micrófono bidireccional orientado hacia los laterales (eje
izquierda-derecha), añadimos un micrófono bidireccional orientado hacia el techo
(eje arriba-abajo) y otro hacia delante (eje delante-atrás). Para la señal Mid, en vez
de utilizar un micro cardioide para capturar el componente mono, utilicemos uno
micrófono omnidireccional para tener una señal mono completa de todo el entorno.
Esto es Ambisonics.
[Link] 22
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
Micrófonos Ambisonics
Una de las cosas que quedó clara desde el
principio es que grabar con un micrófono
omnidireccional y 3 bidireccionales no era
sencillo , especialmente teniendo en cuenta
que las cápsulas debían estar lo más cerca
posible. Sin embargo, el mismo resultado se
puede obtener con un micrófono tetrahedral
con 4 cápsulas cardioides (como se muestra
en la figura 13).
Aunque las cápsulas están cerca las unas de las otras, esa pequeña distancia puede
tener su impacto en ciertas frecuencias, ya que la señal no llega a todas las cápsulas
al mismo tiempo. Por eso, algunos sistemas/plugins son capaces de hacer un
procesamiento de señal incluso más avanzado durante esta conversión de
formato A -+ formato B en un intento de compensar esos efectos mínimos.
[Link] 23
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
En primer lugar, hay gente que deposita demasiadas expectativas en los resultados
de estos micrófonos. Imaginemos una producción cinematográfica que se va a lanzar
en estéreo. Pensar que instalar un solo micro estéreo en la cámara es suficiente sería
demasiado ingenuo, ¿verdad? Pues lo mismo ocurre con las producciones de sonido
3D: no basta con instalar un micrófono Ambisonics a una cámara 360. Es necesario
instalar los micrófonos cerca del diálogo (aunque solo sean mono), añadir mejores
efectos de sonido durante la mezcla, tiempo de posproducción, etc.
En segundo lugar, los ingenieros que reciben premios Grammy por sus maravillosas
grabaciones de orquestas no utilizan un simple micrófono XY colocado en cualquier
sitio. Normalmente, se colocan varios micrófonos en distintos sitios para utilizar el
tiempo como una herramienta espacial . Una vez más, en las grabaciones inmersivas,
los micrófonos Ambisonics son una excelente opción (y sin duda son mejores que los
pares estéreo XY o MS), pero si se busca un sonido excelente, es necesario utilizar
micrófonos distribuidos por el espacio para, una vez más, poder utilizar el tiempo
como herramienta espacial.
[Link] 24
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
Figura 14. Diagramas polares de los varios canales Ambisonics (cortesía de Franz Zotter)
[Link] 25
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
4. También existe el concepto de orden mixto , muy poco frecuente en la actualidad, que nos permite
tener una mejor resolución en el plano horizontal, pero menos (o ninguna) en el plano elevado.
[Link] 26
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
Al preguntar por estos parámetros, puede que nos mencionen AmbiX, un formato de
archivo de audio especial para Ambisonics que utiliza formato B, ACN, SN3D. A veces,
la gente menciona AmbiX no porque utilice ese formato de archivo, sino para decir
formato B, ACN, SN3D.
Gracias a esta característica, Ambisonics es perfecto para las aplicaciones de RV. ¿Por
qué? En las aplicaciones de RV, cuando se mira alrededor, básicamente lo que se
hace es rotar la cámara: hacia el lado (Yaw / Guiñada), mirara hacia arriba y hacia
abajo (Pitch / Cabeceo) o inclinar la cabeza (Roll / Alabeo). Por este motivo, es fácil
para la aplicación RV tomar las señales de Ambisonics y rotarlas según la rotación de
la cabeza, lo que permite generar un sonido coherente con la imagen.
6. El acrónimo de Furse-Malham
[Link] 27
Todo lo que Necesitas Saber Sobre 3D Audio Ambisonics
Pros y contras
La principal ventaja de Ambisonics es su capacidad de adaptación a cualquier
disposición de altavoces. En segundo lugar, puede reproducir una escena de audio
3D utilizando pocos canales de audio (mínimo 4 canales). Y, tercero, Ambisonics se
puede escalar a más canales para mejorar la resolución espacial.
[Link] 28
Todo lo que Necesitas Saber Sobre 3D Audio Audio binaural
Audio binaural
Cuando se habla de sonido inmersivo, automáticamente pensamos en una sala llena
de altavoces por doquier (arriba, a los lados, en la parte frontal, etc.). Sin embargo,
existe un tipo especial de enfoque de sonido inmersivo que solo requiere una
configuración muy sencilla: auriculares. Pero ¿se puede simular realmente el sonido
3D con unos auriculares?
Percepción
Para comprender cómo funciona el sonido
binaural, es necesario entender cómo
perciben los humanos la dirección de un
sonido. Por ejemplo, imaginemos un sonido
que se reproduce a nuestro lado derecho, tal
como se muestra en la imagen (figura 16).
[Link] 29
Todo lo que Necesitas Saber Sobre 3D Audio Audio binaural
Sin embargo, estos dos fenómenos no lo explican todo. Por ejemplo, ¿cómo
detectamos la diferencia entre sonidos frontales, elevados o traseros? En las tres
situaciones, el sonido llega a ambos oídos en el mismo nivel y al mismo tiempo.
Por último, también habrá un ligero efecto sombra en el oído contrario. Las
frecuencias más altas, debido a su longitud de onda más corta, tendrán más dificultad
para adaptarse y entrar en las zonas de sombra, es decir, que el oído más lejano
también tendrá un ligero descenso en las frecuencias altas.
HRTF
Todos estos factores hacen que nuestro cerebro sea capaz de detectar la dirección
de un sonido y, como podemos ver, depende de los niveles, los retardos y los filtros.
Por tanto, la siguiente pregunta que debemos hacernos es cómo podemos capturar (o
representar) la respuesta total a una dirección de sonido concreta que llega a una
cabeza humana.
7. Por ejemplo, el asfalto refleja un sonido con una respuesta a la frecuencia que es diferente al reflejo de
una alfombra.
[Link] 30
Todo lo que Necesitas Saber Sobre 3D Audio Audio binaural
HRTF son lo mismo. La única diferencia entre ellas es que las HRIR están en el
dominio del tiempo (como una ola) y las HRTF, en el dominio de la frecuencia (como
un espectrograma).
8. Estas cápsulas de micrófono se deben colocar lo más internamente posible, ya que, si no,
[Link] 31
Todo lo que Necesitas Saber Sobre 3D Audio Audio binaural
Personalización de la HRTF
Entonces, ¿esto quiere decir que todo el mundo puede experimentar un sonido
realista 3D gracias a los auriculares? Desafortunadamente, no todo el mundo.
La cabeza de cada persona es diferente, al igual que lo son sus oídos y otros
aspectos físicos que son únicos en cada individuo, lo que significa que puede haber
ligeras variaciones en la forma de los oídos que puede afectar a la llegada del sonido.
Y cada cerebro ha pasado muchos años escuchando el sonido con esas
características personales y no con otras.
Con los altavoces no tenemos ese problema. El sonido sale del altavoz y, aunque el
oído de cada persona lo oiga de una manera diferente, esa ligera diferencia es la
manera habitual para el cerebro de esa persona (el sonido que viene de esa dirección
siempre lo ha oído de esa forma). El problema de los auriculares con las HRTF de
otras personases que el cerebro escucha los sonidos de una forma ligeramente
diferente y poco habitual, y eso puede resultar extraño.
Si escucho audio binaural creado a partir del conjunto de datos HRTF captados de
otra persona, puede que tenga una experiencia fantástica con un sonido 3D perfecto
o que mi cerebro no lo tenga fácil a la hora de interpretar la información en conflicto
debido a las diferencias fisiológicas que tengo con la persona de la HRTF original.
[Link] 32
Todo lo que Necesitas Saber Sobre 3D Audio Audio binaural
Figura 18. La HRTF del oído izquierdo de 45 personas para la misma posición exacta: frontal centro
(azimutal = 0, elevación = 0)
Una vez más, puede que para algunas personas la percepción de un sonido binaural
concreto sea tremendamente realista, para otras ligeramente realista (pero mejor que
el estéreo) y para otras, nada realista. Por ejemplo, cuando escucho un sonido
binaural, los sonidos frontales me suelen parecer elevados, quizá porque mis oídos
son ligeramente diferentes a los de la mayoría de las personas.
Por supuesto, muchas empresas intentan elegir los mejores conjuntos de datos HRTF
para sus productos, es decir, que eligen una HRTF que se adapta a un porcentaje
elevado de oyentes. Pero incluso con un conjunto de datos HRTF fantástico, siempre
habrá un porcentaje de oyentes que no disfrute del todo ese audio binaural con ese
conjunto de datos.
[Link] 33
Todo lo que Necesitas Saber Sobre 3D Audio Audio binaural
El segundo aspecto importante que se debe tener en cuenta es que todos los
abordajes mencionados anteriormente (basados en canales, basados en objetos y
Ambisonics) se pueden convertir a audio binaural.
Por ejemplo, se puede convertir una señal 5.1 o 22.2 a una binaural, renderizar Dolby
Atmos en binaural o incluso convertir una señal Ambisonics de 3er orden en binaural.
De hecho, esta conversión de Ambisonics a binaural es lo que ocurre en la mayor
parte de aplicaciones de RV. Aunque la RV se puede probar con altavoces, la señal de
audio Ambisonics de una escena de RV se suele convertir a binaural y se reproduce
en los auriculares del visor VR.
BARRAS DE SONIDO
Pros y contras
La principal ventaja del sonido binaural es la capacidad de reproducir sonido 3D con
una configuración muy sencilla, con unos auriculares, sin necesidad de una gran
cantidad de altavoces: una experiencia 3D disponible en cualquier sitio, económica y
con una configuración eficiente.
[Link] 34
Todo lo que Necesitas Saber Sobre 3D Audio Audio binaural
Una vez más, el audio binaural es una opción fantástica siempre y cuando la persona
conozca cuáles son sus necesidades de personalización.
[Link] 35
Todo lo que Necesitas Saber Sobre 3D Audio Conclusión
Conclusión
Hemos visto cuatro abordajes del sonido 3D: audio basado en canales, audio basado
en objetos , Ambisonics (también conocido como audio basado en escenas) y audio
binaural. Cada uno de estos abordajes presenta sus ventajas y sus desventajas, y
ninguno de ellos es capaz de sustituir a los demás en todas las situaciones, por lo
que hay que elegirlo con cuidado.
Espero que ahora tengas una visión más amplia del sonido 3D (cómo funciona y cómo
se puede utilizar, cuáles son los diferentes sistemas y para qué se usan) y que
entiendas un poco mejor este mundo del sonido 3D que actualmente está en auge,
tanto en el cine como en la televisión, así como en los videojuegos, la música, la RV y
otras muchas aplicaciones. Estos son tiempos maravillosos para todos los que aman
el audio espacial. Y siempre podrás hacer tus pruebas con el software Sound
Particles , que admite la mayoría de estos formatos.
[Link] 36
Sound Particles es el software de sonido 3D
imprescindible que ya han utilizado los principales
estudios de Hollywood en producciones como
Dune, Juego de Tronos, Star Wars 9 y Frozen 2.
Gracias a los micrófonos virtuales, podrás para generar miles de sonidos. ¿Quieres
renderizar audio en cualquier formato, crear un campo de batalla? Basta con crear
desde mono a 22.2 pasando por un grupo de partículas con 10 000
Ambisonics de 6.ª generación o cualquier partículas (fuentes de sonido), importar 200
otra configuración personalizada.
Sound efectos sonoros bélicos de tu biblioteca de
Particles es el arma secreta de los estudios audio, añadir movimientos y efectos
de Hollywood para crear un sonido épico. sonoros aleatorios, y capturar el resultado
Una de sus características únicas es su con un micrófono virtual. Todo este proceso,
capacidad de utilizar sistemas de partículas listo en pocos minutos.
PRUEBA LA DEMO YA