0% encontró este documento útil (0 votos)
34 vistas128 páginas

Untitled

Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
34 vistas128 páginas

Untitled

Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Análisis

espectrográfico
de los sonidos
del habla

Ariel
Ariel Practicum
Eugenio Martínez Celdrán

Análisis
espectrográfico
de los sonidos
del habla

EditorialAriel, S.A.
Barcelona
Diseño cubierta: Vicente Morales

l.ª edición: junio 1998

© 1998: Eugenio Martínez Celdrán

Derechos exclusivos de edición en español


reservados para todo el mundo:
© 1998: Editorial Ariel, S. A.
Córcega, 270 - 08008 Barcelona

ISBN: 84-344-2823-7

Depósito legal: B. 18.723 - 1998

Impreso en España

Ninguna parte de e.�ta publicación, incluido el diseño


de la cubierta, puede ser reproducida, almacenada o transmitida
en manera alguna ni por ningún medio, ya sea eléctrico,
químico, mecánico, óptico, de grabación o de fotocopia,
sin permiso previo del editor.
PRÓLOGO

Este libro pretende, como indica su nombre, enseñar los conceptos


y criterios que permiten analizar los gráficos más habituales que se
manejan en fonética acústica y que proporcionan todos los analizadores
de habla. Nosotros hemos utilizado el CSL (Computerized Speech Lab)
de Kay Elem. S. A. de New Jersey, pero los gráficos son semejantes a
los proporcionados por cualquier otro programa de los que existen en el
mercado actualmente .
Se ofrecen ejercicios múltiples en cada capítulo para practicar lo
que se estudia en cada lección. Los profesores que estén interesados en
la clave de esos ejercicios deben ponerse en contacto con el autor. En
definitiva, lo importante es superar los posibles problemas que puedan
ofrecer.
Esperamos que el material que presentamos sea suficientemente
práctico y que ayude al dominio de la fonética en esta rama tan útil para
la investigación y para otros objetivos como son los logopédicos, foren­
ses, tecnológicos, etc.
EUGENIO MARTÍNEZ CELDRÁN
Universidad de Barcelona
Facultad de Filología
Gran Vía, 585
08007 Barcelona
e-mail: emartine@[Link]

Barcelona, 6 de febrero de 1998


CAPÍTULO 1

ONDAS SIMPLES Y COMPLEJAS


1 .1 . Fenómenos periódicos

Antes de entrar en el estudio físico del sonido conviene que se expongan


algunas nociones fundamentales que, luego, tendremos que aplicar a las on­
das sonoras.
En la naturaleza hay muchos fenómenos que son periódicos. Un pe­
riodo es el tiempo que tarda en repetirse un fenómeno o en volver un
cuerpo al estado o posición que tenía al principio. Y hablamos de ciclo
cuando examinamos todas las fases por las que pasa un fenómeno perió­
dico hasta que se repite una fase anterior.
Las estaciones del año son periódicas. En el hemisferio norte, por
ejemplo, en fechas fijas y, por tanto, con duraciones iguales se van repi­
tiendo las estaciones. Por ejemplo: el invierno comienza el 2 1 de diciem­
bre; hecho que se repite cada año y su ciclo es de unos tres meses apro­
ximadamente. Al cabo de ese tiempo, entra una nueva estación: la prima­
vera. Son hechos que se repiten año tras año. Se trata de fenómenos pe­
riódicos.
El periodo del giro de la Tierra sobre sí misma es de 24 h. Al cabo
de este tiempo se vuelve a repetir el fenómeno: un nuevo día comienza,
lo cual significa que se encuentra en la misma posición de cara al sol;
para ello es necesario situarse en un punto concreto de la geografía de la
Tierra. Por otra parte, cada uno de los planetas tiene su propio periodo,
tomando convencionalmente como unidad de tiempo la hora terrestre.
También es un fenómeno periódico el giro de cada planeta alrededor del
sol. La Tierra tarda un año en dar una vuelta completa alrededor del sol,
mientras que Júpiter tarda 1 1 años y 3 1 5 días : casi doce años. Ahora
tomamos como medida de referencia del tiempo el año terrestre. Es evi­
dente que si nos situamos en un punto terrestre cualquiera de partida
12 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

respecto del sol, al cabo del año volveremos a pasar por ese mismo pun­
to. Año tras año se repite lo mismo. La repetición es la característica más
importante de todo fenómeno periódico.
El periodo está conectado con otro concepto clave: la frecuencia. Se
trata del número de veces que se repite el mismo fenómeno tomando una
unidad de tiempo. Tomemos el minuto como unidad de tiempo y conte­
mos las pulsaciones de nuestro corazón en estado de reposo colocando
nuestros dedos pulgar e índice de la mano derecha sobre la muñeca iz­
quierda: 60 pulsaciones en un minuto. Ésa es la frecuencia de los latidos
de nuestro corazón. Eso significa que cada segundo se produce una pul­
sación. Hagamos una carrera de 1 00 metros y contemos de nuevo las
pulsaciones : 1 1 O pulsaciones en un minuto; es decir, 0.55 segundos cada
una de ellas. 60 y 1 1 0 son datos de frecuencia de nuestro pulso. 1 y 0.55
segundos son datos del periodo. Cada 0.55 segundos se repite el latido al
terminar la carrera; el tiempo que tarda en repetirse el siguiente latido
constituye el periodo. Ahora se puede comprobar otro hecho: periodo y
frecuencia tienen una relación inversa. Cuando el pulso posee una fre­
cuencia de 60 latidos por minuto, el periodo de cada latido es de un se­
gundo; mientras que cuando la frecuencia aumenta a 1 1 O, el periodo dis­
minuye a 0.55 segundos : poseen una relación inversa.

Matemáticamente: T = 1 /F

Se suele simbolizar con T el periodo (medido en segundos) y con F


la frecuencia.
Muchos fenómenos cotidianos suelen ser periódicos: los movimien­
tos de los planetas, el horario de abertura de un comercio, el puente aéreo
Madrid-Barcelona, etc.; aunque los humanos no somos tan exactos como
las leyes astronómicas. Supongamos que en un país imaginario hemos
estado quince días durante un invierno para medir la temperatura diaria­
mente cada dos horas. Durante ese tiempo cada día la temperatura ha
sufrido las mismas variaciones:

horas grados horas grados

6 o 18 o
8 5 20 -5
10 7 22 -7
12 9 24 -9
14 7 2 -7
16 5 4 -5
y un nuevo día comienza . . .
ONDAS SIMPLES Y COMPLEJAS 13

Las oscilaciones de la temperatura las representamos en un gráfico


de la forma representada en la figura 1 . 1 :

HORAS

FIG. l. l. Oscilación de la temperatura a lo largo de un día.

Se representa la amplitud a través del tiempo. Se denomina amplitud


al alejamiento máximo que alcanza la temperatura respecto de la línea
media situado en O grados centígrados. En nuestro ejemplo la amplitud
vale 9 grados, tanto en la fase positiva, como en la negativa. Muchos
fenómenos pueden tener una representación como la efectuada anterior­
mente, lo cual ayuda a su comprensión y al estudio de sus cualidades; por
ejemplo, podemos hablar de fenómeno periódico en el caso que nos ocu­
pa, si al cabo de los quince días hemos obtenido quince gráficos exacta­
mente iguales. Los gráficos son siempre muy importantes porque ayudan
a relacionar cualidades y a estudiarlas en su interacción.
En la naturaleza y sobre todo en la sociedad humana existen también
muchos fenómenos que son aperiódicos. Antes hemos puesto un ejemplo
en un país imaginario, puesto que en uno real la temperatura no tiene
oscilaciones tan regulares no sólo dentro de un mismo día sino tampoco
en días sucesivos ni, por supuesto, a lo largo del año. No es realmente un
fenómeno periódico, por regla general. Tampoco lo es el régimen de
lluvias de una región determinada, ni la erupción de los volcanes, etc.
Frecuentemente, la hora de levantarse es periódica y no lo es la hora de
acostarse; por eso mismo utilizamos un despertador. Aunque no parece
que los humanos seamos periódicos en nuestras acciones, hay algo en
nuestra vida que ha de ser siempre periódico, como ya se ha comentado,
los movimientos del corazón.
14 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

1.2. Las ondas sonoras

El sonido es un movimiento de vibración longitudinal perceptible


por el oído. Estriba en una serie de concentraciones y enrarecimientos
que se pueden transmitir en cualquier medio elástico. Ese movitniento de
vibración es una onda sonora. En el habla, el medio elástico es el aire.
Una cuerda de guitarra puede servirnos para explicar el fenómeno. Al
pulsarla, ésta se pone en movimiento consistente en un vaivén que se
denomina vibración. Antes de pulsar la cuerda, en una habitación en si­
lencio, las partículas de aire mantendrán un espacio equidistante entre
ellas. Después de la pulsación, en la ida, la cuerda habrá empujado, en su
desplazamiento, a las partículas más próximas formando una concentra­
ción al suprimir los espacios que mantenían. Ésta es la perturbación ori­
ginal. La fuente de esta perturbación es la cuerda de la guitarra. Pero
como todo cuerpo elástico, la cuerda no sólo vuelve a su posición de
partida sino que también se desplaza en sentido contrario otro tanto como
en la ida. Las partículas seguirán el movimiento de la cuerda, pues no
sólo volverán a su punto de partida, sino que también se desplazarán en
sentido contrario, aumentando el espacio de separación entre cada una de
ellas produciéndose un enrarecimiento.
Básicamente en esto consiste el sonido desde un punto de vista físi­
co. Para poder estudiar sus cualidades, vamos a partir de una onda simple
como la emitida por un diapasón. La representación de su movimiento
corresponde a una onda sinusoidal; es decir, aquella en la que su ordena­
da es una función del seno del ángulo: e= r sen a. Llamamos e (elonga­
ción) a la distancia existente entre el centro de la circunferencia (O) y el
punto proyectado (M) a partir de otro punto que recorre la circunferencia
en el sentido contrario a las agujas del reloj en un movimiento circular
uniforme. Cuando ese punto (P) se proyecta ortogonalmente en otro
punto (M) durante su recorrido, entonces decimos que es un movimiento
armónico simple. La elongación máxima es igual a r (radio de la circun­
ferencia). a es el ángulo de la proyección (véase fig. 1 .2). Por ejemplo,
si tomamos un punto que recorre la circunferencia desde un punto de
origen C, cuando se sitúe en los 45º, si el radio midiera 30 mm, ten­
dríamos que su elongación sería de 2 1 . 2 1 mm, pues el sen 45º = 0.707; y
30 X 0.707 = 2 1 . 2 1 .
La representación de la sinusoide implica calcular las 360 elonga­
ciones posibles en la circunferencia y situar sus valores en la ordenada.
La sinusoide es la curva que pasa por todas las elongaciones. La elonga:-:
ción máxima es igual al radio.
ONDAS SIMPLES Y COMPLEJAS 15

FIG. 1.2. Movimiento armónico simple. La elongación es la distancia 0-M. El punto P,


que recorre la circunferencia desde C, se proyecta en el radio formando el ángulo a.,
cuyo seno multiplicado por el valor del radio nos proporciona la elongación o distancia
entre el centro O y la proyección M del punto.

La elongación máxima representa la amplitud de la onda y la línea,


donde figuran los ángulos, el periodo (fig. 1 .3). Mientras que la elonga­
ción máxima equivale a la amplitud, la abscisa no tiene ninguna relación
con la longitud de la circunferencia, ya que ahí se representa convencio­
nalmente la velocidad del punto que la recorre; es decir, el tiempo que
tarda en recorrerla.

�---==- ------

P1 C•"'l
O 45 90 1J5 180 225 270 J15 J&O

a In degrees

FIG. 1.3. Representación de la sinusoide. Los puntos (Po hasta P7) son las elongaciones
cada 45º y representan el movimiento armónico simple. Cada punto muestra en la
función sinusoidal la magnitud del desplazamiento desde la línea de base que se
corresponde con el ángulo de rotación (figura tomada de C. E. Speaks, 1992, p. 48).
16 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

La onda del diapasón es una vibración periódica; es decir, constituye


un movimiento armónico simple; por tanto, en ella se pueden observar
las mismas características que hemos visto en cualquier fenómeno perió­
dico: periodo, amplitud y frecuencia. Si tomamos un diapasón que emite
la nota musical denominada LA natural, podemos comprobar que posee '
una frecuencia de 440 Hz; es decir, la varilla del diapasón tendrá 440
oscilaciones en un segundo; cada oscilación o ciclo corresponde a una
ida y una vuelta a partir del eje de reposo. El Hertz (hercio), simbolizado
Hz, es la unidad de medida de la frecueneia, que también se puede de­
nominar ciclos por segundo: cps. Por tanto, en este caso su periodo posee
un poco más de dos milésimas de segundo:

1
T = = -- = 0,00 2 27 segundos
F 440

El periodo siempre se expresará en segundos para poder operar con


él. La amplitud se mide en decibelios (dB) y resulta del mayor o menor
desplazamiento de las varillas del diapasón respecto de su posición de
reposo, lo cual es debido a la fuerza del empuje inicial:

a b
a

o Ol 0 . 2 sec 0. 1 0.2
o
· - -
·

A B

FIG. 1.4. A. Ondas con igual periodo y distinta amplitud.


B. Ondas con igual amplitud y distinto periodo.

Amplitud y periodo son elementos independientes entre sí; mientras


que el periodo y la frecuencia son totalmente dependientes y mantienen
la relación inversa que ya hemos estudiado anteriormente (fig. 1 .4 ). La
frecuencia es una característica propia de cada cuerpo. Los cuerpos gran-
ONDAS SIMPLES Y COMPLEJAS 17

des y pesados poseen una frecuencia menor que los pequeños y livianos,
porque éstos pueden moverse más rápidamente. Los más largos también
vibrarán con una frecuencia menor que los cortos. Por último, los cuer­
pos que puedan tensarse tendrán una frecuencia de vibración mayor
cuanto más tensos estén y viceversa. Todos estos aspectos se pueden
comprobar fácilmente si se tiene una guitarra a mano; lo proponemos
como experiencia.

A
+ 01'-����+-��c;__..;��-+�
B

o 0,25 0,5 0,75 1


1 11 1 1 1 1
o 1

FIG. 1.5. Suma de ondas y onda compleja.


18 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

No obstante, la guitarra no emite una onda simple como la del dia­


pasón, sino una onda compuesta (denominada compleja) por la suma de
muchas otras con la forma de la onda simple; pues los cuerpos suma­
mente elásticos como el de la cuerda vibran de tal forma que se mueven
todas sus partes a la vez; pero ese movimiento de las partes no es inde­
pendiente sino que vibran conjuntamente : toda la cuerda, sus mitades,
sus terceras partes, sus cuartas partes, etc . Cuando el sonido complejo
es periódico, todos sus componentes guardan una relación matemática
entre ellos, pues todos son múltiplos del primero, que se llama tono
fundamental. Todos los componentes reciben el nombre de armónicos.
El primero es el tono fundamental (simbolizado FO) y corresponde a la
vibración de la cuerda entera. El segundo pertenece a sus mitades; el
tercero, a sus terceras partes y así sucesivamente hasta agotar la cuerda.
Por ejemplo, si el primer armónico tiene 250 Hz, el segundo poseerá
500 Hz. . . y el décimo 2.500. Multiplicando el número de orden del
armónico por la frecuencia del fundamental se obtiene la frecuencia de
ese armónico:

FA = NA* FO,

donde FA = frecuencia de un armónico, NA = número de orden del ar­


mónico y FO = frecuencia del tono fundamental o primer armónico de la
serie.
A pesar de reconocer que una onda compleja periódica está com­
puesta de muchas otras con la forma de las simples, resulta un todo con
sus propias características . De hecho, en la naturaleza lo que más abunda
son los sonidos complejos .
E l sonido complejo no periódico recibe el nombre d e ruido. E l ruido
está formado por una serie de ondas que se dan en todas las frecuencias
de forma aleatoria, a partir de una primera, y por tanto sin guardar entre
sí ninguna relación matemática.
En el sonido complejo periódico se pueden obtener sus elementos
componentes mediante el análisis; se pueden contar fácilmente, pues
guardan espacios entre ellos . Posee un espectro discontinuo. En el rui­
do, por el contrario, el análisis se torna mucho más difícil, pues prácti­
camente no existen espacios entre esos componentes, por lo que resulta
casi imposible contarlos. Su característica principal es la irregularidad.
Posee un espectro continuo. En la figura 1 .6 se ve cómo el ruido es una
mancha informe donde las líneas verticales se distribuyen aleatoria­
mente; por el contrario, el sonido armónico se presenta como una serie
de ondas ordenadas, contables y regulares.
ONDAS SIMPLES Y COMPLEJAS 19

Armonicidad

"C
:E
o.
E
<

Tiempo

FIG. [Link] aquí una visión primaria de la irregularidad del ruido o sonido
inarmónico (fricativa) frente a la regularidad del sonido armónico (vocal).

1.3. La resonancia

Todo cuerpo capaz de vibrar por sí mismo se constituye en una


fuente de sonido que puede transmitir su vibración a otros cuerpos que
coincidan con su frecuencia. Esos otros cuerpos pueden a su vez tener
la posibilidad de ser fuentes o ser cajas o cavidades de resonancia que
pueden captar la vibración, aunque por sí mismas no vibrarían. Cuando
la vibración es compleja y se transmite a una cavidad, ésta tiene unas
propiedades vibratorias propias, de modo que dará amplitud a las fre­
cuencias que coincidan con esas propiedades y atenuará las que no
coincidan, modificando de esta manera la onda producida por la fuente
del sonido. El fenómeno se conoce como resonancia y la cavidad que
procede así se denomina resonador(a). Un resonador actúa como un
filtro ya que deja pasar las frecuencias coincidentes y debilita las que
no lo son.
Nuestras cuerdas vocales constituyen la fuente principal de sonido
armónico y el tracto vocal (desde la laringe hasta los labios) está for­
mado por varias cavidades de resonancia que amplifican ciertas zonas
del espectro vocálico y atenúan otras . Esas mismas cavidades se con­
vierten en fuente de sonido aperiódico o ruido cuando las cuerdas vo­
cales no vibran y el aire pasa por algunas de esas zonas constreñidas
(fig. l. 7).
20 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

30

m
� 20
�"'
A !
"' 10

Q.
E
<
o

1.000 2.000 3.000

30
j
20

B
10 - :

500 1.500 2.500

30

20
j
e 10 -

o
1111 I l 111
1.000 2.000 3.000

FIG. 1.7. En A, se presenta un espectro• esquemático de la onda laríngea; en B, la


estructura de un filtro con función resonadora; y en C, el resultado de pasar A por B.
(Adaptado de Bordeu, Harris y Raphael, 1980.)

l. Véase en el capítulo 2 en qué consiste un espectro.


ONDAS SIMPLES Y COMPLEJAS 21

Ejercicios

A. Resolución de problemas

1 . L a elongación correspondiente a los 60º e s d e 17 .32 m m , ¿cuántos


milímetros tendrá la elongación máxima?
2 . Si u n a sinusoide posee como elongación máxima 50 mm a los 90º,
¿cuánto medirá la elongación a los 270º?
3 . Dibujar una sinusoide cuya longitud (abscisa) sea de 90 mm y el
radio (ordenada), de 40 m m .
4. El tiempo total invertido por seis ondas es de 6 ms, ¿cuál será la
frecuencia de este sonido?
5. El periodo d e u n a onda e s d e 0.4 m s , ¿cuál será su frecuencia?
6. El quinto armónico d e u n a onda compleja posee 450 Hz, ¿qué fre­
cuencia tendrá el octavo?
7. Un armónico posee 576 Hz, ¿qué número d e l a serie será sabiendo
que el noveno posee 864 Hz?
8. S i e n e l osciloscopio aparece u n a onda q u e ocupa 4 divisiones y la
base de tiempos está en 50 millonésimas de segundo, ¿qué fre­
cuencia poseerá? (En el osciloscopio, la base de tiempos nos pro­
porciona la velocidad del punto por cada d ivisión . )

B. Resolución de gráficos2

1. ¿ Qu é frecuencia posee la onda 1 .1 sabiendo que cada división po­


see 1,663 ms aproxi madamente?

Onda 1.1.

2. Para resolver estos gráficos se deben medir los milímetros que posee una división (o cuadradito del gráfico)
horizontalmente. Después se divide el tiempo que se indica por los milímetros obtenidos, con lo cual sabremos qué
tiempo posee 1 mm. A continuación, se miden los milímetros que ocupa una onda, tomando dos puntos correlativos
que la delimiten y, por último, se multiplican por el tiempo de 1 mm. El tiempo total estará en milésimas de segundo;
hay que pasarlo a segundos para operar con él: F = lff.
22 ANÁLISIS ESPECfROGRÁFICO DE LOS SONIDOS DEL HABLA

2. ¿Qué frecuencia, posee la onda 1.2 sabiendo que cada división po­
see 1,862 ms aproximadamente?

_l
Onda 1.2.

3. ¿Qué frecuencia posee la onda 1.3 sabiendo que cada división po­
see 1,7575 ms aproximadamente?

Onda 1.3.

4. A contin uación hay dos vocales iguales ([a]), pero su FO es diferen­


te , uno es masculino y el otro femenino. Averiguar cuál es el FO de
ambas para saber cuál es el femen ino, que tiene mayor frecuencia
por término medio (cada división posee 12,50 ms).
ONDAS SIMPLES Y COMPLEJAS 23


i
I · •. . . •• I • ••• • ' • ••. ·•• ·· ·•••• ••••• , , • •
· · - ········ !· ·

l
··············-·············· · ····- = ······· ········ ; ............... : . .. .... .. . .. .
·· · .

..

1
i

······· · ¡ ········-··· · · � -- .. ...... �


- · · ···· t
······ · ......... ¡
·· ·..·· .......

····-······················· ·· .. : :
···•······· ··············· ·-············· ·············· :

·············- � �
·-·····-····- ·-····· ••••••• ! •••• ·········· ·-···········- ·-············ �
i �
. . - ...···• . . ······-···. - ···· ·--- -- . - ······--- ---··········· ··············
� .
! ..•... � �

Ondas 1.4.

5. ¿Pod rías describir qué tipo de onda s e ve e n l a siguiente figura? ¿A


qué clase de sonidos humanos puede corresponder?

1-�:r:::1 J :1 J:::
!
.


·-············· ··· ·-·-·------ ---······.. ···· ! !
····-·········· ··· ·······-··
.
·
.... . ..

.. .......... .. ·� ........... ···· � ······· . ... .. .. ¡ .... ' . .. . ..... . ;:.. . . ... ... . .. ..... . .. . .. .


········-····· ···-···-····- � ········ ..····· � ··············- ·-· i .. . .... . .. ..... .. . ..... . .. .

Onda 1.5.
CAPÍTUL02
ANÁLISIS ESPECTROGRÁFICO
2.1 . Oscilogramas

Hasta aquí sólo hemos ido utilizando principalmente un tipo de grá­


fico; en el que en la abscisa (eje horizontal) se expresa tiempo y, en la
ordenada (eje vertical), amplitud. Normalmente lo denominamos oscilo­
grama; en inglés recibe el nombre de "waveform". En él se capta la for­
ma de onda de modo unitario. Su utilidad para el análisis es escasa, pues
sólo se puede averiguar el periodo y, por tanto, la frecuencia fundamental
de cualquier sonido periódico. En éste, como en cualquiera de los gráfi­
cos que vamos a estudiar, la diferencia entre sonido periódico (o cuasi­
periódico) y aperiódico se observa a primera vista, por su diferencia en la
repetición aproximada de una misma forma (véase fig. 2.1 ).

2.2. Espectros

El espectro es un gráfico muy adecuado para representar los distintos


componentes de un sonido complejo ya descompuesto. En la abscisa
quedan reflejadas las frecuencias (KHz) y en la ordenada las amplitudes
(dB).1 En la figura 2.2 representamos un espectro esquemático donde hay
tres armónicos con diferentes amplitudes (A).

l. El decibelio (dB) es una unidad de medida de la amplitud. Esta unidad es relativa; pues se ha establecido
convencionalmente que una amplitud de O dB se ha de situar en el nivel en que un sonido de l.000 Hz comienza a ser
oído por un oído sano. Esa amplitud equivale a una potencia eléctrica de 1O"16 w/cm'. Se ha comprobado, además, que
mientras la potencia sigue una escala logarítmica (se multiplica por diez), los decibelios la siguen aritmética (aumen­
tan de diez en diez): 1-0, 10- 1 0, 100-20, l.000-30, 10.000-40, etc.
28 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

>ch1 COPY 8.88888<-ZGm>

8.888 Tit1e <sec> 8.811

>ch1 : COPY 6 8.88888( 8)

Tit1e <sec>

D>ch1 : COPY 8.88888< -812>

8.888 Til'M! <sec> 8.888

>ch1 : COPY 6 8.88888< 8>

8.888 Til'M! <sec> 8.

FIG. 2.1. Oscilogramas de una onda simple y de tres complejas: vocal [aj (sonido
periódico), consonante {sj (sonido aperiódico o ruido) y consonante /ni (sonido periódico).
Observen que en los sonidos periódicos las formas se van repitiendo entre las marcas.

dB
40
A
30
B

20

10

FIG. 2.2. Espectros esquemáticos: A. Armónicos; B. Envolvente.


ANÁLISIS ESPECTOGRÁFICO 29

También es posible representar con el espectro una curva que repre­


senta la forma que adquieren los armónicos : se trata de la envolvente (B).
Estas representaciones ofrecen una información rica ya que nos permiten
analizar los rasgos más destacados de los sonidos aislados en un punto
determinado de su duración. Esos rasgos son los picos de mayor ampli­
tud que representan el centro de los formantes de las vocales, su ancho de
banda y los picos de frecuencia de mayor intensidad a lo largo de todo el
espectro en las consonantes.
Las vocales se caracterizan fundamentalmente por sus tres primeros
formantes. Los formantes son resonancias del tracto vocal que producen
unas amplificaciones en el espectro. El centro y el ancho de los tres pri­
meros formantes determinan cada una de las vocales.
En la figura 2 . 3 hay tres resonadores caracterizados por su fre­
cuencia y su ancho de banda. El primero de ellos posee una frecuencia
de 1 00 Hz y un ancho de banda de 1 0 Hz (105 -95 ) . El segundo tiene su
frecuencia situada a 200 Hz y su ancho de banda es de 50 Hz (225 -
1 75). El tercero, por último, tiene su frecuencia a 450 Hz y su ancho de
banda es de 200 Hz (550-350). Los formantes vocálicos también po­
seen característicamente unos formantes, cuyos picos o centros se si­
túan en una frecuencia determinada y que poseen anchos de banda que
varían en virtud de la relevancia de dicho formante. Los anchos de
banda estrechos prestan una mayor relevancia a los formantes, mientras
que los muy anchos la disminuyen. No sólo las vocales poseen espec­
tros con amplificaciones en unas frecuencias determinadas. También
las consonantes se caracterizan según su punto de articulación por di­
chas amplificaciones.

---
95-105 175-225 350-550

FIG. 2.3. Tres curvas que especifican diferentes resonadores


(tomado de Ladefoged, 1962).
30 ANÁLISIS ESPECfROORÁACO DE LOS SONIDOS DEL HABLA

Así pues, los espectros proporcionan tres informaciones precisas de


cada formante: la frecuencia central, el ancho de banda y la amplitud.
Obsérvese la figura 2.4, de ella podemos obtener las tres magnitudes del
primer y del segundo formante a partir, por ejemplo, del LPC; Fl: fre­
cuencia 230 Hz, ancho de 70 Hz y amplitud de 40 dB; F2: frecuencia
1988 Hz, ancho de 210 Hz y amplitud de 29 dB. Esas cantidades deter­
minan el timbre de la vocal [i].
En la figura 2.4 presentamos dos espectros diferentes. El espectro
FFT (Fast Fourier Transform) proporciona la composición en armónicos
del sonido y el LPC (Linear Predictive Coding) da la envolvente; es de­
cir, la línea curva que predice los picos de mayor amplitud en el espectro.
Esta última es ideal para establecer las medidas más importantes de los
formantes (las marcas de calibración son las líneas verticales, cada una
marca 200 Hz). El LPC no representa armónicos.

B>FFT 8< 8.88>

1
1 1
1 1
1

1 1

1 11 1
1
1
1
1 1
1 1 r
1
!
!

"
.1 1
1
"' 1 1

1
i
� 1
1

1
!:!
1
11 1 1!
1
1
1 1
Fr•qu.•ncw (-) - 11 Fr•qu•ncw <Hz> 4-

FIG. 2.4. Espectros de la vocal [i]. de donde se han obtenido las medidas.

2.3 . Espectrogramas

El espectrograma representa también el sonido complejo, pero desde


otro punto de vista. La frecuencia se muestra ahora en la ordenada y en la ..
abscisa se manifiesta el tiempo, que sirve para saber la duración de los
sonidos. El espectro, como no incluye el tiempo, constituye una repre-
ANÁLISIS ESPECTOGRÁFICO 31

sentación frecuencial del sonido en un punto determinado de su duración.


En cambio, el espectrograma (fig. 2.5) refleja el sonido en su evolución
frecuencial a lo largo del tiempo; es la mejor forma de ver las imbrica­
ciones de los sonidos en la cadena hablada.

1.42868( 8)

...

� ---- -- --- -- -- - - -----.

, � � t� i
11�--- LLt .., . . --�
J..429 J.,987

FIG. 2.5. Espectrograma de la vocal {ij

Se utilizan dos clases principales de espectrogramas según el filtro


utilizado en el proceso de descomposición de la onda compleja. Si el
filtro tiene un ancho de banda de 150 Hz o más, se llama espectrogra­
ma de banda ancha. Si el filtro es de banda más reducida, por ej . 59 Hz,
se denomina espectrograma de banda estrecha. En la banda ancha (figs.
2.5 y 2.6.B) no se distinguen armónicos, sino sus concentraciones a
ciertas frecuencias; sin embargo, en la banda estrecha (fig. 2.6.C) se
pueden ver los armónicos que componen cada una de esas concentra­
ciones . Obsérvese que en el espectro (fig. 2.4.B ) los armónicos se pre­
sentan verticales, mientras que en el espectrograma de banda estrecha ·

son horizontales (fig. 2.6.C). Lo que se ve en el de banda ancha son las


estrías de los pulsos glotales: la parte negra indica que las cuerdas vo­
cales están abiertas (pasa energía) y, la parte blanca, que están cerradas
(no pasa energía).
La voz grave -por ej . la masculina- frente a la voz aguda -la
femenina- se presenta de diversas formas según el gráfico que se
adopte. En los gráficos donde se muestran los armónicos directamente,
como en los espectros (FFT) y en los espectrogramas de banda estre­
cha, los armónicos de la voz femenina tendrán mayores separaciones
entre ellos que los de la voz masculina, debido a sus relaciones mate­
máticas, por ej .:
32 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

armqnico masculina femenina niño

l. º 125 230 300


2. º 250 460 600
3. º 375 690 900
4. º 500 920 1.200
5.º 625 1.150 l.500

En cambio en los espectrogramas de banda ancha, donde no se mani­


fiestan los armónicos, las diferencias de voz se detectan a través de las
estrías, que marcan los pulsos glotales, de los sonidos armónicos, más
separadas cuanto más grave es la voz y viceversa (fig. 2.6). En la voz
infantil, no llegan a apreciarse las estrías pues aparecen unidas en un
continuo.

2.4. Medidas

Los programas actuales de análisis de sonido permiten tener unos


cursores que señalan la frecuencia y/o amplitud de un punto determi­
nado del espectrograma, así como la duración de un trozo selecciona­
do previamente. Pero si esos espectrogramas los tenemos en papel,
entonces hay que tomar la regla y la calculadora para establecer la
equivalencia de los milímetros en Hz, dB o ms . Por ejemplo, si me­
dimos el espacio existente en la ordenada del cuadro C de la figura
2.6 y resulta que es de 5 3 mm, entonces 1 mm es igual a 74.13 Hz
(pues se indica que en ese espacio tenemos 4.003 Hz (4.003/5 3 =
75 . 5 ) ) . Si medimos en mm cualquier punto del espectrograma verti­
calmente y lo multiplicamos por 75.5, obtendremos la frecuencia
aproximada a la que aparece dicho punto; por ejemplo, el armónico
más intenso del cuadro C (señalado con una flecha), está situado a 9.5
mm, multiplicados por 75.5, resulta que su frecuencia será de 717 Hz.
Lo mismo se hace para calcular la duración horizontalmente. Si re­
sulta que entre comienzo y el final hay, por ejemplo, 200 ms (0.840
seg - 0.640 seg = 0. 200 seg en la ventana B ), que están situados a lo
largo de 58 mm, entonces 1 mm es igual a 3.4 ms. Si se desea saber la
duración de un sonido, por ejemplo, basta medir su longitud en mm y
multiplicar por esa cantidad.
ANÁLISIS ESPECTOGRÁACO 33

8>

FO
FIG. 2.6. Vocal [e] femenina con las dos bandas: FO= 166 Hz.

En la figura 2.7 ofrecemos cuatro ventanas con líneas de calibración


diferentes. A partir de ellas se pueden adoptar las medidas pertinentes.
Por ejemplo, en la ventana C > SPG 1 000 Hz se representan en 6 mm,
aproximadamente; por tanto, 1 .000/6 = 1 66; es decir, cada mm mide 1 66
Hz. Podremos saber ahora qué frecuencia posee cualquier punto del es­
pectrograma midiendo cuántos milímetros hay desde la base hasta ese
punto verticalmente y multiplicando por 166. Si partimos de la ventana
G > SPG, que no posee líneas de calibración, tendremos que dividir
4.06 2 Hz que posee toda la ordenada entre 25 mm: 4.06 2/ 25 = 1 6 2. 5 .
Como s e v e los cálculos son aproximados, pues hay una diferencia de
3 . 5 Hz de medir entre marcas a hacerlo en toda la ordenada. La duración
se mide de forma equivalente: la abscisa mide 55 mm y posee 1 .7 1 5 ms ;
por tanto, 1 .715/55 = 3 1 ms. Cualquier espacio horizontal medido en mm
habrá que multiplicarlo por 3 1 ms para saber cuál es su duración. Los
mismos cálculos hay que establecer en los espectros.
34 ANÁLISIS ESPECfROGRÁFICO DE LOS SONIDOS DEL HABLA

OC)SPG , 8.11888<8 8> pG>SPG 8.88888< 8)

"l ·--·- ·· · ·· · · ·· ·---- · . ----- · - · · · -····----- .. . . . ···--· - · . ········ "i


�I' ---·--·----·--·---·---···-------
�I'
.�
� -·--·····---·-----·------··-·····---·--·-···-···---·---···---

"'

., .,
11.- Tit"Mt <s•c > Titw <s•c> 1.7J.:S
DD>FFT 1828(-15.87> �H>FFT : 8< 18.78>
1 ! 1 1! 11 11 1 :l 1 1
··· ·- - · - · - · · · · · · · · · ··· -- · · ·····································--·····················

! 1
11
!
¡ i

1 1 i
--- · ··· - ··---- ·····--·-···-·-··-·-··-·--· .. . ·---·--·······-·-

1! 1 i�
l 11 11
! ! '
------··-···--··-·-·----· ····-··-·--·--·-·····-··-----·-···--···


...
11 1111 ! 1 1 1� · ··- ·-·- · ··---·· · · · · · -·· · -· · · · - -·

i ! i '
! 1 i i ¡ l ¡ ¡ .,
11 Frequenc\I <Hz> 11 Fr•quenc\I <Hz>

FIG. 2 .7. Cuatro imágenes con líneas de calibración diferentes: C > SPG es una ventana
para espectrograma con líneas de calibración cada 1.000 Hz; G > SPG igual, pero sin
líneas de calibración, no obstante la ordenada comprende de O a 4.062 Hz; D > FFT es
una ventana de espectro con líneas de calibración verticales (para frecuencia) de 200 Hz
cada una y, por último, H > FFT posee líneas de calibración horizantales (para amplitud)
de 20 dB cada una.
ANÁLISIS ESPECTOGRÁACO 35

Ejercicios

1. Aqu í hay dos espectros (la misma vocal: espectros con armónicos
(FFT) y con la envolvente (LPC)). Expl icar las diferencias y las se­
mejanzas que se encuentren entre ellos.

¡l I :
•B>FFT 0< 8.58> 0( 0.00>
'
1 ' 1
'
¡

1 1 1
1 '
¡ 1
1 1 1 1'
1

1
1 '

1i
11
1 I Frequency <Hz>
('.
...
'1-'---'--'---'-'---'---""'""-�
Frequency <Hz>

2. A continuación proporcionamos dos espectros vocálicos; analizar sus


tres primeros formantes (centros, anchos de banda y amplitudes).

•B>LPC 0< 0.00> >LPC 0( 0.00>

4111111 Fr•quanc1:1 <Hz>


36 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

3. Los cuatro espéctros sigu ientes corresponden a las barras de explo­


sión de las tres ocl usivas sordas y de la africada: [p, t, ij, k]. Tras
medir en qué frecuencia se produce la máxima amplitud, indicar si
ése podría ser un índice para detectar su pu nto de articu lación.
Obsérvese también las direcciones ascendentes o descendentes de
los distintos picos.

•C>LPC 8< 8.88> DE>LPC 8< 8.88>


OI

111
,,

Frequenc11 CHz> Frequenc11 <Hz> 581!18

8< 8.88>

� �

..i ··-·······-·····----·--·-····-·······--·····-········--········ ···········--·-···-·····--·····-·-·······-·· ..i


� �
0 0
� �

111
,,

Frequenc11 CHz> Frequenc11 <Hz> 581!18

4. Aqu í tienen la matriz de datos de la vocal (a] . I ndiquen cuál es el


valor de sus formantes y anchos de banda. (En esta matriz cada l í­
nea posee 1 O ms; Fn = formantes; ABn = anchos de banda de cada
formante. ) El valor se puede obtener haciendo una media aritmética
de las cinco l íneas centrales, por ejemplo.
ANÁLISIS ESPECTOGRÁACO 37

F1 F2 F3 F4 F5 AB1 AB2 AB3 AB4 AB5

667 1.545 2.719 2.999 3.900 153 126 600 700 335
727 1.467 2.414 3.253 3.900 153 234 600 700 335
793 1.394 2.414 3.528 3.900 153 126 190 700 335
793 1.394 2.414 3.528 3.900 77 126 190 700 335
793 1.394 2.414 2.999 3.900 153 126 600 700 335
793 1.394 2.414 2.766 4.600 153 126 600 265 800
727 1.394 2.414 3.253 3.900 153 126 600 700 800
727 1.394 2.414 3.253 3.900 153 126 600 700 800
727 1.394 2.414 3.253 3.900 153 126 600 700 800
727 1.324 2.414 3.528 3.900 303 126 600 700 800
667 1.324 2.414 3.528 4.600 303 126 190 700 800

Estas matrices las necesitan los sintetizadores . De hecho, son los


datos con que trabajan todos ellos.

5. A continuación ofrecemos dos espectrogramas de banda estrecha


de una vocal : medi r el primer armónico para saber cuál es su tono
fundamental ; hay que comprobar si sus armónicos segu ndo y tercero
son múltiplos del primero; se debe indicar, además, cuál de ellos
puede pertenecer a una voz masculina, pues el otro pertenece a una
voz femenina.

8.88378< 8>
-- -

..�........................................................................
. "

..,
...-"
ii:-:::=::...._ . ..
7---·-····--. ---·· ................................ -

. ... l

3.488 3.797 11.894 J..2J.3


38 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEI. HABLA

6. Medir la duración de la nasal [n], de la vocal [o] siguiente y de la


fricativa [s] en el espectrograma de banda ancha de la palabra dino­
saurio.

•B>SPG

¡
" ........................................... ..

"
N
:i:
....

1 .259

d n o 's a f J o

7. Los dos espectrogramas de banda ancha siguientes, que represen­


tan una vocal, sirven para determinar las diferencias entre voz mas­
culina y femenina. Descríbanlas.
DB>SPG

"
N
:i:
....

11 •

4.363
CAPÍTULO 3

PROPIEDADES ACÚSTICAS
DE LAS VOCALES
Como hemos visto en el apartado anterior, las vocales están caracte­
rizadas por sus tres primeros formantes, aunque sólo las lenguas que
distinguen fonológicamente entre anteriores redondeadas / no redondea­
das y/o posteriores redondeadas / no redondeadas necesitan de verdad la
referencia del tercer formante. A las lenguas, como el español, cuyas
vocales anteriores son no redondeadas y las posteriores son redondeadas
sólo les basta con mencionar los dos primeros formantes. Vamos a pre­
sentar las vocales a través del español. Los valores son totalmente relati­
vos, en el sentido de que se trata de medias aritméticas obtenidas a partir
de los datos de cinco individuos varones (Martínez Celdrán, 1 995). En
realidad, no existen los valores absolutos.. Los datos de cada formante
cubren un amplio abanico de valores que se denomina campo de disper­
sión. Cualquier valor que demos es uno de los posibles dentro de ese
campo y sólo lo ofrecemos como referencia. Estos datos corresponden a
la voz masculina.

DATOS:

Datos en Hz e a o u

Fl 313 457 699 495 349

F2 2.200 1.926 1.471 1.070 877

Estas medias pueden llevarse a una carta de formantes (fig. 3 . 1 ); esto


es, a un gráfico en el que en la ordenada se coloca el Fl de forma des­
cendente y el F2 en la abscisa y ordenado de derecha a izquierda según
42 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

se mira. Además los' dos ejes de coordenadas se suelen expresar con es­
calas logarítmicas para que reflejen el modo especial de percepción de la
realidad.

200

400

600

a
800

- f -+ - - -- f------------·--- --- ·

2.500 1.500 500

FIG. 3. 1 . Carta de formantes.

Como se puede apreciar en la figura 3.2, el F2 desciende de frecuen­


cia según la lengua va retrocediendo desde el paladar duro. La vocal [i]
es la vocal más adelantada; la [u] es la más atrasada. El F2 hace que la
vocal sea más aguda cuanto más alto esté y más grave cuanto más bajo.
En el triángulo vocálico, las vocales anteriores son agudas y, las poste­
riores, graves. La vocal [a] no está definida en cuanto a la acuidad. El FI
tiene relación con la elevación de la masa de la lengua; si ésta se eleva el
Fl desciende y viceversa; esto sucede porque si se levanta se amplía la
zona faríngea; de lo contrario, se estrecha. Si el FI sube aproximándose
al F2 en el centro del espectro vocálico, la vocal será densa, si el Fl se
hace extremo, entonces la vocal será difusa. Así, el rasgo acústico agu­
do/grave está en relación estrecha con el articulatorio anterior/posterior
y, el difuso/denso, con el alto/bajo. Todo lo dicho se puede comprobar en
la figura 3.3. donde se muestra ese descenso progresivo de los segundos
formantes desde la vocal más anterior a la más posterior y la uve inverti­
da de los primeros por el descenso de las difusas y el ascenso de las den­
sas. Se ve, además, la diferencia entre voz masculina y femenina; esta
última posee, de forma sistemática, valores de formantes más altos que
los de la voz masculina.
PROPIEDADES ACÚSTICAS DE LAS VOCALES 43

2.52890 < 0)

T
-·-·······-- ---·-···------·-·--------·······-····· .. ·---····---·-···-·---··

···-·-·-.. · .. ·---········-······--·-·······-······-···············--·········-·······--··

2.529

e a o
u

FIG. 3.2. Una muestra de los formantes vocálicos de las cinco vocales españolas.

Hz

e a o u

F1(M) f-- F1(F) *-- F2(M) --- F2(F)

M= masculino; F = fe me n i no"

FJG. 3.3. Relación de los valores formánticos de la voz masculina y la femenina.


44 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

De hecho, entra voz masculina y femenina existe una correlación, de


forma que a través de fórmulas podemos calcular un formante x de un
sexo a partir del valor real del sexo opuesto (Martínez Celdrán, 1 995).
Fórmulas para la predicción de la voz femenina:

Fl : y = 1 ' 1 78x + 16

(donde "x" es el valor de F1 masculino e "y" es el valor de F1 predicho)

F2: y = l ' 278x - 1 48

(para predecir los masculinos se utiliza la misma fórmula, pero despejan­


do "x"; por ejemplo, para F2, x = y/ 1 ' 278 + 1 48).
Por otra parte, si se prefiere simplificar, se podría multiplicar siem­
pre por el coeficiente l ' 2, que es bastante aproximado a las cantidades de
las fórmulas anteriores. Por ejemplo, un F2 masculino de 2.250 Hz, apli­
cando la fórmula se transforma en 2.727 Hz; y multiplicando por el coe­
ficiente l ' 2 nos da 2.700 Hz.
Un diptongo creciente se compone de unas transiciones alargadas y
un núcleo más o menos estacionario. Uno decreciente invierte los tér­
minos : núcleo más transiciones. Una transición no es más que un alar­
gamiento de uno o más formantes vocálicos que van cambiando de
frecuencia de forma rápida. Decimos que un diptongo posee transicio­
nes alargadas porque toda conexión consonante-vocal provoca zonas de
transición entre ellas, pero esas transiciones suelen ser cortas, mientras
que en los diptongos las transiciones duran más tiempo. Cuando no
existe diptongo, sino hiato, entonces el cambio de una vocal a otra es
brusco, no existe el paso suave y deslizante que supone cualquier tran­
sición. La figura 3.4 muestra un diptongo [je) de pie y el hiato [íe) de
píe. Si medimos la frecuencia del primer pulso glotal de [j ) o [í) en su
F2, la frecuencia del primer pulso glotal del periodo estacionario y el
tiempo existente entre ambos, podremos saber si la transición es lenta o
rápida mediante la fórmula F2c-F2i/T = Tr, donde F2c es la frecuencia
de F2 en el primer pulso de la zona estacionaria, F2i en la inicial y T es
el tiempo que existe entre ambos. Tr es la transición. Por ejemplo, su­
pongamos que Fe = 1 .800 y Fi es 2.200 y el tiempo entre ambas es de
30 ms, entonces 1 .800-2.200/30 = - 1 3.3 3 Hz/ms; es decir, se trata de
una transición que va descendiendo (porque es negativa) 1 3 ' 13 Hz cada
milésima de segundo. Si obtuviéramos otros datos de frecuencia para
un hiato cuya transición durase 1 0 ms entonces 1 .800-2.1 00/ 1 0 = -30;
es decir, el descenso sería más rápido pues en cada milésima de segun-
PROPIEDADES ACÚSTICAS DE LAS VOCALES 45

do se descenderían 30 Hz. Está claro que tendríamos un diptongo en el


primer caso y un hiato en el segundo. Estos datos podrían muy bien ser
los de pie/píe.

\..___

é e

F2 de diptongo F2 de hiato

FIG. 3.4. Diptongo donde {j] es pura transición; e hiato donde [í]posee su propio
formante y la transición es brusca por rápida.

FIG. 3 .5. Espectrograma real del diptongo y del hiato: [jó]- [íoj
46 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

Ejercicios

1. Analizar los tres primeros formantes (frecuencia central, ancho de


banda y ampl itud) de las dos vocales siguientes [i-y] y comentar las
diferencias existentes entre ellas. Proporcionar una explicación de
cavidad articu latoria para esas diferencias.

JB>LPC 8< 8 . 88 > • C >LPC 8< 8 . 88 >

Fre qu.• naw < Hz > Fre que nc y < Hz >

2. Trasladar los siguientes datos a una carta de formantes:

e e 8 ;J o u

F1 300 450 550 690 520 470 270


F2 2.300 1 .960 1 .71 0 1 .380 1 . 1 28 980 800

2ot

no

)IO

):IO

llO

rn
ISO

sso

IOO

no
100

IOO
t:IO
'°º

1321 9 1 1 ' u 21 9 • 1 • • J 2 l • • 1 1 •
'

2.500 3 000 2.500 2.000 1 .500 1 .000 500 250 MI

¡ 21 roa 11U u 1
PROPIEDADES ACÚSTICAS DE LAS VOCALES 47

3. I ndicar si en los espectrogramas siguientes hay dos m uestras de una


misma vocal o dos vocales diferentes.

8)

"
N
o

2 . 98:5 4 . ?98

4. En los dos espectrogramas siguientes s e presenta un diptongo y u n


hiato, ¿se puede decir cuál e s el diptongo y comentar sus diferencias
con el hiato? Para ello hay que hacer un cálculo para averiguar si la
transición es rápida o lenta en cada caso.

B >SPG 8> •C>SPG

¡
.,

" "
N N
:e :e
" "

T i tte Csec > 1 . 42 1 2 . 7 18 T i tte Csec > 3 . 1!128


48 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

5. Ahora t e ofrecem�s dos espectrogramas con sendas vocales y hay


que dil ucidar si se trata de la misma vocal o no, tras medir su tres
primeros formantes.

6. I ndicar si el espectrog rama y espectro siguientes son de voz mascu­


lina o femen ina por los valores vocál icos: vocal [e) .

6 8 . 88888 < 8( 8 . 88>


¡

(1)
...¡
! �������
" Frequenc 11 <Hz >
PROPIEDADES ACÚSTICAS DE LAS VOCALES 49

7. Obtener los valores de F 1 y F2 de las vocales de la fig u ra 3.2 y colo­


carlos en una carta de formantes .

200

250

lOO

3�

�00
...
...

•:iO ::
"'

SDO �
...
..
5:;0

600
650
100
1�
aoo
ISO
900

•321 9 8 7 6 o 2 1 9 11 1 6 • J 2 l g 11 1 '
2.500 3.000 2.500 2.000 1 .500 1 .000 500 250 Hz

1 21 rORllAI TE 1
CAPÍTUL0 4

PROPIEDADES ACÚSTICAS
DE LAS CONSONANTES OCLUSIVAS
4.1 . Sonoridad, tensión y aspiración

La sonoridad hace referencia a la vibración de las cuerdas vocales .


El sonido cuya fuente principal sea la vibración laríngea será sonoro,
mientras que si no existe ésta será sordo. La vibración laríngea es muy
rica en armónicos. El tono fundamental depende del número de veces que
las cuerdas se abran y se cierren en un segundo; en el hombre, entre 1 00
y 200 veces; en la mujer, entre 1 50 y 300. En los espectrogramas de ban­
da ancha se manifiesta por un formante de baja frecuencia (unos 500 Hz),
que denota la vibración laríngea y que se suele denominar barra de sono­
ridad (fig. 4.1 ) .
L a tensión s e manifiesta e n los sonidos tensos por una mayor pre­
sión aérea detrás del punto de articulación y una rigidez de los múscu­
los, lo cual conlleva una mayor duración del sonido. Los laxos corres­
pondientes tienen una reducida presión, rigidez y duración.
Está claro que muchos fonetistas consideran que la duración es uno
de los índices de la tensión de los sonidos, no tanto porque la duración
en sí misma produzca tensión sino porque toda tensión conlleva forzo­
samente una mayor duración: la tensión exige un mayor esfuerzo mus­
cular y para realizarlo se necesita más tiempo. Existen sonidos largos
que no son tensos; de hecho, todos los sonidos que acaban un grupo
fónico se suelen alargar y, en cambio, precisamente por estar en la fase
final del grupo se relajan mucho. Además, cuando se encuentran dos
sonidos iguales en la cadena hablada, por ej emplo entre final de una
palabra y principio de otra, por ej . los sabores salados o con natura­
lidad, pueden alargarse sin que la tensión aumente. Incluso, si esa se­
cuencia se encuentra en el interior de una palabra, por ej . inn oble, no
54 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

a 't a º d a
FIG . 4. 1 . En el espectrograma de la palabra "la tanda ", se observa la barra de
sonoridad en la fd/y su ausencia en la [t}

tiene por qué necesitar mayor tensión que cuando sólo se da una con­
sonante sola: y noble. En este caso se trata de sonidos largos o breves,
no de tensos o laxos.
En el caso de los sonidos tensos, frente a los laxos correspondientes,
se produce una mayor duración porque en su articulación los músculos
están enérgicamente enervados. Un gesto tenso exige por sí mismo un
mayor tiempo de permanencia de los órganos en su posición que un gesto
relaj ado. Por ej emplo, Fisher-Jergensen ( 1 968: 1 08 ) caracterizaba las
oclusivas tensas de la siguiente forma: «acoustically, they are characteri­
zed by a longer closure period and a shortening of the preceding vowel
and, to sorne extent, of the folowing vowel, perhaps also by a stronger
intensity of the explosion» .
Este fenómeno se observa también en otros sonidos como los fri­
cativos (fig. 4. 2).
La aspiración se manifiesta sobre todo en los sonidos aspirados de
varias lenguas como un soplo laríngeo que sucede a l a explosión por un
gesto de abertura de la gloti s, ausente en los sonidos no aspirados;
desde un punto de vista acústico, ese soplo constituye un ruido turbu­
lento (fig. 4.3 ) .
Por las explicaciones que hemos dado podría parecer que sonori­
dad, tensión y aspirac ión son rasgos que no tienen nada en com ú n ;
pero rec ientemente se ha defendido q u e l o s tres pueden explicarse
conj untamente en las oc lusivas en relación con el momento en que
PROPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUSIVAS 55

comienza la vibrac ión l aríngea respecto de la relaj ación de l a oclusi­


va, fenómeno conocido con la sigla VOT ( VOICE ONSET TIME) (Li sker
y Abramson , 1964) (en algunos libros se ha traducido por «tiempo de
emisión de la voz» TEV ) . Tomadas tres lenguas como el español, el
inglés y el thai , cada una de ellas segmenta el continuum del VOT de
diferente manera.

111

1
- 1 1 (mseg)

español: [b) [p)


inglés: [b) (b)[p) [p"J
thai: [b] [p) [p"J

La barra vertical representa el momento de la explosión . Por tanto,


en el segmento I el comienzo de la vibración laríngea ocurre antes de la
explosión . En el segmento II el comienzo de la vibración laríngea coinci­
de o está muy próxi mo a la explosión. Por último, en el segmento III el
comienzo es bastante posterior a la explosión. (En la representación del
segmento, la línea horizontal representa la dispersión de los valores tem­
porales de comienzo de la vibración laríngea o VOT.)

B>SPG 0 . 99220<
C\I

,.,
N

'k a s
FIG. 4.2. La oposición / kas :JJI[ kaz:J] del catalán muestra claramente las diferencias de
duración no sólo de las / s/z] sino también de las vocales precedentes respectivas, mayor en
la sonora-laxa que en la sorda-tensa, como compensación de la menor duración de la
fricativa sonora frente a la mayor de la sorda.
56 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

El continuum qued� segmentado en tres partes. El español sólo utiliza


las dos primeras, pues carece de oclusivas aspiradas. El inglés utiliza los
tres, pero fonológicamente sólo distingue dos, pues en el momento inter­
medio realiza las sonoras iniciales y las sordas tras [s] inicial. El thai, por
último, utiliza las tres segmentaciones fonológicamente. Es decir, el espa­
ñol sólo tiene sonidos sordos y sonoros y, en todo caso, los sordos son
tensos y los sonoros son laxos : vino/pino (tramos 1/11). El inglés utiliza
también la aspiración: beak/peak 'pico de ave/cima' (11/III); reborn/report
'renacido/contar' (I/III); spy 'espía' (II). Como se ve el funcionamiento es
muy diferente del español, pues el inglés no enfrenta los segmentos 1/11,
como el español, sino 11/III o I/III. Además, en inglés serán tensos los so­
nidos aspirados y laxos los restantes; por tanto, desde un punto de vista
fonológico el inglés hablará sólo de sordas y sonoras. Por último, el thai
ofrece la posibilidad de oponer todas las combinaciones entre sí, por lo
que en thai habrá que hablar de dos rasgos fonológicos : sonoro y aspirado;
ej. baa/paa!laa 'hombro/bosque/partir' .
Ejemplos :

,j o
111

1 (mseg)

español: vino pino


inglés: reborn balloon/spy peep/report
thai: bBa paa p"aa

Obsérvese que el VOT de las oclusivas de la figura 4.3 es de 1 2 ms


para [t] y de 93 ms para [th].
La actividad laríngea no se limita a la comentada: sorda/sonora/
aspirada. En muchas lenguas hay también sonidos laringalizados ("crea­
ky voice"): son aquellos en los que existe una gran tensión en las cuer­
das vocales lo cual hace que se produzca una corriente de aire menor
que en la posición de sonoridad normal ya que sólo vibra la parte ante­
rior, pues la zona intercartilaginosa está fuertemente unida y las cuerdas
vocales vibran más lentamente, lo cual se traduce en el espectrograma en
una mayor separación de las estrías (pulsos glotales) que muestran la
vibración de las cuerdas vocales. En un sentido opuesto, están los mur­
murados ("breathy voice"): la zona intercartilaginosa está bastante
abierta y la corriente de aire es mayor que en los sonoros normales, lo
cual hace que en el espectrograma se vea ruido mezclado con las estrías
de la vibración (fig. 4.4).
PROPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUSIVAS 57

1 y 3 explosión
4 aspiración
2 y 5 comienzo de la vocal

FIG. 4.3. Diferencias espectrográficas entre la oclusiva sorda no aspirada y la sorda


aspirada [ta-tha}

B>SPG 4 . 74328( B> •C>SPG B>


'

f l

'I
.... ....

� �
" "
r r
"' "'

7 . 494

munnurada laringalizada

FIG. 4.4. Sonidos murmurados y laringalizados.


58 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

4.2. Consonantes nq pulmonares

Hay una distinción mayor entre consonantes pulmonares, la mayoría,


que se caracterizan por ser real izadas con el aire que sale de los pulmo­
nes y no pulmonares, que aprovechan el aire que se queda atrapado en la
boca entre dos cierres, caso de las eyectivas, o hay una entrada de aire
exterior, como sucede con inyectivas y clics. Como todas estas conso­
nantes poseen dos cierres, se caracterizan por tener dos explosiones: la
primera corresponde a la abertura de la zona más anterior: labial, den­
toalveolar, etc . ; la segunda, a la abertura de la zona g lotal, en las eyecti­
vas o inyectivas, o de la zona velar en los clics. Entre la primera explo­
sión y la segunda hay un tiempo de sí lencio que en algunas de estas con­
sonantes es muy l argo, por encima de las 1 50 ms. Además, la primera
explosión es también muy larga: alrededor de las 20 ms.

B >SPG 5 . 29588 < 8> • C >SPG 5 . 37228 < 8)

i �
� '
.,

l ª Exp.: \
"'
N
:i:
"

5 . 295

FIG. 4.5 . Consonante eyectiva alveolar y clic dental.

4.3. Las oclusivas del español

Se caracterizan acústicamente por una zona de silencio, unas 90 ms


para las sordas y unas 60 ms para las sonoras, y una barra de explosión
en el momento de la relaj ación, esto por lo que se refiere al modo de
articulación. Como las oc lusivas españolas no son aspiradas, veremos
PROPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUSIVAS 59

que el VOT no alcanza valores altos en las sordas, aunque e l contraste


entre sonoras y sordas está suficientemente representado por las dife­
rencias de VOT. Por último, el punto de articu lación v iene dado tanto
por la frecuencia donde se sitúa la máxima intensidad de la explosión,
como por las transiciones vocálicas. Resulta que los fo rmantes de las
vocales no son rectos; es decir, no se mantienen en la misma frecuen­
cia, sino que sufren vari aciones en los extremos debido a la influencia
del punto de articulación de las con sonantes que la c ircundan . Estas
variaciones se denominan transiciones.
Como siempre, los valores y los espectrogramas expuestos para el
español no son absol utos, son sólo valores de referencia.

• B >SPG
C\lt .. ·•····•······•········•··•·······


""1........... . . . . .......!itJi+I

p a t a k a

Estas flechas indican la dirección de las transiciones de los formantes segundos.

Esta otra indica la máxima intensidad de la explosión a una frecuencia determinada.

Este sím bolo indica el comienzo de la transición y el centro de la vocal según el F2.

F1G . 4.6. Espectrograma de las oclusivas sordas.

A partir de un espectrograma como éste podemos efectuar diversos


cálculos como los que siguen :

Cálculos previos: l . 1 1 5 ms - 1 1 5 mm ; por tanto 1 mm = 9.7 ms


( l . 1 1 5/ 1 1 5 )
60 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

500 Hz ..:. 5 . 5 mm; por tanto l mm = 9 1 Hz (500/5 .5)

A) Pendiente de la transición de p :

Fe Fe -Fi!T
Fi� T(iempo)
Pendiente(p) = = 1.245 - 1 .079n6 = 2.18 Hz/ms

Donde Fe = Frecuencia del centro del formante ; Fi = Frecuenci a ini­


cial o del primer pulso glotal ; y T = tiempo existente entre esos dos
puntos.
Es decir, la transición va ascendiendo (pendiente positiva) 2. 1 8 Hz
por milésima de segundo .

B)
Fi
Pendiente d e la transición d e t :

Fe -Fi!T
�Fe T
Pendiente (" = = 1 .328-1 .500173.6 = -2,34 Hz/ms

Esto es, la transición va descendiendo (pendiente negativa) 2,34 Hz


por milésima de segundo.

C) VOT (voice onset time) de k = 36 ms.

D) Explosiones: p - 620 Hz aproximadamente


t - por encima de los 2.500 Hz
k - 1 .500 Hz aproximadamente

Podemos ofrecer unos valores generales de VOT para el español pe­


ninsular, siguiendo los datos de M.ª L. Castañeda ( 1 986) (datos en milé­
simas de segundo) : 1

[p] = 6.5 [b ] = -69.8


[t ] = 1 0.4 [d ]= -77.7
[k] = 25.7 [g ] = -58

1. Para medir el VOT se considera que la barra de explosión posee O ms; cuando los pulsos glotales comienzan
antes, entonces el VOT será negativo, de lo contrario será positivo.
PROPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUSJV AS 61

Barras de sonoridad.

FtG. 4.7. Espectrograma de las oclusivas sonoras.

Situándonos en las consonantes, se observa que las transiciones de F2


y F3 son ascendentes en la bilabial, pues ambos tienen pendientes positi­
vas. Dentales y velares coinciden en el hecho de que el F2 es descendente.2
La diferencia entre ambas se nota en los valores más extremos de [k] ; tam­
bién el valor de la pendiente es mayor para la velar. La pendiente está
calculada con la fórmula siguiente: p = F2 centro F2 inicio I tiempo en -

ms; se toma el tiempo que media entre el inicio de la transición y el centro


de la vocal, como se muestra en los cálculos ejemplificados que acompa­
ñan a la figura 4.6.
En la figura 4.8 hemos resumido los índices más importantes que ca­
racterizan a las oclusivas en general y a cada una en particular: transicio­
nes, barras de explosión y VOT. Hemos añadido un concepto discutido : el
locus. Desde un punto de vista acústico no existe ningún elemento que
podamos identificar como locus. Es sólo un punto teórico a donde se diri­
gen las transiciones vocálicas. En la síntesis se determinaron tres loci:
700 Hz para las bilabiales; 1 . 800 Hz para las alveolares y 3.000 Hz para
las velares, aunque posteriormente se vio que las velares poseían dos :
3.000 para las vocales anteriores y 800 para las posteriores.

2. Aunque s e ha d e tener en cuenta el valor del F 2 y F 3 d e Ja vocal, ya q u e la transición variará e n función d e l a


altura d e estos formantes ( véase li g . 4.8).
62 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

KHz

Explosiones
�---
3

-----


2 .....
VQ�
'
a

' u •
.......
u

k
o
• ms

FIG. 4 . 8 . Dibujo esquemático de las transiciones de F2 d e [ i , a, u] y de las barras de


explosión (se señala el VOT al tener en cuenta la distancia de la explosión al formante
vocálico y también mostramos con mayor grosor en qué frecuencia se da la mayor
intensidad), según las oclusivas sordas. El punto negro indica la dirección que toman las
transiciones. Se conoce con el nombre de "/ocus ".
PROPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUS I Y AS 63

Ejercicios

1. En el espectrograma sigu iente hay tres oclusivas sordas ; de cada


u na de ellas analizar a) el VOT, b) la frecuencia a la que está la má­
xima ampl itud de la barra de explosión y e) la d u ración del silencio
existente entre la vocal anterior y la barra de �xplosión . Hágase
además d) un cálcu lo de la pendiente de la transición del F2 de la
vocal sigu iente de cada oclusiva.

a p e a a

2. Hágase lo mismo con el siguiente espectrograma y averigüese cada


una de las ocl usivas.
• B >SPG

� IP[f!!
m

....
N
:r
"'
64 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

3. Comparar sorda/sonora calculando el VOT en la palabra "gata".

4. Comparar aspi rada/no aspi rada calculando el VOT.

8 > •C>SPG 8>


Cll
ID
"'

"
N
::
lt

¡,
"'

4 . 587
PROPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUSIY AS 65

5. I ndicar si las oclusivas siguientes son aspi radas o no. ¿ Por qué?
¿ Convend ría disti nguir g rados de aspi ración?

0 > • C >SPG


"'

m'--����---"
2 . 845 4 . 886
CAPÍTULO S

PROPIEDADES ACÚSTICAS
DE LAS CONSONANTES FRICATIVAS
Y APROXIMANTES
5. 1 . Fricativas

Las consonantes fricativas se caracterizan por tener ruido turbu­


lento; es decir, inarmónicos . Obsérvese en los espectrogramas la ar­
monicidad de las vocales vecinas, que se manifiesta a través de las
estrías de los pulsos glotales perfectamente regulares, frente a la amal­
gama aleatoria que es la inarmonicidad del ruido. Esto es lo que las
caracteriza frente a los demás sonidos. Entre sí, además de las transi­
ciones son evidentes dos diferencias: la frecuencia donde se da la má­
xima intensidad (mayor negror) y esa misma intensidad, como se ve en
el siguiente cuadro.

• B >SPG fl . 87755 < fl >

a a
e s a X a

FIG. 5 . l . Espectrograma de las fricativas.


70 ANÁLISIS ESPECTROGRÁFICO DE LOS SON IDOS DEL HABLA

FrecueflC'Ía Frecuencia máxima Intensidad Intensidad


comien:.o intensidad de pico global
H� H� dB dB
---·�-- --· -

[ f] 2.000 5 .000 4 7

[8) 3.000 5 .500 13 9

[ s] [Link] 3 .680 26 24

[x) 1 .000 3.700 20 14

(La frecuencia de comienzo es sólo aproximada; obsérvese en los espec­


trogramas. Intensidad de pico quiere dec ir la intensidad que tiene el pico
más alto del espectro. En el espectrograma, las intensidades sólo se pue­
den apreciar por el mayor o menor negror. )
Una diferencia que queremos destacar es la existente entre la [§] api­
cal típica de las zonas castellanas y la predorsal que predomina en anda­
luz, canario, latinoamericano, etc. Obsérvese que la apical posee gran
intensidad de ruido a partir de los 3 .000 Hz, mientras que Ja predorsal
posee una intensidad menor y comienza a partir de Jos 4.000 Hz.

's apical' 's predorsal'

FIG. 5 . 2 . Espectrogramas de las dos variedades principales de "s " pronunciadas e n la


palabra "casa ".
l'IWPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUSIVAS 71

5 . 2. Aproximantes

Carecen de ruido. Tienen las estrías típicas de los sonidos armóni­


cos. Se caracteri zan por un descenso considerable de la intensidad res­
pecto de las vocales vecinas, aprec iable por el menor negror de sus zonas
formánticas. Los formantes son meras transiciones entre los formantes
vocál icos; su frecuencia determina su di stinto punto de articulación, so­
bre todo a través de las transiciones del F2 y de la frecuencia de ese
mi smo F2 .

F1G. 5 . 3 . Espectrograma de las aproximantes.

Intensidad lntensidtul D(ferencia Frecuencia


vocal c<[Link] dt' F2
precedente aproximante intemillad aproximante
-- - · - · · - · · · · · - -·-- . ·-· ·-------· - -

llH 32 14 18 900

l{IJ: 27 10 17 1 .280

ljj: 25 16 9 2.080

[y[: 34 13 21 . 1 .640

Obsérvese la figura 5 .4; en la parte alta de la fricativa inglesa [6] hay


ruido, es decir, una masa amorfa que no presenta estrías ni forma regular
alguna. Compárese con el sonido español [{!) y se verá que este último no
posee nada de ruido y todo en él son estrías : ésta es la di ferencia esencial
entre fricativas y aproxi mantes (Martínez Celdrán, 1 99 1 ).
72 ANÁLISIS ESPECTROGRÁHCO DE LOS SON IDOS DEL HABLA

Ruido Ausencia de ruido


_ ., Sólo pulsos glotales
7 • --'- i-4---- - - - - ---- - --

! ! !

Fricativa Aproxlmante

Fig. 5 .4. Comparación entre la fricativa inglesa y l a aproximante española.

Hay también una aprox i mante pal atal que no sólo se ha de diferen­
ciar de la fricati va correspondiente, sino que además es diferente tam­
bién de los elementos pre y posnucleares palatales de los diptongo s ;
por ej . [j] d e mayo y la [j] d e piojo.
En los espectrogramas de la figura 5 .5 se observa que Ja aproxi mante
es una transición muy débi l entre dos vocales, mientras que el elemento
prenuclear del diptongo no es nada débil, es en realidad un elemento vo­
cálico muy breve y una gran transición.

• B >SPG 0> C >SPG 0)

i
Cll

..


"'

'm a o
'p j e

FIG. 5 . 5 . Aproximante v.1· sem icon so11ante de diptongo.


PROPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUSIVAS

Ejercicios

1. Analizar las d ife rencias existentes entre estas dos fricativas: sor­
da/sonora: 'kas;:)/' kaz;}.

8 . 40828 < 8> • C >SPG 8 . 4 1 158< 8>


lll
N
""
(D

"
N
:e
...,

tr
GI
f.
"'

l!I . 41!18 Ti- <sec > 1 . 1!1 18 1!1 . 4 12 1 . 1!11!14

2. (s] / U J : anal izar sus diferencias: 'kas;)/' kaJ;}.

>SPG 8 . 48828< 8) 2 . 44935 ( 8)


ltl
N ¡
(D

"
N
:e
..., r "
N
:e
...,

tr
u
s.
"'

l!I . 41!18 Ti- Csec > 1 . 1!1 18 2 . 449 T i l-1e <sec > 3 . 196
74 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

3. En el oscilograma y en el espectrograma siguientes hay una aproxi­


mante y una fricativa; analizar sus diferencias. Comparar también la
aproximante con la fricativa sonora.

DA>ch1 : -Captured* - SCALE 1 . 20 165 < -44>


X
(IJ
(')

"CI
� ·
..
·�
..

ll.
t
a: x
(IJ s o [
(')
1 1--��� 1
. 202 T i 11e <sec > 1 . 79

• B >SPG 0) DC >SPG 0 . 4 1 150< 0)


lll lll
(IJ (IJ
..¡ ..¡
Q) Q)

,.., ,..,

N N
:e :e
..., ...,

1 . 202 T i 11e <sec > i . 794 0 . 4 12 T i 11e <s ec > 1 . 004

4. He aquí cuatro espectros de las cuatro fricativas sordas del castella­


no. Indicar qué determina su punto de articulación; obsérvese a qué
frecuencia se da el primer pico, a qué frecuencia se da el pico más
alto y también cuáles son sus amplitudes. (En [x] se ha marcado el
primer pico porque es el más característico, aunque en este caso no
sea el más alto.) La dirección de la intensidad también puede ser un
índice relevante.
PROPIEDADES ACÚSTICAS DE LAS CONSONANTES OCLUSIVAS 75

DC >LPC -7999< 0 . 00 > E >LPC 0< 0 . 00 >


!'- 'ot
f
8
:::;
...
!:'.?
..
...

"'
1
8 Fre que ncy < Hz > Freque nc y CHz > -
DD>LPC 0< 0( 0 . 00 >
(')
s X

.l
...
!:'.?
..
...

co
1
8 Fre que ncy < Hz > 8888 8 Frequency < Hz > 8888

Dirección de los picos de intensidad

Picos de mayor amplitud

5. I ndicar si el plural d e l artícu lo de "los pasos" s e ha realizado con (z]


o [fi l . ¿ Por qué? ¿ La ú ltima [o] es abierta o cerrada?

•B>SPG 1.63610< 0)
N

el
"'

"
H
::i:
"

1 . 636 T i ,.e (sec ) 2 . 894


CAPÍTUL0 6

AFRICADAS
<seo >

a:

FIG. 6 . 1 . Espectrograma de la africada sorda.

En la africada sorda exi ste un ruido tan largo o más que la zona de
silencio correspondiente a la oclusión. En la sonora, además de las estrías
de baj a frecuencia debidas a la vibración de las cuerdas vocales, el silen­
cio y el ruido (o las estrías de la aproximante) se reducen considerable­
mente.
80 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

FIG. 6.2. Espectrograma de la africada sonora.


AFRICADAS 81

Ejercicios

1. Med i r la du ración de la ocl usión y de la fricación de la africada por


separado. Compararlas con las de la fricativa y la oclusiva de las
otras palabras . Palabras grabadas: cacho-caso-cato.

2. Describir las d iferencias existentes entre la africada sonora [d3] del


catalán en metge y la [dj] del castellano en el yeso.
82 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

3. Comparar las real izaciones africadas anteriores con las ocl usivas
palatales.

8 > • C >SPG 8)
N
�.,.
CAPÍTUL0 7

NASALES
Como se ve, se caracterizan por tener formantes con una energía o
intensidad bastante más reducida que las vocales que las rodean . Su dife­
rencia principal con las aproximantes es el paso abrupto de la vocal a la
consonante y viceversa en las nasales; eso hace que se vean como blo­
ques. Las aproximantes son transiciones suaves entre las vocales . Obsér­
vese cómo las transiciones nasales determinan su punto de articulación,
además del segundo formante.

Intensidad vocal Intensidad conso- Diferencia


precedente nante nasal de intensidad

[ m] : 27 21 6
[n ] 30 18 12
[J1 ] : 23 16 7

He aquí algunos cálculos realizados sobre este espectrograma:

A) Pendientes de las transiciones (Hz/ms):


-m : 1 .285 - 1 .000/44 .45 = 6.4 1
-n : 1 .356 - 1 .295/63.5 = 1 . 1 2
-p: 1 .607 - 2 .000/95 .25 = -4. 1 3

B) Fl = 250 para las tres nasales

C) F2 (m) = 1 .000 Hz
F2 (n) = 1 .400 Hz
F2 (JI) = l . 900 Hz
86 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

0>

a m a 'p a n a

F1G. 7 . 1 . Espectrograma de las nasales.

Las nasales se caracterizan también por poseer ceros en el espectro o


antirresonancias. Se trata de picos negativos en el espectro nasal como
Jos que mostramos en la figura 7 . 2 :

DB>FFT
·
8< 19 . 38 > DC>FF
............ .... ........... ..................
·····
T 8< 28 . 85 }
· ·· ·
1E1
L'- ·· · 1E1
L'-

· ·
· ··
· ··
1 mr (a ]
7����������������....... 7..._��������������� ....... 1
9 Freque ncy¡ < Hz > 4999 9 Freque ncy < Hz ) 4999

FIG. 7 . 2 . Espectros de una nasal que muestra picos negativos, que son los ceros o
antirresonancias. Obsérvese cómo en el espectro vocálico no hay ningún pico por debajo
de la línea de puntos que es la línea cero dB.
NASALES 87

Ejercicios

1. Diferenciar entre nasal y aproximante: maño/mayo.

0> DC >SPG 0>


N
ID
IS)
.,

"
N N
::i:: ::i::
.... ....

1 . 44 1

2. Medir pendientes de las nasales; ¿de qué nasales se trata?

m B>SPG 1 . 88468( 8>


(11
ID
........ ......... . . . . . . . . . . . . . . . . . . . . . . . ......... . . .. . . . . . . . . .. . . . . . . . . . . . . . . .. . . . . ........ . . ...... .. . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . ..

SI
.,

"
N
:i:
V
88 ANÁLISIS ESPECTROGRÁFJCO DE LOS SONIDOS DEL HABLA

3. Dos espectros de la vocal precedente y de la nasa l . Med i r amplitu­


des de F 1 , F2 y F3. Comparar las diferencias.

f ----- ---
0< 0 . 00 > • C >LPC 0< 0 . 00 >

m
O dB

111 111
is is

/
ID °'
...
... . .. . .. ,_.,,.......•. -. . ' '--����"'-"'� !
1 .__�����-"-.,¿_� 1
.... -................ ·········- .

l'I Freque nc\I <Hz> 481'11'1 l'I Freque ncy <Hz> 41'11'11'1

4. Curva de intensidad global de la palabra "cama" para comparar las


ampl itudes de las vocales y de la nasal .

0 . 57 180 < 30 . 62 >

... ... ..
...¡
................ _,.,,,_, ············ ,..

�-············-····· .. - -.. · · ...


- ---········--·····-·-········--·····---··· �

\_
\
. . . ... .. . . . . . . .. . - . . -- · - · - · · · · · · .. . . .. . . . . . . . _ , _ . .
NASALES 89

5. He aq u í dos espectros (FFT) de nasales [m-n]. Medir a qué frecuen­


cias se dan los dos picos primeros que bajan por debajo del cero d B .

B>FFT 0< 4 . 13 > • C >F F T 0 < -3 . 25 >


� ...... .............. .. ........ ............... . .... .... ..... ......................... ..... ...................................... � ······· ...........................

(')
1 .._������--' I
Frequenciy <Hz> 41!11!11!1 l!I Frequency <Hz ) 41!11!18
CAPÍTULO 8

LÍQUIDAS
8. 1 . Laterales

Se parecen a las nasales, pues poseen formantes como ellas y el paso


entre consonante y vocal es también abrupto. Se diferencian principal­
mente por la intensidad de los formantes altos, bastante mayor en las
l aterales que en las nasales, por regla general .

Promedio de intensidad (dB)


F2 F3 F4
vocales 24 17 21
[Link] 9 6 7
laterales 20 18 16

FIG. 8 . 1 . Espectrograma de las laterales.


94 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

8.2. Vibrantes

Se caracterizan por las breves interrupciones de la energía que for­


man pequeñas ocl usivas que llevan hasta barra de explosión . Caracterís­
ticamente, la vibrante simple sólo posee una interrupción, mientras que l a
múltiple tiene d o s o más . E n los espectrogramas q u e presentamos las
ocl usiones duran 25 ms aproximadamente. Existe una variante ocasional
de la vibrante que es aproximante ; por tanto, en vez de oclusión o silen­
cio en el espectrograma, se observan las estrías características de l as
aproximantes.

' p e r a 'p e r a

FIG. 8 . 2 . Espectrograma de las vibrantes: simple y múltiple.

F1G. 8 . 3 . Espectrograma d e l a aproximante.


LÍQUIDAS 95

Ejercicios

1. Comparar entre vocal, nasal, vibrante simple y lateral : ñora-callar.

0 > • C >SPG 0>

�.,

2. Medir pendiente d e 1/Á.

jtr · - ·
• B >SPG 3 . 4748 0 < 0> OC >SPG 1 . 94580 ( 0>

i i
, .... . . . . . .. . . ...... ..... . . . , ... .

,..


...................................... _

3 . 475 1 . 946

'l o a k a 'f. a r
96 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

3. Describir diferenci B;S entre la ;:. y su sustituta en el yeísmo.

8 . 55528 ( 8 } • C >SPG 1 . 4&738 < 8}


N

..


N
e


,! ! t
ti' �
" "
f. f.
Jo. Jo.

4. Medir duración de la fase oclusiva y la vocálica en la r de la palabra


"carta" .

• B >SPG
N
ID
SI
"

5 . 1!141!1 T i ,.. e Csec >


LIQUIDAS 97

5. Medir la duración del elemento esvarabático en la palabra ''tres" . ¿ La


l íquida es de tipo vibrante o aproximante?

DB >SPG 2 . 5 1050 { 0>


(11 ...... ............ ...............
ID '
15)
'O'

,..
N
:e
"

2 . S J. J. T i Me (sec > 3 . J.72


Ejercicios globales
sobre palabras y frases

1. Sobre oclusivas

a) "La inquietud turba la casa"


1 00 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

b) "No pescaré este pez "'

• B >SPG 1 . 81810< 0)
N

.,

e) "Temblaron los hombres"

• B >SPG 1 . 87200 <


N
'l
. l·�

., .. .

. . . . . .Ji

11�---
J. . 872 3 . 246

¡ Atención ! La vibrante simple de "temblaron" se ha pronuncia­


do aproxi mante, de forma que no se di stingue bien su articulac i ón
en el espectrograma.
EJERCICIOS GLOBALES SOBRE PALABRAS Y FRASES LO!

2. Sobre fricativas

a) "La fosa"

b) "La fij eza"


J 02 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

e) "Jugaba con sus [Link]"

3. Sobre aproximantes

a) "Salgo al balcón"

, ..
.
) 1·.
r·· · · · · - ··· · · ·-·-· ;
8 . 84918<

. .'· : · · -· · · ·-·· ·- ··-··


.,.. .
B>

:·::: ::::::::::· -. _·• 11·1;==:==


.. ¡ M• ... •••••••H••OoOoo•oooooooOOoooo

1!1 . 849
EJERCICIOS GLOBALES SOBRE PALABRAS Y FRASES 1 03

b) "Meditaba absorto"

4. Sobre nasales y líquidas

a) "Le invitaron a correr"

"

g ···--···-·--···········

5 . 382
1 04 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

h) "La atleta llegó lejos"

5. Sobre vocales y diptongos

a) "He visto mil cisnes"

11'

'

11.____
J. . 495
EJERCICIOS GLOBALES SOBRE PALABRAS Y FRASES 1 05

b) "Hoy aprobáis la ley"

•B>SPG 0)
(11 ................. .
:e
<I'
CAPÍTULO 9

PROSODIA
9. l . Análisis del acento

No parece que el acento tenga un único parámetro acústico al que


poder referirse, aunque son tres los que intervienen en la sílaba tónica
con diferente grado de i mportancia. Hay autores que destacan la eleva­
ción del FO, otros la duración, aunque es posible que sea una combina­
ción de ambos la que proporciona la prominencia de la sílaba acentuada
frente a sus vecinas i nacentuadas . La amplitud no parece que j uegue un
papel demasiado relevante en esta prominencia.
Las lenguas que uti l izan el acento fonológicamente suelen distinguir
entre tres clases de esquemas acentuales: esdrúj ulo, l lano (o grave) y
agudo, según que la sílaba prominente sea la antepenúltima, penúltima o
última sílaba de la palabra. Las sílabas inacentuadas se caracterizan por
simple oposición con las acentuadas ; es decir, tienen los mi smos pará­
metros pero sus valores son menores que en las acentuadas correspon­
dientes. Se forma, pues, una gradación de mayor a menor: l , 2, 3. Por
ejemplo, una esdrújula suele tener el siguiente esquema: 1 -3-2, por regla
general : o sea, la sílaba más prominente es la antepenúltima y, por ello,
lleva el número l . La posición postónica es bastante débil ; por tanto, le
asignamos el valor 3. En la evolución de la lengua es una posición que
suele cambiar e incluso se pierde la vocal : rapidu > rabidu > rabdo > raudo
( 'p> 2 b; 2 ¡> 1 0,. 1b > 4 u).
El esquema grave suele tener la siguiente caracterización: 3 - 1 -2/3 .
En este caso, la prominencia se sitúa en la penúltima sílaba. Las posicio­
nes pre y postónicas suelen ser débiles.
Por último, el esquema agudo se presenta de la siguiente fo rma: 2-3-
1 . Lo cual demuestra que la posición más próxima al acento principal
suele ser siempre la más débil. Véase en la figura 9 . 1 la actuación de los
1 1Ü ANÁLISIS ESPECTROGRÁHCO DE LOS SONIDOS DEL HABLA

tres parámetros que configuran Jos tres esquemas . Se ha pronunciado una


secuencia sin sentido y coh oclusi vas para tener perfectamente delimitada
la vocal , que es la portadora del acento : tátata-tatáta-tatatá.
Valores encontrados :

tá ta ta ta tá ta ta ta tá
75 73 72 69 74 74 70 71 75 dB
1 59 1 49 1 56 1 12 1 56 1 54 1 16 111 1 56 Hz
90 61 68 63 78 58 66 61 85 ms

Como se ve, coinciden los valores máximos en la sílaba tónica. No


obstante, las diferencias son mínimas tanto en las amplitudes (energy),
como en el FO (pitch); sólo el esquema agudo mantiene bastante diferencia
entre las dos átonas y su tónica correspondiente. La duración es la que
mejor pone de manifiesto los esquemas expuestos con [Link].

8 . 88888 < 8)

t á t a t a l lt a t á t a l lt a t a t á
FIG. 9. 1 . Amplitudes, FO y espectrograma de la secuencia tatata con acento esdrújulo,
llano y agudo respectivamente .
PROSODIA 111

Por último, hay que decir que las palabras átonas se integran en los
esquemas acentuales de las tónicas ; por ej . Cómelo = 1 -3-2; la mesa = 3-
1 -3 ; por amor = 2-3- 1 ; etc .

9.2. La melodía

La melodía es la contrapartida fonética de la entonación, concepto


que debe relegarse únicamente a la fonología, para no confundir los he­
chos . La melodía consi ste acústicamente en la curva que describe el pri­
mer armónico o tono fundamental (FO) en el grupo .
Un grupo melódico es el conjunto de tonos que se suceden entre dos
pausas. Suele coincidir con una unidad sintáctica: oración, proposición, vo­
cativo, etc. Para el estudio de los contornos melódicos se suele tomar como
unidad un grupo fónico.
Existen diversos métodos para la eliminación de la variabilidad individual
y toda aquella que no sea relevante. El procedimiento se conoce con el nom­
bre de estilización o normalización de las curvas (véase Garrido, 1 99 1 :20).
Por ejemplo, una forma de normalizar dos curvas de la misma frase pronun­
ciadas por un hablante masculino y otro femenino podría ser la siguiente (cfr.
Cantero, 1 995 :4 1 1 ) : se toma nota del FO de las vocales solamente. U na vez
analizadas, tomamos el primer valor como referencia; es decir, ese primer
valor será el valor cero de un porcentaje; el 1 00 % será la octava de ese valor
(se obtiene multiplicando por dos). Los cálculos posteriores se harán realizan­
do una sencilla regla de tres. Obsérvese lo siguiente: si tenemos dos tonos
pronunciados por un hombre cuyos valores son 1 00 y 1 50 Hz respectivamente
diremos que el segundo es superior al primero en un 50 %, pues 1 50- 1 00 ( 1 00
representa aquí el valor de la octava) = 50; 50* 1 00 ( 1 00 es aquí el valor por­
centual) = 5 .000 y 5 .0001 1 00 ( 1 00 representa aquí de nuevo la octava) = 50; si
esos dos tonos son de una mujer, de modo que el primero mida 200 y el se­
gundo 250, ahora la elevación no es del 50 % sino del 25 %, a pesar de que
físicamente exista la misma diferencia en hercios ; pues 250-200 = 50;
50* 100 = 5 .000 y 5 .000/200 = 25 . Intuitivamente se ve claro si comparamos
las octavas:
A) Ej . de un hombre:
Hz 1 00 1 25 1 50 1 75 200: 1 50 es la mitad de la octava
% o 25 50 75 1 00
B) Ej . de una mujer:
Hz 200 250 300 350 400: 250 es la cuarta parte de la octava
% o 25 50 75 1 00
1 12 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

Es decir, para que la elevación de la voz femenina fuera equivalente a la


masculina tendría que haber subido su fundamental hasta 300 Hz. Esto está
en perfecta consonancia con el modo logarítmico con que los humanos perci­
bimos las frecuencias.
Muchos autores tradicionales, como T. Navarro Tomás ( 1 944), uti­
l izaron los semitonos musicales para medir las diferencias melódicas
dentro de una octava lo cual se asemej a al si stema musical , pero el sis­
tema de porcentajes establece una medición sin relación con la música y
fáci l de manej ar por todos los que no poseen conocimientos musicales .
É sa es su principal ventaja.

•C>P ITCH 8 . 579118 < 11>

"
N
:e

í
V

r


"'

11 . 579 Tine (sec > 1 . 939


' kj e r e z e e 'n i r a 1 '8 i n e:

FIG. 9.2. Curva melódica de la frase.

Estil ización de la curva:

1
kjé- rez Be nír al (}( ne
Hz 1 12 1 28 1 64 1 09 96 80 20 1
% o 14 46 -2.6 -14 -28 . 5 79.46

La estilización 1 nos permite caracterizar en porcentajes algunos he­


chos, como los siguientes : desde el inicio hasta el primer pico (llamamos

l. Exponemos a continuación un par de ejemplos del cálculo de la est i l i zación : 1 28- 1 1 2 = 1 6; 1 6* 1 00 = 1 .600;
1 .600/ 1 1 2 = 1 4 : otro: 1 64- 1 1 2 = 52: 52* 1 00 = 5 . 200: 5.2001 1 1 2 = 46; etc.
PROSODIA 1 13

primer pico al punto más alto a partir del inicio) hay una subida del
46 %; desde el primer pico hasta el punto más bajo de la última sílaba
acentuada la curva ha ido descendiendo un 74.5 % y, por último, la subi­
da final ha sido de un 1 07 .96 % .
La estilización posee otra ventaja: estandariza las diferencias in­
dividuales y, por tanto, las anula. Si una mujer hubiera pronunciado la
misma frase, pero con valores de FO que fuesen una octava más altos; es
dec ir, que fuesen el doble de los pronunciados por la voz masculina ten­
dríamos lo siguiente.

kjé- rez nír al {}( ne

Hz 224 256 328 218 1 92 1 60 402


% o 14 46 -2 .6 -14 -28.5 79 .46

Es decir, los porcentajes serían exactamente los mismos a pesar de la


evidente diferencia física entre la voz masculina y la femenina. El esquema,
pues, se repite, lo cual permite decir que se trata de la misma curva melódica.
Una vez obtenida la melodía por la esti lización de las curvas trazadas
por la sucesión de tonos (fundamentales), podemos observar que, por regla
general, existen tres partes.

A) rama inicial: compuesta por todos los tonos que ascienden hasta el
primer pico. Frecuentemente este primer pico coincide con la pri ­
mera vocal tónica, pero en otras ocasiones no tiene por qué ser así.
En la frase de la figura 9.2, el primer pico se ha situado en la pri­
mera sílaba de la segunda palabra que, además, es átona.

B) cuerpo: comprende desde e l pri mer pico hasta la última vocal tóni­
ca de la frase. Se ha comprobado que en muchas lenguas hay un
descenso progresivo a lo largo del cuerpo del contorno melódico.
Ese descenso dibuj a una pendiente que se ha denominado declina­
ción ; la pendiente será mayor si el primer pico es más alto ; de lo
contrario será menor. En la frase de la figura 9.2, la declinación es
de -0, 1 45 Hz/ms. Es decir, desciende (por eso es negativa) O, 1 45
Hz por milésima de segundo. Se ha obtenido de la siguiente forma:

declinación = 80- 1 64/5 80; es decir, valor más bajo-valor primer pi­
co, partido por el tiempo existente entre esos dos puntos, expresado
en milésimas de segundo.
J 14 ANÁLISIS ESPECTROGRÁFICO D E LOS SONIDOS DEL HABLA

C) rama final: consiste en los tonos que suceden a la última vocal tónica.
Desde el punto de vista fonológico, ésta es la rama más relevante para la
entonación. En la frase mencionada, la subida tiene una pendiente de
0.56 Hzlms.

Obsérvense las tres partes comentadas, en configuraciones diferentes


según la entonación enunciativa, interrogativa y exclamativa:

DB>PITCH 0 .M< 0>


���
M
I
li

8 . 888 fü1e (sec > 3 . 236

FIG. 9.3. Tres curvas melódicas correspondientes a las frases: Ha venido María; ¿ Ha
venido María ? y ¡Ha venido María!

Datos en porcentaj e :

ha ve ni du Ma rí a

enunciativa o 8 9.6 2 1 .6 - 1 6.8 -25 .6 -39 . 2


interrogativa o 64 36.6 -1 5.8 -28 . 3 -30.8 77.5
exclamativa o -4 1 .6 1 1 .2 -48 . 5 -44. 1 1 9.6 -6 1 . 7

Las diferencias en cada rama son llamativas :

rama inicial cuerpo rama final


enunciativa 2 1 .6 (-do) 47 .2 dese. 1 3 .6
interrogativa 64 ( ve- ) 94. 8 ase. 1 08 . 3
exclamativa 1 1 .2 (-ni-) 55.3 dese . 8 1 . 3
PROSODIA 1 15

B astarían estos datos para describir las diferencias existentes en las


configuraciones de cada frase. No obstante aún es posible enumerar al­
gunas otras ; por ej . , la frase exclamativa tiene un primer pico negativo.

9.3. Lenguas tonales

Hay lenguas que en vez de utilizar el acento utilizan el tono funda­


mental para contrastar palabras. En este caso, es exclusivamente el FO el
parámetro que determina qué palabra es. Las lenguas utilizan básica­
mente uno de estos dos patrones: palabras monosilábicas que alargan
bastante la vocal, de modo que tienen dos partes, o palabras que son poli­
silábicas y contrastan tonos altos o bajos entre las diferentes sílabas de la
palabra. Pondremos dos ejemplos, uno por cada patrón descrito .
El chino estándar posee palabras monosilábicas fundamental­
mente y se dice que tiene cuatro tonos : alto, bajo ascendente, bajo des­
cendente-ascendente y alto descendente . Si calificamos los tonos de 1 a
5 , desde el inferior al superior, tendremos los siguientes esquemas para
una misma secuencia de fonemas (UCLA, 1 99 1 ) :
ma 55 "asunto" transcripción l
ma 35 "cáñamo" = A
ma 214 "caballo" =

ma 51 "virago" =

• B>P I TCH 8 . 88888( 8)


11 ·······--······················-·····-·-·····---·-·····-············--········-··············- ····-·-·····--·-·····----·····-·-········--···---······--·····--·-···--······· ·---········----···-··-········-·-·-·---·····-·

....... . 7.:.:.':-_. -� . . . . . . . . . . ...


. - ...... _ .. .. .. . . . - - ....... ... . ... A .·-- · . .-. . . -. . . . . . . . . . . . . . . . . . . .:. . . . . . . . . .L . . .
. .. · - ·--·· · ··-· ·-······

8 . IM'H!I y ¡ .,.. Csec ) 4 . 126

5 5 3 5 2 4 5
F10. 9.4. Tonos del chino estándar.
) J6 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

En la figura 9.4 hemos presentado una voz femenina que pronuncia


las cuatro palabras ' anteriores. Un análisis del FO nos indica que 5-5
equivale a 250-270 Hz; 3-5 a 205 -250 Hz; 2- 1 -4- a 1 85 - 1 48-205 ; y 5- 1 a
270- 1 40. Para este informante, pues, el 5 está alrededor de 250 o más ; 3
y 4, alrededor de 200; 2 alrededor de 1 75 y 1 , por debaj o de 1 50.
La segunda posibilidad la vamos a ejemplificar con el ibidio (lengua
nigeriana) :

Tono alto seguido de Tono bajo seguido de

alto ákpá "extensión del océano" (1) akpá "primero" (2 )


descendente ákpa "cesto cuadrado" (3 ) akpo "árbol del caucho" (4 )
bajo áku "sacerdote" (5) akpa "neaueño" (6)

•C>P I TCH 1 . 27218< 8)


11
111
N

"
N
:i:
"

J
2 3 4 5
11
�'--����- ¡
1 . 272 T i rie < s e c > 6 . 15 1

FIG. 9.5. Estructura tonal de las seis palabras del ibidio.


PROSODIA 1 17

Ejercicios

1. Med i r los parámetros que determ inan la s ílaba tónica en el trío: tér­
mino, termino, terminó.

8 . 884!1 T i ne <sec > 1 . 978


o 8 . 88888 ( 8>

t é m i n ollt e r m i n ollt e r m i n ó

2. Estandarícense y d íganse en porcentaje las diferencias entre las


cu rvas enunciativa, interrogativa y exclamativa de la frase "Mi mamá
me mima".
3. Averígüese la pendiente de la enunciativa y de la interrogativa.
4. Determ ínense las tres ramas en cada curva y las diferencias que
existen entre las tres modal idades basándose en las d iferencias de
las tres ramas.
1 18 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

11 • 8811 T i t1e: <sec> 3 . 129

iJ�
B >P I TCH 0 . 00000 < 0>
BIBLIOGRAFÍA

Lecturas recomendadas

BORDEN , G. J . ; HARRIS, K. s. y RAPHAEL, L. J. ( 1 980) (en referencias).


BORZONE DE MANRIQUE, A . M . ( 1 980): Manual de fonética acústica, B uenos Aires, Ha­
chette.
FRY, D. B. ( 1 979): The Physics of Speech, Cambridge, CUP.
KENT, R. D. y READ, C H . ( 1 992): The Acoustic Analysis of Speech, San Diego, S ingular
Publishing Group.
*LADEFOGED, P. ( 1 962) (en referencias).
*MARTINEZ CELDRÁN, E. ( 1 996): El sonido en la comunicación humana, B arcelona,
Octaedro.

( Los señalados con un asterisco representan lecturas más básicas. )

Referencias

BORDEN , G. J . ; HARRIS, K. s. y RAPHAEL, L. J. ( 1 980): Speech Science Primer, Balti­


more, Williams & Wilkins, 3 .ª ed., 1 994.
CANTERO, F. J. ( 1 995 ) : Estructura de los modelos entonativos: interpretación fonológica
del acento y la entonación en castellano, tesi s doctoral, Universidad de B arcelona.
CASTAÑEDA, M .ª L. ( 1 986): "El VOT de las oclusi vas sordas y sonoras españolas", Estu­
dios de Fonética Experimental, 11, B arcelona, PPU, pp. 9 1 - 1 1 0.
FtSHER-J0RGENSEN, E. ( 1 968): "Voicing, Tenseness, and Aspiration in Stop Consonants, with
Special Reference to French and Danish", Annual Report of the lnstitute of Phonetics of
the University ofCopenhagen, 3, pp. 1 36- 1 64.
GARRIDO, J. M. ( 1 99 1 ): Modelización de patrones melódicos del español para la síntesis
y el reconocimiento de habla, Bellaterra, Universitat Autonoma de B arcelona.
LADEFOGED, P. ( 1 962): Elements of Acoustics Phonetics, Chicago, The University of
Chicago Press ( 1 996, 2.ª ed. ) .
1 20 BIBLIOGRAFÍA

LISKER, L. y ABRAMSON, A. s. ( 1 964): "A Cross-Language Study of Voicing in Initial


Stops : Acoustical Measurements", Word, 20, pp. 3 84-422.
MARTfNEZ CELDRÁN, E. ( 1 99 1 ) : "Sobre la naturaleza fonética de los alófonos de /b,d,g/
en español y sus disti ntas denominaciones", Verba, 1 8, pp. 235-25 3 .
MARTfNEZ CELDRÁN, E. ( 1 995): " E n torno a l a s vocales del español: análisis y reconoci­
miento'', Estudios de Fonética experimenta/ VII, Barcelona, PPU, pp. 1 95 -2 1 8 .
NAVARRO TOMÁS, T. ( 1 944) : Manual de entonación española, Madrid, Guadarrama,
1 974.
PICKETT, J . M . ( 1 980): The sounds of speech communication, Baltimore, University Park
Pres s.
SPEAKS, CH. E. ( 1 992): Introduction to Sound, San Diego, S ingular Publishing Group.
UCLA, LINGUISTICS DPT. ( 1 99 1 ) : Sounds of the World 's Languages, HyperCard stacks,
Los Á ngeles, UCLA.
ÍNDICE
Prólogo 7

CAPÍTULO 1 . Ondas simples y complejas 9


1 . 1 . Fenómenos periódicos 11
1 . 2. Las ondas sonoras 14
1 . 3 . La resonancia 19
Ejercicios . . . . . . . . 21

CAPÍTULO 2. Análisis espectrográfico 25


2. 1 . Oscilogramas . 27
2.2. Espectros . . . 27
2 . 3 . Espectrogramas 30
2.4. Medidas 32
Ejercicios . . . . . . 35

CAPÍTULO 3 . Propiedades acústicas de las vocales 39


Ejercicios . . . . . . . . . . . . . . . . . . . . . 46

CAPÍTULO 4. Propiedades acústicas de las consonantes oclusivas 51


4. 1 . S onoridad, tensión y aspiración 53
4.2. Consonantes no pulmonares 58
4 . 3 . Las oc lusi vas del español 58
Ej ercicios . . . . . . . . . . . . . 63

CAPÍTULO 5 . Propiedades acústicas de las consonantes fricativas y


aproximantes 67
5. 1 . Fricati vas . . 69
5 .2. Aproxi mantes 71
Ejercicios . . . . . 73
1 24 ANÁLISIS ESPECTROGRÁFICO DE LOS SONIDOS DEL HABLA

CAPÍTULO 6 . Africadas 77
Ejercicios 81

CAPÍTULO 7. Nasales 83
Ejercicios . . . . 87

CAPÍTULO 8 . Líquidas 91
8. 1 . Laterales 93
8.2. Vibrantes 94
Ejercicios . . . 95

Ejercicios globales sobre palabras y frases 99

CAPÍTULO 9. Prosodia . . . 1 07
9. l . Análi s i s del acento 1 09
9.2. La melodía . . . 111
9.3. Lenguas tonales 1 15
Ej ercicios 1 17

Bibliografía . . 1 19
Impreso en el mes de junio de 1 998
en A&M GRÁFIC, S. L.
Polígono Industrial « La Florida»
08 1 30 Santa Perpetua de Mogoda
(Barcelona)
¿ Q u i é n t i e n e m i e d o a e nfre nta rse a l a fo n ét i c a a c ú st i c a ? C o n fre­
cuenc i a , los a l u m nos de « l etra s " reh úyen el c a m po de la fonética acús­
t i c a porq u e l e s p a rece d e m a s i ado afín a l a fí s i c a q u e l l egaro n a od i a r
e n e l bach i l l e rato . Este l i b ro p rete nde acerca r l e s a ese m u nd o d o n d e
se re ú n e n l etras y c i e n c i a s .

L a fonética s igue siendo u n a d i sc i p l i n a l i ngüística ; trata de estu d i a r los


sonidos d e l h a b l a . La a c ústica pertenece a l d o m i n i o de la fís i c a pues­
to q u e estu d i a l a s p ro p i ed ad e s fí s i c a s de l o s s o n i d o s . A m b a s se j u n­
tan e n e sta d e n o m i n ac i ó n : fo nética a c ú st i c a .

N u estro pro pós ito e s a l l a n a r e l c a m i n o p a ra q u e l o s e stu d i a ntes d e


« letra s " sean ca paces d e recorrerlo s i n gra ndes d ific u ltades . Para e l l o ,
h e m o s i nte rc a l ad o a b u n d a nte s gráfi c o s aco m pa ñ ad o s d e se ñ a l i za­
c i o nes y exp l i c a c i o n e s a lo l a rgo d e l texto . Ade m á s , se ofrecen n u m e­
rosos ej e rc i c i o s q u e , con e l a poyo d e l p rofesor, ayu d a rá n a aq u i l atar
l o s c onoc i m i e ntos adq u i ri d o s e n c a d a ca pítu l o . Segu ro q u e , d e s p u é s
d e h a be r segu i d o e ste c u rso , t o d o s te n d rá n u n d o m i n i o envi d i a b l e d e
l o s as pectos q u e a b a rca e sta d i sc i p l i n a l i ngüísti ca .

EUGENIO MARTÍNEZ CELORÁN, catedrático de lingüística general,


es profesor de Lingüística y Fonética de la Facultad de Filología de la
Universidad de Barcelona y dirige el Laboratorio de Fonética de la misma.
Es conocido por sus libros: Fonética (1 984), Fonología general y español a
(1 989), Fonética experi menta l : teoría y práctica (1 991), etc. Además ,
ha publicado numerosos artículos en las revistas de la especialidad.

Ariel Practicum

Common questions

Con tecnología de IA

The properties of acoustic consonants, including Voice Onset Time (VOT) and frequency variations, provide essential insights into speech production. VOT measures the time between consonant release and the onset of vocal cord vibration, distinguishing between different types of consonants, such as voiced versus voiceless sounds. Frequency variations, such as those indicated by formant transitions, help identify articulation places and manners. For example, variations in frequency due to consonantal influence can show the articulatory dynamics of a speaker's vocal tract. These acoustic properties enable us to parse and understand the subtle nuances in spoken language and differentiate between similar speech sounds, providing a foundation for speech recognition and language processing technologies .

Periodic phenomena in nature are events that occur at regular, predictable intervals, such as the Earth's rotation and revolution, which drive day-night cycles and seasons. These phenomena are characterized by consistency and can be mathematically modeled and predicted. On the other hand, aperiodic phenomena do not have regular intervals; they occur randomly or irregularly, such as volcanic eruptions and weather patterns in most real-world conditions. The distinction is significant because it determines predictability and the ability to model events mathematically. Periodic phenomena can be precisely forecasted, allowing for advancements in science and technology, while aperiodic phenomena often require probabilistic methods and present greater challenges in prediction and management .

Amplitude and intensity in sound waves represent different aspects of wave phenomena. Amplitude refers to the maximum displacement of the wave from its rest position, indicating the energy carried by the wave. Intensity, however, measures the power per unit area carried by the wave and is perceived as loudness. While amplitude is more descriptive of the wave's inherent properties, intensity is affected by both amplitude and the distance from the source. The measurement of amplitude is typically in decibels (dB), using devices like sound level meters to capture the maximum wave displacement. Intensity additionally considers wave power distribution over an area, highlighting spatial energy concentration across different mediums, which can be observed through varying loudness perceived at different distances .

Simple harmonic motion (SHM) is characterized by having a periodic motion, which means it repeats itself at regular intervals, exhibiting properties such as amplitude, frequency, and period. In SHM, amplitude is the maximum displacement from the rest position, frequency is the number of cycles per unit time, and period is the time taken for one complete cycle of motion. These characteristics of SHM can be modeled using sinusoidal waves. For periodic waves, such as those described for the vibration of a guitar string or a tuning fork, the amplitude corresponds to the wave's maximum displacement, while frequency and period relate inversely as expressed by the equation T = 1/F, where T is the period and F is the frequency. This relationship is crucial in understanding wave behaviors in different mediums .

Frequency and amplitude are independent characteristics that determine different attributes of sound waves. Frequency, which is the number of oscillations per second, affects the pitch of a sound; a higher frequency results in a higher pitch, while a lower frequency results in a lower pitch. Amplitude, on the other hand, affects the loudness of the sound; a higher amplitude results in a louder sound, while a lower amplitude results in a quieter sound. These properties are independent because a sound can have a high pitch with low loudness or vice versa. This distinction is evident in the analysis of sounds where waves with the same frequency can have different amplitudes, leading to variations in loudness without affecting pitch .

The concept of periodicity is fundamental to understanding earth's rotation and revolution, serving as a basis for our measurement of time. Earth's rotation on its axis takes approximately 24 hours to complete, defining the day cycle; this rotation repeats continually, marking the periodic characteristic. Similarly, Earth's revolution around the sun takes approximately 365.25 days, defining the year cycle. These periodic movements are essential for establishing our timekeeping systems, using the day and year as primary units of measurement. This periodicity also dictates seasonal changes and affects various natural and human-made systems, emphasizing its critical role in temporal measurements and broader astronomical understanding .

Hertz (Hz) is a crucial unit of frequency that measures the number of cycles per second of any periodic event and is particularly significant in the context of sound waves. It defines how frequently the wave oscillates in one second, symbolizing cycles per second (cps). For sound waves, Hertz directly correlates to pitch; a higher frequency in Hertz means a higher pitch and vice versa. For example, a tuning fork tuned to 440 Hz produces a sound wave that vibrates 440 times per second, creating the musical note A above middle C. This standardized unit allows for a consistent understanding and analysis of audio frequencies across various applications, from music to acoustics .

The mathematical relationship between period and frequency is an inverse one, expressed by the equation T = 1/F, where T is the period in seconds and F is the frequency in Hertz (Hz). This relationship means that as frequency increases, the period decreases, and vice versa. In the context of sound waves, this inverse relationship can be observed in the vibration of a tuning fork or a guitar string. For instance, a tuning fork emitting the note A4 has a frequency of 440 Hz, meaning it completes 440 cycles per second, and thus the period for one cycle is approximately 0.00227 seconds. This illustrates how the period and frequency determine the characteristics of sound waves such as pitch and tone .

Temperature fluctuations, as described over a period of repetitive daily measurements, can display periodic behavior when there is a regular cycle of temperature rising and falling at consistent intervals. In the imaginary scenario presented, temperature measurements taken every two hours for fifteen days showed consistent patterns, suggesting periodic behavior. This periodicity is represented graphically by oscillations in temperature over time, highlighting the concept of amplitude (maximum deviation from a central value) and periodicity. Understanding temperature as a periodic phenomenon allows for predictions based on these cycles and indicates regular thermal dynamics in controlled environments. However, in real-world settings, such regular oscillations are rare, thus used hypothetically to illustrate the potential periodicity in natural events .

Graphs are essential tools for visualizing the periodicity and interactions of wave phenomena. By representing oscillations and cycles graphically, it's possible to discern patterns such as amplitude, frequency, and phase shifts which are not always evident in raw data. For example, in the context of temperature oscillations over time, a graph can clearly illustrate the highs and lows, amplitude, and periodic intervals, aiding in identifying the periodic nature of the data. Graphs facilitate the correlation of variables and aid in the study of their interactions, such as understanding how changes in amplitude might influence perceived intensity in acoustic waves or how frequency impacts cycles in mechanical systems. They support hypothesis testing and the prediction of future behaviors in scientifically meaningful ways .

También podría gustarte