0% encontró este documento útil (0 votos)
7 vistas30 páginas

Estadística en Hidrología Aplicada

El capítulo 4 aborda la estadística aplicada a la hidrología, diferenciando entre estadística descriptiva e inferencial. Se introducen conceptos básicos como experimento aleatorio, espacio muestral y probabilidad, así como sus definiciones y métodos de cálculo. También se discuten las distribuciones de probabilidad y parámetros estadísticos, enfatizando la importancia de las muestras representativas en el análisis hidrológico.

Cargado por

Santiago Pereyra
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
7 vistas30 páginas

Estadística en Hidrología Aplicada

El capítulo 4 aborda la estadística aplicada a la hidrología, diferenciando entre estadística descriptiva e inferencial. Se introducen conceptos básicos como experimento aleatorio, espacio muestral y probabilidad, así como sus definiciones y métodos de cálculo. También se discuten las distribuciones de probabilidad y parámetros estadísticos, enfatizando la importancia de las muestras representativas en el análisis hidrológico.

Cargado por

Santiago Pereyra
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4

CÁTEDRA: HIDRÁULICA APLICADA

CAPÍTULO 4: ESTADÍSTICA APLICADA A LA HIDROLOGÍA

4.1 CONCEPTO DE ESTADÍSTICA


Según G. Darnois, “la estadística es una ciencia de la observación y como tal consta de dos
partes: el ordenamiento material de los datos y la clasificación lógica de los hechos, para luego
poder inferir las leyes que lo rigen.” De esta definición se pueden distinguir dos ramas o partes
fundamentales que la constituyen:
Estadística descriptiva: se relaciona con el tratamiento de los datos existentes a fin de obtener
toda la información posible, mediante su adecuada ordenación por medio de clasificaciones en
forma de tablas, gráficos, etc.
Estadística matemática o inferencial: se basa en comparar, el fenómeno analizado con modelos
probabilísticos teóricos, a fin de obtener la información que no resulta evidente con la simple orde-
nación de los datos. Para esto se ha desarrollado una aplicación de la Teoría de las Probabilidades.

4.2 ESTADÍSTICA MATEMÁTICA O INFERENCIAL


Los fenómenos o procesos hidrológicos varían en el espacio y en el tiempo, esta evolución
puede ser determinística (parcial o totalmente predecible), o parcialmente aleatoria.
La aleatoriedad de un acontecimiento está directamente relacionada con la imposibilidad de
definir un resultado de un conjunto de resultados posibles.
Es normal que, en un proceso hidrológico, la variabilidad aleatoria supere holgadamente a la
componente determinística, esto hace que sea tratado como puramente aleatorio; un proceso de
este tipo se conoce con el nombre de proceso estocástico.

4.2.1 Conceptos Básicos


Existen un gran número de definiciones asociadas a la estadística, a continuación se desarro-
llarán las consideradas como básicas para la interpretación del presente capítulo.
Experimento Aleatorio (): es el conjunto de operaciones que al realizarlas, en condiciones unifor-
mes (aleatorias), dan resultados que pueden variar por factores no controlados, estas operaciones
se denominan “Pruebas”.
Espacio Muestral (S): dado un experimento aleatorio, es el conjunto constituido por todos los re-
sultados que se reconocen posibles de obtener. El espacio muestral es el conjunto universal de
todos los resultados posibles de un determinado experimento aleatorio, de esto se desprende que,
el espacio muestral puede tener un número finito o infinito de elementos.
Suceso Elemental: dado un experimento aleatorio, es cada uno de los elementos que componen
el espacio muestral.
Suceso: es un subconjunto formado por elementos que componen el espacio muestral, cuando
está formado por un solo elemento se trata de un suceso elemental.

 Ejemplo:
 : lanzar un dado S = (1, 2, 3, 4, 5, 6)
cada uno de los valores que numeran cada cara del dado, de 1 a 6, es un suceso elemental
Ing. Rec. Hídricos Juan B. Sciortino 41
ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

S es el espacio muestral o conjunto universal


Dado el , sacar un 2 o un 3 constituye un suceso, sacar
solamente un 4 también es un suceso, que al estar com-
puesto por un solo elemento es un suceso elemental.

4.2.2 Probabilidad
Hay tres escuelas o métodos para su definición.
Clásica o a Priori: Se realiza un , la probabilidad de ocurrencia de un suceso A es la relación entre
el número de casos favorables de ocurrencia y el número de casos igualmente posibles.
P(A) = No. casos favorables / No. casos posibles
En el ejemplo anterior, el No. de casos posibles = 6 S = (1, 2, 3, 4, 5, 6)
para el suceso A = sacar un 2 o un 3; A = (2, 3)  No. casos favorables = 2
 P(A) = 2/6 = 0,333 = 33,3%
para el suceso A = sacar un 4; A = (4)  No. casos favorables = 1
 P(A) = 1/6 = 0,167 = 16,7%

Empírica o a posteriori: Se realiza un  con “n” pruebas, se llama frecuencia absoluta f(A) al nú-
mero de veces que se presenta el suceso A; la frecuencia relativa h(A) es la relación entre la fre-
cuencia absoluta y el número de pruebas, h(A) = f(A) / n.
A medida que el número de pruebas aumenta, h(A) tiende hacia un valor en forma oscilante,
este valor es la probabilidad de ocurrencia del suceso A.
P A = lim h(A)
n→∞
 Ejemplo: Sea un  arrojar un dado un número “n” de veces, calcular la frecuencia absoluta y
relativa de ocurrencia del suceso A: sacar el número 6.

N Suceso A f (A) h(A)


1 0 0 0,000
2 0 0 0,000
3 1 1 0,333
4 0 1 0,250
5 0 1 0,200
6 0 1 0,167
7 0 1 0,143
8 0 1 0,125
9 0 1 0,111
10 1 2 0,200
de 11 a 20 1 3 0,150
de 21 a 50 6 9 0,180
de 51 a 100 8 17 0,170
A medida que aumenta el número
de pruebas h(6) se hace asintótico a 0,167 que es la probabilidad de ocurrencia del suceso.
Ing. Rec. Hídricos Juan B. Sciortino 42
ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Axiomática: Sea un suceso A, contenido en el espacio muestral S, la probabilidad de ocurrencia


del suceso A es una aplicación que hace corresponder al subconjunto A un valor del intervalo [0, 1]
y que cumple con los siguientes axiomas:
P(A)  0
La probabilidad de la unión de sucesos excluyentes es
igual a la suma de las probabilidades de todos los su-
cesos:
P(Ai)=  P(Ai) siendo AiAj =  i  j
P(S) = 1

En base a estos conceptos se presentan dos teoremas fundamentales (para su demostración


se recomienda recurrir al libro: Análisis Estadístico. Chow, Y. 2ª Edición. McGraw-Hill, México ,
1994):
a). Teorema: Probabilidad Total o Suma de Probabilidades.
Si un acontecimiento puede producirse, sea por la verificación de un seceso A o por la de un
suceso B, su probabilidad de ocurrencia es igual a la suma de las probabilidades de A y de B menos
la probabilidad de que se verifiquen conjuntamente A y B, si A y B son no excluyentes.

P(A ó B) = P(A  B) = P(A) + P(B) – P(AB)


siendo A  B  
Se desprende que, si A y B son excluyentes: A  B = 
P(A  B) = P(A) + P(B)

b). Teorema: Probabilidad Compuesta o Multiplicación de Probabilidades


La probabilidad de que se verifique un suceso A, condicionado a la ocurrencia de un suceso
B, P(A/B), es igual al cociente entre la probabilidad de presentación conjunta P(AB) y la probabilidad
de B P(B), siempre que esta última sea mayor que cero.
P AB
P A/B
P B
Por lo tanto:
Si un acontecimiento depende de la presentación de dos sucesos dependientes entre si, su
probabilidad es igual a la probabilidad de uno de ellos, multiplicada por la probabilidad que tiene el
otro suceso cuando se sabe que se ha verificado el primero.
P AB P B P A/B o P AB P A P B/A
Si A y B son independientes entre sí, la probabilidad de cualquiera de los sucesos no está
condicionada a la ocurrencia del otro.
P A/B P A y P B/A P B
De esta forma, si A y B son sucesos independientes:
P AB P B P A P A P B
 Ejemplo: dado un mazo de 40 naipes;
: extraer una carta
Determinar la probabilidad de que la carta sea un rey ó un oro
A: obtener un rey  P(A) = 4/40 B: obtener un oro  P(B) = 10/40
como A y B no son excluyentes AB: rey de oro  P(AB) = 1/40
Ing. Rec. Hídricos Juan B. Sciortino 43
ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

P(A ó B) = P(A  B) = P(A) + P(B) – P(AB) = 4/40 + 10/40 – 1/40 = 13/40 = 0,325 =32,5%
: extraer dos cartas con reposición
Determinar la probabilidad de que las cartas sean un rey y un as.
A: obtener un rey  P(A) = 4/40 B: obtener un as  P(B) = 4/40
los sucesos A y B son independientes puesto que se repone la carta que se extrae en primer orden
quedando el mazo sin modificaciones
P(A y B) = P(AB) = P(A) P(B) = 4/40 4/40 = 1/100 = 0,01 =1%

4.2.3 Distribución de Probabilidades


Dado un experimento aleatorio, si a cada suceso elemental le asignamos un valor numé-
rico obtenemos una variable aleatoria; por lo tanto, una variable aleatoria (X) puede ser definida
como una función que va del espacio muestral a un conjunto de números X(x1, x2, x3, …); puede ser
discreta o continua:
 Cuando el conjunto numérico es el de los números enteros, ya sea finito o infinito numerable,
la variable aleatoria es discreta.
 Si el conjunto numérico es el de los números reales, infinito no numerable, la variable alea-
toria es continua.
El conjunto de los posibles valores que puede tomar una variable aleatoria se denomina
Rango.
 Ejemplo: variable aleatoria discreta.
: arrojar dos monedas S =[(cara, cara); (cara, seca); (seca, cara); (seca, seca)]
Se define la variable aleatoria X = “número de caras”  X(2, 1, 1, 0)
1
P(x)

Por lo tanto: 0.8


P(X=2)= ¼
0.6
P(X=0)= ¼
P(X=1)= ¼ + ¼ = ½ 0.4

0.2

0
0 1 2 X

Suponiendo que se realizan observaciones de una variable aleatoria determinada (x1, x2,...,
xn), extraídas de una hipotética población infinita, el conjunto de observaciones se denomina mues-
tra; el conjunto de todas las muestras posibles que pueden extraerse de una población se conoce
como el espacio muestral.

Una Distribución de Probabilidades es la correspondencia que existe entre todos los valores
de una variable aleatoria y sus probabilidades de ocurrencia, su expresión matemática se realiza
por medio de una Función de Distribución F(x).
Si la variable aleatoria X es discreta (Figura No.4.1), su función de distribución se define por
la siguiente expresión:

F x = P X≤x = f(xi)
xi≤x
f(xi) función de probabilidad de la variable, se representa en una barra como una unidad de masa.

Ing. Rec. Hídricos Juan B. Sciortino 44


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Figura No. 4.1: Función de Distribución


de Probabilidades. V.A. Discreta

Las funciones teóricas de Distribución de Probabilidades de variables aleatorias discretas o


Modelos Probabilísticos más destacadas son: Binomial, Poisson, Geométrica e Hipergeométrica;
para su estudio e interpretación se recomienda recurrir a: "Probability and Statistics in Hydrology"
Yevjevich, V. Water Resourses Publications. y a “Análisis Estadístico”. Chow, Y. 2ª Edición.
McGraw-Hill, México , 1994.

Si la variable aleatoria X es continua (Figura No. 4.2), la función de distribución de probabi-


lidades se define con la siguiente expresión:
xo

F xo = P X ≤ xo = f x dx
-∞
f(x): función de densidad de masas,
en este caso no es posible represen- Figura No. 4.2: Función de Distribución de
tar la variable aleatoria en forma de Probabilidades. V.A. Continua
barras porque se trata de un continuo
de puntos.

La ordenada F(xo) representa el


área encerrada bajo la curva de den-
sidad de la variable, de esta forma se
tiene:
F(xo) = P(X  xo) , probabilidad
que la v.a. x sea menor o igual
a xo
[1 - F(xo)] = P(X  xo) , proba-
bilidad que la v.a. x sea mayor
o igual a xo

Ing. Rec. Hídricos Juan B. Sciortino 45


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Las funciones probabilísticas deben cumplir con una serie de requisitos:


Función de Distribución de Probabilidades:
 F(-) = 0
 F() = 1
 F(x): función monótona creciente x2 > x1  F(x2) > F(x1)
Función de Densidad de Masas:
 f(x)  0
 La superficie bajo la curva en todo el rango de la variable = 1
+∞

f x dx 1
-∞
La superficie bajo la curva, comprendida entre dos valores de la variable (x1 y x2  x2 > x1)
representa la probabilidad de que la variable tome un valor dentro del mencionado intervalo.
(Figura No. 4.3).
x2

P x1 ≤ X ≤ x2 = F x2 - F x1 = f x dx
x1

Figura No. 4.3

4.2.4. Parámetros Estadísticos


Una población posee propiedades estadísticas constantes, mientras que las propiedades de
muestras tomadas de una misma población pueden variar entre sí y con respecto a las de la pobla-
ción, de esto se desprende la importancia de la toma de los datos que conforman la muestra, a fin
de que esta última sea representativa de la población y que las propiedades estadísticas no pre-
senten diferencias de consideración.
Los parámetros estadísticos característicos de una población se pueden distinguir como: Me-
didas de Tendencia Central, de Dispersión, de Asimetría y de Aplastamiento.
Se denomina momento de una variable aleatoria orden k, centrado con respecto al origen a la
siguiente operación:

αk= xk f x dx
-∞
 Medidas de Tendencia Central:
Esperanza Matemática o Media: Es el momento de primer orden de la variable aleatoria “α 1” y

Ing. Rec. Hídricos Juan B. Sciortino 46


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

representa un valor particular alrededor del cual tiende a agruparse la masa de datos, el valor es-
perado de la variable aleatoria.
Para una población:

E x = μ= α1= x f x dx
-∞
Para una muestra de “n” datos de la variable aleatoria, la media se determina:
N
1
Xm= xi
N
1
Mediana: es el valor de la variable aleatoria correspondiente a una probabilidad del 50%,
F(x) = 0,50.
Moda: es el valor más probable de la variable aleatoria

Se denomina momento orden k, centrado con respecto a la media, de una variable aleatoria,
a la siguiente operación:

k
βk= (x – E(x)) f x dx
-∞
 Medidas de Dispersión:
Varianza: Es el momento de segundo orden centrado con respecto a la media y representa la va-
riabilidad de la información.
Para una población:

2
σ2 = β2= (x – μ) f x dx
-∞

se demuestra que: σ = β2 = α2 – α12


2

Para una muestra de “N” datos de la variable aleatoria:


N
2 1 2
S = (xi – Xm)
N
1
Normalmente, cuando la muestra tiene menos de 30 datos, se divide por (N-1) en lugar de N
para garantizar que el resultado sea insesgado.
Desvío Estándar: Es la raíz cuadrada de la varianza y permite una mejor apreciación de la varia-
bilidad de la información porque tiene las mismas dimensiones de la variable aleatoria.
Para una población:
∞ 0,5
2
σ= (x – μ) f x dx
-∞
Para una muestra de “n” datos de la variable aleatoria:
,
N
1 2
S= (xi – Xm)
N
1

Al igual que en la varianza, cuando la muestra tiene menos de 30 datos, se divide por (N-1) en

Ing. Rec. Hídricos Juan B. Sciortino 47


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

lugar de N.
Cuando  ó S es grande la masa está muy dispersa con respecto a la media, a medida que se
acerca a 0 la masa se concentra alrededor de la media.
Coeficiente de Variación: Es un parámetro adimensional que relaciona el desvío con la media y
que puede expresarse en forma porcentual.
σ S
σv= Cv=
μ Xm

 Medidas de Simetría:
Asimetría: Se determina con el momento de tercer orden centrado con respecto a la media y re-
presenta la simetría de una distribución alrededor de la media.

3
β3= (x – μ) f x dx
-∞
Coeficiente de Asimetría: A fin de tener una representación adimensional de la simetría y por ende
más apreciable, se divide el momento de tercer orden centrado con respecto a la media por el desvío
estándar elevado a la tercera potencia.
β3 ∑N
1 (xi – Xm)
γ= 3 Cs = a
σ S3
Cuando N < 30 a = N /[(N-1) (N-2)] ; cuando N > 30 a = 1/N
Si γ ó Cs < 0 la mayor concentración de la masa se ubica a la izquierda de la media (hacia
menores), si γ ó Cs > 0, la mayor concentración de la masa se ubica a la derecha de la media (hacia
mayores).

En las Figuras Nos. 4.4 y 4.5 se muestran funciones de densidad de masa con distintos des-
víos y asimetrías respectivamente.

 = 0,5 Figura No. 4.4

=1

=3
μ=3

Ing. Rec. Hídricos Juan B. Sciortino 48


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Figura No. 4.5


γ= 0
γ > 0

γ < 0

4.3 INFERENCIA ESTADÍSTICA EN LA HIDROLOGÍA


Una variable aleatoria hidrológica (v.a.h.) es una variable que define la magnitud o cantidad de
algún elemento del ciclo hidrológico (precipitaciones, temperatura, humedad, etc.), estas pueden
ser asumidas como continuas e infinitas, o sea, con un infinito número de potenciales observacio-
nes.
No se pueden contener todos los valores de una población infinita (aún en el caso de pobla-
ciones finitas y largas se hace económicamente prohibitivo dicho trabajo); en hidrología esta dificul-
tad se manifiesta por el paso del tiempo, dado que no es posible tener la información futura y tam-
poco se puede recoger la información del tiempo anterior al inicio de las mediciones de la variable
aleatoria en consideración.
En respuesta a la problemática planteada se toman cantidades finitas de datos recolectados
de la población de la variable aleatoria, este conjunto de datos es denominado “Muestra” de la
población considerada.
Considerando el conjunto de datos observados de una v.a.h. en un determinado lugar ([Link]. 30
años de caudales medios anuales) no es más que un pequeño subconjunto (Muestra) de una po-
blación o conjunto universal constituido por todos los caudales medios anuales pasados y futuros
que, escurrieron y escurrirán, por la sección del curso de agua en estudio.
Ante lo expresado es indispensable que los datos recolectados sean fidedignos y representa-
tivos de la población considerada, esto implica: imparcialidad, independencia y homogeneidad,
estas circunstancias deben ser comprobadas previo a cualquier análisis estadístico.
La dependencia de los datos puede acontecer por influencia del espacio o del tiempo; la falta
de homogeneidad significa que los datos son obtenidos de dos poblaciones diferentes.

 Ejemplo de dependencia espacial: dada un batería de pozos de agua que están explotando un
mismo acuífero, la variable aleatoria: nivel de agua de uno de ellos, estará fuertemente influen-
ciada por el bombeo de los otros pozos que constituyen la batería.
 Ejemplo de dependencia temporal: para una determinada estación de aforos en un curso de
agua, una tormenta intensa y de larga duración genera una importante avenida, inmediatamente
después del paso del pico de la crecida se produce otra tormenta, y aunque esta sea de menor

Ing. Rec. Hídricos Juan B. Sciortino 49


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

intensidad que la anterior, genera otra crecida cuyo pico alcanza niveles muy importantes; con-
siderando la variable aleatoria caudal máximo o nivel máximo alcanzado por el agua, el valor
correspondiente a la segunda crecida depende del caudal o nivel de agua que tenía río al momento
de iniciarse, por lo tanto hay una dependencia directa con el primer evento.
 Ejemplo de falta de homogeneidad: Para una cuenca determinada, la población de caudales que
escurren por una sección del cauce principal pierde homogeneidad si en algún momento se pro-
duce, tanto en forma gradual como rápida, el desmonte de una superficie importante del área
de aporte; como consecuencia del desmonte se incrementa la escorrentía superficial y disminuye
la infiltración resultando que las crecidas tengan picos más importantes y en el estiaje el caudal
disminuya considerablemente.

La muestra de datos debe ser tal que, los estadísticos que se calculan a partir de esta: media
(Xm), desvío(S), varianza (S2), asimetría (Cs), etc., sean considerado estimadores de los paráme-
tros equivalentes de la población: media (μ), desvío(), varianza(2), asimetría(γ), etc., de esta
forma:
μ  Xm aS γ  a Cs
0,5
Si N < 30 a =[N/(N-1)] Si N < 30 a = N /[(N-1) (N-2)]
Si N > 30 a = 1 Si N > 30 a = 1

La población que reúne la v.a.h. tiene una determinada distribución de probabilidades, la que
debe ser estimada a partir de los datos de la muestra y sus respectivos estadísticos.
En hidrología se utilizan un gran número de funciones teóricas de distribución de probabilida-
des y los parámetros de estas funciones deben ser estimados a partir de los estadísticos de la
muestra.
Existen diversos métodos de estimación de parámetros de las funciones de probabilidades
dentro de los que se destacan: Método de los Momentos, Método de la Máxima Verosimilitud, Mé-
todo de los Momentos Pesados o Ponderados, Método de los Momentos Combinados o Mixtos y
Método de los Mínimos Cuadrados. En análisis de estos métodos escapa al alcance propuesto, se
recomienda, para su estudio recurrir a: "Probability and Statistics in Hydrology" Yevjevich, V. Water
Resourses Publications. Fort Collins. Colorado. USA (1972) y “Elementos de la Teoría de Probabi-
lidades”. CRAMER, H. Aguilar. España. (1970)

4.3.1 Funciones de Distribución de Probabilidades en hidrología


Las distribuciones de probabilidades se usan en una amplia variedad de estudios
hidrológicos: análisis del clima de una región; precipitaciones (anuales, mensuales, máximas dia-
rias, intensidad de lluvia para distintas duraciones, etc.); de caudales (medios mensuales, anuales,
mínimos diarios, máximos instantáneos, nivel de agua en crecidas, etc.); volúmenes de embalse
(ingreso anual, cota máxima anual, cota mínima anual, máximo ingreso por crecidas, etc.); etc.
La muestra de datos recolectados, homogénea y de individuos independientes entre
sí, puede ser ajustada a una determinada función de distribución de probabilidades teórica; a
continuación se describirán las de mayor uso en hidrología y se presentará, para cada una de estas,
la metodología de estimación de parámetros.

Distribución Normal (Campana de Gauss):


La distribución normal es una distribución simétrica con respecto a la media y tiene forma de
campana. En general no se ajusta a los datos hidrológicos debido a que es simétrica y que el rango
de la variable aleatoria va de - a + , mientras que, salvo excepciones, las variables hidrológicas
se distribuyen en forma asimétrica y son no negativas.

Ing. Rec. Hídricos Juan B. Sciortino 50


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Se la incluye por ser muy conocida y porque se la utiliza para estudiar y comparar su compor-
tamiento con otras distribuciones.
Las funciones de densidad y de distribución de la variable (Figura No. 4.6), comúnmente re-
ferida como N(,), tienen la siguiente forma:
1 ‐(x-μ)2 x
f x = e 2 σ2 - < x <  F x = f x dx
σ √2π -
En este caso se asume que tanto la media (μ) como el desvío poblacional () son iguales a
sus correspondientes (Xm y S) de la muestra de datos, y como se trata de una integral sin solución
analítica se debe resolver con las tablas desarrolladas a tal efecto.

Figura No. 4.6

Estas tablas están construidas para una función N(0,1), donde μ = 0 y  = 1; para trabajar
con una N(μ, ),se debe hacer un cambio de variables: u = ( x - μ ) /.
Para determinar la probabilidad de ocurrencia de un determinado evento xo, se calcula el valor
de u haciendo x = xo y con ese valor de u se ingresa a la tabla adjunta, que directamente da el
valor de la probabilidad buscada.

Distribución Normal N(0,1)


Segunda cifra decimal del valor de u
u 0.00 .01 .02 .03 .04 .05 .06 .07 .08 .09
0.0 .5000 .5040 .5080 .5120 .5160 .5199 .5239 .5279 .5319 .5359
0.1 .5398 .5438 .5478 .5517 .5557 .5596 .5636 .5675 .5714 .5753
0.2 .5793 .5832 .5871 .5910 .5948 .5987 .6026 .6064 .6103 .6141
0.3 .6179 .6217 .6255 .6293 .6331 .6368 .6406 .6443 .6480 .6517
0.4 .6554 .6591 .6628 .6664 .6700 .6736 .6772 .6808 .6844 .6879
0.5 .6915 .6950 .6985 .7019 .7054 .7088 .7123 .7157 .7190 .7224
0.6 .7257 .7291 .7324 .7357 .7389 .7422 .7454 .7486 .7517 .7549
0.7 .7580 .7611 .7642 .7673 .7704 .7734 .7764 .7794 .7823 .7852
0.8 .7881 .7910 .7939 .7967 .7995 .8023 .8051 .8078 .8106 .8133
0.9 .8159 .8186 .8212 .8238 .8264 .8289 .8315 .8340 .8365 .8389
1.0 .8413 .8438 .8461 .8485 .8508 .8531 .8554 .8577 .8599 .8621
1.1 .8643 .8665 .8686 .8708 .8729 .8749 .8770 .8790 .8810 .8830
1.2 .8849 .8869 .8888 .8907 .8925 .8944 .8962 .8980 .8997 .9015
1.3 .9032 .9049 .9066 .9082 .9099 .9115 .9131 .9147 .9162 .9177
1.4 .9192 .9207 .9222 .9236 .9251 .9265 .9279 .9292 .9306 .9319
1.5 .9332 .9345 .9357 .9370 .9382 .9394 .9406 .9418 .9429 .9441
1.6 .9452 .9463 .9474 .9484 .9495 .9505 .9515 .9525 .9535 .9545
1.7 .9554 .9564 .9573 .9582 .9591 .9599 .9608 .9616 .9625 .9633
1.8 .9641 .9649 .9656 .9664 .9671 .9678 .9686 .9693 .9699 .9706
1.9 .9713 .9719 .9726 .9732 .9738 .9744 .9750 .9756 .9761 .9767
2.0 .9772 .9778 .9783 .9788 .9793 .9798 .9803 .9808 .9812 .9817
… ….. ….. ….. ….. ….. ….. ….. ….. ….. …..

Ing. Rec. Hídricos Juan B. Sciortino 51


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Para el proceso inverso: ¿cuál es el valor de xo que tiene una probabilidad de ocurrencia
determinada?, se ingresa a la tabla por el lado de las probabilidades y se obtiene un valor de u, el
xo calcula como xo =  +  u

Distribución Logaritmo Normal:


Sea la variable aleatoria x, si y = ln x tiene una distribución normal, se dice que los valores de
x tienen una distribución logaritmo normal (Figura No. 4.7).
2
1 -(y-μn)
f y = 0<x<
e 2 σn2
σn √2π
con: y = ln x ; μn y n media y desvío poblacional de la variable aleatoria y, estimados a partir de
Ym y Sy
N
1
Ym= ln xi
N
1
,
N
1 2
Sy= (ln xi – Ym) si N<30
N-1
1

Figura No. 4.7: Distribución LogNormal Media = 0,5 Desvío = 0,3


f(x) F(x)

La distribución lognormal es más utilizada, en hidrología, que la distribución normal porque la


variable aleatoria debe tomar valores mayores que 0 y, lo que no es menos importante, la transfor-
mación logaritmo disminuye considerablemente la asimetría positiva típica en la información hidro-
lógica.
Como limitación se debe señalar que, al igual que la distribución normal, la lognormal tiene
dos parámetros, además requiere que los logaritmos de los datos sean lo más simétricos posibles
alrededor de la media.

Distribución Pearson III (Gamma de 3 Parámetros):


Es una distribución muy utilizada en hidrología por ser muy flexible y tomar distintas formas
según varíen los tres parámetros.
La función de densidad de la variable tiene la siguiente expresión:
(β-1)
1 (x-Xo) -(x-Xo)
f x = e ∝ x Xo
α (β) α
donde: , , Xo: son los parámetros de la función;  y  son los parámetros de escala y forma,
respectivamente , y x0 es el parámetro de localización, estos pueden ser estimados a partir de las

Ing. Rec. Hídricos Juan B. Sciortino 52


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

siguientes ecuaciones:
2
2 σ 0,5
β= α= 0,5
Xo= μ- σ β
γ β

() es la función gamma o factorial,



(β) = e-x x β-1 dx
0
Los parámetros de la función de distribución dependen de la media, desvío y asimetría pobla-
cional, estos pueden ser estimados por sus correspondientes de la muestra: Xm, S y Cs.
Cuando la asimetría de la población tiende a 0, la función Pearson III tiende a la distribución
Normal.
En este sentido Kite, G. recomienda estimar los parámetros de la función con el método de la
Máxima Verosimilitud, a partir de la siguiente ecuación resultante:
1 N N
-N ln  β - xi-Xo + β-1 xi-Xo - Nβ ln α
α 1 1
Derivando con respecto a , , Xo e igualando a 0 se obtienen tres ecuaciones que deben ser
resueltas numéricamente para obtener los parámetros mencionados. Con estos valores se pueden
calcular los estimadores de los estadísticos de la población de las ecuaciones anteriores:
2 0,5 0,5
γ= 0,5 σ=α β μ = Xo + σ β
β
Los estimadores de los estadísticos de la población calculados de esta forma pueden diferir
de los calculados con sus correspondientes de la muestra.
Debido a que la integral no tiene una solución analítica se utiliza un método denominado Factor
de Frecuencia con la siguiente expresión:
x T = μ + K T, γ σ
donde: T: recurrencia T = 1/(1-F(x)) (el concepto se desarrolla en el apartado 3.2.)
K es el factor de frecuencia tabulado por Harter en función de la recurrencia y del estimador
de la asimetría poblacional.
Factores de Frecuencia para Pearson III y Log Pearson III. Haan, 1977
Recurrencia en años
2 5 10 25 50 100 200
Estimador de la Asimetría Probabilidad de ser superado P(X>=xo) = 1-F
Poblacional 0.50 0.20 0.10 0.04 0.02 0.01 0.005
3 -0.396 0.420 1.180 2.278 3.152 4.051 4.970
2.5 -0.360 0.518 1.250 2.262 3.048 3.845 4.652
2 -0.307 0.609 1.302 2.219 2.912 3.605 4.298
1.8 -0.282 0.643 1.318 2.193 2.848 3.499 4.147
1.6 -0.254 0.675 1.329 2.163 2.780 3.388 3.990
1.4 -0.225 0.705 1.337 2.128 2.706 3.271 3.828
1.2 -0.195 0.732 1.340 2.087 2.626 3.149 3.661
1 -0.164 0.758 1.340 2.043 2.542 3.022 3.489
0.8 -0.132 0.780 1.336 1.993 2.453 2.891 3.312
0.6 -0.099 0.800 1.328 1.939 2.359 2.755 3.132
0.4 -0.066 0.816 1.317 1.880 2.261 2.615 2.949
0.2 -0.033 0.830 1.301 1.818 2.159 2.472 2.763
0 0.000 0.842 1.282 1.751 2.054 2.326 2.576
-0.2 0.033 0.850 1.258 1.680 1.945 2.178 2.388
-0.4 0.066 0.855 1.231 1.606 1.834 2.029 2.201
-0.6 0.099 0.857 1.200 1.528 1.720 1.880 2.016
-0.8 0.132 0.856 1.166 1.448 1.606 1.733 1.837
-1 0.164 0.852 1.128 1.366 1.492 1.588 1.664
-1.2 0.195 0.844 1.086 1.282 1.379 1.449 1.501
Ing. Rec. Hídricos Juan B. Sciortino 53
ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Recurrencia en años
2 5 10 25 50 100 200
Estimador de la Asimetría Probabilidad de ser superado P(X>=xo) = 1-F
Poblacional 0.50 0.20 0.10 0.04 0.02 0.01 0.005
-1.4 0.225 0.832 1.041 1.198 1.270 1.318 1.351
-1.6 0.254 0.817 0.994 1.116 1.166 1.197 1.216
-1.8 0.282 0.799 0.945 1.035 1.069 1.087 1.097
-2 0.307 0.777 0.895 0.959 0.980 0.990 0.995
-2.5 0.360 0.711 0.711 0.793 0.798 0.799 0.800
-3 0.396 0.636 0.660 0.666 0.666 0.667 0.667

Distribución Log Pearson III:


Al igual que en la función Log Normal se hace un cambio de variable: Yi = ln xi (también
puede utilizarse la función logaritmo decimal ) y se forma una nueva serie muestral compuesta por
los logaritmos de la variable aleatoria, por lo que la media, desvío y asimetría de la muestra se
calcula con los logaritmos de la variable (Ym, Sy , Csy).
2
2 σL 0,5
β= α= 0,5
Xo= μL - σL β
γL β
Los parámetros de la función de distribución dependen de la media, desvío y asimetría pobla-
cional: μL, L y γL; estos pueden ser estimados por sus correspondientes de la muestra: Ym, Sy ,
Csy.
Cuando la asimetría de la población tiende a 0, la función Log Pearson III tiende a la distribu-
ción Log Normal
Según algunos autores existe incertidumbre acerca del uso del Csy como estimador de la
asimetría poblacional, Rao, D. propone el método de los momentos mixtos o combinados para su
estimación en “Estimating Log Pearson Parameters by Mixed Moments”. Journal of Hidraulic Engi-
neering, Vol 109 (1983).
En esta función la integral no tiene una solución analítica, se utiliza el método de Factor de
Frecuencia con la siguiente expresión:
+ K T, γL σL ]
x T =e L

donde el factor de frecuencia K se obtiene de la tabla utilizada para la distribución Pearson III.

Distribución de Goodrich:
La función de distribución de probabilidades, ajustable con tres parámetros, tiene la siguiente
forma:
1/n
F x = 1- e- a x -Xo
donde: a, Xo y n son los parámetros de la distribución, a: constante de ajuste de la media; xo: valor
mínimo permanente de la variable y n: coeficiente de irregularidad.
Los parámetros de la función dependen de la media, desvío y asimetría poblacional que pue-
den ser estimados por sus correspondientes de la muestra: Xm, S y Cs.
El valor de n se obtiene en función de la asimetría tal como se muestra en la siguiente tabla,
cuando Cs > 2 no se recomienda el ajuste con esta función de distribución.

Cs 0,069 0,217 0,359 0,496 0,631 0,764 0,895 1,028 1,160 1,294 1,430 1,567 1,708 1,852 2,0
n 0,30 0,35 0,40 0,45 0,50 0,55 0,60 0,65 0,70 0,75 0,80 0,85 0,90 0,95 1,0

Luego de determinar el valor de n se despeja a de la siguiente expresión y se calcula el xo:

Ing. Rec. Hídricos Juan B. Sciortino 54


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

0,5
1 S2 1
= Xo = Xm- (n+1)
an  2n+1 - 2 (n+1) an
donde ( ): es la función Gamma o factorial.

Función de Distribución de Valores extremos Tipo [Link]ón de Gumbel:


La función de distribución de probabilidades es del tipo doble exponencial:
(x - Xo)
-
-e α
F x =e
Donde, Xo y  son los parámetros de la función, el primero de localización y el segundo de
concentración, están vinculados a la media y desvío poblacional por medio de las siguientes ecua-
ciones:
√6 σ
α = Xo = μ - 0,5772 α
π
La media y desvío poblacional pueden ser estimados por los correspondientes de la muestra:
Xm y S; Greenwood J y Landwher J proponen estimar los parámetros de la función por el método
de los momentos ponderados:
M 0 - 2 Mk 1
Xo=M 0 - 0,5772 α α=
Ln 2
N
1 (N-i)
siendo: M 0 = Xm y Mk 1 = xi
N (N-1)
i=1
donde xi son los valores de la muestra de datos ordenados de menor a mayor.

Función de Distribución de Valores extremos Tipo II. Función de Frechet (Log Gumbel):
Dada una variable aleatoria x, si y = ln x tiene una distribución de Gumbel, se dice que los
valores de x tienen una distribución Log Gumbel o Frechet, resultando una función de distribución
doble exponencial de dos parámetros idéntica a la de Gumbel:
(y - XLo)
-
-e αL
F y =e
Los parámetros de la función de distribución se calculan igual a los de la función de Gumbel,
cambiando la media y desvío de la muestra por la media y desvío de los logaritmos de los valores
de la muestra.

4.3.2 Período de Retorno. Recurrencia


Se supone que un evento extremo ocurre cuando la variable aleatoria X es mayor o igual a un
cierto valor Xt, se define:
a) Intervalo de Recurrencia (), al tiempo que transcurre entre ocurrencias X  Xt .
b) Período de Retorno T de un evento X  Xt, al valor esperado (Esperanza Matemática) de  , o
sea el tiempo promedio medido en un número de ocurrencias suficientemente grande.
En el gráfico adjunto (Figura No. 4.8) se representa la variación de la v.a. X en el tiempo;
suponiendo que los valores que superen Xt son considerados extremos, se tiene:
6 intervalos de recurrencia de:( 5, 1, 1, 4, 8, 6 años)  25 años
 varía entre 1 y 8 años T = E()= 25/6 = 4,17 años

Ing. Rec. Hídricos Juan B. Sciortino 55


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

X Figura No. 4.8

Xt

Por lo tanto se puede definir como período de retorno T al intervalo de recurrencia promedio
entre eventos que igualan o exceden una magnitud determinada; es indispensable, para expresar
T en años, que la muestra esté conformada por un valor por cada año o ciclo hidrológico.
Asociando a T con la probabilidad de ocurrencia de un determinado evento, se tiene:
 la recurrencia de que un determinado evento xo sea superado es T = 1 / [1 - F(xo)]
 la recurrencia de que ocurran eventos menores a xo T = 1 / F(xo)

4.3.3 Frecuencia Experimental o Posición de Ploteo


A partir de una muestra de datos de una variable aleatoria hidrológica y, en función del objetivo
principal: determinar la probabilidad y recurrencia de que un determinado evento sea alcanzado y/o
superado, es necesario determinar la frecuencia experimental de los valores de la muestra y poder
comparar con la distribución teórica analizada.
Suponiendo una variable aleatoria X compuesta por valores anuales x, y llamando:
F(x) = probabilidad de X  x determinado
(1 – F(x)) = probabilidad de X  x determinado
Si la variable aleatoria X representa eventos anuales, F(x) es la probabilidad anual que el valor
de x no sea superado y (1 – F(x)) es la probabilidad anual de que el valor x sea alcanzado o supe-
rado; la recurrencia T = 1/F(x), es el período promedio en años en el cual el valor de x no es supe-
rado y la recurrencia T = 1/(1 – F(x)), es el período de tiempo promedio expresado en años en el
cual puede ser superado el valor de x.
La frecuencia experimental o empírica (F*(xi)) de los valores que constituyen una muestra, es
la asignación a cada valor de la muestra de una frecuencia en base al ordenamiento de la misma
por orden de magnitud.
De esta forma, luego de ordenar los N valores de la muestra, de menor a mayor, sin importar
la cronología de eventos, se le asigna un valor F*(xi) que dependerá de su número de orden i de la
variable.
Existen distintos tipos de expresiones que se han propuesto para su evaluación:
i
F xi = Función utilizada para la construcción de histogramas y polígonos de frecuencia
N
(estadística descriptiva); no se debe usar en la inferencia estadística puesto que se le asigna
al mayor valor de la serie (i = N) una frecuencia F* del 100%, esto no es real puesto que
implicaría que no hay un valor mayor en la población; no existe un suceso seguro.
i-1
F xi = Conceptualmente es similar al caso anterior, no se utiliza en la inferencia
N

Ing. Rec. Hídricos Juan B. Sciortino 56


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

estadística puesto que se asigna al valor menor (i = 1) una frecuencia experimental F* = 0%,
esto tampoco es real puesto que establece que no se pueden producir eventos menores al
mínimo; no existe un suceso nulo.
i
F xi = (Weibull) expresión muy utilizada con funciones de baja asimetría, típica de
N+1
series de valores medios con escasa fluctuación de la variable alrededor de la media (preci-
pitación anual, mensual, temperatura media anual, caudales medios anuales, etc.)
i - 0,5
F xi = (Hazen) recomendada para series de valores extremos como la máxima
N
precipitación diaria, caudales máximos instantáneos, caudales mínimos medios diarios,
etc.).
i- 0,44
F xi = (Grigorten) recomendada para series de valores extremos, distribuciones
N – 0,12
del tipo I.

4.3.4 Ajuste Estadístico: Muestra - Distribuciones de Probabilidad


La finalidad de un ajuste estadístico es, obtener, a partir de una muestra o serie de datos
independientes, la función de distribución de probabilidades que más se aproxime a la correspon-
diente de la población de la variable.
La metodología práctica para realizar un ajuste estadístico es la siguiente:
1. Selección de la serie, en función del estudio propuesto, es indispensable que la serie esté
conformada por un valor de la v.a. por año o ciclo hidrológico, o al menos tantos valores como
años de observación se tenga.
2. Cálculo de los estadísticos de la muestra, incluyendo los de la variable transformada por
logaritmos y los de la variable reducida con la media de la serie.
3. Ordenar los valores de la variable aleatoria de menor a mayor y asignar un número de orden
sin considerar la cronología de los eventos.
4. Determinación de la Frecuencia Empírica o Experimental de cada valor de la serie ordenada
según el tipo de serie que se trate.
5. Graficar en un sistema de ejes coordenados los valores de la variable con su correspondiente
frecuencia experimental F*.
F(x) Figura No. 4.9
1
F*

0
X
Frec. Experimental Frec. Teórica
6. Seleccionar las funciones de distribución de probabilidades en función de los estadísticos de la
muestra, calcular sus parámetros según corresponda.
7. Cálculo de las probabilidades (F(x)) para un gran recorrido de la v.a., incluyendo los valores

Ing. Rec. Hídricos Juan B. Sciortino 57


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

de la serie y también se debe calcular los valores de la v.a. para las distintas F*, de esta manera
se conforma un importante conjunto de pares x – F(x) para graficar sobre los puntos x – F*
(Figura No. 4.9). Este paso se realiza para todas las funciones seleccionadas en el punto 6.
8. Seleccionar la función teórica que mejor se ajusta a la muestra, para esta tarea se recurre
a una serie de métodos que deben ser evaluados en forma conjunta para tomar una decisión:
a).- Contraste Visual entre los puntos de x – F* y las distintas funciones de distribución eva-
luadas.

b).- Tests Estadísticos, se plantea una hipótesis de aceptar el ajuste estadístico con un de-
terminado nivel de significación , en hidrología se utiliza  = 0.05 = 5%, esto quiere decir
que se tiene un 95% de probabilidad de haber tomado una decisión correcta (haber aceptado
el ajuste siendo bueno o rechazarlo siendo malo). No es conveniente tomar un  menor
puesto que aumenta la probabilidad  de aceptar la hipótesis siendo incorrecta o falsa.
Los tests más usados son el 2 de Pearson y el de Smirnov-Kolmogorov.
2 de Pearson: Divide el rango de la variable en intervalos de clases haciendo una comparación
entre el número total de observaciones en cada intervalo y el número esperado.
Llamando:
r Oi-NPi
2c = Zi2 con Zi=
1 NPi0,5
Donde: i = 1 ... r (número de intervalos)
Oi, número de observaciones en el intervalo i
NPi, número de valores esperados en el intervalo i según la función teórica, N es el
número total de datos de la serie y Pi es el intervalo de probabilidad correspondiente
al intervalo de clase i.
Para aceptar el ajuste se debe verificar:
2c = 2α,
Donde: 2, es el valor teórico tabulado para un nivel de significación  y  grados de libertad,  = r
– k – 1; siendo k el número de parámetros de la función de distribución de probabilidades (en la
Normal k = 2 (,); en PIII k = 3 (,xo,); etc.).

Smirnov-Kolmogorov: se calcula la máxima desviación en valor absoluto entre las frecuencias


experimentales y las teóricas.
Zc = Máx F(xi) – F*i
Se acepta la hipótesis si Zc < Z,N
Z,N es un valor tabulado en función del nivel de significación y la longitud de la muestra.
Si bien se considera que el test 2 de Pearson es muy bueno se le critica que es necesario que
la muestra sea grande, con al menos 5 valores por cada intervalo; en las series de valores extremos
puede darse que se acepte el ajuste pero en los extremos de la función puede haber un importante
desvío entre lo observado y lo teórico. Otro problema del test es que la división de clases de la
variable aleatoria es subjetiva.
Al test de Smirnov-Kolmogorov se le critica que basa toda su potencia en una sola distancia,
la máxima.

c).- Cálculo de los errores medios cuadráticos de la frecuencia y de la variable.

Ing. Rec. Hídricos Juan B. Sciortino 58


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

∑N
1 F xi - F*i
2
AMCF=
N

∑N
1 xi-x(Fi)
2
AMCV=
N

Luego de seleccionar la Función de Distribución de Probabilidades que mejor ajusta con la


serie de datos se puede:
 Calcular el valor xo de la variable aleatoria, partiendo de una probabilidad F(xo) de ocurren-
cia de valores menores al estimado o la probabilidad [1-F(xo)] de que el valor estimado sea
superado.
 A partir de un valor determinado de la variable xo, calcular la probabilidad F(xo) de ocurren-
cia de valores menores o, la probabilidad [1-F(xo)]de que xo sea superado.
 Con el xo asociado a F(xo) se determina la recurrencia o período de retorno de xo.

4.4 ESTADÍSTICA DESCRIPTIVA


Esta rama de la estadística se dedica exclusivamente a la recopilación, ordenamiento y trata-
miento de la información para su presentación por medio de tablas y de gráficos, así como de la
obtención de algunos parámetros útiles para la explicación de la información.
La recopilación de datos determina en gran medida el éxito de un estudio; se debe realizar una
planificación adecuada del trabajo a efectos de no redundar en la información, evitar costos eleva-
dos y elegir correctamente la técnica de toma de muestras.
En hidrología, gran parte de la información está publicada o bien se debe elaborar de los re-
gistros que cuentan los distintos organismos nacionales, provinciales, municipales y privados.
El denominador común de la información hidrológica es la escasa longitud o tamaño de las
muestras y, en muchos casos, con lagunas que disminuyen la posibilidad de su análisis.
Una serie es un ordenamiento sistemático de la información, este puede ser cronológico,
donde el fenómeno varía en el tiempo, o geográfico, donde la variación se produce en forma espa-
cial, en distintos puntos del territorio en estudio.
Los números que describen una muestra de datos son: las medidas de tendencia central (me-
dia aritmética), medidas de variabilidad (varianza, desvío y coeficiente de variación) y medidas de
asimetría (coeficiente de asimetría); estos valores fueron analizados en el apartado 4.2.4 del pre-
sente capítulo.
Normalmente se trabaja con un conjunto importante de datos que, a simple vista requieren un
análisis minucioso para obtener información y más aún, para los que desconocen la materia, este
volumen de datos tiende a confundirlos, por lo que, las figuras y tablas que se utilizan en esta área,
sintetizan, permiten visualizar la información y analizar el conjunto de datos existentes.

4.4.1 Gráficos Simples


La curva de datos cronológicos se desarrolla en un sistema coordenado, donde se grafica la
fluctuación en el tiempo de una variable hidrológica (temperatura media diaria, media anual, preci-
pitaciones mensuales, anuales, caudales medios diarios, mensuales, anuales, máximos anuales,
etc.), muchas veces se incluye la media de la variable y la variación del desvío estándar con res-
pecto a la media (Figura No.4.10).

Ing. Rec. Hídricos Juan B. Sciortino 59


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Datos Cronológicos Figura No. 4.10


Variable aleatoria
1200

1000

800
Xm + S

600
Xm

400
Xm ‐ S

200

0
1935 1940 1945 1950 1955 1960 1965 1970 1975 1980 1985 1990

Tiempo (años)

Esta forma de representación constituye un primer paso que permite apreciar la variación en
el tiempo del conjunto de la información.
Figura No. 4.11 Evaporación Media Mensual (20 años). Tanque A. Embarcación
160
Los diagramas de barras 140
permiten sintetizar la informa-
120
ción, generalmente a partir de
Evaporación (mm)

valores medios mensuales, de 100


la fluctuación anual de una va- 80
riable, de esta forma se puede 60
apreciar a simple vista el régi-
men que caracteriza la zona en 40

estudio (Figura No. 4.11): 20

0
ENE FEB MAR ABR MAY JUN JUL AGO SEP OCT NOV DIC

Figura No. 4.12 Temperatura Media Mensual (18 años)


30.0
También se puede utilizar
25.0
el mismo esquema para repre-
sentar la variación geográfica de
Temperatura (ºC)

20.0
una variable (Figuran No. 4.12):
15.0

10.0

5.0

0.0
ENE FEB MAR ABR MAY JUN JUL AGO SEP OCT NOV DIC

Col Sta Rosa Embarcación Zanja del Tigre

Ing. Rec. Hídricos Juan B. Sciortino 60


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

En síntesis, existen muchas formas y diagramas para sintetizar la información y facilitar la


comprensión, es importante saber seleccionar los datos a procesar y el tipo de gráfico a utilizar; se
debe recordar que muchas veces este tipo de trabajos es evaluado por personas que carecen de
conocimientos completos en el tema y deben tomar decisiones.

4.4.2. Análisis de Frecuencias


Los Histogramas y/o Polígonos de Frecuencia constituyen una herramienta importante para
analizar la distribución de frecuencias, tanto absolutas como relativas, de una variable aleatoria de
una muestra, ya sea de valores anuales, del conjunto de los registros mensuales o diarios.
Inicialmente se debe construir una tabla, denominada Tabla de Frecuencias, reagrupando los
valores de la variable sin importar el orden cronológico puesto que se estudia la variación de las
magnitudes.
La serie de datos de la variable analizada puede ser clasificada por orden de magnitud, para
ello se divide el rango total de variación en intervalos de clase de menor amplitud; a cada intervalo
se le asigna una frecuencia absoluta, dada por la cantidad de valores observados dentro de cada
uno de estos y se calcula la frecuencia relativa, en cada intervalo, dividiendo la frecuencia absoluta
con el número total de datos; finalmente se acumula en forma creciente o decreciente la frecuencia
absoluta y/o relativa, partiendo del 0% en la curva creciente y del 100% en el caso de la curva
decreciente.

Int. de Clase Frec. Abs. Frec. Rel. Frec. Abs. Frec. Rel.
(unidad v.a.) % Acumulada Acumulada %
0 0
(xo - x1) fa1 fr1 = fa1/N Fa1 = fa1 Fr1 = fr1
(x1+0,0001 – x2) fa2 fr2 = fa2/N Fa2 = fa1 + fa2 Fr2 = fr1 + fr2
…. …. …. …. ….
fai = N fi = 1
 Intervalos de Clases: son intervalos de la variable de menor amplitud que el rango de
variación de la misma, es conveniente que estos intervalos tengan una misma amplitud. El
número de intervalos depende de la longitud de la serie y de cómo se distribuyen los valores
en todo el rango.
No hay una expresión matemática con fundamentos teóricos para calcular la amplitud; la
siguiente relación empírica se puede utilizar como un punto de partida, y luego tantear su-
cesivamente hasta lograr un número de intervalos en el cual la distribución de la masa sea
compacta y sin cortes intermedios:
Rango Rango
+
Rango = Máx. valor v.a. - Mín. valor v.a. Amplitud = 5 20
2
Cuando se trabaja con series con grandes variaciones entre el mínimo y el máximo, con una
fuerte concentración de valores en los primeros intervalos y muy dispersos y escasos en el
extremo de los máximos, esto hace conveniente trabajar con dos o más amplitudes de inter-
valos.
El punto medio de cada intervalo de clase se denomina marca de clase.
 Frecuencia Absoluta: es el número de valores (fai), del total de la muestra, que caen
dentro de cada intervalo de clase; la sumatoria de los valores de esta columna es igual al
número total de datos N.
 Frecuencia Relativa: es el cociente entre la frecuencia absoluta de cada intervalo de
clase y el número total de observaciones de la serie, fi = fai/N; es evidente que la sumatoria
de los fi de esta columna es igual a la unidad.
 Frecuencia Absoluta Acumulada: se construye a partir de la suma de las frecuencias
Ing. Rec. Hídricos Juan B. Sciortino 61
ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

absolutas que se acumulan, desde el primer intervalo (menor), hasta el último en considera-
ción y representa, en el caso de la curva creciente, la cantidad de observaciones menores
al extremo superior de cada intervalo.
j
Faj= fai i=1, 2, …, j
i=1
Es costumbre, en el caso de procesar una serie de caudales pertenecientes a una determinada
estación de medición, trabajar con la frecuencia acumulada decreciente, asignando al extremo
inferior del primer intervalo el número N y restando, en cada fila, la frecuencia absoluta de cada
intervalo, de esta manera se obtiene la cantidad de valores que hay por encima del extremo
superior de cada intervalo.
j
Faj= N - fai i=1, 2, …, j
i=1
 Frecuencia Relativa Acumulada: se realiza el mismo análisis que en la columna  pero
con los valores de la frecuencia relativa; en el caso de la curva creciente, cada celda repre-
senta, el porcentaje de observaciones menores al extremo superior del intervalo correspon-
diente, con respecto al total de la serie de datos.

Ejemplo:
Muestra de datos: 14 años de temperaturas medias mensuales en San Rafael (Mendoza)
Total datos N = 168 Máximo = 25,1ºC Mínimo = 3,8ºC Rango = 21,3ºC
Amplitud calculada: 2,66ºC Amplitud adoptada: 2,0ºC
Frec. Rel. Frec. Rel.
Intervalos de Frec. Abs. Frec. Abs.
Frecuencia Frec. Relativa Acumulada Acumulada
Clase Acumulada Acumulada
Absoluta (%) Creciente Decreciente
(ºC) Creciente Decreciente
(%) (%)
0 0 168 100
3.00 - 5.00 2 1.19 2 1.19 166 98.81
5.01 - 7.00 10 5.95 12 7.14 156 92.86
7.01 - 9.00 21 12.50 33 19.64 135 80.36
9.01 - 11.00 25 14.88 58 34.52 110 65.48
11.01 - 13.00 11 6.55 69 41.07 99 58.93
13.01 - 15.00 18 10.71 87 51.79 81 48.21
15.01 - 17.00 12 7.14 99 58.93 69 41.07
17.01 - 19.00 14 8.33 113 67.26 55 32.74
19.01 - 21.00 27 16.07 140 83.33 28 16.67
21.01 - 23.00 18 10.71 158 94.05 10 5.95
23.01 - 25.00 9 5.36 167 99.40 1 0.60
25.01 - 27.00 1 0.60 168 100.00 0 0.00
Se recomienda, para visualizar la importancia de la clasificación, realizar el ejemplo pero con un
intervalo de clase de 2,5ºC.

A fin de visualizar la distribución de la frecuencia se construye el histograma de frecuencias,


este es un diagrama de barras que se desarrolla a partir de la Tabla de Frecuencias; en el eje de
abscisas se ubican los valores de la variable dividida en intervalos de clase y en el eje de ordenadas
la frecuencia correspondiente a cada clase, la masa se concentra en el punto medio del intervalo
denominado marca de clase.
Cuando se analiza una serie de caudales es común invertir los ejes, en el de abscisas la fre-
cuencia y en el de ordenadas la variable.
Pueden ser construidos a partir de la frecuencia absoluta o de la relativa, este último es el más
utilizado puesto que facilita la comparación entre el histograma obtenido y un determinado modelo
teórico representado por una función densidad de probabilidad.
El polígono de frecuencias es una representación gráfica de la distribución de frecuencias

Ing. Rec. Hídricos Juan B. Sciortino 62


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

que resulta equivalente al histograma y se obtiene uniendo mediante segmentos los centros de las
bases superiores de los rectángulos del histograma, es decir, en abscisas: los puntos de las marcas
de clase y en ordenadas la frecuencia correspondiente, absoluta o relativa.
El histograma de frecuencias acumuladas (absolutas o relativas) se construye con los va-
lores acumulados de frecuencias en cada intervalo de clase.
Los polígonos de frecuencias acumuladas u ojivas resultan de unir los centros de las bases
superiores de los rectángulos de la distribución del histograma de frecuencias acumuladas.
En ambos casos pueden construirse en forma creciente o decreciente; los histogramas acu-
mulados y ojivas crecientes son las representaciones más comunes en las diversas ciencias que
recurren a la estadística, inclusive, en la hidrología, pero los decrecientes son, a fuerza de costum-
bre, utilizados para representar la distribución de frecuencias de caudales.
Ejemplo: De la tabla del ejercicio anterior se obtienen las siguientes figuras: Histograma de Fre-
cuencias Absolutas (Fig. No. 4.13), Histograma de Frecuencias Relativas (Fig. No. 4.14), Histo-
grama de Frecuencias Relativas Acumuladas Creciente (Fig. No. 4.15), Polígono de frecuencias
relativas (Fig. No. 4.16) y Polígonos de frecuencias acumuladas relativas (Fig. No. 4.17).

Figura No. 4.13


Histograma de Frecuencias Absolutas
Frecuencia Absoluta

30

25

20

15

10

0
3 5 7 9 11 13 15 17 19 21 23 25 27 29
1 3 5 7 9 11 13 15 17 19 21 23 25 27
ºC

Figura No. 4.14 Histograma de Frecuencias Relativas


Frecuencia Relativa (%)

18
16
Se puede observar
14
que no existe dife-
rencia en la forma 12
relativa de los histo- 10
gramas.
8
6
4
2
0
3 5 7 9 11 13 15 17 19 21 23 25 27 29
1 3 5 7 9 11 13 15 17 19 21 23 25 27
ºC

Ing. Rec. Hídricos Juan B. Sciortino 63


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Figura No. 4.15


Histograma de Frecuencias Relativas Acumulada
Frecuencia Relativa (%)

100
90
80
70
60
50
40
30
20
10
0
3 5 7 9 11 13 15 17 19 21 23 25 27
1 3 5 7 9 11 13 15 17 19 21 23 25
ºC

Figura No. 4.16 Polígono de Frecuencias Relativas


18
Frecuencia Relativa (%)

Mediana Media
16
14
12
10
8
6
4
2
0
1 3 5 7 9 11 13 15 17 19 21 23 25 27 29
ºC

Figura No. 4.17 Ojivas Creciente y Decreciente


100
Frecuencia Relativa (%)

90
80
70
60
50
40
30
20 Mediana

10
0
1 3 5 7 9 11 13 15 17 19 21 23 25 ºC 27

Ing. Rec. Hídricos Juan B. Sciortino 64


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Con la tabla de frecuencia y los gráficos resultantes se pueden precisar dos conceptos ya
definidos en el apartado 4.2.4 “medidas de tendencia central”:
Mediana: es la medida de la variable que divide la masa de las frecuencias relativas en dos partes iguales o,
lo que es lo mismo, es el valor de la variable en el cual el 50% del tiempo se han producido valores menores
o iguales.
Moda: es el valor que ocurre con mayor frecuencia en una tabla o curva de frecuencias de una serie de datos.
Es posible que en algunas ocasiones se presente dos intervalos con la mayor frecuencia, lo cual se denomina
Bimodal, en otros casos, más de dos valores, lo que se conoce como multimodal.

Cuando una distribución es simétrica, la media coincide con la mediana y con la moda y la
asimetría de la muestra es igual a 0.
En la Figura No. 4.18 se muestra la relación entre las medidas de tendencia central y distribu-
ciones de frecuencias.
Moda

Moda
Moda
Mediana

Figura No. 4.18 Mediana

Mediana
Media

Media
Media

Distribución Asimétrica Distribución Simétrica Distribución Asimétrica


Asimetria < 0 Asimetria = 0 Asimetria > 0

Una forma de cuantificar la serie de datos está dada por las denominadas medidas de posición,
dentro de estas se destacan:
Percentiles: son los valores de la variable resultantes de dividir la curva de frecuencias relativas
creciente en cien partes porcentualmente iguales; el Percentil 15 (P15) es el valor de la variable en
la cual el 15% de los datos observados son menores.
Cuartiles: son los tres valores la variable que dividen la curva de frecuencias relativas creciente en
cuatro partes porcentualmente iguales, constituyen un caso particular de percentiles; el primer cuar-
til Q1 es P25, es el valor de la variable que supera una cuarta parte de los valores de la serie; el
segundo cuartil Q2 es P50, coincide con la mediana, corresponde al valor que supera el 50% de los
datos y el tercer cuartil Q3 es P75 corresponde al valor que es mayor que tres cuartas partes de los
datos.

Analizando las figuras precedentes y la tabla de frecuencia del ejemplo anterior se puede realizar
el siguiente resumen de las características de la serie de datos:
Total datos N = 168 Máximo = 25,1ºC Mínimo = 3,8ºC Rango = 21,3ºC
Media = 14,8 ºC Mediana = 13,7 ºC
Moda = Bimodal (dos modas extremas bien definidas 10 y 20 ºC respectivamente con mayor con-
centración en la temperatura más baja)
Varianza = 32 Desvío Estándar = 5,7 ºC Coef. Variación = 38,2 %
Coeficiente de Asimetría = -0,023 Curtosis = -3,41
Cuartiles: Q1 = 8,7 ºC Q2 = 13,7 ºC Q3 = 19,0 ºC
Percentiles: P10 = 6,5 ºC P40 = 11,7 ºC P60 = 16,3 ºC P90 = 21,2 ºC

Ing. Rec. Hídricos Juan B. Sciortino 65


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Obsérvese que, en ningún momento, en el estudio descriptivo de los datos de una serie (tabla
de frecuencia, histogramas y polígonos de frecuencia) se ha utilizado término “probabilidad”, siem-
pre se ha hecho referencia al porcentaje de datos, con respecto a la totalidad de la serie o conjunto
de observaciones existentes de la variable, que son superados por un valor determinado de la va-
riable o que superan dicho valor. Esto se debe a que se estudia y describe un conjunto de valores
y no se infiere acerca de la población que los contiene.
Para determinar la probabilidad de ocurrencia de un determinado valor de una variable se
requiere, realizar la inferencia estadística de la población a la cual pertenece la muestra de datos y
evaluar el modelo probabilístico correspondiente.
Se realiza esta diferenciación, pese a que es obvia, puesto que es muy común escuchar a
profesionales que, desconociendo los conceptos básicos de la estadística, hacen referencia, a partir
de un simple polígono de frecuencias acumuladas resultante de un conjunto de observaciones de
una variable, a la probabilidad de ocurrencia de un determinado valor, cuando en realidad se tiene
que decir que, del conjunto de observaciones, el valor de referencia ha sido superado un porcentaje
determinado de veces o de tiempo, o que, este valor es mayor a un tanto por ciento del total de
datos.

4.5 ANÁLISIS DE REGRESIÓN Y CORRELACIÓN SIMPLE


En la hidrología, como en muchas otras ciencias, interesa conocer el grado de relación exis-
tente entre dos o más variables, establecer si existe o no semejanza en el comportamiento de estas,
cuál es la intensidad de la relación y encontrar una ley matemática que describa la relación entre la
variación de los atributos.
Se denomina análisis de correlación a la evaluación, por medio de técnicas estadísticas del
grado de relación entre dos o más variables; para representar esta relación se utiliza una represen-
tación gráfica llamada diagrama de dispersión.
Normalmente se cuenta con una única variable de salida o respuesta (dependiente) Y, mien-
tras que se pueden tener una o varias variables de entrada (independientes) X1, X2, ..., Xk,.
En estas condiciones, el análisis de regresión consiste en encontrar una expresión matemá-
tica entre la variable dependiente Y el conjunto de variables independientes Xi (Y=f(X1,X2,...,Xk)) que
aproxime a la relación que realmente existe entre estas y que es desconocida, con el objeto de
poder predecir valores de Y, a partir de los valores de Xi.
Según que la variable de salida Y dependa de una o varias variables de entrada, se denomina
de regresión y correlación simple o regresión y correlación múltiple respectivamente; aquí se tra-
tará únicamente la forma simple, para estudiar los métodos multivariados se recomienda: "Probabi-
lity and Statistics in Hydrology". Yevjevich, V. y “Análisis Estadístico”. Chow, Y.
Según la forma que presente la función que relaciona las variables, se pueden distinguir la
regresión lineal y las no lineales: parabólica, hiperbólica, etc.
En hidrología se presentan dos tipos de regresiones:
a) Relaciones basadas en términos de causa-efecto, donde la variable aleatoria Y está
correlativamente relacionada con un factor causal X, el que produce o afecta la salida
de Y. Un ejemplo típico es la relación Escorrentía (Y) = f[precipitación (X)].
b) Relaciones entre variables aleatorias que tienen los mismos factores causales. Por
ejemplo, la precipitación de estaciones próximas sometidas a un mismo régimen hidro-
meteorológico.
Dadas dos variables aleatorias (datos observados) Xi e Yi, coincidentes en el tiempo, siendo
Yi(Y1, Y2, Y3, …, YN) la variable dependiente y Xi(X1, X2, X3, …, XN) la variable independiente,
graficando los pares de valores ordenados en un sistema de ejes ortogonales se genera una nube
de puntos (diagrama de dispersión)
Ing. Rec. Hídricos Juan B. Sciortino 66
ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Figura No. 4.19


Y
Si existe una relación entre estos valores, se
alinearan siguiendo una función matemática tal
como una línea recta, una parábola, etc.

X
La ecuación de la función Y* = f(X), debe ser tal, que sea mínima la distancia entre los valores
observados Yi y los correspondientes de la función Y*i, para lo cual se utiliza el método denominado
Mínimos Cuadrados.

Y Figura No. 4.20


En el caso de una recta la función toma la siguiente
forma:
(Xi,Y*i) Y* = a X + b
se deben determinar los coeficientes “a” y “b” que mini-
(Xi,Yi) micen esa distancia, o sea por el método de Mínimos
Cuadrados:
N N
2 2
A= Yi-Y*i = Yi- a Xi + b
1 1
A A
=0 =0
a b

X
Derivando queda un sistema de dos ecuaciones con dos incógnitas donde “a” y “b” se obtienen
de las siguientes expresiones:
∑N N N
1 Xi ∑1 Yi – N ∑1 Xi Yi SXY
a= 2
= 2
∑N N 2 SX
1 Xi - N ∑1 Xi
b= Ym – a Xm
siendo: Xm, Ym las valores medios de las series X e Y respectivamente
SX , Sy el desvío estándar de la series X e Y respectivamente (SX2 varianza)
SXY covarianza de las series X, Y

La covarianza es una medida de la asociación lineal entre dos variables aleatorias que resume
la información existente en un gráfico de dispersión, en general se simboliza como SXY cuando se
trata de dos series o muestras y XY.
Una covarianza positiva significa que existe una relación lineal positiva entre las dos variables.

Ing. Rec. Hídricos Juan B. Sciortino 67


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Es decir, los valores bajos de la variable (X) se asocian con los bajos de la variable (Y), mientras
los altos de X se asocian con los valores altos de Y.
Una covarianza de negativa significa que existe una relación lineal inversa perfecta (negativa)
entre las dos variables. Lo que significa que los valores bajos en X se asocian con los valores altos
en Y, mientras los altos en X se asocian con los bajos en Y.
La covarianza se aproxima a cero cuando no exista relación entre ambas variables o cuando,
existiendo, la relación sea marcadamente no lineal.
La covarianza depende de las unidades de medida de las variables, por lo que no es útil al
momento de comparar grupos diferentes de observaciones con unidades o escalas de medición
diferentes.
A fin de solucionar el problema de unidades y definir el grado de relación entre las variables
Pearson desarrolló el denominado Coeficiente de Correlación (R), que resulta del cociente entre la
covarianza y el producto de los desvíos de ambas variables:

R0
Figura No. 4.21
SXY R  -1
R= Variables no correlacionadas
Correlación negativa
2 2
SX SY

donde -1 ≤ R ≤ 1
Si R = 0, no existe correlación, por
lo tanto hay independencia total en-
tre las dos variables.
Si R = 1, existe una correlación po-
sitiva perfecta o dependencia total
entre las dos variables, todos los
puntos se alinean en la recta. R  0 R  1
Si 0 < R < 1, correlación positiva. Correlación no lineal Correlación positiva

Si R = -1, existe una correlación ne-


gativa perfecta, esto indica una de-
pendencia total e inversa entre las
dos variables, todos los puntos se
alinean en la recta.
Si -1 < R < 0, existe una correlación
negativa

Se denomina coeficiente de determinación a la variación total en la variable dependiente Y,


que se explica por la variación en la variable independiente X y se calcula elevando al cuadrado el
coeficiente de correlación:
2
2 SXY
R = 2 2
donde 0 ≤ R2 ≤ 1
SX SY

Si se multiplica R2 por 100 se puede expresar como el porcentaje de la variación de la variable


Y explicada por la variable X, cuanto más se aproxime al 100% más fuerte será la correlación lineal.

Ing. Rec. Hídricos Juan B. Sciortino 68


ELEMENTOS DE HIDROLOGÍA CAPÍTULO 4
CÁTEDRA: HIDRÁULICA APLICADA

Cuando el diagrama de dispersión muestra que los puntos siguen una relación que no es lineal,
pero sí: exponencial, logarítmica, parabólica (polinómica), hiperbólica, etc., es evidente que el coe-
ficiente de correlación lineal no sirve para medir la calidad de la relación entre variables, en estos
casos se utiliza otro tipo de coeficiente.
Las regresiones no lineales pueden ser presentadas de la siguiente forma:
Exponencial: Y* = a e b X
Logarítmica: Y* = a + b Ln X
Potencial: Y* = a + Xb
b a
Hiperbólica: Y* =a+ o Y* =
X b+cX
2
Polinómica: Y* =a + b X + c x + …
Para determinar los coeficientes de cualquiera de estas funciones, por el método de mínimos
cuadrados, se procede igual que con la función lineal:
N
2
A= Yi-Y*i
1
se deriva e iguala a 0 la función A, tantas veces como coeficientes se necesiten calcular:
A A A
=0 =0 =0 ……
a b c

Algunos casos de regresión no lineal pueden linealizarse mediante una transformación de la


función y de esta forma se simplifica el cálculo. Por ejemplo, la función exponencial puede llevarse
a una lineal aplicando logaritmo:
Y* = a e b X transformación ln Y* = ln a + b X

Ing. Rec. Hídricos Juan B. Sciortino 69

También podría gustarte