0% encontró este documento útil (0 votos)
4 vistas62 páginas

Modelos de Distribución y Análisis Estadístico

El documento aborda el análisis de variables aleatorias continuas, específicamente distribuciones de probabilidad como Gamma, Weibull, Exponencial y Normal, aplicando métodos estadísticos para estimar parámetros y evaluar modelos mediante el criterio AIC. Se presentan cálculos de esperanzas, probabilidades conjuntas y proporciones, así como intervalos de confianza y pruebas de hipótesis. Finalmente, se discute el Teorema del Límite Central y su aplicación en la normalización de promedios de distribuciones continuas.

Cargado por

jpazcea
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
4 vistas62 páginas

Modelos de Distribución y Análisis Estadístico

El documento aborda el análisis de variables aleatorias continuas, específicamente distribuciones de probabilidad como Gamma, Weibull, Exponencial y Normal, aplicando métodos estadísticos para estimar parámetros y evaluar modelos mediante el criterio AIC. Se presentan cálculos de esperanzas, probabilidades conjuntas y proporciones, así como intervalos de confianza y pruebas de hipótesis. Finalmente, se discute el Teorema del Límite Central y su aplicación en la normalización de promedios de distribuciones continuas.

Cargado por

jpazcea
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

VARIABLE ALEATORIO CONTINUO( PC 3) :

Que valor tiene que tomar C para que en todo el domino me de un


valor igual de uno (teoria) ---- C tiene que ser un medio.

k
RESPUESTA : 0.3678794
CLASIFICAMOS LOS MDELOS DE MIREAD.
PREGUNTAS:
PRACTICA 4:

funciones densidad de gamma y weibull:

en el problema la primera ecuación es un gamma: el lamda es 0,4 y el alfa es 2

En la segunda ecuación es un Weibull : el alfa es 1.5 y el beta 7.8

Y 0,4 y 0,6 son los marginales y “X” seria distribución Bernoulli con probabilidad del exito es 0,6
porque x=1
Mis dos distribuciones condicionales

probabilidad conjunta como es hombre ( x=1) uso weibull sueldo menor a 5k , 0.6 porque es la
marginal de x=1

Probabilidad conjunt como es mujer ( x= 0) uso gamma sueldo mayor a 5k , 0.4 porque es la marginal
de x=0

en la E) y F) no multiplico por sus marginales porque ya me dicen si es mujer y hombre

no me piden una
probabilidad conjunta
G)

H) e I)
en el problema la primera ecuación es un gamma: el lamda es 0,4 y el alfa es 2

En la segunda ecuación es un Weibull : el alfa es 1.5 y el beta 7.8

A y B) me piden esperanza ( E ) en la a)me dicen mujeres y en la b) puede ser hombre o mujeres.

C)estoy condicionando a solo hombres entonces no considero 0,6 , Esperanza condicional para los
hombres
e) binomial, probabilidad conjunta(la de cuadro rojo):
TAREA 5 ) PART1)

EXPONENCIAL ( LAMBDA) Y~Exponencial(0.03852539)

> y = IMC_Rural2023$IMC

> [Link] = function(par) -sum(dexp(y,par,log=T))

> [Link] = optim(1,[Link])

> [Link]$par

[1] 0.03852539 PARAMETRO LAMBDA


> [Link]$value

[1] 47671.86 MAXIMO VALOR

GAMMA (alfa , lambda)y~GAMMA(37.089,1.429)

> y = IMC_Rural2023$IMC

> [Link] = function(par) -sum(dgamma(y,par[1],par[2],log=T))

> [Link] = optim(c(1,1),[Link])

Warning messages:

1: In dgamma(y, par[1], par[2], log = T) : NaNs produced

2: In dgamma(y, par[1], par[2], log = T) : NaNs produced

3: In dgamma(y, par[1], par[2], log = T) : NaNs produced

4: In dgamma(y, par[1], par[2], log = T) : NaNs produced

5: In dgamma(y, par[1], par[2], log = T) : NaNs produced

> [Link]$par

[1] 37.089516 1.429547

> [Link]$value

[1] 32023.38

Weibull(alfa,beta) y~weibull(5.737,27,827)

> y = IMC_Rural2023$IMC

> [Link] = function(par) -sum(dweibull(y,par[1],par[2],log=T))

> [Link] = optim(c(1,1),[Link])

Warning message:

In dweibull(y, par[1], par[2], log = T) : NaNs produced

> [Link]$par

[1] 5.737384 27.827580

> [Link]$value

[1] 33320.81

NORMAL( mu , sigma**2) y~Normal(25.94, 4.35^ {2} )

> y = IMC_Rural2023$IMC
> [Link] = function(par) -sum(dnorm(y,par[1],par[2],log=T))

> [Link] = optim(c(1,1),[Link])

Warning message:

In dnorm(y, par[1], par[2], log = T) : NaNs produced

> [Link]$par

[1] 25.948166 4.358774

> [Link]$value

[1] 32397.43

mi media es 25.948..... y mi desviación estándar es 4.35.....

Podemos concluir que la variable ¨y¨ puede ser descrita por diferentes modelos

tenemos que buscar que modelo se ajusta mejor a los datos

por eso tenemos que calcular el Estadistico AIC para todos los modelos :

Exponencial: 95345.72
Gamma: 64050.76
Weibull: 66645.62
Normal: 64798.86

x = seq(0,100, by = 0.01)

hist ((IMC_Rural2023$IMC), col="darkgreen", prob=T, ylim=c (0,0.03), main="DISTRIBUCION DE LOS


DATOS")

lines (density (IMC_Rural2023$IMC), col="black", lwd=2)

lines (x, dexp (x, 0.03852539), type = "l", col="blue", lwd=2)

lines (x, dgamma (x, 37.089516 , 1.429547), type = "l", col="red", lwd=2)

lines (x, dweibull (x, 5.737384 , 27.827580), type = "l", col="purple", lwd=2)

lines (x, dnorm (x, 25.948166 , 4.358774), type = "l", col="orange", lwd=2)

OBS: En ylim=c (0,0.03) debe ser (0,0.10)


Gamma tiene el menor AIC entonces es le mejor modelo . Ajusta mejor los datos.

Parte2)
COMPARAMOS MODELOS POR MEDIDAS

Y = IMC de las personas


EXPONENCIAL

E (Y) = 1/Lambda
1/0.03852539 = 25.9569079 de IMC
GAMMA
E(Y) = alfa/1ambda
37.089516 /1.429547 = 25,94452598

WEIBULL

E(Y)= beta * gamma (1 + 1/alfa)

NORMAL
E (Y) = 25.948166 de imc (el mu)
DATOS

Ahora con el RIC:

EXPONENCIAL

qexp (0.75, 0.03852539 ) - qexp (0.25, 0.03852539 )

GAMMA

qgamma (0.75, 37.089516 , 1.429547 )-qgamma (0.25, 37.089516 , 1.429547)

WEIBULL

qweibull (0.75, 5.737384 , 27.827580) -qweibull(0.25, 5.737384 , 27.827580)

NORMAL

qnorm (0.75, 25.948166 , 4.358774) -qnorm(0.25, 25.948166 , 4.358774)

DATOS

IQR(DATA$VARIABLE):
Ahora con proporciones ;

PROPORCIONES : P(y<30) , que probabilidad que mi y sea menor a 30IMC(no tenga obesidad)

EXPONENCIAL

pexp (40,0.02507812 )

GAMMA

pgamma (40, 37.089516 , 1.429547)

WEIBULI

pweibull(30, 5.737384 , 27.827580)

NORMAL

pnorm(30, 25.948166 , 4.358774)

DATOS:

Fun = ecdf(data$variable)

FUN(30)

La distribucion Gamma se aproxima moderadamente a las estimaciones de los datos.

OBSERVACIIN:

y = IMC_Rural2023$IMC[IMC_Rural2023$HV115 =="0"]

INTERVALO DE CONFIANZA:
[Link] para media poblacional

(1) primera forma para hallar el 37% (2) segunda forma para hallar el 37%

(PRE(Consumo de sal) entonces 1- fun(114) = personas que consumen sal común y tiene una
presion mayot a 114 son el 37% [Link] para propocion poblacional ([Link]( valor de exito ,
valores totales, mi nivel de confiabilidad)
No existe una diferencia significativa en diff porque -a b si fuera - a - b si hay una diferencia
significativa.

Alfa complemento de mi nivel de confianza

Se va aproximar 3388 para obtener un nivle de confianza 98% un error de estimacion de mas menos
1
Length(pobreza$ingresos[pobreza$ingresos<950) #cuantos de la variable ingresos cuantos son
menor de 950

De 1000 people hay 233 people que sus ingresos son menores a 950 soles

D.1)

AN

Si se cruzaran entonces es falso porque no hay una diferencia significativa


c :complemento
Variable binomial variable discreta

TEOREMA DEL LIMITE CENTRAL:

LAS MEDIAS(promedios) SIGUEN UNA DISTRIBUCION NORMAL CON PARAMETRO (U) Y VARIANZA
(SIGMA AL CUADRADO).
el sigma al cudrado del xbarra es la varianza/n

El Rstudio trabaja con desviacion estandar (sqrt(1.333/20)).


La distribución del peso de los libros puede ser cualquier distribución( gamma expo normal )

Pero es el peso es una distribucion continua

No me importa
que distribucion sea sino que sus promedios siguen una distribucion normal.
c)

fX toma valores de 0,1 ( exito o fracas ) podemos usar bernoulli o binomial entonces en este
problema se ve un solo ensayo entonces sigue una Bernoulli
curve para graficar

Graficamente se veria haci

El abline(V=29 ......................) es un ejemplo

PREGUNTA 3)
PROBLEMAS DE BIVARIADO DISCRETO:

DIAS(DISCRETO)

1) SI ( CONDICION)

LA PARTE ROJA ES UNA BINOMIAL


En la 2) me dice se espera entonces uso esperanza.

D)
DIAS Y : DIAS QUE LAS PERSONAS CONSUMEN FRUTAS

ANALIZAMOS MEDIA Y MEDIANA PARA COMPARAR EL MODELO Y LOS DATOS:


VARIANZA DE LA BINOMIAL NP(1-P)
PRUEBAS DE HIPOTESIS:
EJEMPLO:
PREGUNTA 1)

DATA ACEITE:
MI DATA ME ARROJA ESTO :
LO ANALIZO

NO ME INTERESA:

OTRO VALOR:

ME ARROJA :
OTRO: TRABAJAMOS CON EL 54
Ahora : P -value

En mu = 52

En mu = 55

En mu= 54
Obs:

También podría gustarte