Muchas veces es necesario contar con una mayor flexibilidad sobre los valores que pueda tomar el
parámetro; es decir tener un rango de valores en los cuales se encuentre el verdadero valor del
parámetro.
Para poder definir un intervalo de confianza se necesita primero introducir el concepto de confianza.
El nivel de confianza es el grado de seguridad que se tiene sobre la veracidad de una afirmación sobre
el parámetro o los parámetros de interés. Por ejemplo, uno podría decir que la confianza de que la
estatura promedio de los mexicanos esté entre 1.60 y 1.70 m es de 90%.
El nivel de confianza se denotará como 1 - , donde es una constante entre cero y uno.
Con base en lo anterior el Intervalo de Confianza., es un rango de valores en el cual se encuentra el
verdadero valor del parámetro Ø, con un determinado nivel de confianza 1 - . Al grado de precisión de
la estimación por intervalo se le conoce como error de estimación y su valor máximo se denota por β.
En estadística, la probabilidad que asociamos con una estimación de intervalo se conoce como el nivel
de confianza. Esta probabilidad, entonces, índica que tanta confianza tenemos de que la estimación de
intervalo incluya al parámetro de la población. Una probabilidad más alta significa más confianza.
En estimación por intervalo se necesitan dos estadísticas, T1 y T2, cuyos valores determinaran los límites
inferior y superior del intervalo de confianza, respectivamente.
Si T1 y T2 son estadísticas, entonces se puede calcular probabilidades del tipo
P ( T1 < Ø < T2 ) = 1 - .
Por ejemplo, bajo ciertas condiciones para algún valor de c, la probabilidad de que la media poblacional
µ pertenezca al intervalo ( x - c, x + c) es un intervalo de confianza para µ con un nivel de 1 - .
En estimación por intervalo, el nivel de confianza tiene una interpretación que se basa en el supuesto de
que se tuviera acceso a todas las posibles muestras de una población. Si por ejemplo ( x - c, x + c) es
un intervalo de confianza del 95%, el nivel de confianza se puede interpretar como que el 95% de todos
los intervalos calculados para cada una de las posibles muestras contienen el verdadero valor de µ
Grado de confianza 95%
0.475 0.475
0.025 0.025
.88
z 2 1.96 z 2 1.96
z0
P ( xi - 1.96 x xi 1.96 x ) 95%
Para calcular el valor Z = 0.025 en R, basta con ejecutar el comando:
qnorm(0.975)
## [1] 1.96
Otra forma
(z_alfa2=qnorm(1-alfa2) )
## [1] 1.96
PARA 95% = .475 + .475 = Desviaciones de la proporción .475 = 1.96 CON DOS
EXTREMOS
95% = .50 + .45 = Desviaciones de la proporción 1.65 CON UN EXTREMO
Con Varianza Desconocida
PARA ENCONTRAR LOS VALORES DEL INTERVALO LO HAREMOS DE LA SIGUIENTE
MANERA
A LA MEDIA TAMAÑO DEL INTERVALO*DESVIACION = VALORES DEL INTERVALO
EJEMPLO:
n = 36; σ = 3 y = 24.2
24.2 ± 0.825 SUMADO 25.025 Y RESTADO 23.385
1.65 (3/) = 0.825
A LA MEDIA O VALOR MEDIO SE LE SUMA Y SE LE RESTA EL TAMAÑO DEL INTERVALO
POR LA DESVIACION
Confianza Formula X±e Intervalo
deseada (1-α)
90 % 0.05 ± 24.2±1.65* (3/) 23.375 – 25.025
95% 0.02
5
99 % 0.00
5
DE UN
EXTREMO
89%
90%
92%
93%
95%
99% 24.2±2.34*(3/) 26.54
DOS
EXTREMO
S
89%
92%
93%
90%
99% 24.2±2.58*(3/)
Valores de Z para los niveles de confianza más usados
Nivel de α α/2
Confianza
90% .10 .05 1.645
95% .05 .025 1.960
99% .01 .005 2.576
EN EXCEL: [Link]
[Link]
Intervalo de Confianza para la Media
1) En una muestra aleatoria de 30 empleados de una empresa se encontró que el salario medio es de
$180.00 por hora y la desviación estándar es de $14.00. El salario medio de todos los empleados por
hora de la empresa se estima, como se indica a continuación, mediante la estimación de un intervalo tal
que se pueda tener 95% de confianza de que el intervalo comprenda el valor de la media poblacional.
Datos
X = 180 1801.96*(2.96) sumando =185.7
S = 14 95% = α = 0.05 Restando = 174.27
n = 30
AL VALOR MEDIO LE VOY A SUMAR O RESTAR EL TAMAÑO DEL INTERVALO O EL VALOR DE z
POR LA DESVIACION
Intervalo de confianza = 0.95, por tanto, z = 1.96
PARA ENCONTRAR LA DESVIACION
Ahora en Excel:
=[Link](0.05,14,30)
Siendo el resultado entonces a nuestro valor medio de 180 le
Sumamos o le Restamos 5.0097436 para encontrar los extremos del intervalo
buscado 5.0097436 -> El intervalo será (174.990256 - 185.009744)
En Rstudio:
a <- 180
s <- 14
n <- 30
error <- qnorm(0.975)*s/sqrt(n)
left <- a-error
right <- a+error
left
right
RESULTADOS en Rstudio
> a <- 180
> s <- 14
> n <- 30
> error <- qnorm(0.975)*s/sqrt(n)
> left <- a-error
> right <- a+error
> left
[1] 174.9903
> right
[1] 185.0097
PARA CUANDO LA VARIANZA ES DESCONOCIDA
a <- 180
s <- 14
n <- 30
error <- qt(0.975,df=n-1)*s/sqrt(n) #SOLO PARA DISTRIBUCION t
left <- a-error
right <- a+error
left
right
RESULTADOS en Rstudio
> a <- 180
> s <- 14
> n <- 30
> error <- qt(0.975,df=n-1)*s/sqrt(n) #SOLO PARA DISTRIBUCION t
> left <- a-error
> right <- a+error
> left
[1] 174.7723
> right
[1] 185.2277
Interpretación: Con un nivel de confianza del 95% se puede afirmar que el salario promedio de todos
los empleados está entre $174.98 y 185.02.
GRAFICO de nuestro Intervalo de Confianza para la Media
174.98 185.02
Nivel de
confianza 0.95
180
OTRA FORMA PERO AHORA CON VALORES CON DE LA MUESTRA CON Rstudio:
data <- c(41, 345, 338, 339, 340, 343, 341, 343, 341, 328, 343, 347, 337, 348, 339)
[Link](data, [Link] = 0.90)$[Link]
RESULTADOS EN Rstudio
data <- c(41,345,338,339,340,343,341,343,341,328,343,347,337,348,339)
[Link](data, [Link] = 0.90)$[Link]
[1] 285.5911 356.1423 LIMITE INFERIOR Y SUPERIOR DEL INTERVALO BUSCADO
attr(,"[Link]")
[1] 0.9 TAMAÑO DEL INTERVALO
Ejemplo 2
El gerente de operación de la planta ensambladora de cerraduras Schlage de México, está interesado
en estudiar el proceso de ensamblado de una pieza particular de la cerradura que produce la empresa,
con el objetivo de reducir el tiempo que se toma el ensamble de dicha pieza. Con este fin, se formó un
equipo relacionado con el proceso de ensamblado. Para mejorar dicho proceso, se capacito a los
trabajadores y se les doto de mejores condiciones en su área de trabajo. Se seleccionaron 20
trabajadores al azar a los cuales se les registraron los tiempos de ensamblado (en segundos) antes y
después del curso de capacitación. Los datos se muestran en la siguiente tabla.
Tiempos de ensamblado registrados antes y después del curso de capacitación
Individu Ante Despué Individu Antes Despué
o s s o s
1 45 42 11 44 42
2 48 46 12 44 42
3 43 42 13 42 40
4 42 42 14 44 43
5 44 42 15 45 42
6 45 42 16 45 41
7 49 45 17 46 45
8 48 45 18 46 43
9 48 44 19 46 42
10 43 43 20 44 44
La información que se tiene es n = 20 trabajadores en la muestra, y se tiene una desviación estándar de
σ = 1.73 se quiere una confianza de 1 - .=0.95. Esto implica que y que , por lo que se obtiene el punto
critico = 1.96. De la información muestral dada en la tabla anterior se obtiene que el tiempo promedio
muestral de ensamblado fue de = 42.8. Sustituya todos los valores en el estadístico respectivo.
CON DOS EXTREMOS
Intervalo del 95% σ/ = 42.8 1.96 (1.73/ ) = (42.04 - 43.55)
EN EXCEL =[Link](0.05,1.73,20) = 0.758192
42.8 - 0.758192 = 42.041808
42.8 + 0.758192 = 43.558192
EN Rstudio
a <- 42.8
s <- 1.73
n <- 20
error <- qnorm(0.975)*s/sqrt(n)
left <- a-error
right <- a+error
left
right
> a <- 42.8
> s <- 1.73
> n <- 20
> error <- qnorm(0.975)*s/sqrt(n)
> left <- a-error
> right <- a+error
> left
[1] 42.04181
> right
[1] 43.55819
data <-c(45,48,43,42,44,45,49,48,48,43,45,48,43,42,44,45,49,48,48,43)
[Link](data, [Link] = 0.95)$[Link]
data <- c(42,46,42,42,42,42,45,45,44,43,42,42,40,43,42,41,45,43,42,44)
[Link](data, [Link] = 0.95)$[Link]
antes_A<-c(45,48,43,42,44,45,49,48,48,43,45,48,43,42,44,45,49,48,48,43)
[Link](data, [Link] = 0.95)$[Link]
despues_B<-c(42,46,42,42,42,42,45,45,44,43,42,42,40,43,42,41,45,43,42,44)
[Link](data, [Link] = 0.95)$[Link]
Intervalo del 99% σ/ = 42.8 2.57 (1.73/ ) = (41.89 - 43.79)
CON UN EXTREMO QUEDARIA
Intervalo del 95% σ/ = 42.8 1.65 (1.73/ ) = ( - )
Intervalo del 99% σ/ = 42.8 2.33 (1.73/ ) = ( - )
CON VARIANZA DESCONOCIDA DOS EXTREMOS
(s/
s/ = (42.8 2.0930(1.57/) = (42.06 - 43.55)
s/ = (42.8 2.8609(1.57/) = (41.79 - 43.88)
CON UN EXTREMO QUEDARIA
s/ = 42.8 1. 73 (1.57/) = ( - )
s/ = 42.8 2.54 (1.57/) = ( - )
VARIANZA CONOCIDA (Z) VARIANZA DESCONOCIDA ( t )
a <- 5 > a <- 5
s <- 2 > s <- 2
n <- 20 > n <- 20
error <- qnorm(0.975)*s/sqrt(n) > error <- qt (0.975, df = n -1) * s / sqrt (n)
left <- a-error > izquierda <- a - error
right <- a+error > derecha <- a + error
left > izquierda
[1] 4.123477 [1] 4.063971
right > derecha
[1] 5.876523 [1] 5.936029
σ/ = 42.8± 1.96(1.73/) = (42.04, 43.55) s/ = (42.8 2.0930(1.57/) =(42.06, 43.55)
σ/ = 42.8± 2.575(1.73/) = (41.89, 43.79)
Para = 0.01 = 0.005 = 2.8609
s/ = (42.8 2.8609(1.57/) =(41.79, 43.88)
a <- 42.8 a <- 42.8
s <- 1.73 s <- 1.73
n <- 20 n <- 20
error <- qnorm(0.975)*s/sqrt(n) error <- qt (0.975, df = n -1) * s / sqrt (n)
left <- a-error izquierda <- a - error
right <- a+error derecha <- a + error
left 42.04181 izquierda
right 43.55819 41.99034
derecha
a <- 42.8 43.60966
s <- 1.73
n <- 20
error <- qnorm(0.995)*s/sqrt(n) a <- 42.8
left <- a-error s <- 1.73
right <- a+error n <- 20
left error <- qt (0.005, df = n -1) * s / sqrt (n)
41.80357 izquierda <- a - error
right derecha <- a + error
43.79643 izquierda
43.90672
derecha
41.69328
Intervalo de Confianza para una Proporción
1) Una empresa de investigación de mercado establece contacto con una muestra aleatoria de 100
hombres de una ciudad grande y encuentra que una proporción muestral de 0.40 prefiere las hojas de
rasurar fabricadas por la empresa Gillette a las de otras marcas. Determinar la proporción de hombres
que en toda la ciudad que prefieren las hojas de rasurar de la empresa cliente, con un intervalo de
confianza del 95%.
Datos
p = 0.40
q = 1 – p = 1 – 0.40 = 0.60
n = 100
Intervalo de confianza = 0.95, por tanto, z = 1.96
DESVIACION
EN RSTUDIO
[Link](40,100)
0.3047801 0.5029964
> [Link](40,100)
1-sample proportions test with continuity correction
data: 40 out of 100, null probability 0.5
X-squared = 3.61, df = 1, p-value = 0.05743
alternative hypothesis: true p is not equal to 0.5
95 percent confidence interval:
0.3047801 0.5029964
sample estimates:
p
0.4
0.30 0.50
Nivel de
confianza 0.95
0.25 0.30 0.35 0.40 0.45 0.50 0.55
Interpretación: Con un 95% de confianza se estima que la proporción de todos los hombres de la
ciudad que prefieren las hojas de la empresa Gillette, está aproximadamente entre 0.30 y 0.50.
Ejemplo 2
En una muestra de 900 personas con pelo oscuro se encontró que 150 de ellas tenían los
ojos azules. Construir un intervalo de confianza al 95% para la proporción de individuos
que teniendo el pelo oscuro posee los ajos azules.
[Link](150,900) # Indicacion para R studio
> [Link](150,900)
1-sample proportions test with continuity correction
data: 150 out of 900, null probability 0.5
X-squared = 398.67, df = 1, p-value < 2.2e-16
alternative hypothesis: true p is not equal to 0.5
95 percent confidence interval:
0.1432251 0.1930061
sample estimates:
p
0.1666667
Ejercicio 3
Se ha obtenido una muestra al azar de 150 vendedores de una Editorial para estimar la proporción de
vendedores en la Editorial que no alcanza un lı́mite de ventas mı́nimo establecido por la dirección. De entre
los seleccionados, 50 no han conseguido llegar al lı́mite de ventas mı́nimo establecido.
Calcule el intervalo de confianza para la proporción de trabajadores en la Editorial que no alcanza el lı́mite al
80 %.
pi<-50/150
c<-150
nivelconfianza = 0.8
z<-qnorm(0.1)
#Claculo el error estándar y margen de error
[Link] <- sqrt((pi*(1-pi))/c) # Calculamos el error estándar
[Link] <- z* [Link] # nivel de confianza de 99%
[Link] <- pi - [Link] # Límite inferior del intervalo
[Link]
[Link] <- pi + [Link] # Límite superior del intervalo
[Link]
[Link](50, 150,[Link]=0.8,correct=F) EN FORMA DIRECTA
EJEMPLO PARA t student
Grafico del área bajo la curva
qt(0.05/2, df=9)
library(ggplot2)
library(mosaic)
plotDist("t", df = 9, groups = x < 2.26, type = "h")
Para calcular t19,0.025 y t19,0.975
qt(p=0.025,df=19)
[1] -2.093024
qt(p=0.975,df=19)
[1] 2.093024
Se ha obtenido una muestra de 15 vendedores de una Editorial para estimar el valor medio de las ventas por
trabajador en la Empresa. La media y varianza de la muestra ( en miles de euros ) son 5 y 2,
respectivamente.
Determine el intervalo de confianza para la venta media por trabajador en la Editorial al 99 %.
n <- 15 # El tamaño válido de la muestra
media <- 5 # la media
nivelconfianza = 0.99
desv <- sqrt(2) # utilizo la raíz cuadrada porque me dan como dato la varianza y la
fórmula del error estándar utiliza la desvío típico.
Luego calculo tα/2
qt(0.005,14) # donde 14 son los grados de libertad. GL = n – 1 = 15 - 1 = 14
## [1] -2.976843
Luego calculo tα/2=2.97
[Link] <- desv/sqrt(n) # Calculamos el error estándar
[Link] <- 2.97 * [Link] # nivel de confianza de 99%
[Link] <- media - [Link] # Límite inferior del intervalo
[Link]
## [1] 3.915509
[Link] <- media + [Link] # Límite superior del intervalo
[Link]
## [1] 6.084491
# La media poblacional va a estar entre los valores 3,91 y 6,08 con un 99% de
confianza
Ahora lo calculamos con una función de R, también del paquete BSDA
library(BSDA)
[Link](mean.x=5,s.x=sqrt(2),n.x=15,[Link]=0.99)
## Warning in [Link](mean.x = 5, s.x = sqrt(2), n.x = 15, [Link] =
## 0.99): argument '[Link]' ignored for one-sample test.
INTERVALOS Y PRUEBA DE HIPOTESIS EXCELENTE