Estadística y Probabilidad II CCH Oriente
Estadística y Probabilidad II CCH Oriente
VA R
IA
D I ST BL E A LE
R A
I NT E I B UCI O TORI A
R N
PRU E VAL OS D ES MUE S
B AS E T
D E H CONF I A RA L ES
I P ÓT N
E SI S ZA
COORDINARON
GÓMEZ SÁNCHEZ
VA R
IA
DI ST B L E AL E
R A
I N TE I BUCI O T ORI A
R N
PRUE VA L OS D E S MUE S
BA S E T
DE H CONF I A RAL E S
I PÓ T N
E SI S Z A
COORDINARON
GÓMEZ - SÁNCHEZ 2021 2022
COORDINARON CICLO ESCOLAR
GÓMEZ SÁNCHEZ 2021 2022
Introducción i
1. Modelos de probabilidad y sus aplicaciones 1
1.1 Variable aleatoria 2
1.2 Distribución binomial y distribución normal 37
1.3 Resumen y autoevaluación 76
2. Estimadores e introducción a la inferencia estadística 98
2.1 Población, muestra, parámetro y estadístico 99
2.2 Distribuciones muestrales 113
2.3 Resumen y autoevaluación 133
3. Inferencia estadística 140
3.1 Estimación 141
3.2 Prueba de hipótesis, media y proporción poblacional 160
3.3 Resumen y autoevaluación 177
A. Tablas 193
A.1 Probabilidades binomiales acumuladas 194
A.2 Probabilidades y percentiles normales 201
A.3 Números aleatorios 206
B. Soluciones 207
B.1 Soluciones a problemas propuestos 208
B.2 Soluciones a autoevaluaciones 214
Bibliografía 217
i
Este libro de texto es una contribución de quienes integramos el grupo de trabajo EMCONA en
apoyo la enseñanza aprendizaje de la asignatura de Estadística y Probabilidad II. Al mismo tiempo,
tiene el propósito de poner a disposición de los profesores y alumnos, un material que corresponda
al Programa de Estudios actualizado y que los oriente en un mejor desarrollo de las sesiones
presenciales, a distancia o híbridas. En su elaboración tomamos hemos tomado en cuenta dos
aspectos:
1. El enfoque disciplinario, es decir al destacar los argumentos básicos de la teoría matemática en
que se sustenta la inferencia estadística, sin olvidar que no es un libro para expertos. Tampoco
perdemos de vista la aplicabilidad y la utilidad que tiene la Estadística en desarrollo de las diferentes
áreas de la ciencia.
2. El enfoque didáctico, se encuentra totalmente vinculado al modelo educativo del Colegio, al
proponer el desarrollo de los aprendizajes que deben lograr los alumnos con base en la resolución
de problemas.
El libro se divide en once secciones; cada unidad contiene tres partes, en las dos iniciales
presentamos el desarrollo de los aprendizajes y contenidos temáticos y en la tercera se encuentran:
actividades extras, el resumen de los conceptos y propiedades básicas, el uso de las tecnologías y
la sección de autoevaluación de la unidad. Casi al final, el apartado A. incluye las tablas de
probabilidades binomiales acumuladas, las tablas de probabilidades y percentiles normales, y una
tabla de números aleatorios, por último, en el apartado B. Soluciones, contiene la solución a los
problemas propuestos en las secciones y las soluciones de las autoevaluaciones de las Unidades:
Unidad 1. Modelos de probabilidad y sus aplicaciones.
Unidad 2. Estimadores e introducción a la inferencia estadística.
Unidad 3. Inferencia estadística.
Para lograr los propósitos y aprendizajes del Programa de Estudios vigente de la asignatura de
Estadística y Probabilidad II, consideramos que, en las clases o sesiones, desarrollemos:
Las habilidades del profesor.
Al menos tres habilidades de los docentes del Área de Matemáticas se desprenden o son
propias de la formación científica de nuestra disciplina de estudio:
1. La formulación clara y precisa de los conceptos matemáticos.
2. El empleo o aplicación correcta de dichos conceptos en la resolución de problemas, mismos que
pueden ser de índole teórico, o bien de carácter concreto y práctico.
3. La utilización de las aportaciones de la estadística y de su metodología, a otras áreas del
conocimiento, ya sea de las ciencias de la naturaleza o de las ciencias sociales y humanidades, sin
descuidar las ciencias exactas.
Existen otras habilidades que tienen que ver con nuestra vocación como docentes, y que sólo
son efectivas al ponerlas en práctica en el salón de clase, tales como propiciar el interés y motivar el
ii
estudio por la materia, hacer uso de un lenguaje accesible, claro y versátil para con los alumnos. Del
mismo modo, tener paciencia y estar dispuestos a aclarar dudas y a tomar en cuenta sus
participaciones, entre otros elementos a considerar.
En este libro de texto de Estadística y Probabilidad II, nos propusimos apoyar este conjunto de
habilidades del profesor, de tal forma que, en cada una de las tres unidades el lector encontrará:
a) Una presentación de la Unidad temática
En donde se anotan los propósitos y los aprendizajes, también resaltamos las interrogantes: ¿qué
debe aprender? ¿Por qué debe aprenderlo?
Los profesores que participamos en la elaboración del libro coincidimos en que los aprendizajes son
el objetivo prioritario de nuestro trabajo en el aula con los alumnos, por lo que todas nuestras
propuestas didácticas, desde el material impreso, libros, artículos, las actividades, ejercicios o
problemas sugeridos, el uso de aplicaciones y programas de cómputo, por citar algunos, así como
las formas de evaluación y calificación, tienen que estar vinculadas con los propósitos y aprendizajes
del Programa de Estudios actualizado correspondiente.
En este contexto, puntualizamos los conceptos clave de cada uno de los aprendizajes descritos en
cada una de las Unidades del Programa de Estudios, y por ello, resaltamos en recuadros las
definiciones básicas indispensables del curso de Estadística y Probabilidad II.
Por otra parte, los alumnos y profesores podrán disponer de una exposición de los conceptos clave y
también del desarrollo paso a paso en la solución de problemas concretos, en los que se aplican
dichos conceptos. Asimismo, sugerimos una serie de:
b) Actividades de enseñanza aprendizaje.
En concordancia con el modelo educativo del Colegio y con el propósito de constatar que los
alumnos han comprendido correctamente los conceptos clave, incluimos al final de cada sección un
conjunto de problemas que requieren del uso de un procedimiento o de un algoritmo presentado en
el texto. La dificultad de los ejercicios ha sido graduada de tal manera que los primeros fomenten la
confianza del estudiante en sí mismo y que ello les refuerce los aprendizajes que se persigue
adquieran. De los últimos, se pretende sean un reto a su intelecto. En la sección A.4 proporcionamos
la solución de los ejercicios seleccionados.
Para enfatizar en los conceptos y aprendizajes, al final de las unidades incluimos:
c) Resumen y autoevaluación.
En primer lugar, se ubican actividades y ejercicios de apoyo en función de cada uno de los
aprendizajes y contenidos temáticos de las unidades, ofreciendo una variabilidad y extensión de
actividades realmente importante, tanto en calidad como en actualidad del tipo de problemas de los
que se ocupa la Estadística. Situación que es posible presentar con entera confiabilidad en virtud de
que dichas propuestas de actividades de enseñanza aprendizaje son producto, tanto de una
profunda revisión bibliográfica, como del resultado de muchos años de experiencia docente del
grupo de profesores con los estudiantes del CCH.
También, el lector encontrará un resumen de los conceptos e ideas clave para posteriormente,
resolver un conjunto de problemas tanto operativos como conceptuales, con el propósito de que el
estudiante pueda autoevaluarse e identificar su grado de avance en el aprendizaje de la materia.
Además, dedicamos un inciso al:
iii
El libro de texto significó para el grupo de trabajo EMCONA, un arduo trabajo de sesiones en
línea, de consulta e investigación de material bibliográfico sobre la materia de Estadística y
Probabilidad, lo que sin duda es un factor que explica su extensión, pero sobre todo el cumplimiento
de servir como un material sumamente completo y riguroso con respecto a la enseñanza de la
asignatura al nivel de nuestro bachillerato. No obstante, este libro en todas sus secciones ya
descritas, al igual que las referencias bibliográficas en que se apoya, están sujetas a las
consideraciones, propuestas y críticas constructivas que ayuden a mejorar el libro de texto.
En este marco de reflexión y propuestas académicas abiertas, el libro de texto para Estadística y
Probabilidad II, incluye al final una selección de bibliografía básica y complementaria susceptible de
ser utilizada por profesores y alumnos en el desarrollo y aprendizaje, respectivamente, del curso
escolar.
LOS AUTORES
iv
1.
MODELOS DE PROBABILIDAD
Y SUS APLICACIONES
PROPÓSITO
Al finalizar la unidad el alumno:
Continuará desarrollando su pensamiento estadístico, apropiándose del
concepto de variable aleatoria, y construyendo modelos de probabilidad
en términos de su tendencia, variabilidad y distribución
CONTENIDO
1.1 VARIABLE ALEATORIA
1.2 DISTRIBUCIÓN BINOMIAL Y
D ISTRIBUCIÓN NORMAL
2 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
Temática
Propiedades. Distribución. Distribución acumulada, Parámetros: valor
esperado y desviación estándar. Modelo de probabilidad continuo.
Sección 1.1 Variable aleatoria 3
La repetición de un fenómeno (bajo las mismas condiciones) que no siempre produce el mismo
resultado se denomina experimento aleatorio. En un experimento aleatorio es imposible determinar a
priori (inicialmente) cuál de sus resultados se va a producir, sin embargo, existe una ley de regularidad
que rige la frecuencia con la que se obtiene cada uno de ellos. Si en la repetición de un fenómeno
aleatorio es de mayor interés una característica numérica que una parte de sus resultados conviene
establecer una regla que asigne a cada resultado un número real, vea la figura 1.
s s
O
O
CI AL CI L
PA TR S PA T RA
S
E E S E ES
U U
E M E M
V V
En
E E
N N
Ei
T
O
E4
E3
T
O
Ei
E2
S S
E1
x1 ... xn a , b
VARIABLE VARIABLE
ALEATORIA X xi
ALEATORIA X intervalo de
números reales
números reales
FIGURA 1
La introducción de una regla que transforme los eventos (de un espacio muestral) en números
reales facilita su manejo en cuanto a, notación y escritura vinculando así la probabilidad con otras
ramas de la matemática.
“Una variable aleatoria es una regla que transforma los eventos del espacio muestral de
experimento aleatorio en números reales”.
X ( (h , h ) ) = 0.
La figura 2 muestra la transformación del espacio muestral en el conjunto RX = 0, 1, 2 .
S
IR
(m,m)
(m,h)
2
(h,m)
1
(h,h)
0
FIGURA 2
Y ( (r , r , r ) ) = 3 − 0 = 3 Y ( ( r , r , i ) ) = 2 −1 = 1,
Y ( (r ,i , r ) ) = 2 −1 = 1 Y ( ( i , r , r ) ) = 2 −1 = 1 ,
Y ( (r ,i ,i ) ) = 1 − 2 = −1 Y ( ( i , r , i ) ) = 1 − 2 = −1
Y ( (i , i , r ) ) = 1 − 2 = −1 Y ( ( i , i , i ) ) = 0 − 3 = −3 .
c. El diagrama de la figura 3 muestra un sistema de transportación de aceite, los puntos
V1 , V2 , V3 y V4 ,
representan válvulas y pueden estar abiertas o cerradas. Se desea transportar el aceite desde el punto
A hasta el punto B .
V2
A B
V1 V3
V4
FIGURA 3
Y ( 1 , 2 ) = ( 1 )( 2 ) = 2
Y ( 2, 2 )= ( 2 )( 2 ) = 4
el recorrido es el conjunto
RY = 1, 2, 4 .
( 1,1 ) ( 1, 2 ) ( 1, 3 ) ( 1, 4 ) ( 1, 5 ) ( 1, 6 )
( 2 ,1 ) ( 2,2 ) ( 2,3 ) ( 2,4 ) ( 2,5 ) ( 2 , 6 )
( 3 ,1 ) ( 3, 2 ) ( 3,3 ) ( 3, 4 ) ( 3,5 ) ( 3 , 6 )
S = .
( 4 ,1 ) ( 4,2 ) ( 4,3 ) ( 4,4 ) ( 4,5 ) ( 4 , 6 )
( 5 ,1 ) ( 5,2 ) ( 5,3 ) ( 5,4 ) ( 5,5 ) ( 5,6 )
( 6 ,1 ) ( 6,2 ) ( 6,3 ) ( 6,4 ) ( 6,5 ) ( 6 , 6 )
ii. La regla de correspondencia es
X = “Diferencia de los números que se observan en las caras”.
iii. Puesto que
X ( 1 , 1 ) = 1−1 = 0 X ( 1 , 2 ) = 1 − 2 = −1 X ( 1 , 3 ) = 1 − 3 = −2
X ( 2 , 1 ) = 2 −1 = 1 X ( 2, 2 )= 2−2 = 0 X ( 2 , 3 ) = 2 − 3 = −1
X ( 3 , 1 ) = 3 −1 = 2 X ( 3 , 2 ) = 3− 2 =1 X ( 3 , 3 ) = 3−3 = 0
X ( 4 , 1 ) = 4 −1 = 3 X ( 4, 2 )= 4−2 = 2 X ( 4 , 3 )= 4−3 =1
X ( 5 , 1 ) = 5 −1 = 4 X ( 5 , 2 )= 5−2 = 3 X ( 5 , 3 )= 5−3 = 2
X ( 6 , 1 ) = 6 −1 = 5 X ( 6, 2 )= 6−2 = 4 X ( 6 , 3 )= 6−3 = 3
X ( 1 , 4 ) = 1 − 4 = −3 X ( 1 , 5 ) = 1 − 5 = −4 X ( 1 , 6 ) = 1 − 6 = −5
X ( 2 , 4 ) = 2 − 4 = −2 X ( 2 , 5 ) = 2 − 5 = −3 X ( 2 , 6 ) = 2 − 6 = −4
X ( 3 , 4 ) = 3 − 4 = −1 X ( 3 , 5 ) = 3 − 5 = −2 X ( 3 , 6 ) = 3 − 6 = −3
X ( 4, 4 )= 4−4 = 0 X ( 4 , 5 ) = 4 − 5 = −1 X ( 4 , 6 ) = 4 − 6 = −2
X ( 5 , 4 )= 5−4 =1 X ( 5 , 5 )= 5−5 = 0 X ( 5 , 6 ) = 5 − 6 = −1
X ( 6, 4 )= 6−4 = 2 X ( 6 , 5 )= 6−5 =1 X ( 6 , 6 )= 6−6 = 0
El recorrido (o rango) de la variable aleatoria X es el conjunto
R X = − 5, − 4, − 3, − 2, − 1, 0, 1, 2, 3, 4, 5 .
1. Utilizaremos las siglas “ VAD ” para indicar que una variable aleatoria es discreta y las
siglas “ VAC ” para indicar que es continua.
2. Es común representar las variables aleatorias por las últimas letras (mayúsculas) del
alfabeto español tales como X , Y , Z , W ; y los números que asume por letras minúsculas,
adoptaremos esta convención en la presente obra.
8 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
La simbología:
i. X = x1 , x2 indica que la VAD X asume los valores (números) x1 y x2 .
ii. Z = z1 , z 2 , z10 indica que la VAD Z asume los valores z1 , z 2 y z10 .
iii. X ( A ) = x significa que la variable aleatoria X asocia al evento A el número real x .
Una variable aleatoria es una función bien definida (determinista) que no presenta aleatoriedad
alguna, recibe este nombre considerando que los posibles resultados del experimento aleatorio son los
diferentes números reales x que la función X puede asumir. Por tanto, una variable aleatoria es una
medición que se hace de cada uno de los resultados del experimento aleatorio que tiene como
respuesta número real. Así, cada evento tiene asociado un único número x . En la definición 1
formalizamos el concepto de variable aleatoria discreta, sin embargo, también existen variables
aleatorias que no son discretas. Llamaremos a la variable aleatoria X continua cuando su recorrido
sean todos los números reales de un intervalo I IR . La clasificación de las variables aleatorias en
discretas y continuas no es completa puesto que existen variables aleatorias que no son de estos tipos.
Una de las características que distinguen a las variables aleatorias continuas de las variables
aleatorias discretas, es que las primeras asignan probabilidad cero a un valor específico x0 del
recorrido de la variable, es decir,
si X es una variable aleatoria continua, entonces
p ( X = x0 )= 0
(no necesariamente es cierto si la variable aleatoria es discreta).
La forma de asignar probabilidades al recorrido de una variable aleatoria (es posible debido a la
equivalencia entre los números de su recorrido y los eventos de su dominio) se realiza con“la función de
probabilidad”, vea la figura 4., si la variable aleatoria es discreta; y con la función de densidad si es
continua, en el contexto que corresponda nos referiremos a ambas funciones por sus iniciales, es decir,
por fdp .
i
s
O
CI AL
S PA TR
E E S
E MU
V En
E
N Ei
T E4
E3
O E2
S E1
x1 ... xi xn
f(x)
VARIABLE p ( X = xi ) = f ( xi )
ALEATORIA X números
X
función de
reales probabilidad
FIGURA 4
RY = 1, 2, 4 .
iii. Dado que el espacio muestral tiene cuatro eventos simples, entonces
1 2 1
p ( Y =1 )= , p (Y = 2 )= y p (Y = 4 )= .
4 4 4
La información sobre las probabilidades puede sistematizarse en la tabla (distribución)
1
si y =1
4
y 1 2 4 2
o representarse en
p (Y = y )=
si y=2 .
4
1 2 1 forma de función
p(Y = y ) 1
si y=4
4 4 4
4
0 otro caso
b. Un futbolista ejecutará tres penales, la probabilidad de que anote uno de ellos es 0.5 y el anotar o
fallar el posterior no depende de los que ha ejecutado.
i. Si a = “el futbolista anota el penal” y f = “el futbolista falla el penal”,
entonces
S = (f , f , f ), ( f , f , a ) , ( f , a , f ),( a, f , f ) ,( f , a , a ), ( a , f , a ) , ( a , a , f ) ,(a , a , a )
ii. Las asignaciones de la variable aleatoria
X = “número de penales que el futbolista anota”,
a los eventos del espacio muestral S son
X ( ( f , f , f ) ) = 0 , X ( ( f , f , a ) ) = 1,
X(( f ,a, f ) ) = 1, X ( ( a , f , f ) ) = 1 ,
X ( ( f , a , a ) )= 2 , X ( (a , f , a ) )= 2,
X ( (a , a , f ) ) = 2 , X ( (a , a , a ) )= 3.
iii. Observe que el espacio muestral tiene cardinal ocho, entonces
1 3 3 1
p ( X = 0 )= , p ( X =1 )= , p ( X = 2 )= y p ( X = 4 )= .
8 8 8 8
La información sobre las probabilidades puede sistematizarse en la tabla (distribución)
1
si x=0
8
3
si x =1
x 0 1 2 4
8
o en la forma (como p ( X = x )= 3
si x=2
1 3 3 1 8
p( X =x ) función)
8 8 8 8 1
si x=3
8
0 otro caso
.
c. El 40% de las veces que las personas que comen tacos en el puesto de la esquina se enferman de
la panza. Una persona asiste a comer tacos a ese puesto un máximo de cuatro veces.
Sección 1.1 Variable aleatoria 11
y 1 2 3 4
p(Y = y ) 0.400 0.240 0.144 0.216
CASO DISCRETO
Los fundamentos teóricos de los ejemplos antes tratados se basan en las definiciones 4 y 5.
12 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
El lector debe tener en cuenta que los símbolos X y x , representan cosas distintas: X
representa una función y x un número real de su dominio. En general, representaremos una función de
probabilidad con la letra f minúscula.
x 1 2 1
2 3
fX (x) x
5 5 0 1 2
x −1 0 1 2
fX (x) 0 .2 0,6 0 .1 0 .1
f
0.2 x = −1
0.6 x=0
1
fX ( x )=
0.1 x = 1, 2
0 otro caso
-1 0 1 2 x
respectivamente
1
x 0 2 3
fX (x) 0 .1 0 .5 0 .4
0 1 2 3 x
FIGURA 5
respectivamente
La expresión
F ( x )= p ( X x )
es la función de distribución evaluada en un numero x cualquiera y proporciona la probabilidad de que
la variable aleatoria asuma un número (valor) menor o igual al número x . Así, F ( x ) representa una
probabilidad, por tanto, está comprendida entre cero y uno. Si f X ( x ) es la función de probabilidad de
la variable aleatoria X , entonces
F ( x ) = p ( X xi ) = f ( x ).
x xi
x −2 2 3
fX (x) 0 .2 0 .5 0 .3
En la tabla anterior:
i. Antes de x = −2 no hay probabilidad acumulada,
( x ) = 0 , si x −2 .
F
ii. Antes de x = 2 la probabilidad acumulada es F ( x ) = 0.2 , por tanto,
F ( x ) = 0.2 , para − 2 x 2 .
iii. Antes de x = 3 la probabilidad acumulada es F ( x ) = 0.7 , por tanto,
F ( x ) = 0.7 , cuando 2 x 3 .
iv. A partir de x = 3 la probabilidad acumulada es F ( x ) = 1 , por tanto,
F ( x ) = 1 , si x 3 .
La FPA y su representación gráfica son
16 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
0 si x −2 1
0.2 si − 2 x 2
F ( x )=
0.7 si 2 x 3
-2 0 1 2 3 x
1 si x 3
FIGURA 6
respectivamente.
x −2 1 2
fX (x) 0 .2 0 .4 0 .4
F(x )
i. En la construcción de la FPA que tiene asociada, agreguemos una tercera fila con primera entrada
(“cuadrito”) F ( x ) .
x −2 1 2
fX (x) 0 .2 0 .4 0 .4
F (x)
ii. En la segunda entrada repetimos la probabilidad del primer valor que asociado a la VAD :
x −2 1 2
fX (x) 0 .2 0 .4 0 .4
F(x ) 0 .2
f
0 si x −2
1
0.2 si − 2 x 1
F ( x )=
0.6 si 1 x 2
1 si x 2 -2 0 1 2 3 x
FIGURA 7
F
1
x1 O x2 xi - 1 xi xi + 1 x j -1 xj xj + 1 xn x
FIGURA 8
-1 0 1 2 3 x
FIGURA 9
i. p ( X 1 ) = F ( 1 ) = 0.8 .
ii. p ( X 3 ) = F ( 1 ) = 0.8 , revisa el inciso [Link] la proposición 2.
iii. p ( X 4 ) = F ( 3 ) = 1 , revisa el inciso [Link] la proposición 2.
iv. p ( X −1 ) = F ( − 1 ) = 0.5 , vea el inciso a. de la proposición 2.
v. p ( X −2 ) = F ( − 2 ) = 0 , vea el inciso [Link] la proposición 2.a.
vi. p ( X 1 ) = 1 − F ( 1 ) = 1 − 0.8 = 0.2 , vea los incisos d. y a. de la proposición2.
vii. p ( X 1 ) = 1 − p ( X 1 ) = 1 − 0.5 = 0.5 , revisa los incisos c. y b. de la proposición2.
viii. p ( 1 X 3 ) = F ( 3 ) − F ( − 1 ) = 1 − 0.5 = 0.5 , vea los incisos e. y a. de la proposición 2.
x1 O x2 xi xn x
xk xm
FIGURA 10
F
1
-4 -3 -2 -1 0 1 2 3 4 x
FIGURA 11
En los cursos elementales de estadística se calcula la media aritmética (que se representa con el
símbolo x y es un número alrededor del cual se agrupan o distribuyen los números del conjunto) de un
grupo de datos (muestra) sumándolos y dividiendo el total por el número de datos, es decir (en notación
sigma), para el conjunto de datos
x1 , x2 , x3 , , xn ,
la media aritmética es el número
n
f i xi
1 n
f1 x1 + f 2 x 2 + f 3 x3 + + f n x n
x= i =1
n
=
n
f 1 x1 =
n
,
f i =1
i
i =1
Sección 1.1 Variable aleatoria 21
los números f i representan las frecuencias de los datos (número de veces que se repite el dato x i ).
Supongamos que
R X = x1 , x2 , x3 , , xn
es el recorrido de la VAD X con frecuencias
f1 , f 2 , f 3 , , f n ,
respectivamente, entonces
n n n n n
1 fi fi
x=
n
i =1
f i xi =
i =1 n
xi =
i =1
xi
n
=
i =1
xi p ( X = xi ) = x
i =1
i fX ( xi ) ,
es decir,
n
x= x
i =1
i fX ( xi )
representa la media aritmética o “promedio” de la VAD X .
Si suponemos
x = E X ,
podemos rescribir
n
E X = x i fX ( xi ) .
i =1
x 0 1 2 6
1 3 1 1
fX (x)
4 8 4 8
su valor esperado es
1 3 1 1 13
E X = 0 + 1 + 2 + 6 = .
4 8 4 8 8
b. Si la VAD Y tiene distribución de probabilidad,
y −2 0 3 4 5
fY (y) 0 .1 0 .4 0 .2 0 .1 0 .2
Su valor esperado es
E X = ( − 2 )( 0.1 ) + ( 0 )( 0.4 ) + ( 3 )( 0.2 ) + ( 4 )( 0.1 ) + ( 5 )( 0.2 ) = 1.8 .
La descripción de la VAD X se complementa con el estudio del parámetro que manifiesta su nivel
de variabilidad en relación con su valor esperado. Si la VAD X tiene recorrido
R X = x1 , x2 , x3 , , xn
y valor esperado E X , entonces las diferencias
xi − E X
representan las dispersiones de los números xi respecto al valor esperado
E X ,
sin embargo, son de mayor utilidad las “dispersiones cuadráticas”, es decir los números,
( xi − E X )2 f X ( xi ) ,
vea la figura 12.
xi - E [ X ]
x
E[X] xi
FIGURA 12
( x )2 f X ( x i ) = ( x i − E X )2 f X ( x i )
n
V X = E i −E X
i =1
Para homogeneizar las unidades de la VAD X con las de su varianza es necesario introducir
como medida de su variabilidad la desviación estándar.
Observa que cuando la VAD X asume valores “lejanos” a su valor esperado E X el término
( X − E X )2 es grande y que, si asume valores “cercanos” al número E X el término
( X − E X )2 es pequeño. Por lo antes señalado, la varianza se utiliza para comparar distribuciones
de probabilidad semejantes.
x 0 1 2
1 1 1
fX (x)
4 2 4
En juegos gobernados por el azar el valor esperado se utiliza para estimar si, a la larga, es
conveniente o no participar en el juego, así un juego de azar se denomina “justo” cuando
E X = 0 .
El cliente gana si
E X 0
y la casa gana cuando
E X 0 .
1 2 1
fX (x)
4 4 4
Entonces
1 2 1
E x = −3000 + 1000 + 2000 = 250 ,
4 4 4
quien juegue un número “muy grande de veces”, en promedio, ganará $ 250 , luego conviene jugar.
b. Por otra parte
1 2 1
V X = ( − 3000 − 250 )2 + ( 1000 − 250 )2 + ( 2000 − 250 )2 = 3 687 500
4 4 4
y
VX = 3 687 500 1 920 .286 .
Las propiedades de los parámetros (el valor esperado y la varianza) son imprescindibles en la
justificación de las propiedades de los métodos de la inferencia estadística (que estudiaremos
posteriormente), por lo que no podemos prescindir de establecer sus propiedades básicas.
Sección 1.1 Variable aleatoria 25
CASO CONTINUO
Hasta el momento solo hemos tratado variables aleatorias con recorrido (o rango)compuesto por
un número finito de números, sin embargo, también existen variables, generalmente asociadas a
cantidades medibles tales como: tiempos, longitudes, áreas, volúmenes, pesos, entre otras, en las que
no es posible contar los valores que asumen. Derivado de la influencia del azar y con la certeza de que
26 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
la “medición exacta” de características numéricas (como las antes mencionadas) de los objetos es
imposible, al medir una característica del objeto, formalmente se le debe asignar un número indicando
el nivel de incertidumbre o precisión, lo que, entre otros elementos, justifica la existencia y estudio de
las variables aleatorias continuas.
Las variables aleatorias relacionadas con los procesos de medida se denominan continuas
(utilizaremos sus iniciales VAC para referirnos a ellas) y se caracterizan por asociar a cada evento del
espacio muestral un intervalo de números reales, revisa la definición 2.
El proceso de asignación de probabilidades a variables aleatoria continuas es más complejo que
en el caso discreto, en particular, se asigna probabilidad cero a valores específicos (números) asumidos
o asignados a una VAC .
S X
intervalo
w [ ] IR
0
X(w)
FIGURA 13
x
− 0 + a 0 b x
a. b.
FIGURA 14
Sección 1.1 Variable aleatoria 27
Con respecto a la figura15, el área de la región limitada por la curva asociada a la función continua
+
y positiva f y el eje X la representaremos con el símbolo A f .
−
y
f
x
− 0 +
FIGURA 15
En la definición 9:
i. El inciso a. garantiza que la probabilidad es un número positivo y que la curva asociada a la función
de densidad de probabilidad se encuentra en los dos primeros cuadrantes del plano cartesiano.
ii. El inciso b. significa que la probabilidad del espacio muestral es 1 , es decir, que el área de la región
del plano positiva que está limitada por la curva asociada a f X ( x ) y el eje x es 1 . Bajo las dos
b
condiciones anteriores p ( a X b ) = A f X , vea a la figura 16.
a
y y
f f
p ( X = x0 ) p ( a X b )
x0 0 b x a 0 b x
FIGURA 16
Como antes lo señalamos, si X es una VAC con fdp dada por f X , entonces
fX ( x0 ) = p ( X = x0 )= 0
garantiza
p ( a X b ) = p ( a X b ) = p ( a X b ) = p ( a X b ).
28 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
es una fdp , en efecto, en la figura 17 se observa una región rectangular de base y altura con
longitudes 1 , por tanto,
+ 2
Af
−
( x ) = A1 f ( x ) = ( 2 − 1 )( 1 ) = 1 , note que fX ( x ) 0.
y
1 f
0 1 2 x
FIGURA 17
y y
p ( 0.5 x 1. ) = 0.5 p ( 1.3 x 1. ) = 0.2
1 f 1 f
FIGURA 18
1.9
p ( 1.1 x 1.9 ) = A f ( x ) = ( 1.9 − 1.1 )( 1 ) = 0.8 .
1.1
2 2 2.5
p ( 1.8 x 2.5 ) = A f ( x )= Af ( x )+ A f ( x ) = ( 2 − 1.8 )( 1 ) + ( 2.5 − 2 )( 0 ) = 0.2 .
1.8 1.8 2
Sección 1.1 Variable aleatoria 29
y y
p ( 1.1 x 1.9 ) = 0.8 p ( 1.8 x 2. ) = 0.2
1 f 1 f
FIGURA 19
3 3
p ( 2.8 x 3 ) = A f ( x )= A f ( x ) = ( 3 − 2.8 )( 0 ) = 0 .
2.8 2.8
1 f
0 1 2 x
FIGURA 20
La figura 20 muestra un triángulo rectángulo de base de longitud 2 y altura de longitud 1 , por tanto, su
1
área es A = ( 2 )( 1 ) = 1 .También el segmento de recta asociado a
2
1
f ( x ) = 2 ( 2 − x ) si 0 x2
0 otro caso
se encuentra en el primer cuadrante del plano cartesiano, lo que significa que es no negativo.
Con base en las dos observaciones previas concluimos que
1
f ( x ) = 2 ( 2 − x ) si 0 x2
0 otro caso
es una función de probabilidad.
30 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
1 f 1 f 1 f
0 1 2 x 0 1/2 1 2 x 0 1/2 1 2 x
a. b. c.
FIGURA 21
1
c. La probabilidad p x es el área del trapecio con:
2
1 1 3
i. Base menor de longitud f ( 1 / 2 ) = 2 − = .
2 2 4
ii. Base mayor de longitud 1 .
1
iii. Altura de longitud .
2
3 1
+ 1
1 4 2 = 7
Vea la figura 21.b., entonces p x = .
2 2 16
1
d. La probabilidad p
x 1 es el área del trapecio con:
2
1 1
i. Base menor de longitud f ( 1 ) = ( 2 − 1 ) = .
2 2
1 1 3
ii. Base mayor de longitud f ( 1 / 2 ) = 2 − = .
2 2 4
1
iii. Altura de longitud .
2
1 3 1
+
1 2 4 2 5
p
Vea la figura 21.c., entonces x 1 = = .
2 2 16
Las variables aleatorias continuas tienen asociada una función de probabilidad acumulada y los
parámetros: valor esperado y varianza, sin embargo, los fundamentos matemáticos que involucran se
encuentran fuera de nuestro alcance.
Sección 1.1 Variable aleatoria 31
PROBLEMAS PROPUESTOS
(CASO DISCRETO)
1. Determina el recorrido. observados”.
a. X = “número de tazas limpias, de las 100 a. ¿Cuáles son los valores que asume X ?
que tiene una escuela”. b. Construya una lista de cinco eventos con los
b. Y = “Número de líneas telefónicas ocupadas valores que asocia X .
en momento en específico”, de un sistema
telefónico con 30 líneas. 4. Se va a determinar el número de retretes
c. Un refrigerador contiene 30 botellas de ocupados, por sección, en un momento
cerveza: 8 “coronas”, 6 “bohemias” y 16 específico. Una de las secciones tiene seis y la
“tecates”; se extraen, una tras otra, dos botellas otra cuatro. Determina el recorrido.
de cerveza. Sea la VAD : a. X = “número de retretes ocupados en
Z = “doble del número de las cervezas ambas secciones”.
b. Y = “diferencia entre el número de retretes
“tecates” extraídas”.
ocupados en ambas secciones”.
2. Cierta compañía posee tres camiones,
5. Un futbolista ejecutó 4 “tiros penales” en un
mismos que pueden tener motor a diésel o
torneo de fútbol.
motor eléctrico. Establece el espacio muestral y
En cada caso establece el espacio muestral, a
a cada evento asígnale el valor
cada evento asígnale el número real
correspondiente.
correspondiente y luego determina el recorrido
a. X = “número de camiones con motor
de la variable aleatoria.
diésel”.
a. Sea X = “tiros penales” convertidos en gol
b. Y = “número de camiones con motor
por el futbolista.
eléctrico”.
b. Sea Z = “tiros penales” fallados por el
futbolista.
3. En un lapso de tiempo, se observan los
automóviles que llegan a un crucero específico
6. Considera el experimento que consiste
y se anota: I si da vuelta a la izquierda, D si
lanzar simultáneamente dos dados normales y
da vuelta a la derecha o F si avanza de frente.
anotar el número de la cara que aparece hacia
El experimento termina tan pronto como se
arriba. Construye el espacio muestral, a cada
observa que un automóvil da vuelta a la
evento asígnale el número correspondiente y
izquierda. Sea X = “número de automóviles
32 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
y determina el recorrido. c.
a. X = “suma de los números que se observan y −2 0 3 4 5
en las caras”. fY (y) − 0.1 0 .4 0 .2 0 .3 0 .2
b. Y = “menor de los números que se observan
d.
en las caras”.
y −2 3 4 5 6
c. Z = “doble del primer número menos el
segundo número”. gY (y) 0 .3 0 .3 0 .2 0 0 .2
7. Las caras de una moneda se han marcado 10. Las caras de una moneda han sido
como 1 y 2 . Se lanza tres veces. En cada marcadas como 1 y 2 . Considere el
caso construye el espacio muestral, a cada experimento que consiste en lanzarla tres
evento asígnale el número correspondiente y veces y anotar el número de la cara que queda
determina el recorrido. hacia arriba.
a. X = “suma de los números que aparecen en Construye la distribución de probabilidad y
las caras”. función de probabilidad.
b. Y = “menor de los números que aparecen en a. X = “suma de los números anotados”.
las caras”. b. Y = “menor de los números anotados”.
c. Z = “suma de los dos primeros números que c. Z = “suma de los dos primeros números
aparecen en las caras menos el tercero de los anotados menos el tercero de los números
números”. anotados”.
8. Un experimento que consiste en lanzar dos
veces un dado equilibrado y anotar los 11. De las seis personas que solicitaron
números de las caras que quedan hacia arriba. empleo, tres son menores de edad. Suponga
Construye la fdp . que se seleccionan al azar tres de las
a. X = “la suma de los números anotados”. personas (a la vez) para asignarles empleo.
b. Y = “el menor de los números anotados”. Sea X “número de menores de edad a los
que se les asignó empleo”.
9. ¿Cuáles de las siguientes tablas a. Determina la fdp .
corresponden a una fdp ?, justifica tu b. Construye la FPA .
respuesta.
a. 12. De diez personas que solicitaron empleo,
x −2 1 3 6 seis son mujeres y cuatro son hombres.
fX ( x ) Suponga que se seleccionan, a la vez y al
0.28 0.55 0.13 0.04
azar, tres de las personas para emplearlas
b.
Sea:
x 2 4 6 8 X = “número de mujeres que son
1 5 1 1 empleadas”.
gY ( x ) −
4 8 4 8 a. Determina la fdp .
b. Construye la FPA .
Sección 1.1 Variable aleatoria 33
X 0 1 2 3 x
26. Sea f X ( x ) = y x = 1, 2, 3, 4 .
fX (x) 0.20 K K 0.20 10
a. Construye la FPA .
a. Si E X = 1.5 , determina el valor de K , b. Calcula E X y la desviación estándar.
b. Calcula la varianza y la desviación estándar.
27. Sea
23. El jefe de redacción de la revista “Paradero 0 si x 1
69 ” ha solicitado que el reporte de actividades F ( x ) = 0.5 si 1 x 3 .
de los redactores sea entregado la semana 1 si x3
siguiente, ha agregado la condición: aquél Obtén la esperanza y la desviación estándar.
reporte que rebase cuatro páginas será
rechazado. Sea la variable aleatoria X 28. Se lanzan simultáneamente dos monedas,
“número de páginas del reporte de los si aparecen dos “soles” se ganan $ 50 , en
“redactores”, supón que la distribución de
cualquier otro caso se pierden $10 . ¿Conviene
probabilidad es:
jugar “muchas” veces?
X 1 2 3 4
fX (x) 0.01 0.19 0.35 0.45 29. Se lanzan simultáneamente tres monedas,
si aparece al menos un “sol” se ganan $ 50 , en
a. Calcula E X e interprétala.
cualquier otro caso se pierden $150 .
b. Calcula V X y la desviación estándar.
Sección 1.1 Variable aleatoria 35
a. E 5 X − 2 . 2 0 x 0.5
a. f X ( x ) = .
c. E 12 X − 2Y . 0 otro caso
1
b. E X + Y − 2 .
b. f X ( x ) = 8 2 x 10
.
d. E − 14 X − 23 Y + 121 . 0 otro caso
1
0 x2
33. Sean X , Y variables aleatorias c. f X ( x ) = 4 x .
0 otro caso
independientes e igualmente distribuidas
E X = 0.3 y E Y = 0.8 .
2 0 x 0.5
Calcula: 37. Si f X ( x ) =
a. E 10 X + 5Y − 21 . 0 otro caso
b. E − X + 15Y + 1 . es una función de densidad continua, evalúa:
c. E − 0.4 X + 1.2Y − 1.6 . a. p ( x 0.3 ) .
d. E − 4 + 2.8Y . b. p ( 0.2 x 0.3 ) .
c. p ( x 0.4 ) .
34. Sean X , Y variables aleatorias d. p ( x 0.1 ) .
independientes igualmente distribuidas con
V X = 0.1 y V Y = 2 calcula: 1
a. V 4Y − 2 . 38. Si f X ( x ) = 1 − 2 x 0 x2
0 otro caso
b. V − 2 X + 2Y + 1 .
es una función de densidad continua, evalúa:
36 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES
a. p ( x 0.5 ) .
b. p ( 1 x 2 ) .
c. p ( x 0.5 ) .
d. p ( x 1.5 ) .
8x 0 x A
39. Si f X ( x ) = .
0 otro caso
a. ¿Cuál es el valor de A (positivo)?
1
b. Calcula p x .
10
1
c. Calcula p x .
10
1 1
d. Calcula p x .
20 10
1.2 DISTRIBUCIÓN BINOMIAL
Y DISTRIBUCIÓN NORMAL
Temática
Distribución binomial: Experimento binomial, variable aleatoria binomial,
parámetros y aplicaciones
Distribución Normal: Distribución normal estándar, área bajo la curva
normal y manejo de tablas, problemas de aplicación.
38 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
DISTRIBUCIÓN BINOMIAL
Los experimentos aleatorios discretos pueden tratarse considerando que su espacio muestral está
constituido por un par de eventos simples, uno de ellos puede considerarse como el evento favorable y
el otro negando el evento favorable. Si éste es el caso, al evento favorable se denomina “éxito” (se
representa por E ) y el otro (su negación) es el “fracaso” (se representa por F ). Bajo este enfoque, el
espacio muestral de un solo experimento es S = E , F y cada experimento recibe el nombre de
“ensayo “Bernoulli”.
Nota En un ensayo, él éxito es aquel resultado que satisface la afirmación dada en la variable
aleatoria, y él fracaso es el evento que se obtiene negando al éxito .
R X = 0, 1 .
b. Construyamos la fdp ,
si x = 0 , entonces se obtuvo un fracaso en el ensayo, por tanto, f ( 0 ) = p ( X = 0 ) = 1 − p ,
si x = 1 , entonces se obtuvo éxito en el ensayo, por tanto, f ( 1 ) = p ( X = 1 ) = p .
Entonces,
1− p si x = 0
fX ( x )= p si x = 1 ,
0 otro caso
en forma tabular
x 0 1
fX (x) 1− p p
cuyo gráfico es
f
0 1 x
FIGURA 1
x 0 1
fX (x) 1− p p
F(x ) 1− p 1− p + p =1
por tanto,
0 si x 0
F ( x ) = 1− p si 0 x 1
1 si x 1
cuyo gráfico es
40 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
1-p
0 1 x
FIGURA 2
d. Valor esperado
E X =( 0 )( 1 − p ) +( 1 )( p ) = p .
e. Varianza
V X =( 0 − p
) 2 ( 1 − p ) + ( 1 − p ) 2 ( p ) = p 2 ( 1 − p ) + p( 1 − p )
= p( 1 − p )( 1 − p + p ) = p( 1 − p ) = pq .
f. Desviación estándar V X = pq .
Para construir la fdp , misma que representaremos por b ( x ; n , p ) , utilizaremos un proceso inductivo
y posteriormente generalizaremos el patrón de comportamiento.
0 otro caso
siempre que X = 0 , 1 .
b. Sea la VAD
X = “número de éxitos en n = 2 ensayos”.
El espacio muestral es el conjunto S = ( F , F ) , ( F , E ) , ( E , F ) , ( E , E ) .
Las asignaciones numéricas a los eventos por parte de la variable aleatoria son
X ( ( F , F ) ) = 0 , X ( ( F , E ) ) = 1 , X ( ( E , F ) ) = 1, X ( ( E , E ) )= 2 ,
por tanto,
b ( 0 ; 2 , p ) = p ( X = 0 ) = p ( F1 F2 ) = p ( F1 ) p ( F2 ) = 1 q q = q 2 p 0 .
b ( 1 ; 2 , p ) = p ( X = 1 ) = p ( F1 E 2 ) + p ( E1 F2 )
= p ( F1 ) p ( E 2 ) + p ( E1 ) p ( F2 ) = q p + p q = 2 p q
b ( 2 ; 2 , p ) = p ( X = 2 ) = p ( E1 E2 ) = p ( E1 ) p ( E2 ) = p p = 1 q 0 p 2
q2 si x = 0
2 p q si x = 1
b( x ; 2 , p )= , o bien b ( x ; 2 , p ) = C x p x q 2− x , si X = 0 , 1, 2 .
2
2
p si x = 2
0 otro caso
42 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
p3 si x = 3
0 otro caso
La tabla 1 sistematiza los resultados obtenidos en el ejemplo 1 y justifica las conjeturas que se
encuentran después de ella.
NÚMERO DE ENSAYOS FUNCIÓN DE PROBABILIDAD
b ( x ;1, p ) = Cpq
1 x 1− x
n =1 x
, si X = 0 , 1 .
b( x ; 2 , p )=C p q
2 x 2− x
n=2 x
, si X = 0 , 1, 2 .
b( x ; 3 , p ) = C p q
3 x 3− x
n=3 x
, si X = 0 , 1, 2, 3 .
TABLA 1
x x
ii. Tiene como FPA a B ( x , n , p ) = b( k , n , p ) = C k p k q n −k , sí X = 0, 1, 2, ... , n .
n
k =0 k =0
k =0 k =0
c. b ( x, n, p ) = B ( x, n, p ) − B ( x − 1, n, p ) .
Cabe señalar:
Nota a. La fdp asociada a la variable aleatoria binomial X , depende de los “parámetros” n y p ,
esto es X ~ b ( x , n , p ) .
b. La FPA asociada a la variable aleatoria binomial la representaremos por
X
X ~ B( x , n , p ).
4!
b ( 1 , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 1 )!1! ( 0.30 ) ( 0.70 ) = ( 4 )( 0.30 ) ( 0.70 )
4 1 3 1 3 1 3
1
= 0.4116 .
44 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
4!
b ( 2 , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 2 )! 2! ( 0.30 ) ( 0.70 ) = ( 6 )( 0.30 ) ( 0.70 )
4 2 2 2 2 2 2
2
= 0.2646 .
4!
b ( 3 , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 3 )! 3! ( 0.30 ) ( 0.70 ) = ( 4 )( 0.30 ) ( 0.70 )
4 3 1 3 1 3 1
3
= 0.0756 ,
4!
b ( 4 , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 4 )! 4! ( 0.30 ) ( 0.70 ) = ( 1 )( 0.30 ) ( 0.70 )
4 4 0 4 0 4 0
4
= 0.0081 .
La distribución de probabilidad es
X 0 1 2 3 4
0 1 2 3 4 x
FIGURA 3
0 sí x0
0.2401 sí 0 x 1
0.6517 sí 1 x 2
B ( x , 4 , 0.30 ) = .
0.9163 sí 2 x 3
0.9919 sí 3 x 4
1 sí x4
El gráfico asociado se muestra en la figura 4.
F
0 1 2 3 4 x
FIGURA 4
Sección 1.2 Distribución binomial y distribución normal 45
El ejemplo 5 muestra la forma de uso de las tablas de probabilidades binomiales acumuladas que se
incluyen en el apéndice A.1 de este libro.
Nota Las tablas de probabilidad binomiales del apéndice A.1 pueden ser inoperantes para ciertos
valores de los parámetros binomiales, sin embargo, una aplicación computacional facilita los
cálculos, revise la sección 1.3.
luego
E X = ( 0 )( q ) + ( 1 )( p ) = p .
b( x ; 2 , p ) q p q2
de donde
E X = ( 0 )( q 2 ) + ( 1 )( 2 pq ) + ( 2 )( p 2 )
= 2 p( q + p ) = 2 p
c. Si X = ”número de éxitos en n = 3 ensayos”, entonces la fdp es
x 0 1 2 3
b( x ; 2 , p ) q3 3q 2 p 3qp 2 p3
Sección 1.2 Distribución binomial y distribución normal 47
luego
E X = ( 0 )( q 3 ) + ( 1 )( 3q 2 p ) + ( 2 )( 3qp 2
) + ( 3 )( p ) 3
= ( 1 )( 3q 2 p ) + ( 2 )( 3qp 2 ) + ( 3 )( p 3)
= 3q 2 p + 6qp 2 + 3 p 3 = 3 p ( q + qp + p )
2 2
= 3 p( q + p )2
= 3 p.
n=3 E X = 3p
TABLA 3
x2 0 1
b( x ;1, p ) q p
48 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
también
E X2 = ( 0 )( q ) + ( 1 )( p ) = p y V X = p − p 2 = p( 1 − p ) = pq .
x2 0 1 4
b( x ; 2 , p ) q p q2
Luego
( ) (
E X 2 = ( 0 ) q 2 + ( 1 )( 2 pq ) + ( 4 ) p 2 = 2 pq + 4 p 2 )
por lo que
V X = 2 pq + 4 p 2 − ( 2 p )2 = 2 pq .
x 0 1 2 3
x2 0 1 4 9
b( x ; 2 , p ) q3 3q 2 p 3qp 2 p3
entonces
E X 2 = 3q 2 p + 12qp2 + 9 p3 ,
por tanto,
V X = 3q 2 p + 12qp2 + 9 p3 − 9 p3 = 3 pq( q + p ) = 3 pq .
GENERALIZACIÓN
ii. La probabilidad de que exactamente dos alumnos del CCHO, seleccionados al azar cursen una
asignatura en el programa PAE está dada por
6
p ( X = 2 ) = b ( 2 , 6 , 0.25 ) = C ( 0.25 ) ( 0.75 )
2 4
= 0.2966 .
2
iii. La probabilidad de que más de dos alumnos del CCHO, seleccionados al azar, cursen una
asignatura en el programa PAE es
6
p ( X 2 ) = 1 − p ( X 2 ) = 1 − B ( 2 , 6 , 0.25 ) = 1 − C ( 0.25 ) ( 0.75 )
2 4
= 0.1694 .
2
iv. El valor esperado y la varianza de la VAD X = “número de alumnos del CCHO que cursan una
asignatura en el programa PAE en una muestra de tamaño 6 ” son
E X = 6( 0.25 ) = 1.5 y V X = 6( 0.25 )( 0.75 ) = 9 respectivamente.
8
respectivamente.
ii. El valor esperado y la varianza son
E X = 12( 0.90 ) = 10.8 y V X = 12( 0.90 )( 0.10 ) = 1.08 respectivamente.
iii. La probabilidad de que entre tres (inclusive) y seis (inclusive) alumnos hayan perdido el hábito de
copiar en los exámenes es
p ( 3 X 6 ) = B ( 6 , 12 , 0.90 ) − B ( 2 , 12 , 0.90 ) = 0.0005 .
iv. La probabilidad de que más de cuatro alumnos hayan perdido el hábito de copiar en los exámenes
es
p ( X 5 ) = 1 − p ( X 4 ) = 1 − B ( 4 , 12 , 0.90 ) = 1 .
b. Sea la VAD X = “número de alumnos que no perdieron el habito de copiar en los exámenes en una
muestra de 12 ”.
i. La fdp y la FPA son
12
b ( x , 12 , 0.10 ) = C ( 0.10 ) ( 0.90 )
x 12− x
y
x 12
B ( x , 12 , 0.90 ) = C ( 0.10 ) ( 0.90 )
k =0 k
k 12− k
,
respectivamente.
ii. El valor esperado y la varianza son
E X = 12( 0.10 ) = 1.2 y V X = 12( 0.10 )( 0.90 ) = 1.8 , respectivamente.
ii. La probabilidad de que entre tres (inclusive) y seis (inclusive) alumnos no hayan perdido el hábito de
copiar en los exámenes es
p ( 3 X 6 ) = B ( 6 , 12 , 0.10 ) − B ( 2 , 12 , 0.10 ) = 0.1108 .
iii. La probabilidad de que más de cuatro alumnos hayan perdido el hábito de copiar en los exámenes
es
p ( X 5 ) = 1 − p ( X 4 ) = 1 − B ( 4 , 12 , 0.90 ) 1 − 0.0043 = 0.9957 .
El ejemplo 10 muestra que en ocasiones definir nuevamente el “éxito” facilita el cálculo de las
probabilidades.
( )
p X c = 6 = B ( 6 , 24 , 0.05 ) − B ( 5 , 24 , 0.05 ) = 0.9998 − 0.9990 = 0.0008 .
ii. Más de 9 ratas a las que asestó un garrotazo en la cabeza no pasen a mejor vida.
p ( X c 10 ) = 1 − B ( 9, 24, 0.05 ) = 1 − 1.0000 = 0 .
iii. Más de 9 pero menos de 15 ratas que recibieron un garrotazo en la cabeza pasen a mejor vida es
p ( 9 X 15 ) = B ( 14, 24, 0.95 ) − B ( 9, 24, 0.95 ) = 0 − 0 = 0 .
iii. Más de 9 pero menos de 15 ratas que recibieron un garrotazo en la cabeza no pasen a mejor vida
es p ( 9 X c 15 ) = B ( 14, 24, 0.05 ) − B ( 9, 24, 0.05 ) = 0 .
iv. Entre 15 y 22 ratas que recibieron un garrotazo en la cabeza pasen a mejor vida es
p (15 X 22 ) = B ( 21 , 24, 0.95 ) − B ( 15 , 24, 0.95 ) = 0.1159 .
DISTRIBUCIÓN NORMAL
El grafico asociado a una variable aleatoria (o no aleatoria) proporciona información sobre su
comportamiento. En el proceso de la descripción estadística de un grupo de medidas (datos), después
del cálculo de algunas de sus medidas descriptivas (en particular las de tendencia central y las de
dispersión) el siguiente paso consiste en realizar su descripción gráfica, misma que proporciona una
buena idea del comportamiento de la variable que los genera. La figura 5 presenta el gráfico de la
distribución de probabilidad asociada a cierta variable aleatoria discreta junto con su histograma de
probabilidad.
52 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
f f
0.5 0.5
0 x1 x2 x3 x4 x5 x 0 x1 x2 x3 x4 x5 x
FIGURA 5
f f
0 x1 x2 x3 x 4 x5 x6 x 0 x1 x2 x3 x4 x5 x6 x
E[X] x=x
FIGURA 6
f f E[X]
E[X]
0 x 1 x 2 x 3 x 4 x 5 x 6 x 7 x 8 x 9 x 10 x 0 x 1 x 2 x 3 x x 5 x x 7 x x x 10 x
4 6 8 9
FIGURA 7
Sección 1.2 Distribución binomial y distribución normal 53
En una gran diversidad de estudios y análisis del comportamiento de grupos de medidas (datos),
se ha observado que el patrón de comportamiento del histograma de frecuencias (o probabilidades) es
similar al mostrado en la figura 8.
f E[X]
0 x
FIGURA 8
Si el gráfico de la figura 8 se “suaviza” se obtiene la curva de la figura 9. Esta curva suave "asintótica"
(con asíntota el eje cartesiano horizontal) representa de modo intuitivo la distribución teórica de la
característica observada y su importancia se debe a la frecuencia con la que distintas variables
asociadas a mediciones (de características de objetos, fenómenos naturales y cotidianos, entre otros)
se aproximan a ella.
f
f ( x ± )
0 x
FIGURA 9
f
f ( x ± )
0 x- x+ x
FIGURA 10
1
√2π
0 x
x=
FIGURA 11
2
1 x−
1 −
( x )=
2 e
La función f y cumple con los axiomas:
2
i. Es no negativa no negatividad (la curva gaussiana está “arriba” del eje de las abscisas).
ii. El área de la región que define con el eje de las abscisas es de una unidad, por tanto, la región
izquierda (derecha) que definen: el eje x , la línea recta de ecuación x = y la curva Gaussiana es
0.5 unidades de área, vea la figura 12.
f esta región
esta región
tiene área de tiene área de
0.5 unidades 0.5 unidades
cuadradas cuadradas
0 x
FIGURA 12
2
x 1 x−
1 −
Φ( x )= p ( X x )= A e 2
.
− 2
f
F(x)=p(X x)
0 x x
FIGURA 13
Nota
El símbolo Φ corresponde a la letra griega phi y lo utilizaremos para referirnos a la función de
distribución acumulada normal.
1 1
0 x x 0 x x
FIGURA 14
Nota
En lo subsecuente nos referiremos al valor esperado de la distribución normal como “media”.
y la curva asociada a esta última función se obtiene por medio de un desplazamiento horizontal de la
gaussiana asociada a
2
1 x−
1 −
( )=
2 e
f x , 2
de manera que la línea recta de ecuación x = coincida con el eje de las ordenadas, vea las figuras
15 y 16.
y y
- 1 ( x ) - 1 ( x - )
2 2
= 1
2
1 f(x) e 1 f(x)= 1 e 2
√2π 1 √2π √2π √2 π
x
x==0 x =
FIGURA 15
y
1
√2π
x
= - 2.5 =0 =2 =4
FIGURA 16
58 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
2
1 x−
1 − 1
ii. El valor máximo de la función f ( x )= e 2
es el número y lo alcanza si
2 2
1
x = . Si se incrementa disminuye el número , este hecho se refleja en un “aplanamiento”
2
2
1 x−
1 −
de la curva gaussiana asociada a f ( x )= e 2
.
2
En la figura 17, 2 es menor que 1 y 1 es menor que 3 .
y
1
√2π
- 21 ( x )
2
1
f(x) = 1 e
√2π 1 √2π
1
√2π
0 x
x =
FIGURA 17
Todas las curvas gaussianas, junto con el eje de las abscisas, determinan regiones cuya área (o
probabilidad) igual a la unidad, sin embargo, el cálculo de áreas de secciones como las mostradas en la
figura 18 resulta prácticamente imposible utilizando “métodos geométricos” y su cálculo requiere de
elementos de otras ramas de la matemática (por ejemplo, cálculo diferencial o métodos numéricos). Por
esta razón el cálculo de probabilidades de distribuciones normales se realiza utilizan las “tablas de
probabilidades normales estandarizadas” (construidas previamente) o alguna aplicación computacional,
sin embargo, en ambos casos es necesario “convertir” la distribución normal de parámetros y 2 en
la distribución normal de parámetros
1
1 − z2
= 0 , 2 = 1 y fdp f ( z )= e 2 .
2
p p p
0 x
FIGURA 18
Sección 1.2 Distribución binomial y distribución normal 59
X −
Si aplicamos la transformación Z = a cualquier fdp de una variable aleatoria normal
obtenemos
1
1 − z2
f ( z )= e 2
,
2
vea la figura 19, por tanto, el cálculo de probabilidades la VAC
X N ( , 2 )
puede tratarse como un problema de evaluación de probabilidades de la variable aleatoria normal cero
uno (parámetros)
E X = 0 y 2 =1 .
y y
X-
Z= 1
√2π
1
√2π
N ( 2) N( 0,1 )
2
Z Z
0 0
FIGURA 19
f 1
0 z1 x 0 z1 x
FIGURA 20
PROPOSICIÓN 5 (PROPIEDADES DE Z N ( 0 , 12 ) )
Si Z N ( 0 , 12 ) y ( z1 ) = p ( Z z1 ) , entonces
a. p ( Z z1 ) = ( − z1) y p ( Z − z1 ) = ( z1 ) .
b. p ( a Z b ) = ( b ) − ( a ) .
c. p ( − a Z a ) = D ( a ) .
z1 z - z1 0 z
0
FIGURA 21.a.
f f
a 0 b z a 0 b z
FIGURA 21.b.
Sección 1.2 Distribución binomial y distribución normal 61
Las tablas A.2 del apéndice A.1 están encabezadas por una fila como la mostrada a continuación:
z ( − z ) ( z ) D( z )
i. La primera columna contiene las asignaciones a la variable aleatoria Z .
ii. La segunda columna proporciona la probabilidad acumulada ( − z ) = p ( Z − z ) , para
asignaciones negativas z .
iii. La tercera columna contiene la probabilidad acumulada ( z ) = p ( Z z ) , para asignaciones
positivas a z .
iv. La cuarta columna contiene la probabilidad D ( z ) = p ( − z Z z ) que corresponde a dos
números simétricos − z y z .
DEFINICIÓN 7 (CUANTILES)
Si Z N ( 0 , 12 ) , entonces
El número Z = z 0 tal que p ( Z z0 ) = ( z0 ) = p0 se denomina “cuantil del 100 % p0 ”.
100% ( z0 ) = 100% p
0
0 z
z
100% ( z0 )
FIGURA 22
En las tablas del apéndice A se incluyen los cuantiles asociados a la distribución normal
estandarizada y el ejemplo 13 muestra la forma en que se calculan.
% Z( ) Z(D )
47.5 0.063 0.714
por consiguiente z0 = −0.063 .
b. Si p ( Z z 0 ) = 0.11 , entonces la probabilidad acumulada hasta el número z 0 es p ( Z z 0 ) = 0.89 ,
las tablas del apéndice A.2 muestran
% Z( ) Z(D )
89 1.227 0.138
por consiguiente z 0 = −1.227 .
c. Si p ( − z0 Z z0 ) = 0.45 , entonces Z ( D ) = p ( − z 0 Z z 0 ) = 0.45 , en las tablas del apéndice
A.2 observamos:
% Z( ) Z(D )
45 − 0.126 0.598
por tanto, z0 = 0.598 .
d. Si p ( − z0 Z z0 ) = 0.90 , entonces Z ( D ) = p ( − z0 Z z0 ) = 0.90 , en las tablas del
apéndice A.2 observamos:
% Z( ) Z(D )
90 1.281 1.645
en consecuencia z0 = 1.645 .
c. El gasto semanal x0 que se rebasa con una probabilidad de 0.10 se calcula de la siguiente forma,
x0 − 400
de p ( X x0 ) = p Z = 0.10 ,
20
obtenemos z10 = 1.2816 , luego
x 0 − 400
= 1.2816 ,
20
el gasto semanal es
x0 = 425.632 pesos.
X N ( 20 , ) , entonces
2
p (
X 20.5 ) = p Z
20.5 − 20
= 0.05 , el número z 0 que deja
un área de z0 = 0.05 unidades, de acuerdo con las tablas de percentiles normales, es 1.6449 ,
entonces
20.5 − 20
= 1.6449 , de aquí = 0.304 .
( )
b. X N 50 , 2 , entonces p (
X 50.1 ) = p Z
50.1 − 50
= 0.02 , el número z 0 que
deja un área de 0.02 unidades a su derecha es: z0 = 2.0537 , así
50.1 − 50
= 2.0537 , de donde = 0.0487 .
EJEMPLO 20
(
Sea la VAC tal que Z N 0 , 2 )
a. Para determinar la proporción de asignaciones a X que difieren de la media en menos de una
desviación estándar, es decir, p ( − X + ) , al estandarizar y simplificar obtenemos
− − X − + −
p ( − X + )= p
− X −
= p = p ( −1 Z 1 ).
Las tablas de la distribución normal dan
p ( − 1 Z 1 ) = 0.8413 .
b. Para determinar la proporción de asignaciones a X que difieren de la media en menos de dos
desviaciones estándar, es decir, p ( − 2 X + 2 ) , al estandarizar y simplificar obtenemos
− 2 − X − + 2 −
p ( − 2 X + 2 ) = p
− 2 X − 2
= p = p ( − 2 Z 2 ).
De las tablas de la distribución normal
p ( − 2 Z 2 ) = 0.9545 .
c. Para determinar la proporción de asignaciones a X que difieren de la media en menos de tres
desviaciones estándar, es decir, p ( − 3 X + 3 ) , al estandarizar y simplificar obtenemos
− 2 − X − + 3 − − 3 X − 3
p ( − 3 X + 3 )= p = p .
Las tablas de la distribución normal dan
p ( − 3 Z 3 ) = 09773 .
68 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
PROBLEMAS PROPUESTOS
DISTRIBUCIÓN BINOMIAL
1. Si X ~ b ( x , 15 , 0.25 ) , calcula las verificando la producción de Mr. Aldo utilizando
probabilidades binomiales. un muestreo continuo desde que notó la
a. b ( 3 , 15, 0.25 ) . e. p ( 2 X 9 ) . situación anormal. Calcula la probabilidad de
b. b ( 5 , 15, 0.25 ) . f. p ( 2 X 9 ) . que en una muestra de diez piezas producidas
por Mr. Aldo y revisadas por el ingeniero
c. p ( X 6 ) . g. p ( X 10 ) .
encuentre:
d. p ( X 8 ) . h. p ( X 9 ) . a. Exactamente cinco defectuosas.
b. Cero defectuosas.
2. Suponga que X ~ b ( x , 23 , 0.70 ) y calcula c. A lo más cinco defectuosas.
las probabilidades binomiales. d. Cinco o más defectuosas.
a. b ( 3 , 23, 0.70 ) . e. p ( 5 X 10 ) .
b. b ( 5 , 23 , 0.70 ) . f. p ( 12 X 21 ) . 6. Una moneda se ha balanceado de manera
c. p ( X 13 ) . g. p ( X 17 ) . que la probabilidad de observar sol al ser
lanzada es 0.6 . Si la moneda se lanza nueve
d. p ( X 18 ) . h. p ( X 11 ) .
veces determina la probabilidad de observar:
a. Exactamente dos soles.
3. Construya la función de probabilidad y traza
b. Menos de tres soles.
la grafica.
c. A lo más tres soles.
a. b ( x , 6 , 0.2 ) . c. B ( x , 8 , 0.2 ) .
d. Al menos cuatro soles.
b. b ( x , 3 , 0.4 ) . d. B ( x , 10 , 0.4 ) . e. Un número par de soles.
8. Un examen de opción múltiple incluye 15 11. La CFE, “Zona Norte” promueve el ahorro
preguntas, cada una con cinco respuestas de de energía eléctrica ofreciendo descuentos a
las que solamente una es correcta. Supóngase consumidores que mantienen su consumo por
que uno de los “estudiantes” que realizan el debajo de las normas de subsidio establecidas.
examen contesta las preguntas al azar. Estudios recientes muestran que en el 70 %
a. ¿Cuál es la probabilidad de que conteste de los usuarios han reducido el uso de energía
correctamente al menos 10 preguntas? eléctrica y pueden disfrutar de los descuentos.
b. ¿Cuál es la probabilidad de que conteste Si se seleccionan cinco usuarios de la “Zona
correctamente a lo más 10 preguntas? Norte”, determina las probabilidades:
c. ¿Cuál es la probabilidad de que conteste a. Los cinco califiquen para obtener tarifas más
correctamente menos de 10 preguntas? favorables.
d. ¿Cuál es la probabilidad de que conteste b. Al menos cuatro califiquen para tarifas más
correctamente más de 10 preguntas? favorables.
10. El jefe de personal de “Sintex S. A.” detectó 13. Un estudio sobre los residentes de la
que algunas de las personas que contrató no Ciudad de Chilpancingo mostró que el 30 %
son lo que dicen ser. Sabe que el 35 % de los de ellos prefieren la carne de cerdo en lugar de
antecedentes de las personas que contrató fue la carne de iguana. Se preguntó a 10
alterado. La semana pasada contrató a cinco residentes de la ciudad sobre sus preferencias
nuevos empleados. ¿Cuáles son las en cuanto a los dos tipos de carne señalados.
probabilidades de que hayan sido alterados los Determina la probabilidad de:
expedientes de las personas que contrató? a. Ninguna prefiera la carne del cerdo.
a. De al menos uno. b. Cuatro prefieran la carne del cerdo.
b. De tres o más. c. Al menos ocho prefieran la carne del cerdo.
c. De un número. d. A lo más dos prefieran la carne del cerdo.
e. La mayoría no prefiera la carne de cerdo.
70 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
14. El 20 % de los estudiantes del sexto ¿Cuál es el número de niños que se espera
semestre del CCH han contestado sí a la hereden la inteligencia de su padre?
pregunta ¿le has quemado las patas al diablo?
En una muestra aleatoria de 15 estudiantes de 19. El 60 % de los clientes de la cantina “Las
sexto semestre, determina la probabilidad de: Pelotas de Villa” piden tequila como primera
a. Cuatro no hayan contestado sí a la pregunta. bebida. Sean 25 clientes de “Las Pelotas de
b. Seis no hayan contestado sí. Villa”, determina la probabilidad:
c. Al menos seis no hayan contestado “sí” a la a. Exactamente ocho no pidan tequila como
pregunta señalada? primera bebida.
d. Desde ocho y hasta trece inclusive, no b. Seis no pidan tequila como primera bebida.
hayan contestado “sí”. c. Más de 6 pidan tequila como primera
e. Entre ocho y trece inclusive, hayan bebida.
contestado “sí”. d. El número esperado y la varianza de que
pedirán tequila como primera bebida.
15. Supón que las condiciones para un
experimento binomial son válidas y determine 20. El 40 % de los tiros penales que ejecutan
E X y V X si: los seleccionados del equipo mexicano de
a. n = 20 y p = 0.60 . fútbol no son gol, determina la probabilidad de
b. n = 20 y p = 0.85 . que en los próximos 15 penales que
c. n = 40 y p = 0.30 . efectuarán los seleccionados mexicanos de
fútbol:
a. Ocho no sean gol.
16. Con base en un largo periodo de estudio,
b. Seis no sean gol.
se ha determinado que el 10 % de los
c. Menos de seis no sean gol.
estudiantes inscritos en los cursos de
d. El número esperado y la varianza de los
matemáticas amenazan al profesor para que
tiros penales, ejecutados por los seleccionados
los apruebe. Si los estudiantes toman el curso
del equipo mexicano de fútbol, que son gol.
en grupos de treinta, determina el valor
esperado y la desviación estándar del número
21. Un agricultor afirma que: en las cajas con
de estudiantes que amenazan, por grupo, al
treinta mangos, que distribuye, el 60% de
profesor para que los apruebe.
ellos se encuentran deliciosos, jugosos,
maduros y listos para comer. Considera una
17. Sea X una variable aleatoria binomial con
caja y determina la probabilidad:
valor esperado 10 y varianza 5 . Determina la
a. Al menos dos mangos no se encuentren
fdp .
deliciosos, jugosos, maduros y listos para
comer.
18. La probabilidad de que un niño de cierta b. El número esperado de mangos que no se
familia herede la inteligencia de su padre es encuentren deliciosos, jugosos, maduros y
0.2 . Si un padre de familia tiene 5 niños. listos para comer.
Sección 1.2 Distribución binomial y distribución normal 71
c. La varianza del número de mangos que se 24. Juan Mota sabe que la probabilidad de que
encuentran deliciosos, jugosos, maduros y germine una semilla de amapola es 0.9 . Desea
listos para comer. vender cultivos de amapola garantizando que
d. Al menos dos de los mangos, se encuentren cada uno contiene 100 plantas. Si siembra
deliciosos, jugosos, maduros y listos para 110 semillas en cada cultivo (que se supone
comer. germinarán independientemente).
a. ¿Cuántos cultivos se espera que contenga
22. “Vitro S. A.” produce vasijas de cristal un contenido de plantas medio?
cortado y el gerente sabe que el 15 % de ellas b. ¿Cuántas semillas de amapola deben poner
tienen defectos y en consecuencia deben en cada cultivo para tener la certeza de que el
venderse en los tianguis. cultivo tendrá 105 plantas?
a. De seis piezas seleccionadas al azar, ¿qué
tan probable es que sólo dos deban venderse 25. Un sistema de protección contra robos está
en los tianguis? construido por n cámaras de vídeo que
b. De doce piezas seleccionadas al azar, ¿qué funcionan independientemente, cada una con
tan probable es que sólo dos no deban probabilidad de 0.9 de detectar al sospechoso
venderse en los tianguis? que ingrese en la zona de cobertura. Si n = 5
c. De diez piezas seleccionadas al azar, y un sospechoso entra en la zona.
¿cuántas cabe esperar que no deban venderse a. ¿Cuál es la probabilidad de que
en los tianguis? exactamente cuatro cámaras detecten al
d. De nueve piezas seleccionadas al azar, sospechoso?
¿cuántas cabe esperar que deban venderse en b. ¿Cuál es la probabilidad de que al menos
los tianguis? una cámara detecte al sospechoso?
c. ¿Cuál debe ser el número de cámaras para
23. Una avioneta dispone de cuatro lugares que la probabilidad de detectar al sospechoso
para un viaje. El piloto acepta un máximo de al entrar en la zona sea de 0.9990 ?
seis reservaciones por viaje, y un pasajero
debe tener una reservación para poder viajar. 26. Si “Beto Pelotas” (habitante de la zona de
Por registros pasados, el piloto sabe que el la merced) “gorrea” un promedio de 25
20 % de las personas que reservan, no se cigarrillos diarios, con una desviación estándar
presentan al viaje. Suponiendo independencia, de 6 , determina la fdp binomial
si se hacen seis reservaciones: correspondiente.
a. ¿Cuál es la probabilidad de que al menos
27. Si X N ( 0 , 12 ) determine:
una persona que reservó no tenga espacio
para el viaje?
a. p ( Z −2.78 ) .
b. ¿Cuál es el número esperado de lugares
disponibles al inicio del viaje? b. p ( Z 2.78 ) .
c. p ( − 0.87 Z 0.87 ) .
d. p ( − 0.34 Z 0.62 ) .
72 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
35. Sea X N ( 5, 22 ), determina x0 en 39. Las donas elaboradas por “Donuts S. A.”
cada caso. tienen un hueco cilíndrico con diámetro
a. p ( X x0 ) = 0.22 . promedio de 2 centímetros y desviación
estándar 0.2 centímetros. Si los diámetros se
b. p ( X x0 ) = 0.39 .
distribuyen normalmente.
c. p ( X x0 ) = 0.96 .
a. ¿Qué porcentaje de las donas tienen hueco
d. p ( X x0 ) = 0.62 . con diámetro mayor de 1.8 centímetros?
b. ¿Qué porcentaje de las donas tienen hueco
36. Cierta clase de lagartijas viven en promedio con diámetro entre 1.91 y 2.24 centímetros?
40 meses. Si sus tiempos de vida se c. ¿Qué porcentaje de las donas tienen hueco
distribuyen normalmente y tienen una con diámetro menor de 1.95 centímetros?
desviación estándar de 6.3 meses, determina
la probabilidad de que una lagartija viva: 40. Los radios internos de los balones que
a. Más de 32 meses. fabrica la “Estrella S. A.” se distribuyen
b. Menos de 28 meses. normalmente con un valor promedio de 15
c. Entre 37 y 49 meses. centímetros y desviación estándar de 0.03
centímetros.
37. Los virotes distribuidos por “Bizcochos S. a. ¿Qué proporción de ellos tienen un radio
A.” tienen una longitud promedio de 30 interno superior a los 15.75 centímetros?
centímetros, una desviación estándar de 2 b. ¿Cuál es la probabilidad de que un balón
centímetros. Supón que las longitudes están fabricado tenga radio interno comprendido
normalmente distribuidas. entre 14.97 y 10.03 centímetros?
a. ¿Qué porcentaje de los virotes miden más c. ¿Debajo de qué longitud de radio interno
de 31.7 centímetros de longitud? está el 15% de los balones?
b. ¿Qué porcentaje de los virotes miden entre
29.5 y 33.5 centímetros de longitud? 41. Las estaturas de 1000 granaderos está
c. ¿Qué porcentaje de los virotes miden menos de normalmente distribuida con un valor promedio
25.5 centímetros? de 174 .5 centímetros y desviación estándar de
6.9 centímetros. Si las alturas se registran
38. Los virotes distribuidos por “Bizcochos S.
cerrando los valores a los medios centímetros:
A.” tienen un grosor promedio de 8
a. ¿Cuántos granaderos tendrán estaturas
centímetros y una desviación estándar de 0.8
menores que 160 centímetros?
centímetros y están normalmente distribuidos.
b. ¿Cuántos granaderos tendrían estaturas
a. ¿Qué porcentaje de los virotes tienen un
entre 171 .5 y 182 centímetros inclusive?
grosor mayor a 7.7 centímetros?
c. ¿Cuántos granaderos tendrán estaturas de
b. ¿Qué porcentaje de los virotes tienen un
175 centímetros o menos?
grosor entre 0.72 y 8.04 centímetros?
d. ¿Cuántos granaderos tendrán estaturas
c. ¿Qué porcentaje de los virotes tienen un
mayores que o iguales a 188 centímetros?
grosor menor de 8.09 centímetros?
74 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
42. Los pesos de los perros Coker Spaniel con a. Si el fabricante de “Sunbeam” sólo desea
un año se distribuyen normalmente, con media reponer 1% de las licuadoras cuya vida útil es
de 8 kilogramos y desviación estándar de 0.9 menor al periodo promedio. ¿Qué tiempo de
kilogramos. Si se registran las mediciones y se garantía debe ofrecer?
cierran a décimas de kilogramos, determine la b. Si el fabricante de “Sunbeam” sólo desea
proporción de perros con peso: reponer 5% de las licuadoras cuya vida útil es
a. Superior a 9.5 kilogramos. menor al periodo promedio. ¿Qué tiempo de
b. Menor a 8.6 kilogramos. garantía debe ofrecer?
c. Entre 7.3 y 9.1 kilogramos inclusive.
46. “Bremen S. A.” envasa bombones en
43. La precipitación pluvial media (registrada bolsas de plástico, los pesos netos siguen una
en centésimas de milímetro) en Valle de Bravo, distribución normal con desviación estándar de
en el mes de agosto fue de 9.22 centímetros. 1.4 gramos. Si el 4 % de las bolsas con
Suponiendo una distribución normal con bombones pesan más de 350 gramos,
desviación estándar 2.83 centímetros, determina el peso promedio de las bolsas de
determine la probabilidad de que, en el próximo bombones.
mes de agosto, Valle de Bravo, tenga una
precipitación pluvial de: 47. “Bremen S. A.” envasa las gomitas en
a. Menos de 1.84 centímetros. bolsas de plástico, los pesos netos siguen una
b. Más de 5 centímetros, pero menos de 7 distribución normal, con valor promedio de
centímetros. 500 gramos.
c. Más de 13.8 centímetros. a. Si el 6% de las bolsas con gomitas pesan
más de 504 gramos, calcula la desviación
44. El tiempo que tarda Mamerto en estándar.
transportarse de su casa a su trabajo se b. Si el 2% de las bolsas con gomitas pesan
distribuye normalmente con valor medio de 40 más de 502 gramos, determina la desviación
minutos y desviación estándar de 4 minutos. estándar.
a. ¿A qué hora debe de salir de su casa para
tener una probabilidad del 95% de estar en su 48. Las barras de metal utilizadas en la
trabajo antes de las 8 horas? construcción de las perreras del antirrábico “El
b. ¿A qué hora debe de salir para tener una Perrón”, son cortadas de forma automática por
probabilidad del 99% de estar en su trabajo una máquina con longitud nominal de 60
antes de las 8 de la mañana? centímetros. Las longitudes reales se
distribuyen normalmente con valor medio de
45. El tiempo de vida de las licuadoras 60 centímetros y desviación estándar 0.6
“Sunbeam” se distribuye normalmente con centímetros.
media de cinco años y desviación estándar de a. ¿Qué proporción de las barras rebasan los
un año. límites de tolerancia que son de 59 a 61
centímetros?
Sección 1.2 Distribución binomial y distribución normal 75
b. ¿A qué valor debe ajustarse la desviación 51. El peso de la harina contenida en las cajas
estándar si el 98% de las barras debe estar de “Trigal” sigue una distribución normal con
dentro de los límites de tolerancia? un valor promedio de 600 gramos. La
máquina que efectúa el proceso de llenado, de
49. La distribución de los pesos de las cajas las cajas de “Trigal”, está diseñada para que
con aguacates del Sr. Plancarte es normal con vierta entre 590 y 610 gramos harina con una
un valor promedio de 10 kilogramos y probabilidad de 0.90 . ¿Cuál es el valor
desviación estándar 1 kilogramo. El servicio de máximo de la desviación estándar para
fletes desea establecer un valor de peso p 0 , a alcanzar tal necesidad?
partir del qué hará un cargo de tres pesos al Sr.
Plancarte. 52. La resistencia de las cajas en las que se
a. ¿Cuál es el valor del peso p 0 de manera envasa la mantequilla “Chipilo” se distribuye
que el 99% de las cajas de aguacates del Sr. normalmente. Si el 10% de las cajas tienen
Plancarte pesen un kilogramo menos del peso una resistencia que excede los 10.216
con cargo extra? kilogramos y el 5% tiene una resistencia
b. ¿Cuál es el valor del peso p 0 de forma que menor de 9.671 kilogramos. ¿Cuál es el valor
el 99% de las cajas con aguacates del Sr. promedio y cuál es la desviación estándar de
la distribución de la resistencia de las cajas?
Plancarte lo excedan en un kilogramo o más?
1.3 RESUMEN Y
AUTOEVALUACIÓN
Sección 1.3 Resumen y autoevaluación 77
ACTIVIDADES
RESUMEN
SECCIÓN 1.1
Propiedades de la Función de a. 0 F xi 1 .
probabilidad acumulada (caso b. p X xi F xi 1
discreto). c. p X xi 1 F xi .
d. p X xi 1 F xi 1 .
e. p X xi F xi F xi 1 .
f. p a X b F b F a .
g. No negativa y no decreciente
h. Valor mínimo cero y valor máximo 1.
Propiedades de la Función de a. 0 F x 1.
probabilidad acumulada (caso b. F x0 p X x0 p X x0
continuo). c. p X x0 1 F x0 .
d. p X x0 1 F x0 .
e. p X x0 0 .
f. p a X b F b F a .
Valor esperado o esperanza de E X x1 f X
x1 x2 f X x2 xn f X xn
una VAD X . xi f xi
xi
xi
, 0 y X .
FDA Normal. 1 t
2
1
x
F x x e 2
dt .
2
Notación
X N , 2 .
Parámetros de la VAC E X y V X 2.
Normal.
Gráfico de la fdp normal f(x)
(curva Gaussiana o
campana de Gauss).
0 X
Propiedad de simetría f(x)
fX x fX x .
f (x-) f (x+ )
0 x- x+ X
x=
Variable aleatoria normal X
Z .
estándar.
fdp de la variable aleatoria 1 2 z2
1
f z ; 0, 1 e .
normal estándar. 2
Parámetros de VAC normal E X 0 y V X 2 1.
estándar.
Notación y lectura
X N , 2 , “la variable aleatoria continua X se
distribuye normalmente con valor medio 1 y varianza
2 1 ”.
Sección 1.3 Resumen y autoevaluación 81
k 0
Para calcular la probabilidad deseada debes ingresar el número de ensayos N realizados para
un evento, la probabilidad de éxito p de dicho evento, la fila que corresponda al evento deseado dar
click en la pestaña calcular.
Por ejemplo:
En el cálculo de probabilidades binomiales puntuales se utiliza la opción.
Se observa en la pantalla
82 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
Se observa en la pantalla
Se observa en la pantalla
Se observa en la pantalla
Sección 1.3 Resumen y autoevaluación 83
Se observa en la pantalla
Two-Tailed:
Left-Tailed:
Right-Tailed:
Calcular
probabilidad binomial Necesitamos calcular una probabilidad de distribución binomial. Se proporciona la siguiente
puntual b 2, 4, 0.30
información
observamos 4
Pr X 2 0 .32 0. 7 4 2 0.2646
2
START OVER
4
Pr X 3 0 .33 0.7 4 3 0 .0756
3
START OVER
Sección 1.3 Resumen y autoevaluación 85
b 3, 4, 0.30 0.0756.
iii. En la determinación de la probabilidad binomial acumulada B 1 , 4 , 0.30 completamos los
campos solicitados y al oprimir la “pestaña” calcular, observamos
Solution:
i 0 i 0
Esto implica que
Pr X 1 Pr X 0 Pr X 1
4 0 4 0 4 1 4 1
0.3 0. 7 0.3 0.7
0 1
0 .2401 . 4116 0. 6517
Solution:
i 0 i 0
Esto implica que
Pr X 2 Pr X 0 Pr X 1 Pr X 2
4 4 4
0 .3 0 0 .7 4 0 0 .31 0 .7 41 0 .3 2 0 .7 4 2
0
1
2
0.2401 .4116 0. 2646 0.9163
START OVER
[Link]
Ingresando el enlace anterior se despliega y ejecutando observamos en la pantalla del dispositivo
electrónico
MED DESVT
probabilidad
?
?
Cálculo directo Cálculo inverso
MEDIA 0 DESV.TÍPICA 1
?
?
Cálculo directo Cálculo inverso
Entonces Entonces
p 0 Z 1.20 0.3849 p 0.90 Z 0 0.3159.
entonces entonces
p 0.30 Z 1.56 0.3227 . p 0.20 Z 0.20 D 0.20 0.1585 .
Sección 1.3 Resumen y autoevaluación 89
luego entonces
p Z 0.20 0.20 0.5793. p Z 2.30 0.0107 .
Se descarga desde Play Store. Sea que Z N 0 , 1 . Sólo hay que llenar los espacios
2
por tanto,
entonces p Z 1.20 0.8849. p Z 1.60 1.60 0.0548.
por tanto,
entonces p 0.30 Z 1.56 0.32271. p 0.20 Z 0.20 0.15852.
observamos
Por tanto,
p Z 2.30 0.01072.
p 0 Z 1.20 0.57926.
92 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
a. Si p Z z 0 0.30 , b. Si p Z z0 0.875 ,
MED 0 DESVT 1
probabilidad 0.525
?
?
Cálculo directo Cálculo inverso
entonces entonces
z30 0.5244. z87.5 1.1503.
c. Para calcular el cuantil que corresponde a d. En el cálculo del cuantil que corresponde a
p z0 Z z0 0.45 , rellenamos espacios p z0 Z z0 0.90 , completamos
y observamos espacios y se despliega la pantalla
AUTOEVALUACIÓN
CIERTO O FALSO
(Selecciona la opción que consideres correcta)
C F 1. El tiempo que tarda una persona en hablar por teléfono es una VAD .
C F 2. El número de cachorros que tendrá una perra en su próximo parto es VAD
C F 3. El recorrido de una variable aleatoria discreta es una parte de números enteros.
C F 4. En una distribución de probabilidad la suma de ellas es uno.
C F 5. En un histograma de probabilidades la suma de las áreas de los rectángulos es uno.
C F 6. La curva asociada a una FDA es decreciente.
C F 7. El valor esperado de una variable aleatoria puede ser negativo.
C F 8. El valor esperado de una variable aleatoria es una probabilidad.
C F 9. El valor esperado de una variable aleatoria también se denomina media aritmética.
C F 10. Todas las variables aleatorias tienen varianza.
C F 11. La varianza de una variable aleatoria es positiva o cero.
C F 12. La varianza de una variable aleatoria es una medida de su “dispersión”.
C F 13. La desviación estándar de una variable aleatoria es un parámetro de una fdp .
C F 14. La desviación estándar de una variable aleatoria es positiva o cero.
C F 15. El recorrido de una variable aleatoria binomial es un número entero.
C F 16. La variable aleatoria “tiempo transcurrido entre dos éxitos” no es binomial.
C F 17. El valor esperado de una variable aleatoria binomial indica el número de éxitos que
se espera obtener una vez que el experimento se ha efectuado un sin fin de veces.
C F 18. En una variable aleatoria binomial p 1 q .
96 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES
PROBLEMAS PROPUESTOS
1. S la VAD X sigue la distribución: 2. Sea la FDA asociada a la VAD X :
X 3 1 1 3 0 X 5
fX x 0.25 0.25 0.25 0.25
F x
0.2 5 X 2
.
Determina: 0.6 2 X 2
a. La fdp y dibuje su gráfica. 1 X 2
b. La FDA y dibuje su gráfica. Determina:
c. La esperanza matemática. a. La distribución de probabilidades.
d. La varianza y la desviación estándar. b. La fdp .
e. p 2 X 1 . c. La esperanza matemática.
f. p 2 X 1 . d. La varianza y la desviación estándar.
g. p 2 X 1 . e. p 2 X 3 .
h. p X 1 . f. p 2 X 2 .
i. p X 1 . g. p 2 X 3 .
j. p X 1 . h. p X 2 .
k. p X 1 . i. p X 2 .
j. p X 2 .
k. p X 2 .
Sección 1.3 Resumen y autoevaluación 97
PROPÓSITO
Al finalizar la unidad el alumno:
Analizará el comportamiento de los estimadores media y proporción, a
través del modelo Normal, para construir un vínculo entre la
probabilidad y la inferencia estadística
CONTENIDO
2.1 POBLACIÓN y MUESTRA
2.2 PARÁMETRO y ESTADÍSTICO
Sección 2.1 Población y muestra 99
2.1 POBLACIÓN
Y MUESTRA
Temática
Población y muestra: Muestreo aleatorio simple con y sin reemplazo.
Parámetros y estadísticos: Variabilidad muestral.
100 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
174 .5 179 .5 8
179 .5 184 .5 10
184 .5 189 .5 13
189 .5 194 .5 10
194 .5 199 .5 9
199 .5 204 .5 6
204 .5 209 .5 4
TABLA 1
f fr
15 0.25
10 0.167
5 0.08
f fr
15 0.25
10 0.167
5 0.08
FIGURA 1
4. Sin embargo, las conjeturas anteriores, y que hicimos en forma categórica solo son “inferencias
informales” sobre el comportamiento de los tiempos de recorrido del circuito “Tacubaya – Tepalcates –
Tacubaya”, y de ninguna manera son válidas (solo son creencias) en el conjunto de todos los tiempos
de recorrido del circuito señalado.
5. Con toda certeza, si se selecciona (sin) otro grupo de tiempos de recorrido del circuito “Tacubaya –
Tepalcates – Tacubaya”, las conjeturas planteadas con base en ellos seguramente serían “muy
diferentes” considerando que la variable (tiempo de recorrido del…) está gobernada por
una combinación de circunstancias o de causas imprevisibles, complejas, sin plan previo y sin
propósito, que provocan que acontezca se obtenga una determinada medida que no está condicionada
por la relación de causa y efecto, ni por la intervención humana, es decir, parte de del tiempo medido se
debe a la casualidad, a lo fortuito o accidental, a lo involuntario, o sin una intención o un motivo
determinado o prefijado, a lo que no puede medirse u ocurre aleatoriamente.
(población de estudio), por tanto, para comprender correctamente los procesos de la estadística
inferencial es necesario tener presentes y claros los conceptos de población, muestra y muestreo.
se describe
ESTADÍSTICA DESCRIPTIVA
se realizan conclusiones respecto a al población
utilizando elementos probabilísticos
ESTADÍSTICA INFERENCIAL
FIGURA 2
EJEMPLO 2 (CARACTERÍSTICAS)
Dada una población de ciudadanos:
a. Características cuantitativas (medibles) son: la estatura, el peso, la presión sanguínea, el coeficiente
intelectual, la envergadura, entre otras.
b. Características cualitativas (no medibles) son: el color de piel, el tono de voz, la belleza, entre otros.
Formalización:
Sección 2.1 Población y muestra 103
w1 , w2 , ..., w n Xi = X ( wi )
w1 , w2 , ...
FIGURA 3
104 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
realización
MAS se mide una (medidas)
se toma característica
X1 , X 2 ,..., X n x1 , x2 , ..., xn
FIGURA 4
Otro de los propósitos de la estadística inferencial es obtener información sobre los valores reales
o parámetros que tiene asociada una población, entre ellos se encuentran “los promedios”, las “medidas
de dispersión”, las proporciones, los totales, los porcentajes, etcétera.
106 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
DEFINICIÓN 5 (MUESTREO)
Proceso de selección y medición de la información en una parte de la población estadística.
Considerando que una muestra representativa es útil cuando no es posible medir la característica
de interés en todos los elementos de la población es adecuado señalar que existen dos métodos
básicos de selección de muestras de una población:
i. No aleatoria o de juicio, es práctica común seleccionar una muestra en forma intencional, de acuerdo
con opiniones o criterios personales, fundamentalmente con el objeto de obtener información sin mucho
costo. Este muestreo se conoce como muestreo no probabilístico, no aleatorio o de juicio y no involucra
aspectos aleatorios en el procedimiento de selección, es adecuado cuando solo se necesitan
estimaciones gruesas que no van a ser utilizadas para tomar decisiones importantes.
ii. Aleatoriamente, si en el proceso de selección de la muestra todos los objetos de la población tienen
la misma probabilidad de ser electos. Si de una población con N objetos se obtienen muestras
aleatorias de n de ellos, entonces cada objeto en cada muestra tiene la misma probabilidad de resultar
electo.
muestra muestra
datos estadística datos
estadística
REEMPLAZO
FIGURA 5
a b c d
a aa ab ac ad
b ba bb bc bd
c ca ca cc cd
d da db dc dd
FIGURA 6
a. Si el muestreo importa el orden, se realiza con reemplazo y con repetición (los objetos pueden
repetirse), entonces todas las muestras de tamaño n 2 son
aa, ab, ac, ad, ba, bb, bc, bd, ca, cb, cc, cd, da, db, dc, dd
b. Si el muestreo importa el orden, se realiza con reemplazo y sin repetición (los objetos no pueden
repetirse), entonces todas las muestras de tamaño n 2 son
ab, ac, ad, ba, bc, bd, ca, cb, cd , da, db, dc
c. Si en el muestreo no importa el orden, se realiza sin reemplazo y sin repetición, entonces todas las
muestras de tamaño n 2 son
ab, ac, ad, bc, bd, cd .
Antes señalamos que una vez conocido el valor real de una característica de interés de una
población el estudio referente a ella ha concluido. Los valores reales de una población se llaman
parámetros.
108 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
FIGURA 7
DEFINICIÓN 6 (ESTADÍSTICA)
Se denomina estadística a cualquier función (o fórmula) obtenida a partir de la combinación de las
variables aleatorias de una MAS y que no contiene parámetros.
Si sumamos dos o más variables aleatorias obtenemos como resultado otra variable aleatoria, si
multiplicamos por un número (distinto de cero) a una variable aleatoria el resultado es una variable
aleatoria, si multiplicamos dos variables aleatorias obtendremos otra variable aleatoria.
MAS
estadística
se combinan
X1 , X 2 ,..., X n f ( X 1 , X2 , ..., X n )
FIGURA 8
En el desarrollo de la presente obra sólo trataremos las estadísticas: “media” y “proporción”, sin
embargo, debemos señalar que existen otras.
110 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
MAS
estadística
X1 , X 2 , ..., Xn f ( X1 , X2 , ..., Xn )
datos
x1 , x 2 , ..., x n
realización
FIGURA 9
Formalmente:
b. Si todas las variables aleatorias X 1 , X 2 , , X n asumen (su recorrido es) uno de los números del
X1 X 2 X n
conjunto 0 , 1 , entonces la variable aleatoria P se denomina proporción.
n
EJEMPLO 9 (ESTADÍSTICAS)
a. Sea la muestra aleatoria simple X 1 , X 2 , X 3 , X 4 , correspondiente a cierto experimento.
La estadística
4
X1 X 2 X 3 X 4 1
X
n
n
X
i 1
i
453 4
x1 4.
4
433 4
ii. Si 4 , 3 , 3 y 4 , es otra de sus realizaciones, entonces x1 3.5
4
b. En una consulta efectuada por cierto medio de comunicación se utilizó la MAS X 1 , X 2 , , X 2000 .
i. Si en una primera realización de X 1 , X 2 , , X 2000 se observó que 800 de ellos prefirieron la marca
A de cierto producto, entonces la estadística
X X 2 X 2000
P 1 ( X 0 o 1)
n
asumió el valor
800
p 0.40 .
2000
ii. Si en una segunda realización de X 1 , X 2 , , X 2000 se observó que 728 de ellos tienen preferencia
por la marca A del producto, entonces
728
p 0.364 .
2000
112 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
PROBLEMAS PROPUESTOS
2. La siguiente tabla de frecuencias representa 4. Obtén todas las muestras de tamaño 2 del
una muestra extraída cierta ciudad. conjunto S 2 , 4, 6, 8, 10 .
Temática
Distribución muestral de medias. Distribución muestral de proporciones.
Teorema del Límite Central.
114 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
V X =
( 2 − 4 )2 + ( 4 − 4 )2 + ( 6 − 4 )2 =
8
.
3 3
iii. Sea la MAS
X1, X 2 .
a. Las realizaciones de la muestra aleatoria simple
X1, X 2
(tamaño dos), y sus medias respectivas (tabla de la izquierda), la fdp (función de distribución, tabla de
la derecha) y su grafico se muestran a continuación
116 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
MUESTRA ASIGNACIONES xi
2+2
2, 2 x ( 2, 2 )= =2
2
2+4
2, 4 x ( 2, 4 )= =3
2
2+6
2, 6 x ( 2, 6 )= =4 x fX (x)
2
4+2 1
4, 2 x ( 4, 2 )= =3 2
9
2
4+4 2
4, 4 x ( 4, 4 )= =4 3
2 9
6+4 3
4, 6 x ( 6, 4 )= =5 4
9
2
6+2 2
6, 2 x ( 6, 2 )= =4 5
2 9
6+4 1
6, 4 x ( 6, 4 )= =5 6
2 9
6+6
6, 6 x ( 6, 6 )= =6
2
f
1
0 2 3 4 5 6 x
FIGURA 1
4
X2 = .
3
8 4 V X
c. Puesto que V X = , el tamaño de la muestra es n = 2 y 2 X = , entonces X2 = , por
3 3 2
lo que es justificable establecer las conjeturas
V X ,
E X = X y 2X =
n
es decir,
“La media de la distribución muestral de la media es igual a la media real (poblacional)” y “la
varianza de la distribución muestral de la media es igual la varianza de la población dividida por
el tamaño de muestra”.
Muestra
Muestra P
número
Muestra
1 r1 , r1 P1 = 1 número
Muestra P
r1 , b2 P2 =
1 6 b2 , b3 P6 = 0
2
2
1
1 7 b3 , r1 P7 =
3 r1 , b3 P3 = 2
2
8 b3 , b2 P8 = 0
1
4 b2 , r1 P4 =
9 b3 , b3 P9 = 0
2
5 b2 , b 2 P5 = 0
f
1
1
P 0 1
2
4 4 1
fP ( x )
9 9 9
0 0.5 1 x
FIGURA 2
d. Con:
valor esperado
4 1 4 1 1
P = E P = ( 0 ) + + ( 1 ) =
9 2 9 9 3
y varianza
2 2 2
1 4 1 1 4 1 1 1
P2 = 0 − + − + 1− = .
3 9 2 3 9 3 9 9
e.
i. La proporción de canicas rojas de la población está relacionada con la media de la distribución
1
E X = p = = P .
3
Es decir, “la proporción de canicas rojas de la población es igual a la media de la distribución muestral
de proporciones”.
ii. También es posible relacionar la varianza de la población con la varianza de la distribución muestral
de la proporción, note que
1 2
2 1 2 3 3
V X = = = = P2
9 3 3 1
1 2
iii. En este problema p = , q = y n = 1 , por tanto, podemos establecer las conjeturas
3 3
pq
P = p y también P2 = , es decir,
n
La media de la distribución muestral de la proporción es igual a la proporción real (poblacional)”
y la varianza de la distribución muestral de la proporción es igual la varianza de la población
dividida por el tamaño de muestra”.
A continuación, damos formalidad a las conjeturas hechas sobre las distribuciones muestrales
señaladas en los dos ejemplos anteriores.
n
X1 + X 2 + + X n 1
La estadística X =
n
=
n
X
i =1
i es una variable aleatoria que se genera combinando
la muestra aleatoria simple X 1 , X 2 , , X n , por tanto, tiene asociada una media y una varianza,
Sección 2.2 Parámetro y estadístico 119
entonces
X1 + X 2 + + X n
X = E X = E ,
n
1 1
= E X 1 + X 2 + + X n = E X 1 + E X 1 + + E X n ,
n n
considerando que las variables aleatorias X 1 , X 2 , , X n están idénticamente distribuidas ( idd ) y
que tienen el mismo valor esperado , obtenemos
1
1
X = + + + = ( n ) = .
n
n
n veces
La varianza de la estadística X (que se representa por X2 ) es
X1 + X 2 + + X n
X2 = V X = V
n
1
=V X1 + X 2 + + X n
n2
1
= 2 V X 1 + V X 1 + + V X n .
n
Las variables aleatorias X 1 , X 2 , , X n están idénticamente distribuidas ( idd ) y cada una de ellas
tiene varianza 2 , entonces
2
X2 =
1
n2
2
2
+ + 2
+
1
(
2
= 2 n = )
n
.
n veces n
La formalización de las observaciones previas es la propiedad 1.
X1 + X 2 + + X n 1 1
P = E P = E = E X == np = p ,
n n n
y también
X 1 1 pq
P2 = V P = V = 2 V X = n 2 npq = n .
n n
P = p = 0.10 , P2 =
( 0.10 )( 0.90 ) ( 0.10 )( 0.90 )
= 0.0036 y P = = 0.06 respectivamente.
25 25
b. Suponga que sólo el 40 % de estudiantes de cierta institución educativa visitan la biblioteca, si se
utiliza una muestra aleatoria de 100 integrantes de la institución educativa, entonces la media, la
varianza y la desviación estándar de la distribución muestral de la proporción son:
P = p = 0.40 , P2 =
( 0.40 )( 0.60 ) ( 0.40 )( 0.60 ) = 0.048989 respectivamente.
= 0.0024 y P =
100 100
c. Una investigación demostró que el 64 % de los electores inscritos el padrón electoral de cierta
población recibió una despensa para votar por cierto partido. Si se toma una muestra aleatoria simple
de n = 25 electores, entonces: la media, la varianza y la desviación estándar de la distribución muestral
de la proporción son:
P = p = 0.64 , P2 =
( 0.64 )( 0.36 ) ( 0.64 )( 0.36 )
= 0.009216 y P = = 0.0959 .
25 25
n
X1 + X 2 + + X n 1
X =
n
=
n
X
i =1
i
es aproximadamente normal.
El TEOREMA DEL LÍMITE CENTRAL (o Teorema Central del Límite), es el resultado de mayor
utilidad e importancia en el cálculo de probabilidades y es la justificación analítica de la aproximación de
las diversas distribuciones de probabilidades a distribución la normal, su enunciado fue obra del
Matemático Aleksandr Liapunov en el Siglo XX, quien además lo demostró.
2
n
converge en distribución a la variable aleatoria normal estándar.
NOTA −
a. En el contexto de la distribución muestral de la media X , el Teorema del Límite Central
afirma:
“la variable aleatoria
X1 + X 2 + + X n
−
n
Zn =
2
n
converge en distribución a la distribución de la variable aleatoria normal estándar Z ”.
b. En el contexto de la distribución muestral de la proporción P , la variable aleatoria
X
− p
n
Zn =
pq
n
converge en distribución (se aproxima a la distribución) de la variable aleatoria normal
estándar Z .
c. En la práctica, la condición “tamaño de la muestra es suficientemente grande” se considera
satisfecha cuando n es mayor o igual que 30 .
Sección 2.2 Parámetro y estadístico 123
x 9 10 11 12 13 14 15 x
0 1 2 3 4 5 0 1 2 3 4 5 6 7 8
f
f
0.28 0.17
0 1 2 3 4 5 6 7 8 9 10 x x
0 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19
FIGURA 3
EJEMPLO 6 (INGRESOS)
El monto promedio de ingresos (por tres horas de trabajo) de los “limpiaparabrisas” que operan en los
principales cruces de avenidas de la Ciudad de México es $ 125 con desviación estándar de $ 24 .
a. Si se seleccionan todas las muestras posibles de tamaño n = 36 , entonces la estadística X se
24
distribuyen normalmente con X = 125 y X = = 4 . El tamaño de muestra garantiza el que el
36
comportamiento normal del promedio es normal, por tanto, la probabilidad de que el ingreso promedio
(por tres horas) sea menor a $ 115 es
115 − 125
p ( X 115 ) = p Z = p ( Z −2.5 ) = ( − 2.5 ) = 0.0062 .
4
b. Si se selecciona una muestra aleatoria simple de 64 “limpiaparabrisas” (que operan en la Ciudad de
México), su tamaño garantiza que el comportamiento normal del ingreso medio (por tres horas) sea
menor o igual a $ 115 , por tanto, la variable aleatoria X se distribuye en forma normal con parámetros
24
X = 125 y X = = 3,
64
por tanto,
115 − 125
p ( X 115 ) = p Z = p ( Z −3.33 ) = ( − 3.33 ) = 0.0004 .
3
124 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
EJEMPLO 7 (DIÁMETROS)
El distribuidor de las tapaderas de las botellas de la compañía Coca Cola S. A., afirma que éstas se
distribuyen normalmente, tienen un diámetro promedio de = 1.001 centímetros y desviación estándar
= 0.003 centímetros, por tanto:
a. La probabilidad de que una muestra aleatoria de n = 9 tapaderas tenga un diámetro promedio
comprendido entre 1.009 y 1.012 (inclusive) centímetros se calcula como sigue:
0.003
Puesto que n = 9 , entonces X = 1.001 y X = = 0.001 , luego
9
1.009 − 1.001 1.012 − 1.001
p ( 1.009 X 1.012 ) = p Z = p ( 8 Z 11 ) = 0 .
0.001 0.001
b. La probabilidad de que una muestra aleatoria de n = 9 tapaderas tenga un diámetro promedio mayor
que 1.00102 centímetros se calcula como sigue
1.00102 − 1.001
p ( X 1.00102 ) = p Z = p ( Z 0.02 ) = ( − 0.02 ) = 0.4920 .
0.001
c. Para responder la pregunta ¿sobre qué longitud de diámetro promedio se encuentra el 90 % de las
tapaderas producidas por el taller?, sea x 0 el diámetro promedio mínimo de las tapaderas, entonces
x 0 − 1.001
p ( X x 0 ) = 0.90 , es decir, p Z = 0.90
0.001
de las tablas de la distribución normal obtenemos z 90 = 1.2816 , de donde,
x 0 − 1.001
= 1.2816 , o bien x 0 = ( 1.2816 )( 0.001 ) + 1.001 = 1.0022816 centímetros.
0.001
d. Sea t 0 el tiempo promedio máximo desconocido (los otros valores de la estadística son menores o
iguales), entonces p ( X t 0 ) = 0.95 , luego
t 0 − 8. 2
p Z = 0.95 ,
0.214
el percentil correspondiente es
t 0 − 8.2
z 95 = 1.6449 , así = 1.6449 ,
0.214
es decir,
t 0 = ( 1.6449 )( 0.214 ) + 8.2 = 8.552 minutos.
0.40 − 240
1
− 0.5 0.60 + 240
1
− 0.5
p ( 0.40 P 0.60 ) = p Z
0.0456 0.0456
= p ( − 2.28 Z 2.28 ) = D ( 2.28 ) = 0.9774 .
b. La probabilidad de que la proporción de aparatos electrónicos de la marca LG sea de 75 % o más es
0.75 − 240
1
− 0.5
p ( P 0.75 ) = p Z = p ( Z 5.391 ) = ( − 5.391 ) 0 .
0.0456
30
c. La proporción correspondiente a 30 departamentos con aparatos de esa marca es = 0.25 ,
120
entonces la probabilidad de que haya 30 o más departamentos con aparatos electrónicos de la marca
LG es
0.25 − 240
1
− 0.5
p ( P 0.25 ) = p Z = p ( Z −5.5738 ) = ( 5.5738 ) 1 .
0.0456
d. La proporción correspondiente a 60 departamentos con aparatos electrónicos de la marca LG es
30
= 0.50 , por tanto, la probabilidad de que la mitad o menos de los departamentos incluyan aparatos
60
electrónicos de la marca señalada es
0.5 + 240
1
− 0.5
p ( P 0.50 ) = p Z = p ( Z 0.091 ) = ( 0.091 ) 0.535 .
0.0456
0.27 − 120
1
− 0.05
p ( P 0.27 ) = p Z = p ( Z 7.52 ) = ( − 7.52 ) 0 .
0.02814
Sección 2.2 Parámetro y estadístico 129
PROBLEMAS PROPUESTOS
“Acuafont S.A.” esté entre 3.5 y 3.8 gramos? miligramos y = 0.1 miligramos. Considere
b. ¿Cuál es la probabilidad de que la cantidad un racimo con 25 “plátanos machos”.
media de minerales en los garrafones de a. ¿Cuál es la probabilidad de que la cantidad
“Acuafont S.A.” sea superior a los 4.2 media de potasio en los 25 “plátanos machos”
gramos? sea superior a los 0.82 miligramos?
c. ¿Cuál es la probabilidad de que la cantidad b. ¿Cuál es la probabilidad de que la cantidad
media de minerales en los garrafones de media de potasio en los 25 “plátanos machos”
“Acuafont S.A.” sea inferior a los 3.9 gramos? sea menor a los 0.86 miligramos?
d. ¿Qué contenido medio máximo de minerales c. ¿Qué contenido promedio máximo de
tiene el 99 % de los garrafones de “Acuafont potasio existe en el 99 % de los 25 “plátanos
S.A.”? machos”?
d. ¿Qué contenido promedio mínimo de
7. La compañía “Oasis” talará 400 árboles de potasio existe en el 5 % de los 25 “plátanos
la Ciudad de México. La distribución de los machos”?
diámetros de los árboles es normal con
= 44 centímetros y = 4 centímetros. 10. Considera un lote de 100 bultos con la
a. Determina la probabilidad de que el diámetro leyenda “Harina la Estrella” seleccionados al
medio de los árboles talados por “ciudad de azar. Si el peso especificado en cada saco es
vanguardia” se encuentre entre 43 y 44 .5 = 50 kilogramos y la desviación estándar es
centímetros. = 1 0 kilogramos, calcula:
b. Determina la probabilidad de que el diámetro
a. p ( 49.75 X 50.25 ).
medio de los árboles talados por “Oasis” se
encuentre entre 0 y 46 centímetros. b. Si = 49.8 calcule
p ( 49.75 X 50.25 ) .
8. Los años de estudio de las personas adultas
de la Alcaldía de Tláhuac, tiene una media 11. El tiempo utilizado en llenar una solicitud
2
= 11 años y varianza de = 9 . Considera de trabajo se distribuye normalmente con
= 10 y = 2 minutos. Si 49 individuos
una encuesta aleatoria efectuada a 100
adultos. llenan la solicitud de trabajo por día.
a. ¿Cuál es la probabilidad de obtener un nivel a. ¿Cuál es la probabilidad de que el tiempo
medio de años de estudios entre 10 y 12 sea a lo más de 13 minutos?
años. b. ¿Cuál es la probabilidad de que el tiempo
b. ¿Cuál es la probabilidad de obtener un nivel medio sea mayor a 11 minutos?
medio de años de estudios sea mayor a 13 c. ¿Cuál es la probabilidad de que el tiempo
años? medio esté entre los 7 y los 11 minutos?
d. ¿Qué tiempo medio mínimo por día se
9. El contenido de potasio de un “plátano ocupará en llenar el 10 % de las solicitudes?
macho” una distribución normal con = 0.8
Sección 2.2 Parámetro y estadístico 131
12. El tiempo medio que tarda una rata en 15. Se ha encontrado que el 2 % de los
devorar un trozo de pan es una variable habitantes de San Iván se levantan antes de
aleatoria normal con media = 1.5 minutos y las 5 : 30 . Sea una muestra de 400
desviación estándar = 0.35 minutos. A cinco habitantes de San Iván. Determina:
ratas se les proporciona un trozo de pan. a. La probabilidad de que la proporción de los
a. ¿Cuál es la probabilidad de que el tiempo que se levantan antes de las 5 : 30 sea de 3 %
medio que tarda la rata en devorarlo esté entre o más.
1 .7 y 1.8 minutos? b. La probabilidad de que la proporción de los
b. ¿Cuál es la probabilidad de que el tiempo que se levantan antes de las 5 : 30 sea de 2 %
medio que tarda la rata en devorarlo sea menor o menos.
de 2 minutos? c. La probabilidad de que la proporción real
c. ¿Cuál es la probabilidad de que el tiempo esté entre 13 % y 27 % (incluya ambos
medio que tarda la rata en devorarlo sea mayor extremos).
a los 1.48 minutos? d. La probabilidad de que la proporción real
d. ¿Cuál es la probabilidad de que el tiempo esté entre Esté entre 4 % y el 8 % (no incluya
medio que tarda la rata en devorarlo sea a lo
los extremos).
más de 1.7 minutos?
16. Un estudio demostró que el 46 % de los
13. La dureza de los cristales, fabricados por
últimos nacimientos en el hospital “CEE”
“Crisa”, se distribuye normalmente con = 50
fueron hombres. Calcula la probabilidad de que
y = 4.5 kilogramos.
en los próximos:
a. ¿Cuál es la probabilidad de que la dureza a. 200 nacimientos sea una mayoría de
media de una muestra aleatoria de 9 cristales hombres.
producidos por “Crisa” sea por lo menos de 52 b. 1000 nacimientos sea una mayoría de
kilogramos? hombres.
b. ¿Cuál es la probabilidad de que la dureza c. 200 nacimientos sean más de 105 mujeres.
media de una muestra aleatoria de 36 cristales
sea por lo menos de 52 kilogramos? 17. La proporción de “huevos pintos” que
ponen las gallinas de la granja “San Cristóbal”
14. Un profesor sólo resuelve correctamente el es 0.5 . Determine la probabilidad de que la
20 % de los problemas que presenta en clase. proporción de “huevos pintos” seleccionados
Si en un curso propone 64 problemas: por uno de los trabajadores, en las próximas
a. ¿Cuál es la probabilidad de que la 200 recolecciones sea de:
proporción de problemas que resuelve a. Menor al 40 % .
correctamente sea del 25 % o más? b. Entre 43 % y 57 % , inclusive.
b. ¿Cuál es la probabilidad de que la c. En las próximas 200 selecciones haya más
proporción de problemas que resuelva de 108 “huevos pintos”.
correctamente sea a lo más del 32 % ?
132 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
18. El jefe de control de calidad de la fábrica de 20. Suponga que las “aspirinas” son efectivas
golosinas “El Cerezo”, afirma que el 5 % de los el 74% de las veces en que se utilizan en el
bombones que elaboran pesan más de 5 tratamiento del dolor de cabeza.
gramos. Cada bolsa contiene 100 bombones. a. A 16 personas con dolor de cabeza se les
Si hace una entrega de 1000 bolsas a cierto administran aspirinas. ¿Cuál es la probabilidad
almacén. de que más de 4 se recuperen del dolor de
a. ¿Cuántas bolsas tienen menos de 20 cabeza?
bombones con peso mayor a 5 gramos? b. A 140 personas que padecen dolor de
b. ¿Cuántas bolsas tienen 48 o más cabeza se les administran aspirinas, ¿cuál es
bombones con peso mayor a 5 gramos? la probabilidad de que más de 4 se recuperen
c. ¿Cuántas bolsas tienen menos de 90 del dolor de cabeza?
bombones con peso menor a 5 gramos?
d. ¿Cuántas bolsas tienen 98 o más 21. Una encuesta reveló que el 70% de los
bombones con peso menor a 5 gramos? taxistas que ingresaron frecuentemente a la
zona de “Peralvillo” habían sido asaltados por
19. En un estudio de mercado se determinó lo menos una vez en los últimos cinco años. Si
que el 78% de los habitantes de la región se selecciona una muestra de 200 taxistas
consumen el refresco “ArciCola”. Considere que ingresan frecuentemente a la zona de
una muestra de 50 personas de la región. “Peralvillo”.
a. ¿Cuál es la probabilidad de que la
Determina la probabilidad de que la proporción
proporción de taxistas asaltados por lo menos
de personas que consume el refresco
una vez en los últimos cinco años esté entre
“ArciCola”:
60 % y él 80 % ?
a. Sea superior al 80 % .
b. ¿Cuál es la probabilidad de que la
b. Sea superior al 20 % .
proporción de taxistas asaltados por lo menos
c. Menos de 30 afirmen consumir “ArciCola”. una vez en los últimos cinco años sea mayor al
d. Menos de 36 afirmen no consumir el 66 % ?
refresco “ArciCola”. c. ¿Cuál es la probabilidad de que la
proporción de taxistas asaltados por lo menos
una vez en los últimos cinco años sea menor al
74 % ?
Sección 2.3 Resumen y autoevaluación 133
2.3 RESUMEN Y
AUTOEVALUACIÓN
134 UNIDAD 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
ACTIVIDADES
RESUMEN
Sección 2.1
Característica Una característica (o carácter) de un objeto (elemento o individuo) es una
propiedad a partir de la que es posible clasificar y estudiar.
Población Conjunto de todos objetos que es posible seleccionar para ser objeto de
Estadística estudio.
Muestra Cualquier parte de una población o subconjunto de la población.
media.
Proporción Si todas las variables aleatorias X 1 , X 2 , , X n asumen (su recorrido
es) uno de los números del conjunto 0 , 1 , entonces la variable
X1 X 2 X n
aleatoria P se denomina proporción.
n
136 UNIDAD 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA
Sección 2.2
Distribución Distribución de probabilidad de una estadística.
muestral
Propiedades de la X1 X 2 X n
Sea la estadística X asociada a la MAS
distribución n
muestral X 1 , , X n , que se extrajo de una población con valor medio
de la media
E X y varianza V X 2 , entonces
i. X .
2
ii. X2 .
n
Propiedades de la X
En la estadística P , X representa el número de éxitos en la MAS
distribución n
muestral X 1 , , X n , misma que se extrajo de una población con valor medio
de la proporción
E X np y varianza V X npq , entonces
i. P p .
pq
ii. P2 .
n
Sección 2.1
Sugerimos utilizar las aplicaciones mencionadas en la unidad 1.
Sección 2.2
Sugerimos utilizar las aplicaciones mencionadas en la unidad 1.
AUTOEVALUACIÓN
CIERTO O FALSO
(Selecciona la opción que consideres correcta)
C F 1. Una variable aleatoria genera una población estadística.
C F 2. Una muestra también puede considerarse como una población.
C F 3. En un muestreo sin reemplazamiento las muestras son aleatorias simples.
C F 4. Una población estadística está compuesta por objetos que pueden tratarse como
variables aleatorias.
C F 5. Una muestra aleatoria simple es un conjunto de números.
C F 6. Con una tabla de números aleatorios es posible construir una MAS
C F 7. Una realización de una muestra aleatoria simple es una variable aleatoria.
C F 8. En el muestreo con reemplazo las muestras son aleatorias simples.
C F 9. Una muestra contiene parámetros.
C F 10. Los símbolos y representan parámetros.
C F 11. El cálculo de una probabilidad asociada a la media requiere de una estandarización
previa.
C F 12. El cálculo de una probabilidad de la variable aleatoria “proporción” requiere
corregirse por continuidad.
C F 13. Un parámetro específico tiene uno o más estimadores.
C F 14. La distribución muestral de la proporción se distribuye normalmente y no depende
del tamaño de la MAS.
C F 15. La distribución muestral de la media siempre se distribuye normalmente.
C F 16. La construcción de distribución muestral de la proporción se basa en la distribución
muestral de la media.
C F 17. Una distribución muestral se construye tomando como base un parámetro.
C F 18. La distribución muestral de la media es una función de probabilidades acumuladas.
C F 19. La distribución de probabilidad de un parámetro se denomina distribución muestral.
C F 20. La distribución muestral de se denomina distribución muestral de la media.
C F 21. La distribución muestral de p se denomina distribución muestral de la proporción.
Sección 2.3 Resumen y autoevaluación 139
PROBLEMAS PROPUESTOS
1. Se seleccionaron muestras de tamaño n de 4. Si p 0.05 y n 60 determina:
ciertas poblaciones con la media y varianza a. p 0.15 P 0.20 .
indicadas, determine la media y la desviación b. p P 0.10 .
estándar de la distribución muestral de medias.
c. p P 0.30 .
Suponga muestreo con reemplazo.
d. p P 0.08 .
a. n 100 , 80 y 2 16 .
e. p P 0.02 .
b. n 200 , 150 y 2 25 .
c. n 625 , 203 y 2 81 .
3. Si 3.0 , 1 y n 81.
a. ¿Cuál es la probabilidad de que X esté
entre 3.1 y 3.3 ?
b. ¿Cuál es la probabilidad de X 3.2 ?
c. ¿Cuál es la probabilidad de X 2.9 ?
d. Si p X x 0 0.99 , calcula x 0 ,.
e. Calcula x 0 , para p X x 0 0.95 .
f. Si p X x 0 0.02 calcula x 0 .
3.
INFERENCIA
ESTADÍSTICA
PROPÓSITO
Al finalizar la unidad el alumno:
Realizará inferencias formalessobre los valores de los parámetros,
a partir del análisis de los estimadores, para fundamentar la toma de
de decisiones en una investigación estadística, consolidando la
formación de su pensamiento estadístico.
CONTENIDO
3.1 ESTIMACIÓN
3.2 PRUEBA DE HIPÓTESIS PARA LA MEDIA
Y LA PROPORCIÓN POBLACIONAL
Sección 3.1 Estimación 141
3.1 ESTIMACIÓN
Temática
Estimación puntual y por intervalos para la media y la proporción de
la población. Elementos que componen a un intervalo de confianza.
Aplicación e interpretación de resultados.
142 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
Una población estadística está constituida por todos los objetos (elementos o individuos) que
presentan un carácter o propiedad común (medible, definido o seleccionado por el investigador) que se
desea describir utilizando estadísticas. Por otra parte, el propósito de la Estadística Inferencial (
inferencia estadística) es inferir y/o estimar los parámetros (caracteres o números que la describen) de
una población que no es completamente observable (lo que puede deberse a su tamaño, su costo, su
complejidad, etcétera) en su totalidad, por tanto, se requiere utilizar partes de ella (muestras) con el fin
de conocerla (a través del análisis de las muestras y los elementos de probabilidad). Esto significa
calcular números y determinar su bondad, es decir, conocer que tan próximos son a los valores reales
(parámetros) de la población.
muestra
aleatoria
simple realizaciones de la MAS
X1 , X 2 , ..., Xn x 1 , x2 , ..., xn
inferencias
(conclusiones sobre la población)
FIGURA 1
parámetro ¿cuánto vale ?
(se desconoce) (¿quién es f ( x , ) ?)
FIGURA 2
T T
BINOMIAL p P p
n n
n n
NORMAL
i 1
Xi
x
i 1
i
X x
n n
n n
NORMAL 2
2
X
i 1
i X 2
2
x
i 1
i x 2
S s
n 1 n 1
TABLA 1
Con base en el valor calculado a partir de la estadística P se puede efectuar una inferencia sobre el
parámetro p . En este caso el parámetro p se ha estimado puntualmente utilizando el estimador
puntual p 0.6 .
Si deseamos caracterizar la variable X (lo que significa que debemos conocen sus parámetros y
como consecuencia su fdp ) que se refiere al comportamiento de una característica de una población,
y que sabemos tiene asociada una distribución de probabilidades que depende del parámetro
(desconocido), entonces los problemas de inferencia que pueden darse son:
i. De estimación, en los que se busca un valor (estimación puntual) para el parámetro .
ii. Un conjunto de valores posibles para el mismo (estimación por intervalos de confianza).
iii. De contraste, cuyo objetivo es comprobar si es cierta o falsa cierta suposición sobre el parámetro .
2
X
i 1
i X 2
S
n 1
2
y el estimador puntual de es el número
s2
1 5 2 3 5 2 5 5 2 7 5 2 6 5 2 8 5 2 6.8 .
6 1
b. Sea una población con distribución binomial de parámetro p ,
si X 1 , X 2 , X 3 , X 4 , X 5
es una muestra aleatoria y
1, 0, 0, 0, 1
es una de sus realizaciones, entonces para estimar el parámetro p utilizaremos la estadística
146 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
T X1 X 2 X 3 X 4 X 5 .
por tanto,
T 1 0 0 0 1 2 , entonces
2 1
p es el estimador puntual de p .
6 3
1
2
3
4
6 5
7
parámetro estimador del parámetro
FIGURA 4
1
4 estimadores por intervalo
del parámetro
3
2
parámetro estimador del parámetro
FIGURA 5
EJEMPLO 5 (ESTIMADORES)
i. Si deseamos estimar el tiempo promedio de duración de 100 llamadas telefónicas, proporcionar un
“número” como estimador puntual no es tan significativo como el proporcionar un intervalo en el que se
espera se encuentre el tiempo promedio de las llamadas.
ii. Si afirmamos que en un estudio hecho por un profesor, el estimó que la calificación media (promedio)
en las asignaturas de matemáticas oscila entre los 64 y los 76 puntos, y que la investigación se hizo
Sección 3.1 Estimación 147
con un nivel de confianza de 90% , entendemos que la verdadera calificación promedio será un valor
comprendido entre los dos números anteriores y que la probabilidad de que el intervalo 64 , 76 (o
en su caso el intervalo 64 , 76 ) incluya la calificación media real es 0.90 ; en el sentido de: si
efectuamos la estimación un número específico de veces, digamos 50 , las realizaciones de la muestra
aleatoria proporcionarán alrededor de 45 intervalos de confianza que incluirán el promedio real de la
calificación.
Un estimador (aleatorio) por intervalo del parámetro , es una estadística de la forma
i X 1 , , X n , s X 1 , , X n
en donde los extremos dependen de la realización x1 ,, xn de la MAS X 1 ,, X n e n el cálculo de
los estimadores puntuales I y S conocidos como extremo inferior y superior, del intervalo, por tanto,
son valores específicos de los estimadores i X 1 ,, X n y s X 1 ,, X n respectivamente,
vea la figura 6.
realización de la muestra
del parámetro
5 5i 5s
4 4i 4s
3 3i 3s
aleatoria
2 2i 2s
1 1i 2s
parámetro
FIGURA 6
llamado “intervalo de confianza de 1 100% para el parámetro ” o “estimador por intervalo del
parámetro ”. La formalización de los conceptos anteriores se encuentra en la definición 3.
b. Si x1 ,, xn , es una realización de la MAS X 1 , , X n , entonces I S es un intervalo de
confianza para el parámetro con el nivel de confianza 1 .
c. I es el límite inferior de confianza y S es el límite superior de confianza.
d. L S I es la amplitud del intervalo de confianza.
f
distribución
del
estadístico
nivel de
confianza
(
)
S estadístico
I parámetro
límite inferior límite superior
de confianza de confianza
FIGURA 7
El nivel de confianza 1 indica la fiabilidad del estimador por intervalo, esto es, la probabilidad
de que contenga al parámetro de interés, habitualmente se toman niveles de confianza como 90% ,
95% o 99% (correspondientes a las probabilidades de 0.10 , 0.5 y 0.01 respectivamente, de que
el valor del parámetro objetivo no esté contenido en el estimador por intervalo o intervalo de confianza).
El lector debe tener en cuenta que el uso de un alto nivel de confianza en la construcción de un
intervalo de confianza implica una amplitud relativamente grande de él(a mayor nivel de confianza
seleccionado, mayor amplitud del intervalo de confianza), por tanto, se pierde precisión en la estimación
real del parámetro objetivo. En la construcción del intervalo de confianza del 1 100% para un
parámetro específico , se utiliza una estadística (variable aleatoria) que lo incluya y la distribución de
Sección 3.1 Estimación 149
f(z)
( )
- z z z
FIGURA 8
Multiplicando por
n
todos los miembros de la inecuación anterior obtenemos
p z 2 X z 2 1 ,
n n
150 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
o bien p X z 2 X z 2 1 .
n n
Multiplicando por 1 los miembros de las desigualdades y reacomodándolos obtenemos el intervalo
aleatorio de confianza
p X z 2 X z 2 1
n n
Para obtener el estimador por intervalo del parámetro se realiza la muestra aleatoria
X 1 , , X n (extraída de una población con varianza conocida 2 ) y se estiman, tanto ŝ 2 como
X x , luego
s s
x z 2 x z 2 , o bien x z 2 x z 2 .
n n n n
0.68 2.326
0.68 0.32 p 0.68 2.326 0.68 0.32 ,
500 500
o bien
0.631 p 0.729.
iv. Se tiene una confianza del 95% de que la proporción real de estudiantes que escucha “La Zeta” se
encuentra en el intervalo
0.631 , 0.729 .
0.64 2.575
0.64 0.36 p 0.64 2.575 0.64 0.36 ,
100 100
o bien
0.516 p 0.764 .
iii. Se tiene una confianza del 99% de que la verdadera proporción p de los estudiantes que
desayunan “una torta” algún día de la semana se encuentra en el intervalo
0.5164 p 0.7636.
Sección 3.1 Estimación 153
f(Z) f(Z)
Z Z
- z z - z z
error máximo error máximo
amplitud del intervalo amplitud del intervalo
f(Z) f(Z)
Z Z
- z z - z z
error máximo error máximo
amplitud del intervalo amplitud del intervalo
FIGURA 9
La proposición 3 (dos partes) formaliza las observaciones anteriores y proporciona un método para
calcular el tamaño de muestra n cuando se conocen ciertas características del estimador por intervalos.
e S x .
De x 4.8 y S 5.15 , obtenemos e 5.15 4.8 0.35 .
b. Para determinar el tamaño de muestra utilizado ( n ), de 1 100% 90% obtenemos 0.10
y en las tablas de percentiles normales observamos
z 2 z 0.05 1.645 .
Si s 2.6 es estimador puntual de , entonces
1.645 2.6
2
n 149 .
0.35
PROBLEMAS PROPUESTOS
5. Ordena los intervalos de confianza para 10. Un examen sobre las habilidades físicas
respecto a su nivel de confianza. aplicado a 120 aspirantes a Guardias
a. 10.4 16.8 . Nacionales dio una calificación media de 77.8
b. 10.8 16.2 . y una desviación estándar de 11.1 ;
suponiendo que la población de calificaciones
c. 10.0 17.8 .
se distribuye normalmente. Construye
intervalos al 95 % de confianza para la media
6. Ordena los siguientes intervalos de
real de las calificaciones de habilidades físicas
confianza para la proporción real p respecto a
de los aspirantes.
su nivel de confianza.
a. Del 95% .
a. 0.4 p 0.82 .
b. Del 99% .
b. 0.33 p 0.89 .
c. 0.45 p 0.78 .
11. El jefe de personal de “Gorilas” S. A. tomó
33 estaturas de los aspirantes al puesto de
7. ¿Son posibles los intervalos de confianza
vigilante, observó: x 165 centímetros y
para la proporción real p ? Justifica tu
s 2.4 centímetros.
respuesta. a. Construye un intervalo al 95% de confianza
a. 1.74 p 7.12 .
para la media real de las estaturas de todos los
b. 10.74 p 17.98 . aspirantes a vigilantes.
c. 0.53 p 0.88 . b. Construye un intervalo de confianza para la
media real de las estaturas de los aspirantes a
8. Construye intervalos de confianza vigilantes.
apropiados para estimar . a. Del 95 % .
a. n 100 , x 10 , 2 y 0.05 . b. Del 90% .
b. n 625, x 125, 9 y 1 0.99 .
c. n 64 , x 100 , 12 y 1 0.95 . 12. Suponga que el tiempo de vida útil de las
baterías “Energizer” alcalinas en cierto
9. Se analizó una muestra aleatoria de 100 dispositivo electrónico se distribuye
edades de ciudadanos de una población con normalmente; se probó una muestra aleatoria
media desconocida y desviación estándar de 77 baterías ellas para determinar su tiempo
4.5 . Si una ejecución promedió x 28.3 de vida, la muestra produjo x 152 minutos y
años construya un intervalo de confianza para s 5 minutos. Construye un intervalo al 99%
. Determina el ancho de cada intervalo y de confianza para el verdadero tiempo
compara los resultados. promedio de funcionamiento de las baterías
a. 90% . Energizer utilizadas en ese tipo de dispositivo
electrónico.
b. 95% .
c. 99% .
158 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
14. Un estudio efectuado a 672 solicitudes 18. De 350 estudiantes encuestados acerca
sobre devolución de impuestos emitidas por el del tipo de cerveza preferida, 161 de ellos
“SAT”, mostró que 448 dieron lugar a pagos indicaron que prefieren la cerveza obscura
adicionales. sobre cualquier otro tipo. Construya intervalos
a. Construya un intervalo del 95 % de de confianza para la proporción real de
estudiantes que prefieren la cerveza obscura.
confianza para estimar la verdadera proporción
de todas las solicitudes de devolución de a. De 99 % .
impuestos, emitidas por el SAT que dan lugar a b. De 98% .
pagos adicionales.
b. Determine el error máximo cometido en la 19. Una muestra aleatoria de 249 fumadores,
estimación anterior. mostró que 87 % considera que el fumar es un
placer.
15. Los oxímetros de la marca “NK” utilizados a. Construya un intervalo del 92 % de
por 500 marineros de la aduana de Manzanillo confianza para la verdadera proporción de
fallaron en 20 ocasiones. fumadores que considera el fumar un placer.
a. Construya un intervalo del 95 % de b. Construya un intervalo del 90 % de confianza
confianza para la proporción real de oxímetros para la verdadera proporción de fumadores
que fallarán, interprete su resultado. que considera el fumar un placer.
b. Determine el error máximo cometido en la
estimación anterior. 20. Un tratamiento contra las “diarreas
cerebrales” en las personas, da esperanza de
16. Se revisó el contenido de una muestra disminuirlas, e incluso a producido bastantes
aleatoria de 25 “cocas” con la leyenda curas. Un especialista en el tratamiento de ese
“contenido neto 600 mililitros”. Se observó que mal afirma que una nueva técnica las
sólo 20 de ellas tuvieron el contenido indicado. disminuyó considerablemente en 50 de 104
Construya un intervalo del 95% de confianza personas. Construye un intervalo de confianza
para la verdadera proporción de “cocas” que no para la proporción real de personas en las que
contienen la cantidad indicada en la etiqueta el tratamiento hace disminuir significativamente
la “diarrea cerebral”.
17. Al fumigar con “Bayer” cierto terreno baldío, a. De 95 % .
38 de 60 roedores que fueron recolectadas b. De 99% .
murieron 5 minutos después.
Sección 3.1 Estimación 159
21. En un estimador por intervalos para : 25. Un grupo estudiantil quiere estimar el
e 0.0413 y 0.6 con un nivel de porcentaje de personas que están satisfechas
confianza de 95% . con la comida que se expende en la cafetería
a. ¿Qué tamaño de muestra utilizó? del plantel. Determina el tamaño del grupo que
b. Si x 3.6 , ¿cuáles son los límites de debe estudiarse si se quiere tener un 92 % de
confianza? confianza en que la verdadera proporción de
p difiere en menos de un punto porcentual de
22. Para estimar la media real de los diámetros
la estimación p .
de los tornillos que produce “Rugo” S. A. se
utilizó una muestra aleatoria de tamaño n . Si
e 0.01 y s 0.1 milímetros. Con un nivel de 26. Sea una población distribuida
confianza de 99 % , determina n si se utiliza x normalmente, con varianza conocida. ¿Cuál es
el nivel de confianza?
para estimar , interpreta el resultado.
a. x 2.81 x 2.81 .
n n
23. Para estimar la longitud media de las
alturas de los tornillos, en milímetros, que b. x 1.73 x 1.73 .
n n
expende Ferro S. A. se utilizó una muestra
aleatoria de tamaño n de ellos. Si e 0.005 ,
27. Una muestra aleatoria de 50 bolsas de
s 0.4 y el nivel de confianza es 98% ,
caramelos, envasados por una máquina
determina n si se utiliza x para estimar , automática, mostró un contenido promedio de
interpreta el resultado. 251 gramos con s 10.5 gramos, determina
el nivel de confianza para e 0.06 .
24. Un pediatra quiere estimar el porcentaje de
oxígeno en la sangre de los recién nacidos, y 28. Una cafetera automática se ajusta de modo
un estudio previo ha sugerido que este valor es que libere cierta cantidad de café en un vaso
del 68% . donde será mezclado con agua caliente. De
a. Si desea no errar por más de 2 % con un una muestra aleatoria de 36 bebidas se
nivel de confianza de 90% , encuentra el obtiene x 300 mililitros con una desviación
tamaño de muestra requerido. estándar s 1 mililitros. Sí e 0.3 determina
b. Si no se cuenta con una estimación previa, el nivel de confianza sí e 0.3 .
¿qué tan grande debe ser la muestra?
3.2 PRUEBA DE HIPÓTESIS PARA LA MEDIA
Y LA PROPORCIÓN POBLACIONAL
Temática
Elementos que componen una prueba de hipótesis.
Aplicación e interpretación de resultados.
Sección 3.2 Pruebas de hipótesis para la media y la proporción 161
Es posible inferir los valores reales (parámetros) poblacionales de distintas formas, utilizando un
estimador por intervalo o a partir de un estimador puntual. En inferencia estadística una prueba de
hipótesis es un proceso utilizado para decidir cuándo se puede aceptar o rechazar una afirmación
hecha sobre el valor de un parámetro de una población (o de su distribución de probabilidad) en función
de las evidencias que proporcionan un conjunto de datos obtenidos de ella (muestra). Así, cuando el
objeto de la investigación se relaciona con la determinación de cuál de dos suposiciones, sobre un
parámetro, es la correcta, los métodos y técnicas relacionadas para decidir sobre esta problemática
forman parte de la inferencia estadística denominada prueba de hipótesis.
El proceso que conduce a tomar una decisión sobre una hipótesis estadística particular recibe el
nombre de prueba de hipótesis y dependen del uso de la información contenida en la realización de una
muestra aleatoria de la población de interés, incluye:
a. La hipótesis nula representada por H 0 , es la hipótesis de investigación sobre el valor del (los)
parámetro(s) objetivo(s),
b. La hipótesis alternativa, representada por H a es negación o contrastación de la hipótesis nula.
c. Un procedimiento de prueba incluye una regla (basada en la información contenida en una muestra)
que se utiliza para determinar si se rechaza o no se rechaza H 0 . Este procedimiento de prueba incluye
las partes:
i. El cálculo de un valor específico de una estadística de prueba sobre la que se basa la decisión de
aceptar o rechazar H 0 .
ii. La regla de decisión, incluye todos los valores de la distribución muestral para los que se rechaza la
hipótesis nula H 0 y que se conoce como región de rechazo o región crítica ( RR ).
iii. La toma de una decisión, fundamentada en la estadística de prueba y en la región de rechazo (o
región crítica). Si para la realización x1 , x2 , x3 , , xn de la MAS el valor calculado de la estadística
de prueba se localiza en la región de rechazo, se rechaza la hipótesis nula H 0 y se acepta la hipótesis
alternativa H a . Si el valor calculado de la estadística de prueba no se localiza en la región de rechazo,
simplemente no se rechaza H 0 .
En el proceso de prueba de hipótesis la región crítica o región de rechazo está constituida por los
valores de la distribución del estadístico más lejanos del supuesto valor de la hipótesis nula, por tanto,
resulta poco probable que el estadístico de prueba los asuma suponiendo que H 0 es verdadera. La
figura 1 muestra la región de rechazo (o región crítica) y de aceptación (no rechazo) de la hipótesis nula
H 0 respecto a un parámetro específico.
e e e
H := vs Ha : = a s H :> vs Ha : a s H :< vs Ha : a s
0 0 0 0 0 0
t t t
a a a
d d d
í í í
s s s
t t t
i i i
c c c
o o o
región región región región
de de de estadístico de
rechazo rechazo rechazo rechazo
FIGURA 1
La probabilidad asociada a los valores del estadístico para los que la hipótesis nula H 0 se rechaza
se conoce como nivel de significación o nivel de significancia y se representa por el símbolo .
En una de prueba de hipótesis es posible cometer errores en la toma de una decisión (lo que
puede deberse a que la información que proporciona la muestra aleatoria es limitada), por ejemplo, el
rechazar la hipótesis nula siendo verdadera o no rechazarla siendo falsa, en ambos casos se ha
cometido un error y en cada caso el error recibe un nombre específico, vea el cuadro 1.
Sección 3.2 Pruebas de hipótesis para la media y la proporción 165
H0
no se
rechaza se rechaza
decisión error
verdadera
correcta Tipo I
H0
error decisión
falsa
Tipo II correcta
CUADRO 1
La definición 3: formaliza los errores antes señalados, les asigna una probabilidad y establece la
notación y el nombre con el que nos referiremos a ellos.
0
0 + c
región de no rechazo región de rechazo
FIGURA 2
Revisados los elementos que constituyen una prueba de hipótesis estudiemos los casos
específicos:
a. Prueba de hipótesis para: con conocida.
b. Prueba de hipótesis para: con conocida o desconocida pero n 30 .
c. Prueba de hipótesis para: p con n 30 .
Para efectuar una prueba de hipótesis utilizaremos el proceso:
1. Identificar el parámetro objetivo (media o proporción).
2. Determinar el valor nulo, establecer la hipótesis nula y formular la hipótesis alternativa.
3. Efectuar el cálculo del estimador puntual de la estadística de prueba.
4. Utilizar el nivel de significación y establecer la región de rechazo.
5. Localizar el valor del estimador puntual de la estadística de prueba en el gráfico de la
distribución de la estadística de prueba.
6. Determinar si H 0 debe ser o no rechazada y establecer la conclusión en el contexto del
problema.
a. y b. Para: con conocida o n 30 .
En estos casos, la muestra aleatoria
X 1 , X 2 , X 3 , , X n
Sección 3.2 Pruebas de hipótesis para la media y la proporción 169
- z z Z z Z - z 0 Z
0 0
región de región de no región de región de no rechazo región de región de región de no rechazo
rechazo rechazo rechazo rechazo rechazo
c. Para: p con n 30 .
Hipótesis nula: Posibles Hipótesis alternativas:
H 0 : p p0 H a : p p0 , H a : p p 0 y H a : p p0 .
pˆ p0 x np0
Estadística de prueba z .
p0 q0 n n p0 q0
Región de rechazo para la prueba al nivel .
f(z) f(z) f(z)
- z z Z z Z - z 0 Z
0 0
región de región de no región de región de no rechazo región de región de región de no rechazo
rechazo rechazo rechazo rechazo rechazo
1. El parámetro objetivo es .
2. H0 : 175 contra H a : 175.
x 0 177 175
3. Estadístico de prueba z 1.82 ,
s n 7.7 49
(se utilizó la desviación estándar muestral s 7.7 como estimador puntual de ).
4. Región de rechazo.
Si 0.05 , en las tablas de los percentiles normales se observa
z 0.025 1.96 y z 0.025 1.96 .
Por tanto, se rechaza H 0 : 175 sí z 1.96 o z 1.96 .
5. Localización del estadístico de prueba.
f(z)
z = 1.82
0.025 0.025
Z
- 1.96 0 1.96
región de región de no región de
rechazo rechazo rechazo
z = - 1.67
0.10
Z
- 1.282 0
región de región de no rechazo
rechazo
6. Conclusión.
Se rechaza H 0 : 50 , a favor de H a : 50 al nivel de significación dado. Se concluye que el
contenido de queso en los huaraches es menor a 50 gramos.
z = 6.32
0.05
Z
0 1.645
región de no rechazo región de
rechazo
6. Conclusión.
172 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
Puesto que z 6.32 se localiza en la región de rechazo, se rechaza la hipótesis nula H 0 : 0.2526,
a favor de H a : 0.2526. En realidad, el diámetro medio de los pernos es mayor a 0.2526
centímetros.
z = 2.04
0.05
Z
0 1.645
región de no rechazo región de
rechazo
6. Conclusión.
La estadística de prueba se encuentra en la región de rechazo, se rechaza H 0 : p 0.6 al nivel de
significación indicado, por tanto, la proporción jóvenes que prefieren consumir coca cola es mayor a la
de otras bebidas.
b. La probabilidad que limita el número z 2.04 a su derecha es 2.04 0.0207 , por tanto,
0.0207 o 2.07% es el nivel de significación mínimo a partir del cual se rechaza la hipótesis nula
H 0 : p 0.60 .
Sección 3.2 Pruebas de hipótesis para la media y la proporción 173
PROBLEMAS PROPUESTOS
1. Sea 0 123 la hipótesis nula b. H 0 : 8 contra H a : 8 .c. H 0 :
correspondiente a un proceso de prueba, si la p 0.33 contra H a : 0.40 .
hipótesis alterna es: d. H 0 : 2.33 contra H a : 2.33 .
a. 100 . b. 123 . Justifique su respuesta.
c. 123. d. 90 .
e. 123 . f. 105 . 6. Si se pretende verificar la hipótesis nula: el
g. 125 . h. 120 . viagra es eficaz. Explique:
Clasifique el tipo de prueba como unilateral o a. En qué condiciones se comete error tipo I .
bilateral. b. En qué condiciones se comete error tipo II .
2. Sea la afirmación “el promedio final de un 7. El director de un Colegio afirma “al menos el
alumno del CCH Oriente es 7.83 ”. Plantee 40% de los estudiantes del quinto semestre es
la hipótesis nula y una hipótesis alterna. irregular”, explique. cómo el director podría
a. El promedio final del alumno no es 7.83 . cometer:
b. El promedio final del alumno es menor a a. Un error tipo I .
7.83 . b. Un error tipo II .
c. El promedio final del alumno es mayor a
7.83 . 8. Un administrador quiere verificar, si un
empleado es el ideal para asumir la jefatura de
3. Para la afirmación “la proporción de una sección.
a. ¿Qué tipo de error comete?, si rechaza
estudiantes que alguna vez probó cierta droga”
equivocadamente la hipótesis nula “el empleado
es 37.3% , plantee la hipótesis nula y la
es ideal para la jefatura de la sección”.
hipótesis alternativa.
b. ¿Qué tipo de error comete?, si acepta
4. ¿Cuáles de las afirmaciones no representan equivocadamente la hipótesis nula “el empleado
hipótesis estadísticas? ¿Por qué? es ideal para la jefatura de la sección”.
a. H : p 12 .
9. El director de una escuela se interesa en la
b. H : x 8 . eficiencia de un “curso gratuito” para lograr que
c. H : x 0.33 . más estudiantes se integren a su grupo político.
d. H : 2.33 . a. ¿Qué hipótesis prueba si comete un error del
tipo I al rechazar de manera errónea que el
5. ¿Cuáles pares de afirmaciones no
“curso gratuito” no es efectivo?
corresponden a hipótesis estadísticas, ¿por
b. ¿Qué hipótesis prueba si comete un error del
qué?
tipo II al aceptar de manera errónea que el
a. H 0 : 12 contra H a : 13 .
curso gratuito es efectivo?
174 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
10. El encargado de la fonda “El Hijo de Nada” una muestra aleatoria de tamaño 100 .
considera que la proporción de tortas que a. ¿Cuál es la probabilidad de cometer un error
requieren menos de 8 minutos en su tipo I si se rechaza la hipótesis nula cuando
elaboración es p 0.6 . X 78 centímetros, y de otra manera se
Si en una muestra aleatoria de 10 tortas se acepta?
observa que tres o más requirieron 8 minutos o b. ¿Cuál es la probabilidad de cometer un error
más minutos en su elaboración, entonces la tipo II , si en realidad 77.5 centímetros?
hipótesis p 0.6 debe rechazarse a favor de la
alternativa p 0.6 . 14. Para una población normal con 20
a. ¿Cuál es el nivel de significación si la centímetros se contrastan las hipótesis
verdadera proporción es p 0.6 ? 0 255 contra a 255 centímetros; con
b. ¿Cuál es el valor de , si el verdadero valor base en una muestra aleatoria de tamaño
para la proporción es p 0.3 ? n 36 . Se rechaza la hipótesis nula cuando
X 245centímetros o bien, si X 262
Utiliza la distribución Binomial.
centímetros.
a. Determina la probabilidad de cometer un
11. Un químico afirma “el nuevo solvente
error tipo I ;
aplicado a los chicles que se encuentran
pegados en el piso elimina el 70% de ellos”. b. Determina la probabilidad de cometer un
Para verificar su afirmación, el solvente se error tipo II , sí 0 258 .
utilizará a 12 chicles pegados en el piso
(elegidos al azar). Si al menos de 11 chicles 15. Una compañía cosmetóloga desarrolla
son eliminados, se acepta la hipótesis p 0.70 actualmente un nuevo champú y está
en cualquier otro caso se concluye que interesada en la altura de la espuma en
p 0.70 . milímetros que éste genera. La altura de la
espuma se distribuye de forma
a. Evalúe sí p 0.70 .
aproximadamente normal con 20
b. Evalúe sí p 0.90 . milímetros. La compañía confronta H 0 :
Utiliza la distribución Binomial. 0 175 contra H a : 175 milímetros,
utilizando una ejecución de una muestra
12. La Dra. Morales afirma: más del 40% de
aleatoria con n 10 . Para la región crítica
los asistentes a su clínica tienen hongos en los
X 185 .
pies. Para probar tal afirmación se revisan siete
pacientes asignados a la doctora. Si tres o más a. Determina .
de ellos presentan hongos en los pies se acepta b. Determina si realmente 195
la hipótesis nula H 0 : p 0.40 , de otro modo milímetros.
se concluye H a : p 0.40 . 16. Al encargado del departamento de control
de calidad de la Tres Estrellas, le preocupa que
a. Evalúa sí H 0 : p 0.40 . el contenido promedio de fibra de las galletas
b. Evalúa para la alternativa H a : p 0.30 . dietéticas que produce pueda no ser de la
Utiliza la distribución Binomial. cantidad deseada, misma que es de 24
gramos por caja. Si es el promedio de la
13. En una población distribuida normalmente población de referencia, contraste 0 24
con 8.4 centímetros, se contrastan gramos por caja vs a 24 gramos por caja.
0 80 vs a 80 centímetros con base en
Si una ejecución de una muestra aleatoria de
Sección 3.2 Pruebas de hipótesis para la media y la proporción 175
280 cajas de “galletas dietéticas” proporcionó 20. Se afirma que el 40 % de los fumadores
x 24.08 y s 1 gramos por caja, concluye refieren la marca “delicados”. En una
que se debe rechazar la hipótesis nula y que realización de una muestra aleatoria de 120
es significativamente diferente a 24 gramos por consumidores de cigarrillos 50 de ellos
caja. Usa 0.05 . prefirieron la marca “delicados”. ¿Estos
resultados presentan evidencia suficiente para
17. Se desea verificar la afirmación “los concluir que la proporción de fumadores
políticos corruptos pasan en promedio 12.8 “delicados” es superior a la indicada por el
meses en prisión”. Un ciudadano analiza una estudio?
realización de una muestra aleatoria de 60 a. Utiliza el nivel de significación 0.05 .
casos y obtiene x 11 meses y s 3.5 b. Utiliza el nivel de significación 0.01.
meses. c. ¿Cuál es el nivel de significación a partir del
a. Contrasta 0 12.8 meses vs a 12.8 que se rechaza la hipótesis nula?
meses en el nivel de significación de 0.01.
b. Contrasta 0 12.8 vs a 12.8 meses en 21. Una realización de una muestra aleatoria de
n 1000 caramelos mostró que x 306 de
el nivel de significación de 0.01.
ellos tenían peso distinto al especificado en su
etiqueta.
18. El encargado de la seguridad de cierta
a. ¿Proporcionan los datos evidencia para
empresa quiere verificar la hipótesis “el
suponer p 0.31? Utiliza una probabilidad de
promedio de tiempo real requerido por el
velador para realizar una ronda es 25 minutos. cometer error tipo I de 0.05 .
Una ejecución de una muestra aleatoria de 32 b. ¿Proporcionan los datos evidencia que
rondas del velador promedió 25.8 minutos con indique p 0.31 ? Utiliza una probabilidad de
una desviación estándar de 1.5 minutos: cometer error tipo I de 0.01 .
a. Determina en el nivel 0.05 de significación si
tiene evidencia suficiente para rechazar la 22. Un distribuidor de la revista “Nenas” supone
hipótesis nula 0 25 . que el 58 % de sus clientes renovarán su
b. Determina en el nivel 0.10 de significación si suscripción. Para verificar su afirmación
tiene evidencia suficiente para rechazar la entrevistó a 200 de ellos y 112 le indicaron
hipótesis nula 0 25 a favor de a 25 . que sí lo harían.
a. ¿Qué hipótesis alternativa debe escoger el
19. Una realización de una muestra aleatoria de editor para determinar si los datos proporcionan
54 camisas, promedió una vida útil media de suficiente evidencia de una reducción de la
65 lavadas y una desviación estándar de 6 proporción p de suscriptores a la revista
lavadas. Se afirma que en condiciones de clima “Nenas”?
templado las camisas tienen una vida útil b. Efectúa la prueba para 0.05 y concluye.
promedio de 80 lavadas. c. Efectúa la prueba para 0.01 y concluye.
a. ¿Puede concluirse, en el nivel de 0.05 de d. Efectúa la prueba para 0.001 y
significación, que su uso en un clima tropical concluye.
reduce la vida útil promedio de las camisas? e. ¿Cuál es el nivel de significación mínimo con
b. ¿Puede concluirse, en el nivel de 0.01 de el que se debe rechazar la hipótesis nula?
significación, que su uso en un clima tropical
reduce la vida útil promedio de las camisas? 23. Un administrador de la línea de autobuses
“Estrella Blanca” sostiene que menos del 6 %
176 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
de los equipajes extraviados no se recuperan. 26. En una realización de una muestra aleatoria
a. Pruebe esta afirmación, si en una ejecución se observó que 80 de 140 accidentes
de una muestra aleatoria 14 de 200 equipajes industriales fueron consecuencia de errores de
extraviados no se encontraron y la probabilidad los trabajadores. Suponga normalidad.
de cometer un error tipo I es 0.01 . a. Utilice el nivel de significación del 0.05 para
b. ¿Cuál es el nivel de significación mínimo probar la hipótesis “el 0.5 de los accidentes
(unilateral) para rechazar la hipótesis: 0.06 de industriales son consecuencia de los errores
todos los equipajes perdidos no se recuperan? del trabajador”.
b. ¿Cuál es nivel de significación mínimo
24. Para contrastar la afirmación del jefe del (bilateral) para rechazar la hipótesis: “el 0.5 de
departamento de transporte de la Cruz Roja, los accidentes industriales es error de los
“por lo menos 40 % de todas las llamadas que trabajadores?
recibe son emergencias de vida o muerte”, se
tomó una muestra aleatoria de sus registros y 27. Se toma una realización de una muestra
se encontró que 49 de 150 llamadas fueron aleatoria de 50 botellas de leche de la marca
emergencias de vida o muerte. “La vaquita” y se detectan 14 con exceso de
a. ¿Qué puede concluirse, sobre la afirmación grasa.
anterior, si la probabilidad de cometer un error a. ¿Podemos rechazar H 0 : p0 0.12 a favor
tipo I debe ser menor a 0.08 ? de H a : pa 0.12 con el nivel 0.002 de
b. ¿Qué puede concluirse, sobre la afirmación significación?
anterior, si la probabilidad de cometer un error b. ¿Podemos rechazar la hipótesis nula
tipo I debe ser menor de 0.20 ? p0 0.12 a favor de H a : pa 0.12 con el
nivel 0.01 de significación?
25. Un médico afirma: el 10 % de todas las c. ¿Cuál es el nivel de significación mínimo
personas expuestas a cierta cantidad de (unilateral) en el que se puede rechazar la
radiación X tendrá secuelas. Si en una hipótesis alternativa antes señalada?
realización de una muestra aleatoria de 180
personas expuestas a la radiación únicamente
20 de ellas presentaron secuelas.
a. Pruebe H 0 : p0 0.10 contra H a :
pa 0.10 en el nivel de significación 0.05 .
b. ¿Cuál es el nivel de significación mínimo
(unilateral) en el que se rechaza la hipótesis
nula antes señalada?
3.3 RESUMEN Y
AUTOEVALUACIÓN
178 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
ACTIVIDADES
RESUMEN
SECCIÓN 3.1
Estimador Función que depende de una variable aleatoria y que se utiliza
para inferir el valor de un parámetro
Estimador puntual. Valor asociado por un estadístico a una realización de la MAS
que se utiliza para inferir el valor del parámetro de una
población.
Intervalo aleatorio de Intervalo de la forma I S , en el que los extremos son
confianza. funciones que dependen de una MAS.
Estimador por intervalo o Intervalo de valores ˆI ˆS , con una confianza
intervalo de confianza. previamente establecida, en el que se estima que contiene el
valor de un parámetro. ˆI y ˆS dependen del valor de la
estadística o del estimador.
Nivel de confianza Probabilidad de que el parámetro a estimar se encuentre en el
intervalo de confianza.
Elementos de un a. Límite inferior de confianza ˆI .
intervalo de confianza b. Límite superior de confianza ˆS .
p ˆI ˆS 1 .
c. Parámetro objetivo .
d. Coeficiente o nivel de confianza 1 .
e. Confianza 1 100% .
f. Longitud del intervalo L ˆS ˆI .
Intervalo de confianza
x z 2 x z 2 , z 2 es el valor del percentil z
para , con conocida. n n
que deja un área de 2 a su derecha.
Intervalo de confianza s s
x z 2 x z 2 , z 2 es el valor del percentil z
para , con n 30 . n n
que deja un área de 2 a su derecha.
Error máximo cometido al
E Máx z 2 .
estimar . n
Tamaño de la muestra n z 2
2
n .
E MAX
Intervalo de confianza pˆ qˆ pˆ qˆ
pˆ z 2 p pˆ z 2 , z 2 el valor del percentil z
para p . n n
que deja un área de 2 a su derecha.
180 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
si se conoce p̂ . n pˆ qˆ .
EMáx
Tamaño de la muestra n z 2
2
si no se conoce p̂ . n .
2 EMáx
SECCIÓN 3.2
Hipótesis Estadística. Suposición acerca del valor de un parámetro.
Hipótesis nula Suposición acerca del valor de un parámetro que indica que
la situación no cambia.
/2 /2
- z/2 0 z /2 0 z - z 0 Z
región de región de región de región de región de
región de no rechazo región de no rechazo
rechazo no rechazo rechazo rechazo rechazo
/2 /2
- z/2 0 z /2 0 z - z 0 Z
región de región de región de región de región de
región de no rechazo región de no rechazo
rechazo no rechazo rechazo rechazo rechazo
182 CAPÍTULO 3 INFERENCIA ESTADÍSTICA
SECCIÓN 3.1
EJEMPLO 6 BIS (INTERVALO DE CONFIANZA PARA CON APPS).
Se midió la concentración de azúcar en el contenido de una muestra de 49 refrescos Pascual cuyo
envase indica “contenido 355 mililitros”. Se encontró una media aritmética de 36 gramos; si suponemos
que la desviación estándar del contenido de azúcar en la población es 4 , entonces un intervalo de
confianza del 95% para la concentración media de azúcar se construye de la siguiente forma.
DATOS:
Tamaño de muestra n 49 .
Media aritmética x 36 .
Desviación estándar de la población 4 .
Nivel de confianza del 95% .
a. Con la aplicación “APRENDER SOBRE LA ELECTRÓNICA”, con liga
[Link]
Una vez que ingresaste al sitio, solo debes completar los campos solicitados y dar click Izquierdo en la
pestaña “calcular”.
Aprender sobre la electrónica
Inicio Artículos Proyectos Foros
95%
la media
límite límite
inferior superior
Introduzca los números en notación español (ejemplos 1.020,5; 1.2; 12,4)
Introduzca la Media: 36
Introduzca la Desviación estándar: 4
Introduzca el tamaño de muestra: 49
Seleccione el Intervalo de Confianza: 95%
Intervalo de Confianza:
34.88 (Límite inferior) a 37.12 (límite
superior)
Calcular
Una vez que ingresaste al sitio, solo debes completar los campos solicitados y dar click Izquierdo en la
pestaña “calcular”.
Tamaño de muestra ( N ) 49
CALCULAR
Solution:
Media de la muestra ( X )
Tamaño de muestra ( N )
CI = ( X - z c n X + z c n )
= ( 36 - 449 36 + 449 )
= ( 34.88 )
Por lo tanto, según los datos proporcionados, el intervalo de confianza 95% para la media de la
población es 34.88 < μ < 37.12, lo que indica que estamos 95% seguros de que la media de la
población real μ está contenida en el intervalo (34.88, 37.12).
CALCULAR
Solution:
Casos favorables X =
Tamaño de muestra N
N 500
c
c
= ( 0.68 -
0.68(1 - 0.68)
500
, 0.68 - 0.68(1 - 0.68)
500
)
= ( 0.631 , )
P or lo tanto, según los datos proporcionados, el intervalo de confianza 98% para la proporción de la
población es 0.631 < p < 0.729, lo que indica que estamos 98% seguros de que la proporción de
la población real p está contenida en el intervalo (0.631 , 0.729).
Sección 3.3 Resumen y autoevaluación 185
SECCIÓN 3.2
EJEMPLO 11 BIS (PRUEBA DEHIPÓTESIS PARA CON APPS)
Los diámetros de los pernos producidos por “Ferromex” tienen una desviación estándar real de 0.001
centímetros. Una muestra aleatoria de 10 pernos dio un diámetro medio de 0.2546 centímetros. Para
contrastar la hipótesis “el diámetro medio verdadero es menor a 0.2526centímetros” utilizando el nivel
0.05 :
DATOS:
Parámetro objetivo .
Tipo de prueba: H 0 : 0.2526 vs H a : 0.2526.
Tamaño de muestra n 10 .
Media aritmética x 0.2546 .
Desviación estándar s 0.001.
Nivel de significación 0.05 .
Tamaño de muestra ( n )= 10
0.2546 0.2526
z
0.001 10
6.325
( 4 ) Decisión sobre la hipótesis nula
Dado que se observa z 6.325 Z C 1.645 , entonces se concluye que la hipótesis nula es
rechazada.
( 5 ) Conclusión
Se concluye que la hipótesis nula H 0 es rechazada. Por tanto, no hay suficiente evidencia para afirmar
que la media poblacional es mayor que 0.2546, al nivel de significancia 0.05 .
Tamaño de muestra ( n )= 10
Esto corresponde a una prueba de hipótesis de cola derecha, para la cual se utilizará una prueba Z ,
para la media con una desviación estándar de población conocida.
( 2 ) Región de rechazo
Según la información proporcionada, el nivel de significación es 0.05 , y el valor crítico para una
prueba de hipótesis de cola derecha es zC 1.64 .
La región de rechazo para esta prueba de hipótesis de prueba derecha es R z : z 1.645 .
( 3 ) Estadística de prueba
La estadística z se calcula de la siguiente manera:
x 0
z
n
0.2546 0.2526
z
0.001 10
6.325
( 4 ) Decisión sobre la hipótesis nula
Dado que se observa z 6.325 Z C 1.645 , entonces se concluye que la hipótesis nula es
rechazada.
( 5 ) Conclusión
Se concluye que la hipótesis nula H 0 es rechazada. Por tanto, no hay suficiente evidencia para afirmar
que la media poblacional es mayor que 0.2546, al nivel de significancia 0.05 .
DATOS:
Parámetro objetivo p .
Tipo de prueba, H 0 : p 0.6 vs H a : p 0.6 .
Tamaño de muestra n 100 .
Casos favorables 70 .
Nivel de significación 0.05 .
Una vez que ingresaste al sitio, solo debes completar los campos solicitados y dar click Izquierdo en la
pestaña “calcular”. Obtienes,
AUTOEVALUACIÓN
14. La “aceptación” de una hipótesis estadística sólo significa que la información contenida en la
realización de una muestra aleatoria simple no proporciona la suficiente evidencia como para
________________________________.
15. La ________________________________se plantea en términos de alguna de las frases “es igual”,
“no mejora”, “no cambia”, etc.
16. La hipótesis alternativa es la ________________________________ de la hipótesis nula.
17. La ______________________________ determina el criterio para aceptar o rechazar H 0 .
18. La región crítica está compuesta por el conjunto de todos los valores
___________________________ para los cuales se no se acepta la hipótesis nula H 0 .
19. El ________________________________, también denotado por la letra griega alfa, es la
probabilidad de rechazar la hipótesis nula cuando es verdadera.
20. Se comete ________________________________cuando se acepta una hipótesis estadística
siendo falsa.
21. Si en una muestra específica el valor calculado del estadístico de prueba se encuentra en la región
crítica, entonces se rechaza la hipótesis nula y se concluye que la
________________________________ debe aceptarse.
22. Si se plantea una hipótesis nula en términos de una ____________________, entonces el proceso
de prueba se conoce como unilateral o de una cola.
CIERTO O FALSO
(Selecciona la opción correcta)
PROBLEMAS PROPUESTOS
1. A partir de p 1.7 4.2 0.98 n 50 , se define la región crítica
determina: 0 X 11.5 .
a. Las estimaciones de los límites de a. Determina el nivel de significación
confianza. cuando 12 es verdadera.
b. La confianza. b. Evalúa para la alternativa 11.8 .
c. La longitud del intervalo.
9. Sean H0 : p 0.30 y n 22 .
2. Sea n 121, x 23.8 y s 1.24 .
a. Determina el nivel de significación si se
Determina los límites de confianza de 95%
rechaza H 0 cuando 10 X 15 .
para .
b. Determina para sí H a : p 0.25 .
3. Si 1.8 4.2 , x 3 , n 36 y 2
10. Prueba H 0 : 125 contra H a :
determina:
125 para una muestra de tamaño n 81
a. El error máximo cometido si se utiliza x
como estimador de . suponiendo que x 120 y s 3.8 unidades,
utilice un nivel de significación del 2% .
b. El nivel de confianza.
11. Determina el nivel de significación
4. Sea n 144 y pˆ 0.6 . Determine los
mínimo para el cual se rechaza:
límites de confianza del 98% para p . H 0 : 12.8 contra H a : 12.8 sí
x 14 , 4 y n 25 .
5. Si 0.40 p 0.70 , pˆ 0.55 y n 30
determina: 12. Determina el nivel de significación
a. El error máximo cometido si se utiliza p̂ máximo para el cual se rechaza:
como estimador de p . H 0 : 6.13 contra H a : 6.13 sí
b. El nivel de confianza. x 5.8 , 2 y n 100 .
A.2 Probabilidades y
percentiles normales
x
B x , n , p C p k 1 p n k de n = 1 a n = 9
k
0
k 0
Apéndice A.1 Probabilidades binomiales acumuladas 195
x
B x , n , p C p k 1 p n k de n = 9 a n = 1 3
k
0
k 0
196 APÉNDICE A. TABLAS
x
B x , n , p C p k 1 p n k de n = 14 a n = 1 7
k
0
k 0
Apéndice A.1 Probabilidades binomiales acumuladas 197
x
B x , n , p C p k 1 p n k de n = 17 a n = 1 9
k
0
k 0
198 APÉNDICE A. TABLAS
x
B x , n , p C p k 1 p n k de n = 22 a n = 24
k
0
k 0
Apéndice A.1 Probabilidades binomiales acumuladas 199
200 APÉNDICE A. TABLAS
x
B x , n , p C p k 1 p n k de n = 24 a n = 25
k
0
k 0
APÉNDICE A.2 Probabilidades y percentiles normales 201
-z 0 0 z -z 0 z Z
Z Z
- < z < 1.59
202 APÉNDICE A. TABLAS
z( Φ) z( D)
0 z0 Z
-z 0 z0 Z
0
APÉNDICE B. SOLUCIONES
NOMBRE
UNIDAD 1
1. a. X 0, 1, 2, 3, 4, 5, , 100 . b. Y 0, 1, 2, 3, 4, 5, , 30 . c. Z 0, 2, 4 .
D , D , D , D , D , E , D , E , D , E , D , D
2. S . a. X 0, 1, 2, 3 . b.
E , E , D , E , D , E , D , E , E , E , E , E
Y 0, 1, 2, 3 .
3. a. X 0, 1, 2, 3, 4, 5, , n . b. S I , DI , FI , DFI , FDI , X I 1 , X DI 2 ,
X FI 2 , X DFI 3 , X FDI 3 .
4. a. X 0, 1, 2, 3, 4, 5, 6, 7, 8, 9, 10 . b. Y 6, 5, 4, 3, 2, 1, 0, 1, 2, 3, 4 . 5. a.
X 0, 1, 2, 3, 4 . b. Y 0, 1, 2, 3, 4 .
6. a. X 2, 3, 4, 5, 6, 7, 8, 9, 10, 11, 12 . b. Y 1, 2, 3, 4, 5, 6 .
c. Z 4, 3, 2, 1, 0, 1, 2, 3, 4, 5, 6, 7, 8, 9, 10, 11.
1, 1, 1 , 1, 1, 2 , 1, 2 , 1 , 2 , 1, 1
7. S a. X 3, 4, 5, 6 . b. Y 1, 2 . c.
2 , 2 , 1 , 2 , 1 , 2 , 1 , 2 , 2 , 2 , 2 , 2
Z 0, 1, 2, 3 .
8. a.
x 2 3 4 5 6 7 8 9 10 11 12
fX x 1
36
2
36
3
36
4
36
5
36
6
36
5
36
4
36
3
36
2
36
1
36
b.
x 1 2 3 4 5 6
fX x 11
36
9
36
7
36
5
36
3
36
1
36
9. a. d.
10.
a. b. c.
x 3 4 5 6 y 1 2 z 0 1 2 3
fX x 1
8
3
8
3
8
1
8
fY y 7
8
1
8
fZ z 1
8
3
8
3
8
1
8
1
x 3, 6 7
y 1 1
z 0, 3
fX x 8
. fY y 8
. fZ z 8
3
8
x 4, 5
1
8
y2
3
8
z 1, 2
C x3C33 x
11. a. f X x si X 0, 1, 2, 3 .
C36
Apéndice B.1 Soluciones a problemas propuestos 209
0 Y 0
1
20 0 Y 1
Cx6C44 x
x
C k6 C34k
12. a. fX x X 0, 1, 2, 3, 4, 5, 6 . b.
F x 10 1Y 2 . b. F x .
C310 20
19 k 0 C310
20 2 X 3
1 3 X
13.
a. b. c. d.
0.28 x 2 0.1 x 2 1 x 1 0.3 x 0
0.55 x 1 63
0.5 x 1 x3 0.3 x 1
fX x y
gX x 6
0.13 x 3 fX x 0,2 x 0 gX x 0,2 x 3
0 x4
0.04 x 5 0.1 x 1 2 0 x4
x5
6
0 X 2 0.1 x 2 0.2 x5
0 X 1
0. 28 2 X 1 0 X 2 1 0 X 0
F x 0.83 1 X 3 6 1 X 3
0.1 2 X 1 0.3 0 X 1
0.96 3 X 5
G x 64 3 X 4 .
0.6 1 X 0 4 0.6 1 X 3
Fx 6 4 X 5 G x .
1 5 X 0.8 0 X 1 0,8 3 X 4
1 5 X
0.9 1 X 2 0.8 4 X 5
1 2 X 1 5 X
14.
a. F( x)
b. F( y)
0 X 1 1 0 Y 3 1
0.3 1 X 3 0.12 3 Y 0
Fx Fy
0.8 3 X 5 0.18 0 Y 3
0.1 5 X 1 3Y
0 1 3 5 X -3 0 1 3 Y
c.
0 Y 0 F( y)
1 0 Y 1 1
18
F y 183 1 Y 2
0.5
10 2 Y 3
18
1 3Y 0 1 2 3 Y
19. b. F( x)
a. K 0.2 . 0 X 1 1
0.6 1 X 3
F x .
0.8 3 X 5
1 5 X
-2 0 2 4 X
20. b.
F( x)
a. K 0.2 . 0 X 1 1
0.2 1 X 0
F x .
0.8 0 X 2
1 2 X -1 0 X
1 2
SECCIÓN 1.2
1. a. 0.2185. b. 0.0449. c. 0.9964. d. 0.9994. e. 0.3598. f. 0.6813. g. 0 .
2. a. 0 . b. 0 . c. 0.1201. d. 0.7312. e. 0.0072. f. 0.8269. g. 0.4399. h. 0.9786.
3. a. b x , 6 , 0.2 C x6 0.2 x 0.8 6 x b. b x , 3 , 0.4 C x3 0.4 x 0.6 3 x .
c. b x , 8 , 0.2 C x8 0.2 x 0.8 8 x . d. b x , 10 , 0.4 C 10
x 0.4 0.6
x 10 x
.
4. a. b x , 7 , 0.2 C x 0.2 0.8 . b. b x , 12 , 0.2 C x 0.2 0.8 12 x .
7 x 7 x 12 x
b. 0.9920. 13. a. 0.0282. b. 0.2001. c. 0.0016. d. 0.3828. e. 0.8497. 14. a. 0.0000. b. 0.0007.
c. 0.9999. d. 0.8287. e. 0.0042. 15. a. E X 12 y V X 4.8 . b. E X 17 y
V X 2.55 . c. E X 12 y V X 8.4 . 16. E X 3 y DE X 2.7 . 17.
f X x C x20 0.5 0.5
20 x
x
, X 0, , 20 . 18. 1 . 19. a. 0.0031. b. 0.0002. c. 0.9997. d. 15
y 6 respectivamente. 20. a. 0.1181. b. 0.2066. c. 0.4032. d. 9 y 3.6 respectivamente. 21. a. 1.0 .
b. 1.2 . c. 7.2 . d. 1 . e. 1.0 . 22. a. 0.1762. b. 0.0000. c. 8.5 . d. 1.35 . 24. a. 99 . b. 116 o 117 . 25.
a. 0.3280. b. 1.0000. c. 3 . 26. f X x C x25 0.4 x 0.6 25 x , X 0, , 25 . 27. a. 0.0027. b.
0.9973. c. 0.6157 d. 0.3655. e. 0.6273.f. 0.1977. g. 0.7422.h. 0.2661. i. 0.4647. 28. a.
0.4649. b. 0.2204. c. 0.0228. d. 0.8643. e. 0.1822. f. 0.1151. 29. a. 0.0668. b. 0.0062. c. 1 . d.
0.9861. e. 1 . f. 1 . 30. a. 1.8119. b. 2.0537. c. 0.7892. d. 0.3319. e.
p z 0 Z z 0 0.775 . f. p z 0 Z z 0 0.18 . g. 3.0902. h. 4.2667 . i. 5.212 . 31.
a. 1.150 . b. 1.405. c. 1.254 . d. 0.994. e. 0.454. f. 1.405 . g. 3.090 . h. 3.090 . i. 0 . 32. a.
0.311. b. 1.563. c. 0.573. d. 0.412 . e. 1.655 . f. 0.196 . 33. a. 0.440.b. 1.46 . c. 0.283 . d.
1.838 . e. 0.385 . f. 1.175 . 34. a. 36.5 . b. 21.55 . c. 33.416. d. 40.548 . 35. a.
x0 3.456 . b. x0 0.58 . c. x0 1.498 . d. x0 4.39 .36. a. 0.8962. b. 0.02870. c. 0.6030. 37.
a. 19.77 . b. 55.86 . c. 1.22 . 38. a. 64.80 . b. 51.99 . c. 54.38 . 39. a. 84.13 . b. 55.85 . c. 40.13 .
40. a. 0 . b. 0.6827. c. 15.0311 centímetros. 41. a. 18 . b. 526 . c. 528 . d. 26 . 42. a. 0.00475. b.
0.7486. c. 0.6711. 43. a. 0.0047. b. 0.1496. c. 0.0537. 44. a. Aprox. 7 : 14 . b. Aprox. 7 : 17 . 45.
a. Aprox. 2.67 años. b. Aprox. 6.65 años. 46. 347.55 gramos. 47. a. 2.57 gramos. b. 0.974
gramos. 48. a. 0.9051. b. 0.423 centímetros. 49. a. 8.674 kilogramos. b. 6.674 kilogramos. 50.
a. 0.82 % . b. 563.12 . c. 403.88 . 51. 6.079 . 52. 10.035 , 0.1413. 53. 243.334 ,
26.343.
SECCIÓN 2.1
1 1
1. a. 4.12 , 1.65517. b. p 0.70 . 2. a. 166.6 , 3.04 . b. p . 3. a. p , b.
3 4
3
p .
20
2 , 2 , 2 , 4 , 2 , 6 , 2 , 8 , 2 , 10
4 , 2 , 4 , 4 , 4 , 6 , 4 , 8 , 4 , 10
4. 6 , 2 , 6 , 4 , 6 , 6 , 6 , 8 , 6 , 10 .
8 , 2 , 8 , 4 , 8 , 6 , 8 , 8 , 8 , 10
10 , 2 , 10 , 4 , 10 , 6 , 10 , 8 , 10 , 10
0 , 0 , 0,2 x12 0 , x12 1
5. a. . b. . c. x 1 .
2 , 0 , 2,2 x 21 1 , x 22 2
SECCIÓN 2.2
212 APÉNDICE B. SOLUCIONES
SECCIÓN 3.1
1. a. 5.625 y 3.4107 . b. 0.5
4. a. Media real, 1 100% 98% , l 6.4 , i 10.4 y S 16.8 .
b. Proporción real, 1 100% 90% , l 0.21, i 0.72 y S 0.93 .
c. Desviación estándar real, 1 100% 99% , l 9.9 , i 0.72 y S 10.3 .
5. De mayor a menor: 10.0 17.8 , 10.4 16.8 , 10.8 16.2 .
6. De mayor a menor: 0.33 p 0.89 , 0.4 p 0.82 , 0.45 p 0.78 .
7. a. No, la proporción es un número comprendido entre cero y uno (inclusive). b. No, la proporción
es un número comprendido entre cero y uno (inclusive). c. sí.
8. a. 9.608 10.392 . b.. 124.071 125.929 . c.. 97.060 102.940 .
9. a. 90% . 27.588 29.043. b. 27.418 29.182. c. 27.139 29.461.
10. a. 75.82 78.89 . b. 75.180 80.41 . 11. a. 164.1812 165.8185. b.
164.3123 165.6875. 12. 150.5323 153.4677. 13. a. 0.208 p 0.292 . b.
0.218 p 0.282 . c. 0.571 p 0.629 . 14. a. 0.63445 p 0.70555. b. e .03555. 15. a.
0.02282 p 0.5718. b. e 0.01718. 16. 0.0432 p 0.3568. 17. a. e 0.1603 b.
0.6139 p 0.6897 . 18. a. 0.392 p 0.528. b. 0.4 p 0.52 . 19. a. 0.8326 p 0.9073. b.
0.8349 p 0.9051. 20. a. 0.3131 p 0.4884 . b. 0.286 p 0.5160. 21. a. 811. b.
3.5587 p 3.6413. 22. n 66348. 23. n 34635. 24. a. n 1472. b. n 1691. 25. n 7663.
26. a. 95% . b. 91.64% . 27. 1 100% 96.8% . 28. 1 100% 92.81%
SECCIÓN 3.2
1. a. Unilateral izquierda. b. Unilateral derecha. c. Bilateral. d. Unilateral izquierda o bilateral. e.
Unilateral izquierda. f. Unilateral izquierda o bilateral. g. Unilateral derecha o bilateral. h. Bilateral.
Apéndice B.1 Soluciones a problemas propuestos 213
NOMBRE
B.2 SOLUCIONES A LA
AUTOEVALUACIÓN
UNIDAD 1
CIERTO O FALSO
1. F. 2. C. 3. F. 4. C. 5. C. 6. C. 7. C. 8. F. 9. F. 10. C. 11. C. 12. C. 13. C. 14. C. 15. F. 16. C.
17. C. 18. F. 19. C. 20. C. 21. F. 22, F. 23. F. 24. C. 25. C. 26. C. 27. C. 28. F. 29. F. 30. C.
PROBLEMAS PROPUESTOS
0 si x 3
0.25 si 3 X 1
1. a. fX x 0.25 si X 3, 1, 1, 3 . b. F x 0.50 si 1 X 1 . c. E X 0 . d. V X 5 . e.
0.75 si 1 X 3
1 si X 1
2. a.
Apéndice B.2 Solución a la autoevaluaciones 215
X 5 2 2
fX x 0.2 0.4 0.4
0.2 X 5
b. La fdp fX x 0.4 X 2 c. E X 1. d. V X 11.2 y DE. X 3.346 . e.
0.4 X 2
p 2 X 3 F 3 F 1 1 0.6 0.4 . f. p 2 X 2 F 2 F 1 1 0.6 0.4 . g.
p 2 X 3 F 2 F 1 1 0.6 0.4 . h. p X 2 F 1 0.6 . i.
p X 2 1 p X 1 1 0.6 0.4 . j. p X 2 F 1 0.6 . k. p X 2 F 2 F 1 1 0.6 0.4 .
6
3. Sea X b x , 6 , 0.40 a. X 0, 1, 2, 3, 4, 5, 6 . b. fX x C x 0.40 x 0.60 6 x si
x
C
6
X 0, 1, 2, 3, 4, 5, 6 . c. F x 0.40 k 0.60 6k .d. E X 6 0.40 2.4 . e.
k
k 0
UNIDAD 2
CIERTO O FALSO
1. C. 2. C. 3. F. 4. C. 5. F. 6. F. 7. F. 8. F. 9. F. 10. C. 11. C. 12. C. 13. C. 14. F. 15. F. 16. C. 17. C.
18. F. 19. F. 20. C. 21. F.
PROBLEMAS PROPUESTOS
1. a. X 80 y X 0.40 . 2. a. P 0.45 y P .0553.
b. X 150 y X 0.3536. b. P 0.50 y p 0.05 .
c. P 0.65 y P 0.025
c. X 203 y X 0.36 .
d. P 0.85 y P 0.0143.
216 APÉNDICE B. SOLUCIONES
3. Si 3.0 , 1 y n 81. 4.
a. 0.1806. b. 0.0035. a. 0.0006. b. 0.0694.
c. 0.1841. d. x 0 2.7415. c. 0 . d. 0.2206.
e. x 0 3.183. f. x 0 2.772. e. 0.2206.
UNIDAD 3
CIERTO O FALSO
1. F. 2. C. 3. F. 4. C. 5. C. 6. C. 7. F. 8. F. 9. C. 10. F. 11. F. 12. F. 13. F. 14. C. 15. C. 16. C. 17.
F. 18. F. 19. C. 20. F. 21. C. 22, F. 23. C.
PROBLEMAS PROPUESTOS
1. a. Li 1.7 y Ls 4.2 . b. 98 % . c. L 2.5 . 2. 23.58 23.85 . 3. a. E Máx 1.2 . b.
92.82 % . 4. a. E Máx 0.6 . b. 30 . 5. a. E Máx 0.15 . b. 91% . 6. a. E Máx 0.16 . b. n 53 .7. a.
0.0027. b. 0.9967. 8. a. 0.3065. b. 0.6179. 9. a. 0.0016. b. 0.9084.10. Rechazar H 0 en favor
de H a : 125 . 11. 6.68 % . 12. 4.95 % .13. No se rechaza H 0 : p 0.74 , se requieren mayores
evidencias. 14. No se rechaza H 0 : p 0.38 al nivel de significación del 4% .15. 5 % .
BIBLIOGRAFÍA 217
BIBLIOGRAFÍA
Cengage
Johnson, R. (2008) Estadística Elemental ( 10a ed.)
Learning.