0% encontró este documento útil (0 votos)
137 vistas227 páginas

Estadística y Probabilidad II CCH Oriente

Este documento presenta el libro de texto para la asignatura de Estadística y Probabilidad II. El libro contiene tres unidades principales sobre modelos de probabilidad, estimadores e inferencia estadística. Cada unidad incluye los objetivos de aprendizaje, contenidos temáticos, actividades, resúmenes y autoevaluaciones. Además, se proporcionan tablas estadísticas y soluciones a ejercicios en los apéndices. El libro busca apoyar el desarrollo de habilidades en los
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
137 vistas227 páginas

Estadística y Probabilidad II CCH Oriente

Este documento presenta el libro de texto para la asignatura de Estadística y Probabilidad II. El libro contiene tres unidades principales sobre modelos de probabilidad, estimadores e inferencia estadística. Cada unidad incluye los objetivos de aprendizaje, contenidos temáticos, actividades, resúmenes y autoevaluaciones. Además, se proporcionan tablas estadísticas y soluciones a ejercicios en los apéndices. El libro busca apoyar el desarrollo de habilidades en los
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

UNAM CCH Oriente

VA R
IA
D I ST BL E A LE
R A
I NT E I B UCI O TORI A
R N
PRU E VAL OS D ES MUE S
B AS E T
D E H CONF I A RA L ES
I P ÓT N
E SI S ZA

COORDINARON
GÓMEZ SÁNCHEZ
VA R
IA
DI ST B L E AL E
R A
I N TE I BUCI O T ORI A
R N
PRUE VA L OS D E S MUE S
BA S E T
DE H CONF I A RAL E S
I PÓ T N
E SI S Z A

COORDINARON
GÓMEZ - SÁNCHEZ 2021 2022
COORDINARON CICLO ESCOLAR
GÓMEZ SÁNCHEZ 2021 2022
Introducción i
1. Modelos de probabilidad y sus aplicaciones 1
1.1 Variable aleatoria 2
1.2 Distribución binomial y distribución normal 37
1.3 Resumen y autoevaluación 76
2. Estimadores e introducción a la inferencia estadística 98
2.1 Población, muestra, parámetro y estadístico 99
2.2 Distribuciones muestrales 113
2.3 Resumen y autoevaluación 133
3. Inferencia estadística 140
3.1 Estimación 141
3.2 Prueba de hipótesis, media y proporción poblacional 160
3.3 Resumen y autoevaluación 177
A. Tablas 193
A.1 Probabilidades binomiales acumuladas 194
A.2 Probabilidades y percentiles normales 201
A.3 Números aleatorios 206
B. Soluciones 207
B.1 Soluciones a problemas propuestos 208
B.2 Soluciones a autoevaluaciones 214
Bibliografía 217
i

Este libro de texto es una contribución de quienes integramos el grupo de trabajo EMCONA en
apoyo la enseñanza aprendizaje de la asignatura de Estadística y Probabilidad II. Al mismo tiempo,
tiene el propósito de poner a disposición de los profesores y alumnos, un material que corresponda
al Programa de Estudios actualizado y que los oriente en un mejor desarrollo de las sesiones
presenciales, a distancia o híbridas. En su elaboración tomamos hemos tomado en cuenta dos
aspectos:
1. El enfoque disciplinario, es decir al destacar los argumentos básicos de la teoría matemática en
que se sustenta la inferencia estadística, sin olvidar que no es un libro para expertos. Tampoco
perdemos de vista la aplicabilidad y la utilidad que tiene la Estadística en desarrollo de las diferentes
áreas de la ciencia.
2. El enfoque didáctico, se encuentra totalmente vinculado al modelo educativo del Colegio, al
proponer el desarrollo de los aprendizajes que deben lograr los alumnos con base en la resolución
de problemas.
El libro se divide en once secciones; cada unidad contiene tres partes, en las dos iniciales
presentamos el desarrollo de los aprendizajes y contenidos temáticos y en la tercera se encuentran:
actividades extras, el resumen de los conceptos y propiedades básicas, el uso de las tecnologías y
la sección de autoevaluación de la unidad. Casi al final, el apartado A. incluye las tablas de
probabilidades binomiales acumuladas, las tablas de probabilidades y percentiles normales, y una
tabla de números aleatorios, por último, en el apartado B. Soluciones, contiene la solución a los
problemas propuestos en las secciones y las soluciones de las autoevaluaciones de las Unidades:
Unidad 1. Modelos de probabilidad y sus aplicaciones.
Unidad 2. Estimadores e introducción a la inferencia estadística.
Unidad 3. Inferencia estadística.
Para lograr los propósitos y aprendizajes del Programa de Estudios vigente de la asignatura de
Estadística y Probabilidad II, consideramos que, en las clases o sesiones, desarrollemos:
Las habilidades del profesor.
Al menos tres habilidades de los docentes del Área de Matemáticas se desprenden o son
propias de la formación científica de nuestra disciplina de estudio:
1. La formulación clara y precisa de los conceptos matemáticos.
2. El empleo o aplicación correcta de dichos conceptos en la resolución de problemas, mismos que
pueden ser de índole teórico, o bien de carácter concreto y práctico.
3. La utilización de las aportaciones de la estadística y de su metodología, a otras áreas del
conocimiento, ya sea de las ciencias de la naturaleza o de las ciencias sociales y humanidades, sin
descuidar las ciencias exactas.
Existen otras habilidades que tienen que ver con nuestra vocación como docentes, y que sólo
son efectivas al ponerlas en práctica en el salón de clase, tales como propiciar el interés y motivar el
ii

estudio por la materia, hacer uso de un lenguaje accesible, claro y versátil para con los alumnos. Del
mismo modo, tener paciencia y estar dispuestos a aclarar dudas y a tomar en cuenta sus
participaciones, entre otros elementos a considerar.
En este libro de texto de Estadística y Probabilidad II, nos propusimos apoyar este conjunto de
habilidades del profesor, de tal forma que, en cada una de las tres unidades el lector encontrará:
a) Una presentación de la Unidad temática
En donde se anotan los propósitos y los aprendizajes, también resaltamos las interrogantes: ¿qué
debe aprender? ¿Por qué debe aprenderlo?
Los profesores que participamos en la elaboración del libro coincidimos en que los aprendizajes son
el objetivo prioritario de nuestro trabajo en el aula con los alumnos, por lo que todas nuestras
propuestas didácticas, desde el material impreso, libros, artículos, las actividades, ejercicios o
problemas sugeridos, el uso de aplicaciones y programas de cómputo, por citar algunos, así como
las formas de evaluación y calificación, tienen que estar vinculadas con los propósitos y aprendizajes
del Programa de Estudios actualizado correspondiente.
En este contexto, puntualizamos los conceptos clave de cada uno de los aprendizajes descritos en
cada una de las Unidades del Programa de Estudios, y por ello, resaltamos en recuadros las
definiciones básicas indispensables del curso de Estadística y Probabilidad II.
Por otra parte, los alumnos y profesores podrán disponer de una exposición de los conceptos clave y
también del desarrollo paso a paso en la solución de problemas concretos, en los que se aplican
dichos conceptos. Asimismo, sugerimos una serie de:
b) Actividades de enseñanza aprendizaje.
En concordancia con el modelo educativo del Colegio y con el propósito de constatar que los
alumnos han comprendido correctamente los conceptos clave, incluimos al final de cada sección un
conjunto de problemas que requieren del uso de un procedimiento o de un algoritmo presentado en
el texto. La dificultad de los ejercicios ha sido graduada de tal manera que los primeros fomenten la
confianza del estudiante en sí mismo y que ello les refuerce los aprendizajes que se persigue
adquieran. De los últimos, se pretende sean un reto a su intelecto. En la sección A.4 proporcionamos
la solución de los ejercicios seleccionados.
Para enfatizar en los conceptos y aprendizajes, al final de las unidades incluimos:
c) Resumen y autoevaluación.
En primer lugar, se ubican actividades y ejercicios de apoyo en función de cada uno de los
aprendizajes y contenidos temáticos de las unidades, ofreciendo una variabilidad y extensión de
actividades realmente importante, tanto en calidad como en actualidad del tipo de problemas de los
que se ocupa la Estadística. Situación que es posible presentar con entera confiabilidad en virtud de
que dichas propuestas de actividades de enseñanza aprendizaje son producto, tanto de una
profunda revisión bibliográfica, como del resultado de muchos años de experiencia docente del
grupo de profesores con los estudiantes del CCH.
También, el lector encontrará un resumen de los conceptos e ideas clave para posteriormente,
resolver un conjunto de problemas tanto operativos como conceptuales, con el propósito de que el
estudiante pueda autoevaluarse e identificar su grado de avance en el aprendizaje de la materia.
Además, dedicamos un inciso al:
iii

d) Uso de las tecnologías


El uso y aprovechamiento de las tecnologías se encuentra detallado como trabajar algunos
programas de cómputo y diversas aplicaciones para celular, así como también videos. Para cada
aplicación, programa y/o videos, se inserta el hipervínculo o liga para acceder a ellos, los cuales se
sugiere utilizar dependiendo de cada aprendizaje y propósito académico concerniente a las tres
Unidades del Programa de Estudios.
Al respecto de este punto, controvertido y polémico en la academia de profesores, se propone evitar
el abuso de las tecnologías y medios digitales, pues se puede provocar un aprendizaje parcial en los
estudiantes orientado exclusivamente hacia los resultados finales en la solución de problemas.
Es el docente quien determina el momento y la forma en que se deben utilizar estos medios
tecnológicos, sin embargo, en el texto se encuentra nuestra propuesta de cómo trabajarlos, sin hacer
a un lado el desarrollo de los conceptos clave y los aprendizajes.
Finalmente, incluimos la sección que corresponde a:
e) Referencias bibliográficas

El libro de texto significó para el grupo de trabajo EMCONA, un arduo trabajo de sesiones en
línea, de consulta e investigación de material bibliográfico sobre la materia de Estadística y
Probabilidad, lo que sin duda es un factor que explica su extensión, pero sobre todo el cumplimiento
de servir como un material sumamente completo y riguroso con respecto a la enseñanza de la
asignatura al nivel de nuestro bachillerato. No obstante, este libro en todas sus secciones ya
descritas, al igual que las referencias bibliográficas en que se apoya, están sujetas a las
consideraciones, propuestas y críticas constructivas que ayuden a mejorar el libro de texto.
En este marco de reflexión y propuestas académicas abiertas, el libro de texto para Estadística y
Probabilidad II, incluye al final una selección de bibliografía básica y complementaria susceptible de
ser utilizada por profesores y alumnos en el desarrollo y aprendizaje, respectivamente, del curso
escolar.
LOS AUTORES
iv
1.
MODELOS DE PROBABILIDAD
Y SUS APLICACIONES

PROPÓSITO
Al finalizar la unidad el alumno:
Continuará desarrollando su pensamiento estadístico, apropiándose del
concepto de variable aleatoria, y construyendo modelos de probabilidad
en términos de su tendencia, variabilidad y distribución

CONTENIDO
1.1 VARIABLE ALEATORIA
1.2 DISTRIBUCIÓN BINOMIAL Y
D ISTRIBUCIÓN NORMAL
2 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

1.1 VARIABLE ALEATORIA DISCRETA Y


VARIABLE ALEATORIA CONTINUA

¿Qué debe aprender?


1. Identificar el concepto de variable aleatoria.
2. Diferenciar variables aleatorias discretas y continuas.
3. Examinar los conceptos de distribución de probabilidad, esperanza
matemática y desviación estándar.
4. Construir la distribución de probabilidad para una variable aleatoria
discreta y su modelo de simulación físico o por medio de la
computadora.
8. Deduce que en el caso de variables aleatorias continuas, la
probabilidad debe calcularse dentro de un intervalo.
14. Concluye que una variable aleatoria, discreta o continua, puede
describirse y analizarse por su tendencia, dispersión y distribución

¿Por qué debe aprenderlo?


La inclusión de variables aleatorias cuantifica atributos de experimentos
aleatorios y relaciona la probabilidad con otras ramas de la matemática
lo que hace posible el modelado y resolución de problemas de mayor
complejidad e interés .

Temática
Propiedades. Distribución. Distribución acumulada, Parámetros: valor
esperado y desviación estándar. Modelo de probabilidad continuo.
Sección 1.1 Variable aleatoria 3

¿QUÉ ES UNA VARIABLE ALEATORIA? ¿CUÁL ES SU UTILIDAD?

La repetición de un fenómeno (bajo las mismas condiciones) que no siempre produce el mismo
resultado se denomina experimento aleatorio. En un experimento aleatorio es imposible determinar a
priori (inicialmente) cuál de sus resultados se va a producir, sin embargo, existe una ley de regularidad
que rige la frecuencia con la que se obtiene cada uno de ellos. Si en la repetición de un fenómeno
aleatorio es de mayor interés una característica numérica que una parte de sus resultados conviene
establecer una regla que asigne a cada resultado un número real, vea la figura 1.

s s
O
O
CI AL CI L
PA TR S PA T RA
S
E E S E ES
U U
E M E M
V V
En
E E
N N
Ei
T
O
E4
E3
T
O
Ei
E2
S S
E1

x1 ... xn a , b
VARIABLE VARIABLE
ALEATORIA X xi
ALEATORIA X intervalo de
números reales
números reales

FIGURA 1

La introducción de una regla que transforme los eventos (de un espacio muestral) en números
reales facilita su manejo en cuanto a, notación y escritura vinculando así la probabilidad con otras
ramas de la matemática.

“Una variable aleatoria es una regla que transforma los eventos del espacio muestral de
experimento aleatorio en números reales”.

EJEMPLO 1 (VARIABLES ALEATORIAS)


a. Se sabe que una gata tendrá una camada de dos crías e interesa conocer el número de machos. Sea
la variable aleatoria
X =“número de gatos machos en la camada”.
i. Si m representa el evento “la cría es macho” y h el evento “la cría es hembra”, entonces el espacio
muestral es el conjunto
S =  ( m , m ) , ( m , h ), ( h , m ) , ( h , h )  .
4 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

ii. Las asignaciones de la variable aleatoria


X = “número de gatos machos en la camada”,
a los eventos del espacio muestral S son:
X ( ( m , m ) ) = 2,
X ( ( m , h ) ) = 1,
X ( ( h , m ) ) = 1,

X ( (h , h ) ) = 0.
La figura 2 muestra la transformación del espacio muestral en el conjunto RX =  0, 1, 2 .

S
IR
(m,m)
(m,h)

2
(h,m)

1
(h,h)
0

FIGURA 2

b. Se ha constituido un equipo de 3 alumnos en un grupo de la asignatura de Estadística con el fin de


que desarrollen y presenten cierto tema. Los alumnos del equipo pueden ser regulares o irregulares.
i. Sean
r = “el alumno es regular” e i = “el alumno es irregular”,
entonces el espacio muestral es
S =  ( r , r , r ), ( r , r , i ) , ( r , i , r ) , ( i , r , r ) , ( r , i , i ), ( i , r , i ) , ( i , i , r ) , ( i , i , i )  .
ii. Las asignaciones de la variable aleatoria
X = “número de alumnos regulares en el equipo”,
a los eventos del espacio muestral S son
X ( (r , r , r ) )= 3 X ( (r , i , i ) )=1
X ( (r , r , i ) ) = 2 X ( (i , r , i ) )=1
X ( (r ,i , r ) )= 2 X ( (i , i , r ) )=1
X ( (i , r , r ) )= 2 X ( (i , i , i ) )= 0.
iii. Los números que asigna la variable aleatoria:
Y = “número de alumnos regulares menos número de alumnos irregulares en el equipo”,
Sección 1.1 Variable aleatoria 5

Y ( (r , r , r ) ) = 3 − 0 = 3 Y ( ( r , r , i ) ) = 2 −1 = 1,
Y ( (r ,i , r ) ) = 2 −1 = 1 Y ( ( i , r , r ) ) = 2 −1 = 1 ,
Y ( (r ,i ,i ) ) = 1 − 2 = −1 Y ( ( i , r , i ) ) = 1 − 2 = −1
Y ( (i , i , r ) ) = 1 − 2 = −1 Y ( ( i , i , i ) ) = 0 − 3 = −3 .
c. El diagrama de la figura 3 muestra un sistema de transportación de aceite, los puntos
V1 , V2 , V3 y V4 ,
representan válvulas y pueden estar abiertas o cerradas. Se desea transportar el aceite desde el punto
A hasta el punto B .

V2

A B
V1 V3

V4

FIGURA 3

i. Sea la variable aleatoria


X = “número de trayectorias abiertas”.
El aceite fluye del punto A al punto B si hay una o más trayectoria con sus dos válvulas abiertas,
entonces
X = 1, 2 , 3 .
ii. Sea la variable aleatoria
Y =“número válvulas abiertas”.
El aceite fluye del punto A al punto B en el diagrama, si hay dos o más trayectoria con sus dos
válvulas abiertas, por tanto,
Y = 2 , 3, 4 .

Una variable aleatoria es una función, entonces tiene tres componentes:


i. Un dominio, constituido por el espacio muestral del experimento aleatorio.
ii. La regla de correspondencia, en el contexto de la probabilidad llamada variable aleatoria, que es la
regla que asigna los números reales a los eventos.
iii. El recorrido o rango, contiene los números reales que asignó la regla de correspondencia a los
eventos.
6 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

EJEMPLO 2 (PARTES DE UNAVARIABLE ALEATORIA)


a. Un examen de opción múltiple consta de 4 preguntas, cada una de ellas tiene dos respuestas
posibles una correcta y la otra incorrecta. Suponga que quién lo responderá seleccionará las respuestas
aleatoriamente (al azar).
Sea la variable aleatoria
Y = “número de respuestas correctas seleccionadas”.
i. Dominio, sean:
c = “la respuesta seleccionada es correcta”
y
i = “la respuesta seleccionada es incorrecta”,
entonces el espacio muestral o dominio es el conjunto:
 ( c , c , c , c ), ( c , c , c , i ), ( c , c , i , c ), ( c , i , c , c ), ( i , c , c , c ), ( c , c , i , i ), ( c , i , c , i ), ( c , i , i , c ), 
S = .
 ( i , i , c , c ), ( i , c , i , c ), ( i , c , c , i ), ( c , i , i , i ), ( i , c , i , i ), ( i , i , c , i ), ( i , i , i , c ), ( i , i , i , i ) 
ii. La regla de correspondencia es la variable aleatoria
Y = “número de respuestas correctas seleccionadas”.
iii. El recorrido o rango
R X =  0, 1, 2, 3, 4  .
b. Las caras de una moneda han sido marcadas como 1 y 2 . Sea el experimento que consiste en
lanzar la moneda dos veces y anotar los números de las caras que observados.
Sea la variable aleatoria
Y = “Producto de los números que aparecen en las caras de las monedas”.
i. Dominio
S =  ( 1,1 ) , ( 1, 2 ) , ( 2 ,1 ) , ( 2 , 2 ) .
ii. Regla de correspondencia
Y = “producto de los números que aparecen en las caras de las monedas”.
iii. Puesto que
Y ( 2 ,1 ) = ( 2 )( 1 ) = 2
Y ( 1 , 1 ) = ( 1 )( 1 ) = 1

Y ( 1 , 2 ) = ( 1 )( 2 ) = 2

Y ( 2, 2 )= ( 2 )( 2 ) = 4
el recorrido es el conjunto
RY =  1, 2, 4 .

c. Un experimento consiste en lanzar simultáneamente dos dados normales.


Sea la variable aleatoria
X = “Diferencia de los números que aparecen en las caras que se observan”.
i. El espacio muestral o dominio es el conjunto
Sección 1.1 Variable aleatoria 7

 ( 1,1 ) ( 1, 2 ) ( 1, 3 ) ( 1, 4 ) ( 1, 5 ) ( 1, 6 ) 
 ( 2 ,1 ) ( 2,2 ) ( 2,3 ) ( 2,4 ) ( 2,5 ) ( 2 , 6 ) 

 ( 3 ,1 ) ( 3, 2 ) ( 3,3 ) ( 3, 4 ) ( 3,5 ) ( 3 , 6 ) 
S = .
 ( 4 ,1 ) ( 4,2 ) ( 4,3 ) ( 4,4 ) ( 4,5 ) ( 4 , 6 ) 
 ( 5 ,1 ) ( 5,2 ) ( 5,3 ) ( 5,4 ) ( 5,5 ) ( 5,6 ) 
 
 ( 6 ,1 ) ( 6,2 ) ( 6,3 ) ( 6,4 ) ( 6,5 ) ( 6 , 6 ) 
ii. La regla de correspondencia es
X = “Diferencia de los números que se observan en las caras”.
iii. Puesto que
X ( 1 , 1 ) = 1−1 = 0 X ( 1 , 2 ) = 1 − 2 = −1 X ( 1 , 3 ) = 1 − 3 = −2
X ( 2 , 1 ) = 2 −1 = 1 X ( 2, 2 )= 2−2 = 0 X ( 2 , 3 ) = 2 − 3 = −1
X ( 3 , 1 ) = 3 −1 = 2 X ( 3 , 2 ) = 3− 2 =1 X ( 3 , 3 ) = 3−3 = 0
X ( 4 , 1 ) = 4 −1 = 3 X ( 4, 2 )= 4−2 = 2 X ( 4 , 3 )= 4−3 =1
X ( 5 , 1 ) = 5 −1 = 4 X ( 5 , 2 )= 5−2 = 3 X ( 5 , 3 )= 5−3 = 2
X ( 6 , 1 ) = 6 −1 = 5 X ( 6, 2 )= 6−2 = 4 X ( 6 , 3 )= 6−3 = 3
X ( 1 , 4 ) = 1 − 4 = −3 X ( 1 , 5 ) = 1 − 5 = −4 X ( 1 , 6 ) = 1 − 6 = −5
X ( 2 , 4 ) = 2 − 4 = −2 X ( 2 , 5 ) = 2 − 5 = −3 X ( 2 , 6 ) = 2 − 6 = −4
X ( 3 , 4 ) = 3 − 4 = −1 X ( 3 , 5 ) = 3 − 5 = −2 X ( 3 , 6 ) = 3 − 6 = −3
X ( 4, 4 )= 4−4 = 0 X ( 4 , 5 ) = 4 − 5 = −1 X ( 4 , 6 ) = 4 − 6 = −2
X ( 5 , 4 )= 5−4 =1 X ( 5 , 5 )= 5−5 = 0 X ( 5 , 6 ) = 5 − 6 = −1
X ( 6, 4 )= 6−4 = 2 X ( 6 , 5 )= 6−5 =1 X ( 6 , 6 )= 6−6 = 0
El recorrido (o rango) de la variable aleatoria X es el conjunto
R X =  − 5, − 4, − 3, − 2, − 1, 0, 1, 2, 3, 4, 5  .

Formalicemos los conceptos anteriormente tratados.

DEFINICIÓN 1 (VARIABLE ALEATORIA DISCRETA)


Sea un experimento aleatorio con espacio muestral S , entonces
La función X con dominio en el espacio muestral y recorrido (o rango) R X =  x1 , x 2 , x3 , , x n 
finito (o infinito numerable) se denomina
VARIABLE ALEATORIA DISCRETA.

1. Utilizaremos las siglas “ VAD ” para indicar que una variable aleatoria es discreta y las
siglas “ VAC ” para indicar que es continua.
2. Es común representar las variables aleatorias por las últimas letras (mayúsculas) del
alfabeto español tales como X , Y , Z , W ; y los números que asume por letras minúsculas,
adoptaremos esta convención en la presente obra.
8 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

La simbología:
i. X = x1 , x2 indica que la VAD X asume los valores (números) x1 y x2 .
ii. Z = z1 , z 2 , z10 indica que la VAD Z asume los valores z1 , z 2 y z10 .
iii. X ( A ) = x significa que la variable aleatoria X asocia al evento A el número real x .

Una variable aleatoria es una función bien definida (determinista) que no presenta aleatoriedad
alguna, recibe este nombre considerando que los posibles resultados del experimento aleatorio son los
diferentes números reales x que la función X puede asumir. Por tanto, una variable aleatoria es una
medición que se hace de cada uno de los resultados del experimento aleatorio que tiene como
respuesta número real. Así, cada evento  tiene asociado un único número x . En la definición 1
formalizamos el concepto de variable aleatoria discreta, sin embargo, también existen variables
aleatorias que no son discretas. Llamaremos a la variable aleatoria X continua cuando su recorrido
sean todos los números reales de un intervalo I  IR . La clasificación de las variables aleatorias en
discretas y continuas no es completa puesto que existen variables aleatorias que no son de estos tipos.

DEFINICIÓN 2 (VARIABLE ALEATORIA CONTINUA)


Sea un experimento aleatorio con espacio muestral S ,
si la función X tiene como dominio el espacio muestral S , y recorrido (o rango) el intervalo de
números reales
I  IR
se denomina variable aleatoria continua.

Una de las características que distinguen a las variables aleatorias continuas de las variables
aleatorias discretas, es que las primeras asignan probabilidad cero a un valor específico x0 del
recorrido de la variable, es decir,
si X es una variable aleatoria continua, entonces
p ( X = x0 )= 0
(no necesariamente es cierto si la variable aleatoria es discreta).

EJEMPLO 3 (VARIABLE ALEATORIA CONTINUA)


Son variables aleatorias continuas
a. El tiempo de vida de un objeto.
b. La longitud de objeto.
c. El área de una superficie.
d. El volumen de un objeto.
Sección 1.1 Variable aleatoria 9

¿CUÁL ES LA RELACIÓN ENTRE UNA VARIABLE ALEATORIA Y LA


PROBABILIDAD? ¿QUÉ ELEMENTOS TIENE ASOCIADOS?

La forma de asignar probabilidades al recorrido de una variable aleatoria (es posible debido a la
equivalencia entre los números de su recorrido y los eventos de su dominio) se realiza con“la función de
probabilidad”, vea la figura 4., si la variable aleatoria es discreta; y con la función de densidad si es
continua, en el contexto que corresponda nos referiremos a ambas funciones por sus iniciales, es decir,
por fdp .
i

s
O
CI AL
S PA TR
E E S
E MU
V En
E
N Ei
T E4
E3
O E2
S E1

x1 ... xi xn
f(x)
VARIABLE p ( X = xi ) = f ( xi )
ALEATORIA X números
X
función de
reales probabilidad

FIGURA 4

DEFINICIÓN 3 (PROBABILIDAD DE UN NÚMERO DEL RECORRIDO DE UNA VARIABLE


ALEATORIA)
La probabilidad de que la variable aleatoria X asuma el número x , la representaremos por
p ( X = x ) y su valor está dado por la suma de las probabilidades de todos los eventos simples del
espacio muestral S a los que se asigna el número x .

EJEMPLO 4 (PROBABILIDAD DE UNA VARIABLE ALEATORIA DISCRETA)


Las caras de una moneda han sido marcadas con los números 1 y 2 . Sea el experimento que consiste
en lanzarla dos veces y anotar los números de las caras que se observan una vez que ha caído.
Sea la variable aleatoria Y = “producto de los números que se observan en la cara de las moneda”.
i. Espacio muestral
S =  ( 1,1 ) , ( 1, 2 ) , ( 2 ,1 ) , ( 2 , 2 ) .
ii. Puesto que
Y ( 1 , 1 ) = ( 1 )( 1 ) = 1 , Y ( 1 , 2 ) = ( 1 )( 2 ) = 2 y Y ( 2 , 1 ) = ( 2 )( 1 ) = 2 , Y ( 2, 2 )= ( 2 )( 2 ) = 4 ,
el recorrido es el conjunto
10 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

RY =  1, 2, 4 .
iii. Dado que el espacio muestral tiene cuatro eventos simples, entonces
1 2 1
p ( Y =1 )= , p (Y = 2 )= y p (Y = 4 )= .
4 4 4
La información sobre las probabilidades puede sistematizarse en la tabla (distribución)
 1
 si y =1
4
y 1 2 4  2
o representarse en 
p (Y = y )= 
si y=2 .
4
1 2 1 forma de función
p(Y = y )  1
si y=4
4 4 4 
 4
 0 otro caso

b. Un futbolista ejecutará tres penales, la probabilidad de que anote uno de ellos es 0.5 y el anotar o
fallar el posterior no depende de los que ha ejecutado.
i. Si a = “el futbolista anota el penal” y f = “el futbolista falla el penal”,
entonces
S = (f , f , f ), ( f , f , a ) , ( f , a , f ),( a, f , f ) ,( f , a , a ), ( a , f , a ) , ( a , a , f ) ,(a , a , a )
ii. Las asignaciones de la variable aleatoria
X = “número de penales que el futbolista anota”,
a los eventos del espacio muestral S son
X ( ( f , f , f ) ) = 0 , X ( ( f , f , a ) ) = 1,
X(( f ,a, f ) ) = 1, X ( ( a , f , f ) ) = 1 ,
X ( ( f , a , a ) )= 2 , X ( (a , f , a ) )= 2,
X ( (a , a , f ) ) = 2 , X ( (a , a , a ) )= 3.
iii. Observe que el espacio muestral tiene cardinal ocho, entonces
1 3 3 1
p ( X = 0 )= , p ( X =1 )= , p ( X = 2 )= y p ( X = 4 )= .
8 8 8 8
La información sobre las probabilidades puede sistematizarse en la tabla (distribución)
 1
 si x=0
8
 3
 si x =1
x 0 1 2 4 
 8
o en la forma (como p ( X = x )=  3
 si x=2
1 3 3 1 8
p( X =x ) función) 
8 8 8 8 1
 si x=3
 8

 0 otro caso
.
c. El 40% de las veces que las personas que comen tacos en el puesto de la esquina se enferman de
la panza. Una persona asiste a comer tacos a ese puesto un máximo de cuatro veces.
Sección 1.1 Variable aleatoria 11

Sea la variable aleatoria


Y = “número de visita en que la persona enferma de la panza o deja de asistir al puesto”.
i. Si:
Bm significa que no se enfermó en la visita número m
y
E k indica que se enfermó hasta la visita número B k ,
entonces
S =  E1 , B1 E 2 , B1 B2 E3 , B1 B2 B3 E 4 o B1 B2 B3 B4 .
La variable aleatoria
Y = “número de visita en que la persona enferma de la panza o deja de asistir al puesto”,
tiene recorrido (rango)
RY =  1, 2, 3, 4  .
Por otra parte,
p ( Y = 1 ) = 0.400
p ( Y = 2 ) = ( 0.6 )( 0.4 ) = 0.240
p ( Y = 3 ) = ( 0.6 )( 0.6 )( 0.4 ) = 0.144
p ( Y = 4 ) = ( 0.6 )( 0.6 )( 0.6 )( 0.4 ) + ( 0.6 )( 0.6 )( 0.6 )( 0.6 ) = 0.216 .
La información sobre las probabilidades puede sistematizarse en la tabla (distribución)

y 1 2 3 4
p(Y = y ) 0.400 0.240 0.144 0.216

o en la forma (como función)


 0.400 si y =1
 0.240 si y=2


p (Y = y )=  0,144 si y=3 .
 0.216 si y=4


 0 otro caso

Considerando que las “herramientas” utilizadas en la caracterización de las variables aleatorias


discretas son notoriamente distintas a las utilizadas en el caso continuo, trataremos el estudio de ambos
casos separadamente.

CASO DISCRETO
Los fundamentos teóricos de los ejemplos antes tratados se basan en las definiciones 4 y 5.
12 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

DEFINICIÓN 4 (FUNCIÓN DE PROBABILIDAD DE UNA VARIABLE ALEATORIA DISCRETA)


Sea X la variable aleatoria con recorrido R X =  x1 , x2 , x3 , , xn . La función de probabilidad (
fdp ) asociada a X , que representaremos por f X es
 p( X =x ) si x = x0 , x1 , x2 , x3 , 

fX ( x )= 
 0 otro caso

Los símbolos f X ( x ) se interpretan: la variable aleatoria discreta X asume el número (valor) x


con probabilidad f X ( x ) . La función de probabilidad proporciona la probabilidad de los distintos
números (valores) que asume la variable aleatoria. La función f X ( x ) también se representa como
una tabla, en este caso se conoce como distribución de probabilidad
x x0 x1 x2 
fX (x) p0 p1 p2 
En una “ VAD ” los términos “función de probabilidad” y “distribución de probabilidad” son
equivalentes.

El lector debe tener en cuenta que los símbolos X y x , representan cosas distintas: X
representa una función y x un número real de su dominio. En general, representaremos una función de
probabilidad con la letra f minúscula.

EJEMPLO 5 (FORMA DE FUNCIÓN Y FORMA TABULAR DE UNA VARIABLE ALEATORIA


DISCRETA)
a. La VAD X tiene como fdp asociada
 2
 si x =1
 5
 3
fX ( x )=  si x=2 ,
 5
 0 otro caso

su forma tabular y su forma gráfica son
f

x 1 2 1

2 3
fX (x) x
5 5 0 1 2

b. La VAD X con distribución de probabilidad


Sección 1.1 Variable aleatoria 13

x −1 0 1 2
fX (x) 0 .2 0,6 0 .1 0 .1

rescrita en forma de función y representada gráficamente son

f
 0.2 x = −1
 0.6 x=0
 1
fX ( x )= 
 0.1 x = 1, 2

 0 otro caso
-1 0 1 2 x

respectivamente

La función de probabilidad f X ( x ) satisface las propiedades (las hereda de los axiomas de


Kolmogorov).

PROPOSICIÓN 1 (CARACTERÍSTICAS DE LA FUNCIÓN DE PROBABILIDAD DE UNA VAD)


Sea X la variable aleatoria con recorrido
R X =  x1 , x 2 , x3 , , x n  .
Si f X ( x ) es la función de probabilidad asociada a la VAD X , entonces
a. f X ( x )  0 , para todo número real x .
b.  f ( x ) =1.
x
X

En la proposición 1, la propiedad a. se denomina “de no negatividad” y la propiedad b. indica que la


suma de “todas” las probabilidades es uno.

EJEMPLO 6 (NORMALIZACIÓN DE UNA FUNCIÓN)


Para determinar el valor de K de manera que la función
 0.2 K si x=0
 K si x=2

fX ( x )=  ,
 0.4 si x=3

 0 otro caso
sea función de probabilidad, es necesario resolver la ecuación
0.2 K + K + 0.4 = 1 , que implica 1.2 K = 0.6 ,
o bien
K = 0.5 .
14 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

Si sustituimos K = 0.5 en la función anterior obtenemos


 0.1 si x=0
 0.5 si x=2

fX ( x )=  .
 0.4 si x=3

 0 otro caso

Sus formas tabular y gráfica son


f

1
x 0 2 3
fX (x) 0 .1 0 .5 0 .4
0 1 2 3 x

FIGURA 5
respectivamente

En los estudios de los experimentos aleatorios y en la evaluación de probabilidades presenta gran


utilidad la función de distribución (o función de probabilidad acumulada) a la que nos referiremos por
sus iniciales como FPA .

DEFINICIÓN 5 (FUNCIÓN DE DISTRIBUCIÓN O FUNCIÓN DE PROBABILIDAD ACUMULADA)


Sea la variable aleatoria X .
La función de distribución asociada a la VAD X se define por la función
F ( x )= p ( X  x ).

La expresión
F ( x )= p ( X x )
es la función de distribución evaluada en un numero x cualquiera y proporciona la probabilidad de que
la variable aleatoria asuma un número (valor) menor o igual al número x . Así, F ( x ) representa una
probabilidad, por tanto, está comprendida entre cero y uno. Si f X ( x ) es la función de probabilidad de
la variable aleatoria X , entonces
F ( x ) = p ( X  xi ) =  f ( x ).
x  xi

Los símbolos  ,  ,  y  aparecen a menudo en la notación empleada en el cálculo de


probabilidades, el ejemplo 7 ayuda a comprender su significado.

EJEMPLO 7 (SIGNIFICADO DE LOS SÍMBOLOS  ,  ,  y  , CASO DISCRETO)


Sección 1.1 Variable aleatoria 15

Suponga la VAD X tiene recorrido R X =  − 2, − 1, 0, 1, 2, 3, 4, 5  .


i. X 2 significa X = − 2, − 1, 0, 1, 2 .
ii. X  −1 implica X = − 2, − 1 .
iii. X 2 quiere decir X = − 2, − 1, 0, 1 .
iv. X  −1 equivale a X = − 2 .
v. 0  X  3 indica X = 0, 1, 2, 3 .
vi. − 1  X  4 representa X = − 1, 0, 1, 2, 3, 4 .
vii. 0  X  4 implica X = 0, 1, 2, 3 .
viii. − 1  X  4 significa X = 0, 1, 2, 3, 4 .
ix. − 1  X  3 equivale a X = 0, 1, 2 .
x. − 1  X  5 significa X = 0, 1, 2, 3, 4 .

Aclaremos lo anterior con el ejemplo 8.

EJEMPLO 8 (OBTENCIÓN DE LA FPA A PARTIR DE LA fdp )


Para facilitar el proceso de construcción de la FPA asociada a la fdp
 0.2 si x = −2
 0.5 si x=2

fX ( x )=  ,
 0.3 si x=3

 0 otro caso
su distribución de probabilidad es

x −2 2 3
fX (x) 0 .2 0 .5 0 .3

En la tabla anterior:
i. Antes de x = −2 no hay probabilidad acumulada,
( x ) = 0 , si x  −2 .
F
ii. Antes de x = 2 la probabilidad acumulada es F ( x ) = 0.2 , por tanto,
F ( x ) = 0.2 , para − 2  x  2 .
iii. Antes de x = 3 la probabilidad acumulada es F ( x ) = 0.7 , por tanto,
F ( x ) = 0.7 , cuando 2  x  3 .
iv. A partir de x = 3 la probabilidad acumulada es F ( x ) = 1 , por tanto,
F ( x ) = 1 , si x  3 .
La FPA y su representación gráfica son
16 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

 0 si x  −2 1
 0.2 si − 2  x  2

F ( x )= 
 0.7 si 2  x  3
-2 0 1 2 3 x

 1 si x  3

FIGURA 6
respectivamente.

EJEMPLO 9 (OBTENCIÓN DE LA FPA A PARTIR DE LA fdp BIS)


En ocasiones, la forma tabular de la fdp facilita la construcción de la FPA .
La VAD X tiene asociada la distribución de probabilidad:

x −2 1 2
fX (x) 0 .2 0 .4 0 .4
F(x )

i. En la construcción de la FPA que tiene asociada, agreguemos una tercera fila con primera entrada
(“cuadrito”) F ( x ) .
x −2 1 2
fX (x) 0 .2 0 .4 0 .4
F (x)

ii. En la segunda entrada repetimos la probabilidad del primer valor que asociado a la VAD :
x −2 1 2
fX (x) 0 .2 0 .4 0 .4
F(x ) 0 .2

iii. En las entradas restantes sumamos probabilidades consecutivas:


x −2 1 2
fX(x) 0 .2 0 .4 0 .4
F(x) 0 .2 0.2 + 0.4 0.2 + 0.4 + 0.4
iv. Por tanto,
Sección 1.1 Variable aleatoria 17

f
 0 si x  −2
1
 0.2 si − 2  x  1

F ( x )= 
 0.6 si 1  x  2

 1 si x  2 -2 0 1 2 3 x

FIGURA 7

Si conocemos la FPA para determinar el recorrido y la regla de correspondencia de la fdp ,


utilizamos un proceso similar al del ejemplo 10.

EJEMPLO 10 (OBTENCIÓN DE LA fdp A PARTIR DE LA FPA )


La VAD X tiene por FPA a
 0 si x  −4
 0.3 si − 4  x  0


F ( x )=  0.5 si 0  x  2 ,
 0.8 si 2  x  4


 1 si x  4
entonces el recorrido de a VAD X es el conjunto R X =  − 4, 0, 2, 4  , restando probabilidades
acumuladas consecutivas
x −4 0 2 4
fX (x) 0 .3 0.5 − 0.3 0.8 − 0.5 1− 0.8
F(x ) 0 .3 0 .5 0 .8 1
o bien
x −4 0 2 4
fX (x) 0 .3 0 .2 0.3 0.2
por tanto,
 0. 3 si x = −4
 0.2 si x=0


fX ( x )=  0. 3 si x=2 .
 0.2 si x=4


 0 otro caso

El conocimiento de la FPA simplifica el cálculo de probabilidades puesto que la misma FPA


representa una probabilidad, por ejemplo, para los números (valores) x i y x j del recorrido (o rango) de
la variable aleatoria se cumples las propiedades de la proposición 2.
18 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

F
1

x1 O x2 xi - 1 xi xi + 1 x j -1 xj xj + 1 xn x

FIGURA 8

PROPOSICIÓN 2 (PROPIEDADES DE LA FUNCIÓN DE PROBABILIDAD ACUMULADA ASOCIADA


A LA VAD X )
Sea X una variable aleatoria discreta cuyo recorrido incluye los números x i y x j ( xi  x j ) y función
de probabilidad f X , entonces
a. p ( X  xi ) = F ( xi ) .
b. p ( X  xi ) = F ( xi − 1 ) .
c. p ( X  xi ) = 1 − F ( xi − 1 ) .
d. p ( X  xi ) = 1 − F ( xi ) .
e. p ( xi  X  x j ) = F ( x j ) − F ( xi − 1 ) .

Para utilizar correctamente la proposición 2 en el cálculo de probabilidades debemos verificar que


los números
xi y x j
pertenecen al recorrido de la variable aleatoria.

EJEMPLO 11 (CÁLCULO DE PROBABILIDADES UTILIZANDO LA FPA )


Sea la VAD X con función de probabilidades
 0 si x  −1
 0.5 si − 1  x  1

F ( x )=  ,
 0.8 si 1 x  3

 1 si x3
entonces
R X =  − 1, 1, 3 
y el gráfico correspondiente lo muestra la figura 9.
Sección 1.1 Variable aleatoria 19

-1 0 1 2 3 x

FIGURA 9

i. p ( X  1 ) = F ( 1 ) = 0.8 .
ii. p ( X  3 ) = F ( 1 ) = 0.8 , revisa el inciso [Link] la proposición 2.
iii. p ( X  4 ) = F ( 3 ) = 1 , revisa el inciso [Link] la proposición 2.
iv. p ( X  −1 ) = F ( − 1 ) = 0.5 , vea el inciso a. de la proposición 2.
v. p ( X  −2 ) = F ( − 2 ) = 0 , vea el inciso [Link] la proposición 2.a.
vi. p ( X  1 ) = 1 − F ( 1 ) = 1 − 0.8 = 0.2 , vea los incisos d. y a. de la proposición2.
vii. p ( X  1 ) = 1 − p ( X  1 ) = 1 − 0.5 = 0.5 , revisa los incisos c. y b. de la proposición2.
viii. p ( 1  X  3 ) = F ( 3 ) − F ( − 1 ) = 1 − 0.5 = 0.5 , vea los incisos e. y a. de la proposición 2.

Si xi no pertenece al recorrido R X de la VAD , se utiliza la proposición 2.b., revisa la figura 10.


F
1
F ( xn )
F ( xi )

x1 O x2 xi xn x
xk xm
FIGURA 10

PROPOSICIÓN 2.b. (PROPIEDADES DE LA FUNCIÓN DE PROBABILIDAD ACUMULADA ( FPA ) DE


LA VAD X )
Sea X la variable aleatoria discreta cuyo recorrido no incluye los números xk y x m ( x k  x m ) y
función de probabilidad f X , entonces
a. p ( X  x m ) = p ( X  x m ) = F ( x m ) .
b. p ( X  x m ) = p ( X  x m ) = 1 − F ( x m ) .
c. p ( x k  X  x m ) = F ( x m ) − F ( x k ) .
20 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

El ejemplo [Link] la aplicación de la proposición 2.b.

EJEMPLO 12 (CÁLCULO DE PROBABILIDADES UTILIZANDO LA FPA )


Sea la VAD X con función de probabilidades
 0 sí x  −4
 0 .3 sí − 4  x  0


F ( x ) =  0 .5 sí 0  x  2 ,
 0 .8 sí 2  x  4


 1 sí x  4
Su recorrido es R X =  − 4, 0, 2, 4  y el gráfico correspondiente lo muestra la figura 11.

F
1

-4 -3 -2 -1 0 1 2 3 4 x

FIGURA 11

i. p ( X  −2 ) = F ( − 2 ) = 0.3 , proposición 2. b. inciso a.


ii. p ( X  3 ) = F ( 2 ) = 0.8 , proposición 2.b. inciso a.
iii. p ( X  5 ) = F ( 5 ) = 1 , proposición 2.b. inciso a.
iv. p ( X  −1 ) = F ( − 1 ) = 0.3 , proposición [Link] a.
v. p ( X  1 ) = 1 − F ( 1 ) = 1 − 0.8 = 0.2 , proposición 2.b. inciso b.
viii. p ( 1  X  3 ) = F ( 3 ) − F ( − 1 ) = 0.8 − 0.5 = 0.3 , proposición 2.b. inciso c.

En los cursos elementales de estadística se calcula la media aritmética (que se representa con el
símbolo x y es un número alrededor del cual se agrupan o distribuyen los números del conjunto) de un
grupo de datos (muestra) sumándolos y dividiendo el total por el número de datos, es decir (en notación
sigma), para el conjunto de datos
 x1 , x2 , x3 , , xn  ,
la media aritmética es el número
n

f i  xi
1 n
f1  x1 + f 2  x 2 + f 3  x3 +  + f n  x n
x= i =1
n
=
n
f 1  x1 =
n
,
f i =1
i
i =1
Sección 1.1 Variable aleatoria 21

los números f i representan las frecuencias de los datos (número de veces que se repite el dato x i ).

Supongamos que
R X =  x1 , x2 , x3 , , xn 
es el recorrido de la VAD X con frecuencias
f1 , f 2 , f 3 , , f n ,
respectivamente, entonces
n n n n n
1 fi fi
x=
n

i =1
f i  xi = 
i =1 n
 xi = 
i =1
xi 
n
= 
i =1
xi  p ( X = xi ) = x
i =1
i  fX ( xi ) ,
es decir,
n
x= x
i =1
i  fX ( xi )
representa la media aritmética o “promedio” de la VAD X .
Si suponemos
x = E  X ,
podemos rescribir
n
E  X = x i  fX ( xi ) .
i =1

En el contexto de las variables aleatorias discretas el número


n
E  X = x i  fX ( xi )
i =1

se llama ESPERANZA, VALOR ESPERADO o simplemente MEDIA de la variable aleatoria X .

DEFINICIÓN 6 ( ESPERANZA MATEMÁTICA, VALOR ESPERADO o MEDIA DE LA VAD X )


Sea X la VAD con recorrido
RX =  x1 , x2 , x3 , , xn 
numerable y fdp asociada f X ( x ) , entonces el número
n
E  X = x  f ( x )
i X i
i =1

es la esperanza matemática, valor esperado o simplemente media de la VAD X )

El valor esperado de la VAD X es uno de sus parámetros y representa el “promedio” o número


que se espera obtener al repetir el experimento aleatorio, en forma independiente, un número “muy
grande” de veces, en consecuencia, el valor esperado es un número que se encuentra en el intervalo
 x1 , xn 
y no necesariamente coincide con uno de los elementos del recorrido de la VAD .
22 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

EJEMPLO 13 (CÁLCULO DEL VALOR ESPERADO)


a. Sea la VAD X con distribución de probabilidad

x 0 1 2 6
1 3 1 1
fX (x)
4 8 4 8

su valor esperado es
1 3 1 1 13
E  X  = 0  + 1 + 2  + 6  = .
4 8 4 8 8
b. Si la VAD Y tiene distribución de probabilidad,

y −2 0 3 4 5
fY (y) 0 .1 0 .4 0 .2 0 .1 0 .2

Su valor esperado es
E  X  = ( − 2 )( 0.1 ) + ( 0 )( 0.4 ) + ( 3 )( 0.2 ) + ( 4 )( 0.1 ) + ( 5 )( 0.2 ) = 1.8 .

La descripción de la VAD X se complementa con el estudio del parámetro que manifiesta su nivel
de variabilidad en relación con su valor esperado. Si la VAD X tiene recorrido
R X =  x1 , x2 , x3 , , xn 
y valor esperado E  X  , entonces las diferencias
xi − E  X 
representan las dispersiones de los números xi respecto al valor esperado
E  X ,
sin embargo, son de mayor utilidad las “dispersiones cuadráticas”, es decir los números,
( xi − E  X  )2  f X ( xi ) ,
vea la figura 12.

xi - E [ X ]

x
E[X] xi

FIGURA 12

El valor esperado de las “dispersiones cuadráticas” proporciona una “buena” medida de la


dispersión asociada a la VAD que tiene asociada.
Sección 1.1 Variable aleatoria 23

DEFINICIÓN 7 (VARIANZA O VARIANCIA DE LA VAD X )


Sea X la VAD con recorrido R X =  x1 , x 2 , x3 ,  , x n  numerable y
fdp asociada f X ( x ),
entonces el número

( x  )2  f X ( x i )  =  ( x i − E  X  )2  f X ( x i )
n
V  X = E i −E X
i =1

se conoce como varianza (o variancia) de X .

Para homogeneizar las unidades de la VAD X con las de su varianza es necesario introducir
como medida de su variabilidad la desviación estándar.

DEFINICIÓN 8 (DESVIACIÓN ESTÁNDAR DE LA VAD X )


Sea X la VAD con varianza V  X  , entonces el número positivo V  X  se llama desviación
estándar.

Observa que cuando la VAD X asume valores “lejanos” a su valor esperado E  X  el término
( X − E  X  )2 es grande y que, si asume valores “cercanos” al número E  X  el término
( X − E  X  )2 es pequeño. Por lo antes señalado, la varianza se utiliza para comparar distribuciones
de probabilidad semejantes.

EJEMPLO 14 (CÁLCULO DELA VARIANZA Y DE LA DESVIACIÓN ESTÁNDAR)


a. La VAD X tiene distribución de probabilidades

x 0 1 2
1 1 1
fX (x)
4 2 4

En el cálculo de la varianza es necesario conocer el valor esperado,


 1   2   1 
E  X  = 0   + 1  + 2   = 1 ,
 4   4   4 
por tanto, la varianza es
1 2 2 2 1 1 1 1
V  X = ( 0 −1 ) + (1−1 ) + ( 2 −1 )
2
= +0+ = ,
4 4 4 4 4 2
y la desviación estándar
1
VX =+  +0.7071 .
2
24 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

En juegos gobernados por el azar el valor esperado se utiliza para estimar si, a la larga, es
conveniente o no participar en el juego, así un juego de azar se denomina “justo” cuando
E  X = 0 .
El cliente gana si
E  X  0
y la casa gana cuando
E  X  0 .

EJEMPLO 15 (APLICACIÓN DEL VALOR ESPERADO Y DE LA VARIANZA)


Un juego consiste en lanzar dos monedas regulares. Se ganan $ 2000 cuando después de caerse
observan dos soles en las caras; se ganan $1000 si se observa un solo sol y se pierden $3000
cuando no se observan soles.
a. Para determinar si conviene jugar (ganar) es necesario calcular el valor esperado de la variable
aleatoria
X = “ganancia”
y observar que ésta es un número positivo.
La distribución de probabilidades de la variable aleatoria X = “ganancia” es

X − 3000 1000 2000

1 2 1
fX (x)
4 4 4
Entonces
1   2   1 
E  x  = −3000   + 1000   + 2000   = 250 ,
 4   4   4 
quien juegue un número “muy grande de veces”, en promedio, ganará $ 250 , luego conviene jugar.
b. Por otra parte
1  2  1 
V  X  = ( − 3000 − 250 )2   + ( 1000 − 250 )2   + ( 2000 − 250 )2   = 3 687 500
 4   4   4 
y
VX = 3 687 500  1 920 .286 .

Las propiedades de los parámetros (el valor esperado y la varianza) son imprescindibles en la
justificación de las propiedades de los métodos de la inferencia estadística (que estudiaremos
posteriormente), por lo que no podemos prescindir de establecer sus propiedades básicas.
Sección 1.1 Variable aleatoria 25

PROPOSICIÓN 3 (PROPIEDADES DEL VALOR ESPERADO)


Si X , Y son variables aleatorias discretas, independientes con la misma función de probabilidad y c
cualquier número real, entonces:
a. E  c  = c .
b. E  cX  = cE  X .
c. E  X  Y = E  X  E  Y  .

Así mismo, la varianza satisface las propiedades de la proposición 4.

PROPOSICIÓN 4 (PROPIEDADES DE LA VARIANZA)


Si X , Y son variables aleatorias con la misma función de probabilidad y c es un número real,
entonces:
a. V  c  = 0 .
b. V  cX  = c 2V  X .
c. V  X  Y  = V  X  + V  Y  , siempre que X , Y sean independientes.
d. V  X  = E  X 2  − E 2  X , “forma reducida de la varianza”.

EJEMPLO 16 (APLICACIÓN DE LAS PROPIEDADES DEL VALOR ESPERADO Y DE LA VARIANZA)


Si X , Y son variables aleatorias discretas, independientes con la misma función de probabilidad y
E  X  = 4 , E  Y  = −1 y V  X  = 2 , V  Y  = 1 ,
entonces
a. E  4 X − 6Y + 5  = E  4 X  − E  6Y  + E  5  proposición 1.3, inciso c.
= 4 E  X  − 6 E  Y  + E  5  , proposición 1.3, inciso b.
= 4 E  X  − 6 E  Y  + 5 , proposición 1.3, inciso a.
= 4( 4 ) − 6( − 1 ) + 5 = 27 .
b. V  4 X − 6Y + 5  = V  4 X  + V  6Y  + V  5  , proposición 1.4, inciso c.
= 16V  X  + 36V  Y  + V  5  , proposición 1.4, inciso b.
= 16V  X  + 36V  Y  + 0 , proposición 1.4, inciso a.
= 16( 2 ) + 36( 1 ) = 68 .

CASO CONTINUO
Hasta el momento solo hemos tratado variables aleatorias con recorrido (o rango)compuesto por
un número finito de números, sin embargo, también existen variables, generalmente asociadas a
cantidades medibles tales como: tiempos, longitudes, áreas, volúmenes, pesos, entre otras, en las que
no es posible contar los valores que asumen. Derivado de la influencia del azar y con la certeza de que
26 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

la “medición exacta” de características numéricas (como las antes mencionadas) de los objetos es
imposible, al medir una característica del objeto, formalmente se le debe asignar un número indicando
el nivel de incertidumbre o precisión, lo que, entre otros elementos, justifica la existencia y estudio de
las variables aleatorias continuas.
Las variables aleatorias relacionadas con los procesos de medida se denominan continuas
(utilizaremos sus iniciales VAC para referirnos a ellas) y se caracterizan por asociar a cada evento del
espacio muestral un intervalo de números reales, revisa la definición 2.
El proceso de asignación de probabilidades a variables aleatoria continuas es más complejo que
en el caso discreto, en particular, se asigna probabilidad cero a valores específicos (números) asumidos
o asignados a una VAC .

S X
intervalo

w [ ] IR
0
X(w)

FIGURA 13

La función utilizada para la asignación de probabilidades se llama “función de densidad de


probabilidad” y se relaciona con la operación que en el campo de la disciplina del cálculo diferencial e
integral se denomina “integral definida”, sin embargo, en esta obra no haremos uso de tal concepto y
relacionaremos la probabilidad asociada a una VAC con el área de una región del plano cartesiano, vea
la figura 14. La figura 14.a. muestra la curva asociada a la función continua y positiva f en el plano
cartesiano, la figura 14.b. muestra la región del plano cartesiano limitada por:
i. La curva asociada a la función continua y no negativa f .
ii. El eje x .
iii. Los segmentos de líneas rectas verticales con extremos en la curva asociada a la función f y en los
números a y b el eje x .
y y
f f

x
− 0 + a 0 b x

a. b.
FIGURA 14
Sección 1.1 Variable aleatoria 27

Con respecto a la figura15, el área de la región limitada por la curva asociada a la función continua
+
y positiva f y el eje X la representaremos con el símbolo A f .
−

y
f

x
− 0 +

FIGURA 15

DEFINICIÓN 9 (FUNCIÓN DE DENSIDAD DE PROBABILIDAD)


Sea X la variable aleatoria continua tal que:
a. f X ( x )  0 para todo número real x .
+
b. A f X ( x ) = 1 .
−

Entonces f X ( x ) se denomina “función de densidad de probabilidad”, se simboliza por fdp .

En la definición 9:
i. El inciso a. garantiza que la probabilidad es un número positivo y que la curva asociada a la función
de densidad de probabilidad se encuentra en los dos primeros cuadrantes del plano cartesiano.
ii. El inciso b. significa que la probabilidad del espacio muestral es 1 , es decir, que el área de la región
del plano positiva que está limitada por la curva asociada a f X ( x ) y el eje x es 1 . Bajo las dos
b
condiciones anteriores p ( a  X  b ) = A f X , vea a la figura 16.
a

y y
f f

p ( X = x0 ) p ( a X b )

x0 0 b x a 0 b x

FIGURA 16

Como antes lo señalamos, si X es una VAC con fdp dada por f X , entonces
fX ( x0 ) = p ( X = x0 )= 0
garantiza
p ( a  X  b ) = p ( a  X  b ) = p ( a  X  b ) = p ( a  X  b ).
28 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

EJEMPLO 17 (CÁLCULO DE PROBABILIDADES ASOCIADAS A UNA VAC )


a. La función
1 si 1 x  2
fX ( x ) =  ,
0 otro caso

es una fdp , en efecto, en la figura 17 se observa una región rectangular de base y altura con
longitudes 1 , por tanto,
+ 2
Af
−
( x ) = A1 f ( x ) = ( 2 − 1 )( 1 ) = 1 , note que fX ( x ) 0.
y
1 f

0 1 2 x

FIGURA 17

b. A continuación se muestra el cálculo de algunas probabilidades, vea la figura 18.


0 .1
p ( x  0. 1 ) = A f ( x )= 0.
−
0. 4
p ( − 1  x  0.4 ) = A f ( x ) = ( 0.4 − ( − 1 ) )( 0 ) = 0 .
−1
1.5 1 1.5
p ( 0.5  x  1.5 ) = A f ( x )= A f ( x ) + A f ( x ) = ( 1 − 0.5 )( 0 ) + ( 1.5 − 1 )( 1 ) = 0.5 .
0.5 0.5 1

y y
p ( 0.5  x  1. ) = 0.5 p ( 1.3  x  1. ) = 0.2
1 f 1 f

0 0.5 1 1.5 2 x 0 1 1.3 1.5 2 x

FIGURA 18

1.9
p ( 1.1  x  1.9 ) = A f ( x ) = ( 1.9 − 1.1 )( 1 ) = 0.8 .
1.1
2 2 2.5
p ( 1.8  x  2.5 ) = A f ( x )= Af ( x )+ A f ( x ) = ( 2 − 1.8 )( 1 ) + ( 2.5 − 2 )( 0 ) = 0.2 .
1.8 1.8 2
Sección 1.1 Variable aleatoria 29

y y
p ( 1.1  x  1.9 ) = 0.8 p ( 1.8  x  2. ) = 0.2
1 f 1 f

0 1.1 1.9 x 0 1 1.8 2 2.5 x

FIGURA 19

3 3
p ( 2.8  x  3 ) = A f ( x )= A f ( x ) = ( 3 − 2.8 )( 0 ) = 0 .
2.8 2.8

EJEMPLO 18 (VERIFICACIÓN Y CÁLCULO DE PROBABILIDADES ASOCIADAS A UNA VAC )


Sea la función
1
f ( x ) =  2 ( 2 − x ) si 0 x2
,

 0 otro caso
a. f ( 0 ) = 1 y f ( 2 ) = 0 , por tanto, el segmento de línea recta que le corresponde tiene extremos en
los puntos ( 0 , 1 ) y ( 2 , 0 ) , vea la figura 20.
y

1 f

0 1 2 x

FIGURA 20

La figura 20 muestra un triángulo rectángulo de base de longitud 2 y altura de longitud 1 , por tanto, su
1
área es A = ( 2 )( 1 ) = 1 .También el segmento de recta asociado a
2
1
f ( x ) =  2 ( 2 − x ) si 0 x2

 0 otro caso
se encuentra en el primer cuadrante del plano cartesiano, lo que significa que es no negativo.
Con base en las dos observaciones previas concluimos que
1
f ( x ) =  2 ( 2 − x ) si 0 x2

 0 otro caso
es una función de probabilidad.
30 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

b. p ( x  1 ) corresponde al área del triángulo mostrado en la figura 21. a., de altura


1
f (1 )= ( 2 − 1 ) = 1 y base b = 2 − 1 = 1 , por tanto, p ( x  1 ) = 1 ( 1 ) 1  = 1 .
2 2 2  2  4
y y y

1 f 1 f 1 f

0 1 2 x 0 1/2 1 2 x 0 1/2 1 2 x

a. b. c.
FIGURA 21

1 
c. La probabilidad p  x   es el área del trapecio con:
 2 
1 1  3
i. Base menor de longitud f ( 1 / 2 ) =  2 − = .
2 2  4
ii. Base mayor de longitud 1 .
1
iii. Altura de longitud .
2
 3  1 
 + 1  
 1  4  2  = 7
Vea la figura 21.b., entonces p  x   =  .
 2  2 16
1
d. La probabilidad p  
 x  1  es el área del trapecio con:
 2 
1 1
i. Base menor de longitud f ( 1 ) = ( 2 − 1 ) = .
2 2
1 1  3
ii. Base mayor de longitud f ( 1 / 2 ) =  2 − = .
2 2  4
1
iii. Altura de longitud .
2
 1 3  1 
 +  
 1   2 4  2  5
p
Vea la figura 21.c., entonces   x  1  = = .
 2  2 16

Las variables aleatorias continuas tienen asociada una función de probabilidad acumulada y los
parámetros: valor esperado y varianza, sin embargo, los fundamentos matemáticos que involucran se
encuentran fuera de nuestro alcance.
Sección 1.1 Variable aleatoria 31

PROBLEMAS PROPUESTOS

(CASO DISCRETO)
1. Determina el recorrido. observados”.
a. X = “número de tazas limpias, de las 100 a. ¿Cuáles son los valores que asume X ?
que tiene una escuela”. b. Construya una lista de cinco eventos con los
b. Y = “Número de líneas telefónicas ocupadas valores que asocia X .
en momento en específico”, de un sistema
telefónico con 30 líneas. 4. Se va a determinar el número de retretes
c. Un refrigerador contiene 30 botellas de ocupados, por sección, en un momento
cerveza: 8 “coronas”, 6 “bohemias” y 16 específico. Una de las secciones tiene seis y la
“tecates”; se extraen, una tras otra, dos botellas otra cuatro. Determina el recorrido.
de cerveza. Sea la VAD : a. X = “número de retretes ocupados en
Z = “doble del número de las cervezas ambas secciones”.
b. Y = “diferencia entre el número de retretes
“tecates” extraídas”.
ocupados en ambas secciones”.
2. Cierta compañía posee tres camiones,
5. Un futbolista ejecutó 4 “tiros penales” en un
mismos que pueden tener motor a diésel o
torneo de fútbol.
motor eléctrico. Establece el espacio muestral y
En cada caso establece el espacio muestral, a
a cada evento asígnale el valor
cada evento asígnale el número real
correspondiente.
correspondiente y luego determina el recorrido
a. X = “número de camiones con motor
de la variable aleatoria.
diésel”.
a. Sea X = “tiros penales” convertidos en gol
b. Y = “número de camiones con motor
por el futbolista.
eléctrico”.
b. Sea Z = “tiros penales” fallados por el
futbolista.
3. En un lapso de tiempo, se observan los
automóviles que llegan a un crucero específico
6. Considera el experimento que consiste
y se anota: I si da vuelta a la izquierda, D si
lanzar simultáneamente dos dados normales y
da vuelta a la derecha o F si avanza de frente.
anotar el número de la cara que aparece hacia
El experimento termina tan pronto como se
arriba. Construye el espacio muestral, a cada
observa que un automóvil da vuelta a la
evento asígnale el número correspondiente y
izquierda. Sea X = “número de automóviles
32 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

y determina el recorrido. c.
a. X = “suma de los números que se observan y −2 0 3 4 5
en las caras”. fY (y) − 0.1 0 .4 0 .2 0 .3 0 .2
b. Y = “menor de los números que se observan
d.
en las caras”.
y −2 3 4 5 6
c. Z = “doble del primer número menos el
segundo número”. gY (y) 0 .3 0 .3 0 .2 0 0 .2

7. Las caras de una moneda se han marcado 10. Las caras de una moneda han sido
como 1 y 2 . Se lanza tres veces. En cada marcadas como 1 y 2 . Considere el
caso construye el espacio muestral, a cada experimento que consiste en lanzarla tres
evento asígnale el número correspondiente y veces y anotar el número de la cara que queda
determina el recorrido. hacia arriba.
a. X = “suma de los números que aparecen en Construye la distribución de probabilidad y
las caras”. función de probabilidad.
b. Y = “menor de los números que aparecen en a. X = “suma de los números anotados”.
las caras”. b. Y = “menor de los números anotados”.
c. Z = “suma de los dos primeros números que c. Z = “suma de los dos primeros números
aparecen en las caras menos el tercero de los anotados menos el tercero de los números
números”. anotados”.
8. Un experimento que consiste en lanzar dos
veces un dado equilibrado y anotar los 11. De las seis personas que solicitaron
números de las caras que quedan hacia arriba. empleo, tres son menores de edad. Suponga
Construye la fdp . que se seleccionan al azar tres de las
a. X = “la suma de los números anotados”. personas (a la vez) para asignarles empleo.
b. Y = “el menor de los números anotados”. Sea X “número de menores de edad a los
que se les asignó empleo”.
9. ¿Cuáles de las siguientes tablas a. Determina la fdp .
corresponden a una fdp ?, justifica tu b. Construye la FPA .
respuesta.
a. 12. De diez personas que solicitaron empleo,
x −2 1 3 6 seis son mujeres y cuatro son hombres.
fX ( x ) Suponga que se seleccionan, a la vez y al
0.28 0.55 0.13 0.04
azar, tres de las personas para emplearlas
b.
Sea:
x 2 4 6 8 X = “número de mujeres que son
1 5 1 1 empleadas”.
gY ( x ) −
4 8 4 8 a. Determina la fdp .
b. Construye la FPA .
Sección 1.1 Variable aleatoria 33

13. Construye: la fdp , la FPA y grafícalas. 16. Sea


a.  0 x 1

−2 1 3 5 F ( x ) =  0.5 1 x  3,
X
 1 x3
fX (x) 0.28 0.55 0.13 0.04 
calcula:
b.
a. La distribución de probabilidades.
Y −2 −1 0 1 2 b. p ( x = 3 ) .
fY (y) 0 .1 0 .5 0 .2 0 .1 0 .1 c. p ( x = 2 ) .
c. d. p ( 1  x  2 ) .
X 1 3 4 5 e. p ( 1  x  3 ) .
gX ( x ) 1
6
3
6 0 2
6 f. p ( x  1.5 ) .
d.
Y 0 1 3 4 5 17. Sea X una VAD con FPA :
gY (y) 0 .3 0 .3 0 .2 0 0 .2  0 x 1
 0.4 1 x  3

FX ( x )=  ,
 0.8 3 x 4
14. Construye la FDA y traza su gráfico

 1 x4
 0.3 si x =1
 0.5 si x=3 determina:

a. f X ( x ) =  . a. p ( x  2 ) . e. p ( x  2 ) .
 0.2 si x=5
 0 otro caso b. p ( x  2 ) . f. p ( x = 2 ) .
 0.12 si x = −3 c. p ( 1  x  3 ) . g. p ( x = 4 ) .
 0.06 si
 x=0 d. p ( 0  x  3 ) . h. p ( 0  x  3 ) .
b. f Y ( y ) =  .
 0.82 si x=3
 0 otro caso 18. Si
 0 z  −3
x2 +1
c. f X ( x ) = con x = 0, 1, 2, 3 . 
 0.4 − 3  z  −1
18 FZ ( z )=  ,
15. Un edificio tiene dos entradas, marcadas  0.9 −1  z  0

 1 z0
como E1 y E 2 . Entran tres personas al edificio
a las 19 : 00 . Sea la VAD : obtén la fdp

X = “número de personas que entran por E1 ”.  3K si x =1


 0.2 si x=3

Si las personas escogen entrada 9. Si f X ( x ) = 
independientemente y tienen la misma  K si x=5
probabilidad de utilizar cualquiera de las  0 otro caso .
entradas. a. Determina K para que sea una fdp .
a. Determina la fdp . b. Determina la FPA y traza su gráfica.
b. Determina la FPA .
34 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

20. Sea 24. Los “Condominios HIR” disponen de una


 K si x = −1 gran cantidad de viviendas para rentar cada
 0.6 si x=0 mes, lo que preocupa a la gerencia. Un estudio

fX ( x )= 
 K si x=2 reciente reveló el número de departamentos
 0 otro caso desocupados por mes sigue la distribución de
probabilidad:
a. Determina el valor de K de manera que sea
una fdp . X 10 20 30 40
b. Determina la FDA y traza su gráfica. fX (x) 0.10 0.20 0.30 0.40

21. Si a. Calcula E  X  e interprétela.


b. Calcula V  X  y la desviación estándar.
X −4 5 10 K
fX (x) 0.25 0.20 0.30 0.25
5− x
25. Sea f X ( x ) = con x = 1, 2, 3, 4 ,
10
a. Si E  X  = 4 , determina el valor de K .
determina:
b. Calcula la varianza y la desviación estándar.
a. La FPA .
b. E  X  y la desviación estándar.
22. Para la distribución de probabilidades,

X 0 1 2 3 x
26. Sea f X ( x ) = y x = 1, 2, 3, 4 .
fX (x) 0.20 K K 0.20 10
a. Construye la FPA .
a. Si E  X  = 1.5 , determina el valor de K , b. Calcula E  X  y la desviación estándar.
b. Calcula la varianza y la desviación estándar.
27. Sea
23. El jefe de redacción de la revista “Paradero  0 si x 1

69 ” ha solicitado que el reporte de actividades F ( x ) =  0.5 si 1  x  3 .
de los redactores sea entregado la semana  1 si x3

siguiente, ha agregado la condición: aquél Obtén la esperanza y la desviación estándar.
reporte que rebase cuatro páginas será
rechazado. Sea la variable aleatoria X 28. Se lanzan simultáneamente dos monedas,
“número de páginas del reporte de los si aparecen dos “soles” se ganan $ 50 , en
“redactores”, supón que la distribución de
cualquier otro caso se pierden $10 . ¿Conviene
probabilidad es:
jugar “muchas” veces?
X 1 2 3 4
fX (x) 0.01 0.19 0.35 0.45 29. Se lanzan simultáneamente tres monedas,
si aparece al menos un “sol” se ganan $ 50 , en
a. Calcula E  X  e interprétala.
cualquier otro caso se pierden $150 .
b. Calcula V  X  y la desviación estándar.
Sección 1.1 Variable aleatoria 35

¿Conviene jugar un gran número de veces? c. V  − 0.2 X + 0.1Y − 0.3  .


b. V  2 X + 2Y + 3  .
30. Se lanzan simultáneamente dos dados, si
la suma de las caras es mayor que 7 , se 35. Sean X , Y variables aleatorias
duplica la cantidad invertida, en cualquier otro independientes e igualmente distribuidas con
caso se pierden la inversión. ¿Conviene jugar V  X  = 73 y V  Y  = 13 calcula:
“muchas” veces?
a. V  12 X − 14 Y − 1 .
31. Se lanzan simultáneamente dos dados, si b. V  2 − 18 X + 14 Y  .
la suma de las caras es un número par, se le c. V  − 4 + X + 2.8Y  .
duplica la cantidad invertida, en cualquier otro d. V  1.4 X − 0.8Y + 0.6 .
caso, usted pierde su inversión. ¿Jugarías
“muchas” veces?
(CASO CONTINUO)
32. Sean X , Y variables aleatorias
independientes e igualmente distribuidas, 36. Verifica que las siguientes funciones son
E  X  = −1 y E  Y  = −2 calcula: fdp . Traza su gráfica.

a. E  5 X − 2  . 2 0  x  0.5
a. f X ( x ) =  .
c. E  12 X − 2Y  . 0 otro caso
1
b. E  X + Y − 2 .
b. f X ( x ) =  8 2  x  10
.
d. E  − 14 X − 23 Y + 121  .  0 otro caso
 1
 0 x2
33. Sean X , Y variables aleatorias c. f X ( x ) =  4 x .

 0 otro caso
independientes e igualmente distribuidas
E  X  = 0.3 y E  Y  = 0.8 .
2 0  x  0.5
Calcula: 37. Si f X ( x ) = 
a. E  10 X + 5Y − 21  . 0 otro caso
b. E  − X + 15Y + 1  . es una función de densidad continua, evalúa:
c. E  − 0.4 X + 1.2Y − 1.6  . a. p ( x  0.3 ) .
d. E  − 4 + 2.8Y  . b. p ( 0.2  x  0.3 ) .
c. p ( x  0.4 ) .
34. Sean X , Y variables aleatorias d. p ( x  0.1 ) .
independientes igualmente distribuidas con
V  X  = 0.1 y V  Y  = 2 calcula:  1

a. V  4Y − 2 . 38. Si f X ( x ) =  1 − 2 x 0 x2

 0 otro caso
b. V  − 2 X + 2Y + 1  .
es una función de densidad continua, evalúa:
36 CAPÍTULO 1 MODELOS DE PROBABILIDAD Y SUS APLICACIONES

a. p ( x  0.5 ) .
b. p ( 1  x  2 ) .
c. p ( x  0.5 ) .
d. p ( x  1.5 ) .

 8x 0 x A
39. Si f X ( x ) =  .
 0 otro caso
a. ¿Cuál es el valor de A (positivo)?
 1 
b. Calcula p  x  .
 10 
 1 
c. Calcula p  x  .
 10 
 1 1 
d. Calcula p  x .
 20 10 
1.2 DISTRIBUCIÓN BINOMIAL
Y DISTRIBUCIÓN NORMAL

¿Qué debe aprender?


5. Identificar las características de un proceso binomial.
6. Construye el modelo para la distribución binomial, apoyándose en
la simulación física o con la computadora.
7. Aplica el modelo binomial, su valor esperado y su desviación
estándar a fenómenos contextualizados que se ajusten a este
modelo, interpretando los resultados, obtenidos desde la propia
o de tablas.
8. Esboza la curva de densidad para una variable aleatoria
aproximadamente normal, a partir de la suavización del polígono
de frecuencias de un ejemplo sencillo.
10. Deduce el proceso de estandarización de la distribución normal,
aplicando la Regla Empírica, dentro de un problema
contextualizado.
11. Utiliza la tablas para valores bajo la curva de la función normal
estandarizada como el recurso para el cálculo de probabilidades
o de valores z para dicha distribución.
12. Calcula probabilidades por medio de la distribución normal
dentro de problemas contextualizados interpretando resultados.
13. Contrasta la gráfica para una situación de comportamiento
aproximadamente normal con su correspondiente gráfica en el
modelo estandarizado.

¿Por qué debe aprenderlo?


La distribución binomial modela fenómenos en los que el espacio muestral
sólo tiene dos resultados por lo que es básico en el estudio de la inferencia
estadística. La distribución normal modela experimentos aleatorios en los
que las variaciones son muy pequeñas e independientes entre sí, y que
proporcionan resultados que se distribuyen alrededor de su valor esperado
y disminuyen simétricamente conforme se alejan este valor.

Temática
Distribución binomial: Experimento binomial, variable aleatoria binomial,
parámetros y aplicaciones
Distribución Normal: Distribución normal estándar, área bajo la curva
normal y manejo de tablas, problemas de aplicación.
38 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

DISTRIBUCIÓN BINOMIAL

Los experimentos aleatorios discretos pueden tratarse considerando que su espacio muestral está
constituido por un par de eventos simples, uno de ellos puede considerarse como el evento favorable y
el otro negando el evento favorable. Si éste es el caso, al evento favorable se denomina “éxito” (se
representa por E ) y el otro (su negación) es el “fracaso” (se representa por F ). Bajo este enfoque, el
espacio muestral de un solo experimento es S =  E , F  y cada experimento recibe el nombre de
“ensayo “Bernoulli”.

EJEMPLO 1 (ENSAYOS, ÉXITO E Y FRACASO F )


a. En el experimento aleatorio que consiste en “lanzar un dado y anotar el número de la cara visible:
E = ”se observa el número 3 ” y F = ”no se observa el número 3 ”
b. Se mide la estatura de una persona:
E = ”se obtiene una medida superior a 170 centímetros” y
F = ”no se obtiene una medida superior a 170 centímetros”.
c. Se compra un boleto para participar en la rifa de un avión.
E = ”se gana el avión” y F = ”no se gana el avión”.
d. Se mide el contenido de un envase que indica en su etiqueta 600 mililitros.
E = ”el contenido es menor a 600 mililitros” y F = ”el contenido es mayor de 600 mililitros”.

DEFINICIÓN 1 (ENSAYO BERNOULLI)


a. Un ensayo es un experimento aleatorio con sólo dos resultados posibles: éxito y fracaso,
entonces su espacio muestral es S =  éxito , fracaso  .
b. En un ensayo representaremos la probabilidad de éxito por p ( E ) = p y la de fracaso por
p ( F ) = 1− p = q .

Nota En un ensayo, él éxito es aquel resultado que satisface la afirmación dada en la variable
aleatoria, y él fracaso es el evento que se obtiene negando al éxito .

En el ejemplo 2 obtendremos las características de la VAD :


X = ”número de éxitos en un ensayo Bernoulli”.

EJEMPLO 2 (CARACTERÍSTICAS DE LA VARIABLE ALEATORIA BERNOULLI)


Sea la variable aleatoria discreta ( VAD )
X = “número de éxitos en un ensayo Bernoulli”.
a. El recorrido (rango) de la VAD X = ”número de éxitos en un ensayo Bernoulli” es el conjunto
Sección 1.2 Distribución binomial y distribución normal 39

R X =  0, 1  .
b. Construyamos la fdp ,
si x = 0 , entonces se obtuvo un fracaso en el ensayo, por tanto, f ( 0 ) = p ( X = 0 ) = 1 − p ,
si x = 1 , entonces se obtuvo éxito en el ensayo, por tanto, f ( 1 ) = p ( X = 1 ) = p .
Entonces,
 1− p si x = 0

fX ( x )=  p si x = 1 ,
 0 otro caso

en forma tabular
x 0 1
fX (x) 1− p p

cuyo gráfico es
f

0 1 x

FIGURA 1

c. Para construir la FPA notemos

x 0 1
fX (x) 1− p p

F(x ) 1− p 1− p + p =1

por tanto,

 0 si x  0

F ( x ) =  1− p si 0  x  1
 1 si x  1

cuyo gráfico es
40 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

1-p

0 1 x

FIGURA 2

d. Valor esperado
E  X  =( 0 )( 1 − p ) +( 1 )( p ) = p .
e. Varianza
V  X  =( 0 − p
) 2 ( 1 − p ) + ( 1 − p ) 2 ( p ) = p 2 ( 1 − p ) + p( 1 − p )
= p( 1 − p )( 1 − p + p ) = p( 1 − p ) = pq .
f. Desviación estándar V  X  = pq .

¿QUÉ ES UNA VARIABLE ALEATORIA BINOMIAL?

La generalización de la VAD X = ”número de éxitos en un ensayo Bernoulli”, recibe el nombre de


variable aleatoria Binomial, sin embargo, antes de caracterizarla conviene definirla y tener en cuenta las
condiciones que satisface.

DEFINICIÓN 2 (VARIABLE ALEATORIA BINOMIAL)


La variable aleatoria discreta: X = “número de éxitos en n ensayos independientes”, se conoce como
variable aleatoria binomial.

Un experimento binomial tiene las características:


i. Consiste en n ensayos idénticos (Bernoulli)), cada ensayo tiene dos resultados denominados éxito y
fracaso.
ii. Los ensayos son independientes y la probabilidad de éxito es constante de un ensayo a otro, en
consecuencia, también lo es la probabilidad de fracaso.
iii. Se rige por la variable aleatoria discreta: X = “número de éxitos en n ensayos independientes”.
iv. Si E representa al éxito, su probabilidad es p ( E ) = p y si F representa al fracaso, su
probabilidad es p ( F ) = 1 − p = q .
v. Tanto p como q se mantienen constantes, además p + q = 1 .
Sección 1.2 Distribución binomial y distribución normal 41

Para construir la fdp , misma que representaremos por b ( x ; n , p ) , utilizaremos un proceso inductivo
y posteriormente generalizaremos el patrón de comportamiento.

Nota En el contexto de variable aleatoria binomial la notación b ( x ; n , p ) significa “probabilidad


binomial de obtener x éxitos en n ensayos independientes cuando la probabilidad de un
éxito es p .

¿CÓMO SE CONSTRUYE LA fdp DE UNA VARIABLE ALEATORIA BINOMIAL?

EJEMPLO 3 (CONSTRUCCIÓN DE LA fdp ASOCIADA A LA VAD BINOMIAL, SI n = 1, 2 , 3 .


a. Sea la VAD
X = “número de éxitos en n = 1 ensayo”.
El espacio muestral es el conjunto S =  F , E  .
Las asignaciones numéricas a los eventos por parte de la variable aleatoria son
X ( F ) = 0 , X ( E ) = 1,
por tanto,
b ( 0 ;1, p ) = p ( X = 0 ) = p ( F ) = q y b ( 1;1, p ) = p ( X =1 ) = p ( E ) = p ,
de donde obtenemos
 q si x = 0

b( x ;1, p ) =  p si x = 1 o bien, en términos de combinaciones b ( x ; 1 , p ) = C x p x q1− x ,
1

 0 otro caso

siempre que X = 0 , 1 .
b. Sea la VAD
X = “número de éxitos en n = 2 ensayos”.
El espacio muestral es el conjunto S =  ( F , F ) , ( F , E ) , ( E , F ) , ( E , E ) .
Las asignaciones numéricas a los eventos por parte de la variable aleatoria son
X ( ( F , F ) ) = 0 , X ( ( F , E ) ) = 1 , X ( ( E , F ) ) = 1, X ( ( E , E ) )= 2 ,
por tanto,
b ( 0 ; 2 , p ) = p ( X = 0 ) = p ( F1  F2 ) = p ( F1 ) p ( F2 ) = 1 q  q = q 2 p 0 .
b ( 1 ; 2 , p ) = p ( X = 1 ) = p ( F1  E 2 ) + p ( E1  F2 )
= p ( F1 ) p ( E 2 ) + p ( E1 ) p ( F2 ) = q  p + p  q = 2 p  q
b ( 2 ; 2 , p ) = p ( X = 2 ) = p ( E1  E2 ) = p ( E1 ) p ( E2 ) = p  p = 1  q 0  p 2
 q2 si x = 0

 2 p  q si x = 1
b( x ; 2 , p )=  , o bien b ( x ; 2 , p ) = C x p x q 2− x , si X = 0 , 1, 2 .
2
2
 p si x = 2
 0 otro caso

42 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

c. X = “número de éxitos en n = 3 ensayos”.


 ( F , F , F ), ( F , F , E ) , ( F , E , F ) , ( E , F , F ) , 
El espacio muestral es S =  .
 ( F , E , E ), ( E , F , E ) , ( E , E , F ) , ( E , E , E ) 
Las asignaciones numéricas a los eventos por parte de la variable aleatoria son
X ( ( F , F , F ) ) = 0 , X ( ( F , F , E ) ) = 1, X ( ( F , E , F ) ) = 1, X ( ( E , F , F ) ) = 1
X ( ( F , E , E ) )= 2, X ( ( E , F , E ) )= 2, X ( ( E , E , F ) )= 2, X ( ( E , E , E ) ) = 3.
Por tanto,
b ( 0 ; 3 , p ) = p ( X = 0 ) = p ( F1  F2  F3 ) = p ( F1 ) p ( F2 ) p ( F3 ) = q  q  q = q 3 .
b ( 1 ; 3 , p ) = p ( X = 1 ) = p ( E1  F2  F3 ) + p ( F1  E2  F3 ) + p ( F1  F2  E3 )
= p ( E1 ) p ( F2 ) p ( F3 ) + p ( F1 ) p ( E2 ) p ( F3 ) + p ( F1 ) p ( F2 ) p (E3 )
= q 2  p + q 2  p + q 2  p = 3 pq2
b ( 2 ; 3 , p ) = p ( X = 2 ) = p ( F1  E 2  E 3 ) + p ( E1  F2  E 3 ) + p ( E1  E 2  F3 )
= p ( F1 ) p ( E 2 ) p ( E 3 ) + p ( E1 ) p ( F2 ) p ( E 3 ) + p ( E1 ) p ( E 2 ) p (F3 )
= q  p2 + q  p2 + q  p2 = 3p2q
b ( 3 ; 3 , p ) = p ( X = 3 ) = p ( E1  E2  E3 ) = p ( E1 ) p ( E2 ) p ( E3 ) = p  p  p = p 3 .
 q3 si x = 0
 2
 3p  q si x = 1

b ( x ; 3 , p ) =  3 p  q si x = 2 , o bien b ( x ; 3 , p ) = C x p x q 3− x , sí X = 0 , 1, 2, 3 .
2 3

 p3 si x = 3


 0 otro caso

La tabla 1 sistematiza los resultados obtenidos en el ejemplo 1 y justifica las conjeturas que se
encuentran después de ella.
NÚMERO DE ENSAYOS FUNCIÓN DE PROBABILIDAD

b ( x ;1, p ) = Cpq
1 x 1− x
n =1 x
, si X = 0 , 1 .

b( x ; 2 , p )=C p q
2 x 2− x
n=2 x
, si X = 0 , 1, 2 .

b( x ; 3 , p ) = C p q
3 x 3− x
n=3 x
, si X = 0 , 1, 2, 3 .
TABLA 1

GENERALIZACIÓN DE LAS OBSERVACIONES ANTERIORES


Si X es la VAD “número de éxitos en n ensayos independientes”, ( p = probabilidad de éxito y
q = probabilidad de fracaso), entonces
i. Tiene como fdp a b ( x ; n , p ) = C x p x q n− x , si X = 0 , 1, 2 , , n ”.
n
Sección 1.2 Distribución binomial y distribución normal 43

x x
ii. Tiene como FPA a B ( x , n , p ) =  b( k , n , p ) =  C k p k q n −k , sí X = 0, 1, 2, ... , n .
n

k =0 k =0

Conjeturas que son correctas y que se encuentran escritas formalmente en la proposición 1.

PROPOSICIÓN 1 (FUNCIÓN DE PROBABILIDADES DE LA VARIABLE ALEATORIA BINOMIAL)


Sea la VAD X = “número de éxitos en n ensayos independientes”, si p es la probabilidad de éxito y
q es la probabilidad de fracaso, entonces:
a. La fdp correspondiente es b ( x , n , p ) = C x p x q n− x , si
n
X = 0, 1, 2, , n .
x x
b. La FDA es B ( x , n , p ) =  b( k , n , p ) =  C k p k q n−k , si X = 0, 1, 2, , n .
n

k =0 k =0

c. b ( x, n, p ) = B ( x, n, p ) − B ( x − 1, n, p ) .

La expresión b ( x , n , p ) se interpreta como “la probabilidad de obtener x éxitos en n ensayos


independientes cuando la probabilidad de un éxito es p ” y la expresión X ~ B ( x , n , p ) se interpreta:
“la probabilidad de obtener a lo más x éxitos en n ensayos independientes cuando la probabilidad de
un éxito es p ”.

Cabe señalar:
Nota a. La fdp asociada a la variable aleatoria binomial X , depende de los “parámetros” n y p ,
esto es X ~ b ( x , n , p ) .
b. La FPA asociada a la variable aleatoria binomial la representaremos por
X
X ~ B( x , n , p ).

¿CÓMO SE CALCULAN LAS PROBABILIDADES BINOMIALES?

EJEMPLO 4 (OBTENCIÓN DE PROBABILIDADES BINOMIALES)


(En las páginas 81 a 83 se obtienen estas probabilidades utilizando una APP, revise los ejemplos 4 bis
y 4 tris)
Para la VAD X = “número de éxitos en 4 ensayos independientes”, con probabilidad de éxito p = 0.3 .
Se tiene que n = 4 y p = 0.30 , entonces q = 0.70 y la fdp es
b ( x , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 )
4 x 4− x
x
, si X = 0, 1, 2, 3, 4 .
Por tanto,
4!
b ( 0 , 4, 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 0 )! 0! ( 0.30 ) ( 0.70 ) = ( 1 )( 0.30 ) ( 0.70 )
4 0 4 0 4 0 4
0
= 0.2401 .

4!
b ( 1 , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 1 )!1! ( 0.30 ) ( 0.70 ) = ( 4 )( 0.30 ) ( 0.70 )
4 1 3 1 3 1 3
1
= 0.4116 .
44 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

4!
b ( 2 , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 2 )! 2! ( 0.30 ) ( 0.70 ) = ( 6 )( 0.30 ) ( 0.70 )
4 2 2 2 2 2 2
2
= 0.2646 .

4!
b ( 3 , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 3 )! 3! ( 0.30 ) ( 0.70 ) = ( 4 )( 0.30 ) ( 0.70 )
4 3 1 3 1 3 1
3
= 0.0756 ,

4!
b ( 4 , 4 , 0.30 ) = C ( 0.30 ) ( 0.70 ) = ( 4 − 4 )! 4! ( 0.30 ) ( 0.70 ) = ( 1 )( 0.30 ) ( 0.70 )
4 4 0 4 0 4 0
4
= 0.0081 .

La distribución de probabilidad es
X 0 1 2 3 4

b ( x , 4 , 0.30 ) 0.2401 0.4116 0.2646 0.0756 0.0081

La figura 3 muestra el gráfico correspondiente.


b

0 1 2 3 4 x

FIGURA 3

Por otra parte, la FPA es


x
B ( x , 4 , 0.30 ) = C
4
k
p k q 4−k , si X = 0, 1, 2, 3, 4 , o bien
k =0

 0 sí x0
 0.2401 sí 0  x  1

 0.6517 sí 1  x  2
B ( x , 4 , 0.30 ) =  .
 0.9163 sí 2  x  3
 0.9919 sí 3  x  4

 1 sí x4
El gráfico asociado se muestra en la figura 4.
F

0 1 2 3 4 x

FIGURA 4
Sección 1.2 Distribución binomial y distribución normal 45

La determinación de la probabilidad binomial, tanto puntual (para un solo valor de X ) como


acumulada (para una secuencia de números enteros no negativos de X ) el proceso puede ser largo y
tedioso, sin embargo, el uso de tablas puede facilitar su evaluación. El apéndice A.1 contiene las tablas
de las probabilidades binomiales acumuladas desde n = 1 ensayo hasta n = 25 ensayos para diversos
valores de p ; la tabla 2 muestra una sección de ellas.

n X 0.40 0.45 0.50 n X 0.85 0.90 0.95


19 4 0.0696 0.0280 0.0096 10 3 0.0001 0.0000 0.0000
5 0.1629 0.0777 0.0318 4 0.0014 0.0001 0.0000
6 0.3081 0.1727 0.0835 5 0.0099 0.0016 0.0001
7 0.4878 0.3169 0.1796 6 0.0500 0.0128 0.0010
8 0.6675 0.4940 0.3238 7 0.1798 0.0702 0.0115
9 0.8139 0.6710 0.5000 8 0.4557 0.2639 0.0861
10 0.9115 0.8159 0.6762 9 0.8031 0.6513 0.4013
11 0.9648 0.9129 0.8204 10 1.0000 1.0000 1.0000
TABLA 2

El ejemplo 5 muestra la forma de uso de las tablas de probabilidades binomiales acumuladas que se
incluyen en el apéndice A.1 de este libro.

EJEMPLO 5 (DETERMINACIÓN DE PROBABILIDADES BINOMIALES UTILIZANDO TABLAS)


(En la página 86 se obtienen estas probabilidades utilizando una APP para celular, revise el ejemplo 5
bis)
a. Para determinar la probabilidad binomial acumulada B ( 7 , 19 , 0.45 ) , en la primera columna de la
primera tabla se localiza el parámetro n = 19 , a continuación, en la segunda columna se localiza el
número x = 7 y sobre esa fila nos desplazamos a la derecha hasta la columna encabezada por el
parámetro p = 0.45 , por tanto,
B ( 7 , 19 , 0.45 ) = 0.3169 .
b. Para determinar la probabilidad binomial acumulada B ( 8 , 10 , 0.95 ) , en la primera columna
localizamos el parámetro n = 10 , a continuación, en la segunda columna localizamos el número x = 8 y
sobre esa fila nos desplazamos a la derecha hasta la columna encabezada por el parámetro p = 0.95 ,
obtenemos
B ( 8 , 10 , 0.95 ) = 0.0861 .
c. Para calcular b ( 5 , 19 , 0.75 ) utilizando tablas es necesario rescribirla en términos de
B ( x , 9 , 0.75 ) , obtenemos
46 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

b ( 5 , 19 , 0.75 ) = B ( 5 , 19 , 0.75 ) − B ( 4 , 19 , 0.75 ) .


Posteriormente utilizamos el proceso seguido en los incisos anteriores, entonces
b ( 5 , 19 , 0.75 ) = B ( 5 , 19 , 0.75 ) − B ( 4 , 19 , 0.75 ) = 0 − 0 = 0
d. Basta recordar las propiedades de la FDA , en particular p ( X = xi ) = F ( xi ) − F ( xi −1 ) , que para
la vad binomial equivale a b ( x , n , p ) = B ( x , n , p ) − B ( x − 1 , n , p ) y aplicar el procedimiento
descrito en el inciso anterior un par de veces.
b ( 7 , 19 , 0.45 ) = B ( 7 , 19 , 0.45 ) − B ( 6 , 19 , 0.45 ) = 0.3169 − 0.1727 = 0.1442 .

Nota Las tablas de probabilidad binomiales del apéndice A.1 pueden ser inoperantes para ciertos
valores de los parámetros binomiales, sin embargo, una aplicación computacional facilita los
cálculos, revise la sección 1.3.

¿CÓMO SE CALCULA EL VALOR ESPERADO DE LA DISTRIBUCIÓN BINOMIAL?


Para caracterizar completamente la VAD binomial X = “número de éxitos en n ensayos
independientes”, es necesario obtener su valor esperado y su varianza, para ello, nuevamente
utilicemos un proceso inductivo y aprovecharemos los resultados obtenidos en el ejemplo 6.

EJEMPLO 6 (VALOR ESPERADO DE LA VAD BINOMIAL SI n = 0, 1, 2, 3 )


a. Si X = ”número de éxitos en n = 1 ensayo”, entonces la fdp es
x 0 1
b( x ; 1 , p ) q p

luego
E X  = ( 0 )( q ) + ( 1 )( p ) = p .

b. Si X = ”número de éxitos en n = 2 ensayos”, entonces la fdp es


x 0 1 2

b( x ; 2 , p ) q p q2
de donde
E X  = ( 0 )( q 2 ) + ( 1 )( 2 pq ) + ( 2 )( p 2 )
= 2 p( q + p ) = 2 p
c. Si X = ”número de éxitos en n = 3 ensayos”, entonces la fdp es
x 0 1 2 3

b( x ; 2 , p ) q3 3q 2 p 3qp 2 p3
Sección 1.2 Distribución binomial y distribución normal 47

luego
E X = ( 0 )( q 3 ) + ( 1 )( 3q 2 p ) + ( 2 )( 3qp 2
) + ( 3 )( p ) 3

= ( 1 )( 3q 2 p ) + ( 2 )( 3qp 2 ) + ( 3 )( p 3)
= 3q 2 p + 6qp 2 + 3 p 3 = 3 p ( q + qp + p )
2 2

= 3 p( q + p )2
= 3 p.

La tabla 3 reúne los resultados obtenidos en el ejemplo 6.


NÚMERO DE ENSAYOS VALOR ESPERADO
n =1 E X = p
n=2 E X  = 2p

n=3 E X  = 3p
TABLA 3

Fundamentándonos en la tabla 3 podemos establecer la siguiente conjetura (que en realidad es


verdadera e que inmediatamente la formalizamos).

PROPOSICIÓN 2 (ESPERANZA DE LA VARIABLE ALEATORIA BINOMIAL)


Sea la VAD X = “número de éxitos en n ensayos independientes”, si p representa la probabilidad de
éxito y q la probabilidad de fracaso, entonces
E X  = np .

¿CÓMO SE CALCULA EL LA VARIANZA DE LA DISTRIBUCIÓN BINOMIAL?


La obtención del parámetro varianza, se facilita utilizando la propiedad
V X = E X  2
− E 2
 X  (que se trató en la sección anterior). De acuerdo con la proposición 2,
E  X  = np , por tanto, E 2  X  = n 2 p 2 , falta calcular E X 2 .  
EJEMPLO 7 (VARIANZA DE LA VAD BINOMIAL PARA n = 1, 2, 3 )
a. Sea la VAD X = ”número de éxitos en n = 1 ensayo”, entonces la fdp es
x 0 1

x2 0 1

b( x ;1, p ) q p
48 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

también
 
E X2 = ( 0 )( q ) + ( 1 )( p ) = p y V  X  = p − p 2 = p( 1 − p ) = pq .

b. Sea VAD X = ”número de éxitos en n = 2 ensayos”, entonces la fdp es


x 0 1 2

x2 0 1 4

b( x ; 2 , p ) q p q2
Luego
  ( ) (
E X 2 = ( 0 ) q 2 + ( 1 )( 2 pq ) + ( 4 ) p 2 = 2 pq + 4 p 2 )
por lo que
V  X  = 2 pq + 4 p 2 − ( 2 p )2 = 2 pq .

c. Sea la VAD X = ”número de éxitos en n = 3 ensayos”, entonces la fdp es

x 0 1 2 3

x2 0 1 4 9

b( x ; 2 , p ) q3 3q 2 p 3qp 2 p3
entonces
 
E X 2 = 3q 2 p + 12qp2 + 9 p3 ,
por tanto,
V  X  = 3q 2 p + 12qp2 + 9 p3 − 9 p3 = 3 pq( q + p ) = 3 pq .

En la tabla 4., sistematizamos los resultados obtenidos en el ejemplo 7.

NÚMERO DE ENSAYOS VARIANZA


n =1 V X  = pq
n=2 V X  = 2 pq
n=3 V X  = 3 pq
TABLA 4

Con fundamento en la tabla 4. se establece la siguiente conjetura (que en realidad es verdadera e


que inmediatamente la formalizamos).
Sección 1.2 Distribución binomial y distribución normal 49

GENERALIZACIÓN

PROPOSICIÓN 3 (VARIANZA DE LA VARIABLE ALEATORIA BINOMIAL)


Sea la VAD X = “número de éxitos en n ensayos independientes”, si p es la probabilidad de éxito y
q es la probabilidad de fracaso, entonces:
a. V  X  = npq .
b. V  X  = npq .

EJEMPLO 8 (APLICACIONES DE LA DISTRIBUCIÓN BINOMIAL)


Los estudios muestran que 1 de cada 4 alumnos inscritos en el sexto semestre del CCHO cursan una
asignatura en el programa PAE.
Sea la VAD X = “número de alumnos del CCHO que cursan una asignatura en el programa PAE en
una muestra de tamaño 6 ”.
i. La probabilidad de que ningún alumno del CCHO, seleccionado al azar curse una asignatura en el
programa PAE es
6
p ( X = 0 ) = b ( 0 , 6 , 0.25 ) = C ( 0.25 ) ( 0.75 )
0 6
= 0.1780 .
0

ii. La probabilidad de que exactamente dos alumnos del CCHO, seleccionados al azar cursen una
asignatura en el programa PAE está dada por
6
p ( X = 2 ) = b ( 2 , 6 , 0.25 ) = C ( 0.25 ) ( 0.75 )
2 4
= 0.2966 .
2

iii. La probabilidad de que más de dos alumnos del CCHO, seleccionados al azar, cursen una
asignatura en el programa PAE es
6
p ( X  2 ) = 1 − p ( X  2 ) = 1 − B ( 2 , 6 , 0.25 ) = 1 − C ( 0.25 ) ( 0.75 )
2 4
= 0.1694 .
2

iv. El valor esperado y la varianza de la VAD X = “número de alumnos del CCHO que cursan una
asignatura en el programa PAE en una muestra de tamaño 6 ” son
E X  = 6( 0.25 ) = 1.5 y V  X  = 6( 0.25 )( 0.75 ) = 9 respectivamente.
8

EJEMPLO 9 (APLICACIONES DE VACUNAS)


Al aplicar cierta vacuna a cien alumnos, se encontró que noventa de ellos perdieron el hábito de copiar
en los exámenes.
a. Sea la VAD X = “número de alumnos que perdieron el habito de copiar en los exámenes en una
muestra de 12 ”.
i. La fdp y la FPA son
12 x 12
b ( x , 12 , 0.90 ) = C ( 0.90 ) ( 0.10 ) y
x
x 12− x
B ( x , 12 , 0.90 ) =  C ( 0.90 ) ( 0.10 )
k =0 k
k 12− k
50 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

respectivamente.
ii. El valor esperado y la varianza son
E  X  = 12( 0.90 ) = 10.8 y V  X  = 12( 0.90 )( 0.10 ) = 1.08 respectivamente.
iii. La probabilidad de que entre tres (inclusive) y seis (inclusive) alumnos hayan perdido el hábito de
copiar en los exámenes es
p ( 3  X  6 ) = B ( 6 , 12 , 0.90 ) − B ( 2 , 12 , 0.90 ) = 0.0005 .
iv. La probabilidad de que más de cuatro alumnos hayan perdido el hábito de copiar en los exámenes
es
p ( X  5 ) = 1 − p ( X  4 ) = 1 − B ( 4 , 12 , 0.90 ) = 1 .
b. Sea la VAD X = “número de alumnos que no perdieron el habito de copiar en los exámenes en una
muestra de 12 ”.
i. La fdp y la FPA son
12
b ( x , 12 , 0.10 ) = C ( 0.10 ) ( 0.90 )
x 12− x

y
x 12
B ( x , 12 , 0.90 ) = C ( 0.10 ) ( 0.90 )
k =0 k
k 12− k
,

respectivamente.
ii. El valor esperado y la varianza son
E X  = 12( 0.10 ) = 1.2 y V  X  = 12( 0.10 )( 0.90 ) = 1.8 , respectivamente.
ii. La probabilidad de que entre tres (inclusive) y seis (inclusive) alumnos no hayan perdido el hábito de
copiar en los exámenes es
p ( 3  X  6 ) = B ( 6 , 12 , 0.10 ) − B ( 2 , 12 , 0.10 ) = 0.1108 .
iii. La probabilidad de que más de cuatro alumnos hayan perdido el hábito de copiar en los exámenes
es
p ( X  5 ) = 1 − p ( X  4 ) = 1 − B ( 4 , 12 , 0.90 )  1 − 0.0043 = 0.9957 .

El ejemplo 10 muestra que en ocasiones definir nuevamente el “éxito” facilita el cálculo de las
probabilidades.

EJEMPLO 10 (EXTERMINIO DE RATAS)


Una persona que se dedica a exterminar plagas afirma “el 95% de las ratas a las que asesta un
garrotazo en la cabeza pasan a mejor vida”. Sean las variables aleatorias:
X = “número de ratas que reciben un garrotazo en la cabeza y que pasan a mejor vida”.
X C = “número de ratas que reciben un garrotazo en la cabeza y que no pasan a mejor vida”.
Suponiendo que su afirmación es verdadera y que en una faena asesta un garrotazo en la cabeza a 24
ratas, las probabilidades de que:
i. Exactamente 6 de las ratas que asestó un garrotazo en la cabeza no pasen a mejor vida es
Sección 1.2 Distribución binomial y distribución normal 51

( )
p X c = 6 = B ( 6 , 24 , 0.05 ) − B ( 5 , 24 , 0.05 ) = 0.9998 − 0.9990 = 0.0008 .
ii. Más de 9 ratas a las que asestó un garrotazo en la cabeza no pasen a mejor vida.
p ( X c  10 ) = 1 − B ( 9, 24, 0.05 ) = 1 − 1.0000 = 0 .
iii. Más de 9 pero menos de 15 ratas que recibieron un garrotazo en la cabeza pasen a mejor vida es
p ( 9  X  15 ) = B ( 14, 24, 0.95 ) − B ( 9, 24, 0.95 ) = 0 − 0 = 0 .
iii. Más de 9 pero menos de 15 ratas que recibieron un garrotazo en la cabeza no pasen a mejor vida
es p ( 9  X c  15 ) = B ( 14, 24, 0.05 ) − B ( 9, 24, 0.05 ) = 0 .
iv. Entre 15 y 22 ratas que recibieron un garrotazo en la cabeza pasen a mejor vida es
p (15  X  22 ) = B ( 21 , 24, 0.95 ) − B ( 15 , 24, 0.95 ) = 0.1159 .

EJEMPLO 11 (PROBLEMAS OPERATIVOS)


18
a. Si una VAD se distribuye binomialmente y tiene fdp f ( x ) = C ( 0.35 )x ( 0.65 )18− x , entonces sus
x

parámetros son n = 12 y p = 0.35 , también


E  X  = 18( 0.35 ) = 6.3 y V  X  = 18( 0.35 )( 0.65 ) = 4.095 .
b. Si una VAD se distribuye binomialmente con valor esperado 8 y desviación estándar 2 , para
determinar su fdp es necesario conoces los valores de sus parámetros n y p . Puesto que
E  X  = 8 , si DE  X  = 2 , entonces V  X  = 4 .
Al sustituir estos datos en las expresiones para el valor esperado y la varianza de la distribución
binomial obtenemos el sistema de ecuaciones: np = 8 y npq = 4 .
Entonces 8q = 4 y q = 0.5 , así p = 1 − 0.5 = 0.5 . De la primera de las ecuaciones obtenemos
8
n ( 0.5 ) = 8 , n = y n = 16 .
0.5
La fdp es
16
b ( x , 16 , 0.5 ) = C ( 0.5 ) ( 0.5 )
x 16− x
.
x

DISTRIBUCIÓN NORMAL
El grafico asociado a una variable aleatoria (o no aleatoria) proporciona información sobre su
comportamiento. En el proceso de la descripción estadística de un grupo de medidas (datos), después
del cálculo de algunas de sus medidas descriptivas (en particular las de tendencia central y las de
dispersión) el siguiente paso consiste en realizar su descripción gráfica, misma que proporciona una
buena idea del comportamiento de la variable que los genera. La figura 5 presenta el gráfico de la
distribución de probabilidad asociada a cierta variable aleatoria discreta junto con su histograma de
probabilidad.
52 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

f f

0.5 0.5

0 x1 x2 x3 x4 x5 x 0 x1 x2 x3 x4 x5 x

FIGURA 5

Una de las características que se busca en un histograma de probabilidad se refiere a su simetría,


respecto a una línea recta específica, en particular a aquella cuya ecuación es igual al valor esperado
de la variable aleatoria (en el caso de una distribución de frecuencias a una medida de tendencia
central, por ejemplo, la media aritmética), vea la figura 6.

f f

0 x1 x2 x3 x 4 x5 x6 x 0 x1 x2 x3 x4 x5 x6 x

E[X] x=x

FIGURA 6

Cuando una distribución de probabilidad (o en su caso una distribución de frecuencias) no es


simétrica se conoce como asimétrica y su asimetría puede ser a la derecha (también llamada positiva) o
a la izquierda (también llamada negativa), vea la figura 7.

f f E[X]
E[X]

0 x 1 x 2 x 3 x 4 x 5 x 6 x 7 x 8 x 9 x 10 x 0 x 1 x 2 x 3 x x 5 x x 7 x x x 10 x
4 6 8 9

asimetría positiva asimetría negativa

FIGURA 7
Sección 1.2 Distribución binomial y distribución normal 53

En una gran diversidad de estudios y análisis del comportamiento de grupos de medidas (datos),
se ha observado que el patrón de comportamiento del histograma de frecuencias (o probabilidades) es
similar al mostrado en la figura 8.

f E[X]

0 x

FIGURA 8

Si el gráfico de la figura 8 se “suaviza” se obtiene la curva de la figura 9. Esta curva suave "asintótica"
(con asíntota el eje cartesiano horizontal) representa de modo intuitivo la distribución teórica de la
característica observada y su importancia se debe a la frecuencia con la que distintas variables
asociadas a mediciones (de características de objetos, fenómenos naturales y cotidianos, entre otros)
se aproximan a ella.

f 

f ( x ± )

0 x

FIGURA 9

Por tanto, la función de probabilidad (regla de correspondencia) que tiene asociada se ha


llamado normal o distribución normal. La palabra normal viene de la palabra griega «normalis», cuyo
significado es conforme a la regla, o conforme a la norma, que es lo típico o que se repite muchas veces
según la experiencia. La forma de la curva es parecida a una campana y es simétrica respecto a la línea
recta que representa su valor esperado y por este motivo se llama “campana de Gauss o simplemente
Gaussiana”; la función (matemática) que tiene asociada fue descrita por Gauss por lo que en muchos
autores de textos se refieren a ella como “ley de probabilidades de Gauss”. Según este modelo de
probabilidad, en todo proceso de medida influyen diversas causas que hacen variar su resultado (real),
todas las causas son independientes entre sí y son muy pequeñas de manera que los resultados se
acumulan alrededor de su valor esperado.
54 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

¿CÓMO SE DEFINE LA DISTRIBUCIÓN NORMAL?

DEFINICIÓN 3 (FUNCIÓN DE PROBABILIDAD NORMAL O DE GAUSS)


La variable aleatoria continua X tiene distribución normal o de Gauss con parámetros  y  2 , si
SU función de densidad de probabilidad es:
2
1  x− 
1 −  
f ( x )= e 2  
, siempre que −   X  + , −     + y   0 .
 2

En la definición 3 el símbolo e es el número de Euler y representa la base de los logaritmos


naturales, tiene un valor aproximado de 2.718 , el símbolo  es la constante matemática de valor
aproximado a 3.1416 , los símbolos  (miú) y  (sigma) son letras griegas y denominan parámetros.
Para referirnos a distribución normal se utilizaremos la notación
X  N (  ,  2 ),
misma que interpretaremos como: “la variable aleatoria continua X se distribuye normalmente con
parámetros  y  2 ”.

¿CUÁLES SON LAS CARACTERÍSTICAS DE LA DISTRIBUCIÓN NORMAL?

Retornando a la curva asociada a la fdp normal, presenta las características gráficas:


i. Es simétrica a la línea recta vertical de ecuación x =  , por tanto, f ( x −  ) = f ( x +  ),
vea la figura 10.

f

f ( x ± )

0 x- x+ x

FIGURA 10

ii. El eje x es su única asíntota (en este caso horizontal).


1
iii. Alcanza su valor máximo cuando x =  y éste es f (  ) = , vea la figura 11.
 2
Sección 1.2 Distribución binomial y distribución normal 55

1
√2π

0 x
x= 
FIGURA 11

2
1  x− 
1 −  
( x )=
 2 e
La función f y cumple con los axiomas:
2  

i. Es no negativa no negatividad (la curva gaussiana está “arriba” del eje de las abscisas).
ii. El área de la región que define con el eje de las abscisas es de una unidad, por tanto, la región
izquierda (derecha) que definen: el eje x , la línea recta de ecuación x =  y la curva Gaussiana es
0.5 unidades de área, vea la figura 12.
f esta región
esta región
tiene área de tiene área de
0.5 unidades 0.5 unidades
cuadradas cuadradas

0 x

FIGURA 12

La caracterización completa de la distribución normal requiere la construcción de su FPA ,


determinar su valor esperado y su varianza, sin embargo, para ello se utilizan técnicas matemáticas de
nivel superior, por tanto, que simplemente las enunciaremos.

DEFINICIÓN 4 (FUNCIÓN DE PROBABILIDAD ACUMULADA)


Si X  N (  ,  2 ), entonces la función de probabilidad acumulada se define como
2
x 1  x− 
1 −  
Φ( x )= p ( X  x )= A e 2  
, si: −   X  + , −     + y   0 .
− 2

La figura 13 muestra el área o probabilidad asociada a la FPA


56 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

2
x 1  x− 
1 −  
Φ( x )= p ( X  x )= A e 2  
.
− 2
f

F(x)=p(X x)

0 x x

FIGURA 13

Nota
El símbolo Φ corresponde a la letra griega phi y lo utilizaremos para referirnos a la función de
distribución acumulada normal.

En la figura 13, al desplazar continuamente x a la derecha el área (o probabilidad acumulada)


aumenta y se aproxima a 1 , por tanto, el gráfico de
2
x 1  x− 
1 −  
Φ( x )= p ( X  x )= A e 2  
toma la forma de la figura 14.
− 2

1 1

0 x x 0 x x

FIGURA 14

La proposición 4 incluye los parámetros de la variable X  N (  ,  2 ) .

PROPOSICIÓN 4 (VALOR ESPERADO Y VARIANZA DE LA VARIABLE ALEATORIA NORMAL)


Si X  N (  ,  2 ), entonces
a. E  X  =  .
b. V  X  =  2 y DE  X  = + .
Sección 1.2 Distribución binomial y distribución normal 57

Nota
En lo subsecuente nos referiremos al valor esperado de la distribución normal como “media”.

¿CÓMO SE CALCULAN LAS PROBABILIDADES DE LA DISTRIBUCIÓN NORMAL?

La distribución normal es la de mayor importancia en la probabilidad y la estadística, por


consiguiente, debemos detallar su comportamiento con el fin de facilitar el cálculo de probabilidades.
Sea
2 2
1  x−  1 x 
1 −   1 −  
( )= , si  = 0 obtenemos f 1 ( x ) =
 2 e  2 e
f x 2   2  

y la curva asociada a esta última función se obtiene por medio de un desplazamiento horizontal de la
gaussiana asociada a
2
1  x− 
1 −  
( )=
 2 e
f x , 2  

de manera que la línea recta de ecuación x =  coincida con el eje de las ordenadas, vea las figuras
15 y 16.
y y
- 1 ( x ) - 1 ( x - )
2 2

= 1
2
1 f(x) e 1 f(x)= 1 e 2
√2π 1  √2π  √2π √2 π

x
x==0 x =
FIGURA 15

y
1
√2π

x
 = - 2.5 =0 =2 =4

FIGURA 16
58 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

2
1  x− 
1 −   1
ii. El valor máximo de la función f ( x )= e 2  
es el número y lo alcanza si
 2  2
1
x =  . Si se incrementa  disminuye el número , este hecho se refleja en un “aplanamiento”
 2
2
1  x− 
1 −  
de la curva gaussiana asociada a f ( x )= e 2  
.
 2
En la figura 17,  2 es menor que  1 y  1 es menor que  3 .

y
1
√2π
- 21 ( x )
2
1
f(x) = 1 e
√2π 1  √2π

1
√2π

0 x
x =
FIGURA 17

Todas las curvas gaussianas, junto con el eje de las abscisas, determinan regiones cuya área (o
probabilidad) igual a la unidad, sin embargo, el cálculo de áreas de secciones como las mostradas en la
figura 18 resulta prácticamente imposible utilizando “métodos geométricos” y su cálculo requiere de
elementos de otras ramas de la matemática (por ejemplo, cálculo diferencial o métodos numéricos). Por
esta razón el cálculo de probabilidades de distribuciones normales se realiza utilizan las “tablas de
probabilidades normales estandarizadas” (construidas previamente) o alguna aplicación computacional,
sin embargo, en ambos casos es necesario “convertir” la distribución normal de parámetros  y  2 en
la distribución normal de parámetros
1
1 − z2
 = 0 ,  2 = 1 y fdp f ( z )= e 2 .
2

p p p

0 x

FIGURA 18
Sección 1.2 Distribución binomial y distribución normal 59

DEFINICIÓN 5 (VARIABLE ALEATORIA Y DISTRIBUCIÓN NORMAL ESTÁNDAR)


Si X  N (  ,  2 ), entonces
X −
a. La variable Z = se denomina “variable aleatoria normal estándar”.

b. El proceso de conversión de X  N (  ,  2 ) a Z  N ( 0 , 12 ) se llama “normalización” o
“estandarización”.
1
− z2
c. Si Z  N (0 )
, 12 , entonces f ( z )=
1
2 e 2
.

X −
Si aplicamos la transformación Z = a cualquier fdp de una variable aleatoria normal

obtenemos
1
1 − z2
f ( z )= e 2
,
2
vea la figura 19, por tanto, el cálculo de probabilidades la VAC
X N ( , 2 )
puede tratarse como un problema de evaluación de probabilidades de la variable aleatoria normal cero
uno (parámetros)
E  X = 0 y  2 =1 .

y y
X- 
Z=  1
√2π
1
√2π
N (    2)  N( 0,1 )
2

Z Z
0 0

FIGURA 19

DEFINICIÓN 6 (FUNCIÓN DE PROBABILIDAD ACUMULADA NORMAL ESTÁNDAR)


1
− z2
(0 )
z
1
Si Z  N , 1 , entonces la FPA correspondiente es  ( z ) = p ( Z  z ) =
2
A e 2
,
− 2
para todo número real z .

La interpretación geométrica de la definición anterior se muestra en la figura 20.


60 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

f 1

0 z1 x 0 z1 x

FIGURA 20

La proposición 5 incluye otras propiedades de la variable aleatoria Z  N ( 0 , 12 ) .

PROPOSICIÓN 5 (PROPIEDADES DE Z  N ( 0 , 12 ) )
Si Z  N ( 0 , 12 ) y  ( z1 ) = p ( Z  z1 ) , entonces
a. p ( Z  z1 ) =  ( − z1) y p ( Z  − z1 ) =  ( z1 ) .
b. p ( a  Z  b ) =  ( b ) −  ( a ) .
c. p ( − a  Z  a ) = D ( a ) .

La figura 21 ilustra la proposición 5.


f
f
 ( z1 ) = p ( Z > - z 1)
p(Z>-z )
1
(z )
1

z1 z - z1 0 z
0

FIGURA 21.a.
f f

a 0 b z a 0 b z

p ( a < Z < b ) = ( b ) -  ( a ) p ( - a < Z < a ) = ( a ) -  ( - a ) = D ( a )

FIGURA 21.b.
Sección 1.2 Distribución binomial y distribución normal 61

CÁLCULO DE PROBABILIDADES NORMALES CERO–UNO, UTILIZANDO TABLAS

Las tablas A.2 del apéndice A.1 están encabezadas por una fila como la mostrada a continuación:
z ( − z ) ( z ) D( z )
i. La primera columna contiene las asignaciones a la variable aleatoria Z .
ii. La segunda columna proporciona la probabilidad acumulada  ( − z ) = p ( Z  − z ) , para
asignaciones negativas z .
iii. La tercera columna contiene la probabilidad acumulada  ( z ) = p ( Z  z ) , para asignaciones
positivas a z .
iv. La cuarta columna contiene la probabilidad D ( z ) = p ( − z  Z  z ) que corresponde a dos
números simétricos − z y z .

EJEMPLO 12 (USO DE TABLAS DE PROBABILIDAD NORMAL)


(Este proceso se facilita utilizando una APP ya sea para PC o para celular, revisa el ejemplo 12 bis y 12
tris de las páginas 87 a 92).
Supongamos que Z  N ( 0 , 12 ) .
a. Para determinar p ( Z  1.20 ) , notemos que p ( Z  1.20 ) =  ( 1.20 ) , en las tablas A.2 del
apéndice 1 observamos
z (−z ) (z ) D( z )
1.20 0.1151 0.8849 0.7699
entonces p ( Z  1.20 ) = 0.8849 .
b. Para calcular p ( Z  −1.60 ) , notemos que p ( Z  −1.60 ) =  ( − 1.60 ) , en las tablas A.2 del
apéndice 1 observamos
z (−z ) ( z ) D( z )
1.60 0.0548 0.9452 0.8904
por tanto,
p ( Z  −1.60 ) =  ( − 1.60 ) = 0.0548 .
c. Para calcular p ( 0  Z  1.20 ) , escribimos p ( 0  Z  1.20 ) =  ( 1.20 ) −  ( 0 ) , en las tablas
A.2 del apéndice 1 observamos

z (−z ) ( z ) D( z ) z (−Z ) (z ) D( z )


1.20 0.1151 0.8849 0.7699 0 0.5000 0.5000 0.0000
por tanto,
p ( 0  Z  1.20 ) =  ( 1.20 ) −  ( 0 ) = 0,8849 − 0.5000 = 0.3849 .
62 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

d. Para calcular p ( − 0.90  Z  0 ) , primero escribimos p ( − 0.90  Z  0 ) =  ( 0 ) −  ( − 0.90 ) ,


en las tablas A.2 del apéndice 1 observamos
z (−z ) ( z ) D( z ) z (−Z ) ( z ) D( z )
− 0.90 0.1841 0.8159 0.6319 0 0.5000 0.5000 0.0000
entonces
p ( − 0.90  Z  0 ) =  ( 0 ) −  ( − 0.90 ) = 0.5000 − 0.1841 = 0.3159 .
e. Puesto que p ( 0.30  Z  1.56 ) =  ( 1.56 ) −  ( 0.3 ) ; las tablas A.2 del apéndice 1 muestran
z (−z ) ( z ) D( z ) z (−Z ) ( z ) D( z )
0.30 0.3821 0.6179 0.2358 1.56 0.0594 0.9406 0.8812
luego
p ( 0.30  Z  1.56 ) =  ( 1.56 ) −  ( 0.3 ) = 0.9406 − 0.6179 = 0.3227 .
f. Puesto que p ( − 0.20  Z  0.20 ) = D ( 0.20 ) ; las tablas A.2 del apéndice 1 muestran
z (−z ) ( z ) D( z )
0.20 0.4207 0.5793 0.1585
entonces
p ( − 0.20  Z  0.20 ) = D ( 0.20 ) = 0.1585 .
g. Si p ( Z  −0.20 ) , por la propiedad de simetría obtenemos p ( Z  −0.20 ) =  ( 0.20 ) , en las
tablas A.2 del apéndice 1 se observa
z (−z ) ( z ) D( z )

0.20 0.4207 0.5793 0.1585


luego
p ( Z  −0.20 ) =  ( 0.20 ) = 0.5793 .
h. Si p ( Z  2.30 ) , por la propiedad de simetría obtenemos p ( Z  2.30 ) =  ( − 2.30 ) = 0.0107 ; las
tablas A.2 del apéndice 1 muestran
z (−z ) ( z ) D( z )
− 2.30 0.0107 0.9893 0.9786
entonces
p ( Z  2.30 ) = 0.0107 .

En la resolución de problemas relacionados con la distribución normal, en ocasiones, se conoce la


probabilidad, pero no así el valor de la variable aleatoria que le corresponde.
Sección 1.2 Distribución binomial y distribución normal 63

DEFINICIÓN 7 (CUANTILES)
Si Z  N ( 0 , 12 ) , entonces
El número Z = z 0 tal que p ( Z  z0 ) =  ( z0 ) = p0 se denomina “cuantil del 100 % p0 ”.

La figura 22 ilustra los conceptos antes definidos.


f

100% ( z0 ) = 100% p
0

0 z
z
100%  ( z0 )

FIGURA 22

En las tablas del apéndice A se incluyen los cuantiles asociados a la distribución normal
estandarizada y el ejemplo 13 muestra la forma en que se calculan.

EJEMPLO 13 (CÁLCULO DE CUANTILES AL 100% DE LA NORMAL)


(Este proceso se facilita utilizando una APP ya sea para PC o para celular, revisa el ejemplo 13 BIS de
las páginas 90 y 91).
a. Si p ( Z  z 0 ) = 0.30 , entonces el número z 0 se llama cuantil 30% y se representa por z 30 ,
además tiene signo negativo (el área o probabilidad se mide desde −  hasta z 30 ), en las tablas del
apéndice A.2 observamos
p% Z(  ) Z(D )
30.0 − 0.524 0.385
entonces
z30 = −0.524 .
b. Si p ( Z  z 0 ) = 0.875 , entonces el cuantil 87.5% , que se representa por z87.5 tiene signo positivo
(deja a su izquierda un área o probabilidad de 0.875 o 87.5% ), en las tablas del apéndice A.2
observamos:
% Z(  ) Z(D )
87.5 1.1503 1.534
entonces
z87.5 = 1.1503 .
64 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

EJEMPLO 14 (CÁLCULO DE CUANTILES z0 )


(Este proceso se facilita utilizando una APP ya sea para PC o para celular, revisa el ejemplo 14 bis de
las páginas 92 y 93).
a. Si p ( Z  z0 ) = 0.525 , entonces la probabilidad acumulada hasta el número z 0 es
p ( Z  z 0 ) = 0.475 , las tablas del apéndice A.2 muestran:

% Z(  ) Z(D )
47.5 0.063 0.714
por consiguiente z0 = −0.063 .
b. Si p ( Z  z 0 ) = 0.11 , entonces la probabilidad acumulada hasta el número z 0 es p ( Z  z 0 ) = 0.89 ,
las tablas del apéndice A.2 muestran
% Z(  ) Z(D )
89 1.227 0.138
por consiguiente z 0 = −1.227 .
c. Si p ( − z0  Z  z0 ) = 0.45 , entonces Z ( D ) = p ( − z 0  Z  z 0 ) = 0.45 , en las tablas del apéndice
A.2 observamos:
% Z(  ) Z(D )
45 − 0.126 0.598
por tanto, z0 = 0.598 .
d. Si p ( − z0  Z  z0 ) = 0.90 , entonces Z ( D ) = p ( − z0  Z  z0 ) = 0.90 , en las tablas del
apéndice A.2 observamos:
% Z(  ) Z(D )
90 1.281 1.645
en consecuencia z0 = 1.645 .

EJEMPLO 15 (ANCHO DE LAS PUERTAS)


El ancho de las puertas de las crujías de cierto reclusorio se distribuye normalmente con una longitud
media de 100 centímetros y desviación estándar de 4 centímetros.
Sea la VAC X = “ancho de las puertas de las crujías del reclusorio”.
a. En la restructuración de las crujías, las puertas serán medidas y aquellas que tengan anchos
comprendidas entre los 90 y los 105 centímetros serán reemplazadas. Para determinar la fracción de
puertas que deben ser reemplazadas consideremos:
X  N ( 100 , 42 ) , entonces
Sección 1.2 Distribución binomial y distribución normal 65

 90 − 100 105 − 100 


p ( 90  X  105 ) = p  Z  = p ( − 2.5  Z  1.25 ) ,
 4 4 
=  ( 1.25 ) −  ( − 2.5 ) = 0.8944 − 0.0062 = 0.8882 ,
es decir, el 88.82% de las puertas serán reemplazadas.
b. Las puertas con un ancho menor a los 102 centímetros serán enviadas a reparación, entonces la
probabilidad de que una puerta sea enviada a reparación es
 102 − 100 
p ( X  102 ) = p  Z   = p ( Z  0.5 ) = 0.6915 .
 4 
por tanto, el 30.85% de las puertas serán enviadas a reparación.

EJEMPLO 16 (PESO DE LAS PIÑAS)


El peso de las piñas hawaianas que expende “Súper frutas”, se distribuyen normalmente, con un valor
promedio de 2.4 kilogramos y desviación estándar de 0.8 kilogramos.
Sea la VAC X = ”peso de las piñas hawaianas”, entonces X  N ( 2.4, 0.82 ).
a. Si los clientes adquieren primero las piñas hawaianas con peso superior a los 3.0 kilogramos,
entonces la fracción de las piñas que serán seleccionadas inicialmente se calcula como sigue,
 3 − 2.4 
p ( X  3 )= p  Z   = p ( Z  0.75 ) =  ( − 0.75 ) = 0.2266 .
 0.8 
Por tanto, el 22.66% de las piñas hawaianas tiene un peso superior a 3.0 kilogramos.
b. Si se ponen en oferta las piñas hawaianas de peso inferior a los 1.9 kilogramos, entonces el
porcentaje de piñas que será puesto en oferta se calcula como sigue:
 0 − 2. 4 1.9 − 2.4 
p ( 0  X  1. 9 ) = p  Z  = p ( − 3  Z  −0.625 )
 0.8 0. 8 
=  ( − 0.625 ) −  ( − 3 ) = 0.2660 − 0.0013 = 0.2647 , el 26.47% .

EJEMPLO 17 (GASTO EN TRANSPORTE)


El gasto semanal de Ramón, en transporte, se distribuye normalmente con media $ 400 y desviación
estándar de $ 20 , es decir, X = “gasto semanal de Ramón en transporte” y
X N ( 400, 20 ).
2

a. La probabilidad de que Ramón gaste más de $ 450 en transporte la próxima semana es


 450 − 400 
p ( X  450 ) = p  Z   = p ( Z  2.5 ) =  ( − 2.5 ) = 0.0062 .
 20 
b. La probabilidad de que Ramón gaste menos de $ 440 en transporte la próxima semana es
 0 − 400 440 − 400 
p ( 0  X  440 ) = p  Z   = p ( − 20  Z  2 ) =  ( 2 ) = 0.9772 .
 20 20 
66 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

c. El gasto semanal x0 que se rebasa con una probabilidad de 0.10 se calcula de la siguiente forma,
 x0 − 400 
de p ( X  x0 ) = p  Z   = 0.10 ,
 20 
obtenemos z10 = 1.2816 , luego
x 0 − 400
= 1.2816 ,
20
el gasto semanal es
x0 = 425.632 pesos.

EJEMPLO 18 (SELECCIÓN DE EMPLEADOS)


Para seleccionar a sus futuros empleados, el jefe de personal de El Pingüino S.A. utiliza una prueba
cuya puntuación promedio es  y desviación estándar  = 10 . Suponga que la distribución de las
puntuaciones es normal y que una puntuación mínima de 65 le permite al solicitante seguir siendo
considerado.
Sea la VAC X = “puntuación obtenida por los aspirantes”, entonces X  N (  , 10 2 ).
a. Para calcular el valor de  sabiendo que p ( X  65 ) = 0.025 . Si estandarizamos obtenemos
 65 −  
p (X  65 ) = p  Z   = 0.025 ,
 10 
En la tabla de percentiles normales se observa z 2.5 = 1.96 , entonces
65 − 
= 1.96 , por tanto,  = 65 − 19.6 = 45.4 .
10
b. Para calcular el valor de  , de manera que el 5% de los solicitantes sigan siendo considerados
después de la prueba debemos determinar el valor de  bajo la condición p ( X  65 ) = 0.05 , al
estandarizar obtenemos
 65 −  
p ( X  65 ) = p  Z   = 0.05 ,
 10 
en las de percentiles normales se observa z 0 = 1.645 , por tanto,
65 − 
= 1.645 , luego  = 65 − 16.449 = 48.55 .
10

EJEMPLO 19 (ENVASANDO CEREALES)


El Ingeniero Sánchez diseñó una máquina envasadora de cereales, en su instructivo de características
indica que deposita la cantidad de cereal deseada con una desviación estándar de  gramos. Suponga
que la cantidad de cereal vertida se distribuye normalmente.
Sea la VA X = “peso del cereal vertido en los sacos”.
a. Para determinar el valor de  , cuando los sacos contienen la leyenda contenido neto 20 kilogramos,
y el 5% de los sacos contiene más de 20.5 kilogramos de cereal:
Sección 1.2 Distribución binomial y distribución normal 67

X N ( 20 ,  ) , entonces
2
p ( 
X  20.5 ) = p  Z 
20.5 − 20 

 = 0.05 , el número z 0 que deja
 
un área de z0 = 0.05 unidades, de acuerdo con las tablas de percentiles normales, es 1.6449 ,
entonces
20.5 − 20
= 1.6449 , de aquí  = 0.304 .

( )
b. X  N 50 ,  2 , entonces p ( 
X  50.1 ) = p  Z 

50.1 − 50 

 = 0.02 , el número z 0 que

deja un área de 0.02 unidades a su derecha es: z0 = 2.0537 , así
50.1 − 50
= 2.0537 , de donde  = 0.0487 .

EJEMPLO 20
(
Sea la VAC tal que Z  N 0 ,  2 )
a. Para determinar la proporción de asignaciones a X que difieren de la media en menos de una
desviación estándar, es decir, p (  −   X   +  ) , al estandarizar y simplificar obtenemos
  − −  X −   + −  
p (  −  X   + )= p    
    
 − X −   
= p    = p ( −1 Z 1 ).
    
Las tablas de la distribución normal dan
p ( − 1  Z  1 ) = 0.8413 .
b. Para determinar la proporción de asignaciones a X que difieren de la media en menos de dos
desviaciones estándar, es decir, p (  − 2  X   + 2 ) , al estandarizar y simplificar obtenemos
  − 2 −  X −   + 2 −  
p (  − 2  X   + 2 ) = p    
    
 − 2 X −  2 
= p    = p ( − 2  Z  2 ).
    
De las tablas de la distribución normal
p ( − 2  Z  2 ) = 0.9545 .
c. Para determinar la proporción de asignaciones a X que difieren de la media en menos de tres
desviaciones estándar, es decir, p (  − 3  X   + 3 ) , al estandarizar y simplificar obtenemos
  − 2 −  X −   + 3 −    − 3 X −  3 
p (  − 3  X   + 3 )= p   = p   .
         
Las tablas de la distribución normal dan
p ( − 3  Z  3 ) = 09773 .
68 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

PROBLEMAS PROPUESTOS

DISTRIBUCIÓN BINOMIAL
1. Si X ~ b ( x , 15 , 0.25 ) , calcula las verificando la producción de Mr. Aldo utilizando
probabilidades binomiales. un muestreo continuo desde que notó la
a. b ( 3 , 15, 0.25 ) . e. p ( 2  X  9 ) . situación anormal. Calcula la probabilidad de
b. b ( 5 , 15, 0.25 ) . f. p ( 2  X  9 ) . que en una muestra de diez piezas producidas
por Mr. Aldo y revisadas por el ingeniero
c. p ( X  6 ) . g. p ( X  10 ) .
encuentre:
d. p ( X  8 ) . h. p ( X  9 ) . a. Exactamente cinco defectuosas.
b. Cero defectuosas.
2. Suponga que X ~ b ( x , 23 , 0.70 ) y calcula c. A lo más cinco defectuosas.
las probabilidades binomiales. d. Cinco o más defectuosas.
a. b ( 3 , 23, 0.70 ) . e. p ( 5  X  10 ) .
b. b ( 5 , 23 , 0.70 ) . f. p ( 12  X  21 ) . 6. Una moneda se ha balanceado de manera
c. p ( X  13 ) . g. p ( X  17 ) . que la probabilidad de observar sol al ser
lanzada es 0.6 . Si la moneda se lanza nueve
d. p ( X  18 ) . h. p ( X  11 ) .
veces determina la probabilidad de observar:
a. Exactamente dos soles.
3. Construya la función de probabilidad y traza
b. Menos de tres soles.
la grafica.
c. A lo más tres soles.
a. b ( x , 6 , 0.2 ) . c. B ( x , 8 , 0.2 ) .
d. Al menos cuatro soles.
b. b ( x , 3 , 0.4 ) . d. B ( x , 10 , 0.4 ) . e. Un número par de soles.

4. Construye la función de probabilidad y traza 7. El 95 % de los discos que ofrecen los


la grafica. vendedores ambulantes del Eje Central de la
a. b ( x , 7 , 0.2 ) . c. B ( x , 4 , 0.2 ) . Ciudad de México son piratas. Un inspector
b. b ( x , 12 , 0.2 ) . d. B ( x , 8 , 0.2 ) . selecciona 10 de los discos que ofrecen los
vendedores del Eje Central.
5. Mr. Aldo produce el 10 % de las piezas, a. ¿Cuál es la probabilidad de que ninguno de
utilizadas en la elaboración de las sillas de los discos sea pirata?
montar, defectuosas lo que es muy elevado. El b. ¿Cuál es la probabilidad de que todos los
ingeniero de control de calidad ha estado discos sean piratas?
Sección 1.2 Distribución binomial y distribución normal 69

8. Un examen de opción múltiple incluye 15 11. La CFE, “Zona Norte” promueve el ahorro
preguntas, cada una con cinco respuestas de de energía eléctrica ofreciendo descuentos a
las que solamente una es correcta. Supóngase consumidores que mantienen su consumo por
que uno de los “estudiantes” que realizan el debajo de las normas de subsidio establecidas.
examen contesta las preguntas al azar. Estudios recientes muestran que en el 70 %
a. ¿Cuál es la probabilidad de que conteste de los usuarios han reducido el uso de energía
correctamente al menos 10 preguntas? eléctrica y pueden disfrutar de los descuentos.
b. ¿Cuál es la probabilidad de que conteste Si se seleccionan cinco usuarios de la “Zona
correctamente a lo más 10 preguntas? Norte”, determina las probabilidades:
c. ¿Cuál es la probabilidad de que conteste a. Los cinco califiquen para obtener tarifas más
correctamente menos de 10 preguntas? favorables.
d. ¿Cuál es la probabilidad de que conteste b. Al menos cuatro califiquen para tarifas más
correctamente más de 10 preguntas? favorables.

9. Una vendedora tiene una probabilidad p de 12. Un sistema de detección de humo, en


éxito de vender una aspiradora. Suponga que lugares en que está prohibido fumar, utiliza
la vendedora efectúa cinco intentos para tres celdas sensibles al humo que actúan
vender aspiradoras y que los resultados son independientemente entre sí, una o más de
independientes uno de otro. ellas pueden activar la alarma. Cada celda
a. ¿Cuál es la probabilidad de que las cinco tiene una probabilidad p = 0.8 de activar la
operaciones sean exitosas, si p = 0.8 ? alarma al detectar el humo. Sea X = “el
b. ¿Cuál es la probabilidad de que número de celdas que activan la alarma
exactamente cuatro operaciones sean exitosas, cuando detectan el humo”. Determina:
si p = 0.6 ? a. La distribución de probabilidad para X .
c. ¿Cuál es la probabilidad de que menos de b. La probabilidad de que la alarma funcione
dos operaciones sean exitosas, si p = 0.3 ? cuando detecte el humo.

10. El jefe de personal de “Sintex S. A.” detectó 13. Un estudio sobre los residentes de la
que algunas de las personas que contrató no Ciudad de Chilpancingo mostró que el 30 %
son lo que dicen ser. Sabe que el 35 % de los de ellos prefieren la carne de cerdo en lugar de
antecedentes de las personas que contrató fue la carne de iguana. Se preguntó a 10
alterado. La semana pasada contrató a cinco residentes de la ciudad sobre sus preferencias
nuevos empleados. ¿Cuáles son las en cuanto a los dos tipos de carne señalados.
probabilidades de que hayan sido alterados los Determina la probabilidad de:
expedientes de las personas que contrató? a. Ninguna prefiera la carne del cerdo.
a. De al menos uno. b. Cuatro prefieran la carne del cerdo.
b. De tres o más. c. Al menos ocho prefieran la carne del cerdo.
c. De un número. d. A lo más dos prefieran la carne del cerdo.
e. La mayoría no prefiera la carne de cerdo.
70 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

14. El 20 % de los estudiantes del sexto ¿Cuál es el número de niños que se espera
semestre del CCH han contestado sí a la hereden la inteligencia de su padre?
pregunta ¿le has quemado las patas al diablo?
En una muestra aleatoria de 15 estudiantes de 19. El 60 % de los clientes de la cantina “Las
sexto semestre, determina la probabilidad de: Pelotas de Villa” piden tequila como primera
a. Cuatro no hayan contestado sí a la pregunta. bebida. Sean 25 clientes de “Las Pelotas de
b. Seis no hayan contestado sí. Villa”, determina la probabilidad:
c. Al menos seis no hayan contestado “sí” a la a. Exactamente ocho no pidan tequila como
pregunta señalada? primera bebida.
d. Desde ocho y hasta trece inclusive, no b. Seis no pidan tequila como primera bebida.
hayan contestado “sí”. c. Más de 6 pidan tequila como primera
e. Entre ocho y trece inclusive, hayan bebida.
contestado “sí”. d. El número esperado y la varianza de que
pedirán tequila como primera bebida.
15. Supón que las condiciones para un
experimento binomial son válidas y determine 20. El 40 % de los tiros penales que ejecutan
E  X  y V  X  si: los seleccionados del equipo mexicano de
a. n = 20 y p = 0.60 . fútbol no son gol, determina la probabilidad de
b. n = 20 y p = 0.85 . que en los próximos 15 penales que
c. n = 40 y p = 0.30 . efectuarán los seleccionados mexicanos de
fútbol:
a. Ocho no sean gol.
16. Con base en un largo periodo de estudio,
b. Seis no sean gol.
se ha determinado que el 10 % de los
c. Menos de seis no sean gol.
estudiantes inscritos en los cursos de
d. El número esperado y la varianza de los
matemáticas amenazan al profesor para que
tiros penales, ejecutados por los seleccionados
los apruebe. Si los estudiantes toman el curso
del equipo mexicano de fútbol, que son gol.
en grupos de treinta, determina el valor
esperado y la desviación estándar del número
21. Un agricultor afirma que: en las cajas con
de estudiantes que amenazan, por grupo, al
treinta mangos, que distribuye, el 60% de
profesor para que los apruebe.
ellos se encuentran deliciosos, jugosos,
maduros y listos para comer. Considera una
17. Sea X una variable aleatoria binomial con
caja y determina la probabilidad:
valor esperado 10 y varianza 5 . Determina la
a. Al menos dos mangos no se encuentren
fdp .
deliciosos, jugosos, maduros y listos para
comer.
18. La probabilidad de que un niño de cierta b. El número esperado de mangos que no se
familia herede la inteligencia de su padre es encuentren deliciosos, jugosos, maduros y
0.2 . Si un padre de familia tiene 5 niños. listos para comer.
Sección 1.2 Distribución binomial y distribución normal 71

c. La varianza del número de mangos que se 24. Juan Mota sabe que la probabilidad de que
encuentran deliciosos, jugosos, maduros y germine una semilla de amapola es 0.9 . Desea
listos para comer. vender cultivos de amapola garantizando que
d. Al menos dos de los mangos, se encuentren cada uno contiene 100 plantas. Si siembra
deliciosos, jugosos, maduros y listos para 110 semillas en cada cultivo (que se supone
comer. germinarán independientemente).
a. ¿Cuántos cultivos se espera que contenga
22. “Vitro S. A.” produce vasijas de cristal un contenido de plantas medio?
cortado y el gerente sabe que el 15 % de ellas b. ¿Cuántas semillas de amapola deben poner
tienen defectos y en consecuencia deben en cada cultivo para tener la certeza de que el
venderse en los tianguis. cultivo tendrá 105 plantas?
a. De seis piezas seleccionadas al azar, ¿qué
tan probable es que sólo dos deban venderse 25. Un sistema de protección contra robos está
en los tianguis? construido por n cámaras de vídeo que
b. De doce piezas seleccionadas al azar, ¿qué funcionan independientemente, cada una con
tan probable es que sólo dos no deban probabilidad de 0.9 de detectar al sospechoso
venderse en los tianguis? que ingrese en la zona de cobertura. Si n = 5
c. De diez piezas seleccionadas al azar, y un sospechoso entra en la zona.
¿cuántas cabe esperar que no deban venderse a. ¿Cuál es la probabilidad de que
en los tianguis? exactamente cuatro cámaras detecten al
d. De nueve piezas seleccionadas al azar, sospechoso?
¿cuántas cabe esperar que deban venderse en b. ¿Cuál es la probabilidad de que al menos
los tianguis? una cámara detecte al sospechoso?
c. ¿Cuál debe ser el número de cámaras para
23. Una avioneta dispone de cuatro lugares que la probabilidad de detectar al sospechoso
para un viaje. El piloto acepta un máximo de al entrar en la zona sea de 0.9990 ?
seis reservaciones por viaje, y un pasajero
debe tener una reservación para poder viajar. 26. Si “Beto Pelotas” (habitante de la zona de
Por registros pasados, el piloto sabe que el la merced) “gorrea” un promedio de 25
20 % de las personas que reservan, no se cigarrillos diarios, con una desviación estándar
presentan al viaje. Suponiendo independencia, de 6 , determina la fdp binomial
si se hacen seis reservaciones: correspondiente.
a. ¿Cuál es la probabilidad de que al menos
27. Si X  N ( 0 , 12 ) determine:
una persona que reservó no tenga espacio
para el viaje?
a. p ( Z  −2.78 ) .
b. ¿Cuál es el número esperado de lugares
disponibles al inicio del viaje? b. p ( Z  2.78 ) .
c. p ( − 0.87  Z  0.87 ) .
d. p ( − 0.34  Z  0.62 ) .
72 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

e. p ( − 2.12  Z  0.37 ) . a. p ( Z  z0 ) = 0.125 .


f. p ( Z  0.85 ) . b. p ( Z  z0 ) = 0.92 .
g. p ( Z  −0.65 ) . c. p ( Z  z0 ) = 0.895 .
h. p ( − 0.34  Z  0.34 ) . d. p ( Z  z0 ) = 0.16 .
i. p ( − 0.62  Z  0.62 ) . e. p ( − z0  Z  z0 ) = 0.35 .
f. p ( − z0  Z  z0 ) = 0.84 .
28. Si X  N ( 200, 20 2
), determina: g. p ( Z  z0 ) = 0.001 .
a. p ( 185  X  210 ) . h. p ( Z  z0 ) = 0.999 .
b. p ( 215  X  250 ) . i. p ( Z  z0 ) = 0.5000 .
c. p ( X  240 ) .
d. p ( X  178 ) . 32. Sea X  N ( 0 , 12 ) , calcula z 0 .
e. p ( X  −181 ) . a. p ( − 2  Z  z0 ) = 0.35 .
f. p ( − 176  X  176 ) . b. p ( 1  Z  z0 ) = 0.10 .
c. p ( − 2.28  Z  z0 ) = 0.70 .
29. Si X  N ( 300, 10 2
) , obtén: d. p ( z0  Z  2.33 ) = 0.65 .
a. p ( 315  X  410 ) . e. p ( − 1.4  Z  z0 ) = 0.13
b. p ( 325  X  3600 ) . f. p ( − 2.03  Z  z0 ) = 0.3995 .
c. p ( X  340 ) .
d. p ( X  278 ) . 33. Sea X  N ( 0, 12 ) , calcula z 0 .
e. p ( X  −225 ) . a. p ( − 2.2  Z  z0 ) = 0.65 .
f. p ( − 325  X  4312 ) . b. p ( 1.3  Z  z0 ) = 0.02 .
c. p ( z0  Z  2.24 ) = 0.60 .
30. Sea X  N ( 0 , 1 ) , determina z 0 .
2
d. p ( z0  Z  2.43 ) = 0.96 .
a. p ( Z  z0 ) = 0.035 . e. p ( z0  Z  0 ) = 0.15 .
b. p ( Z  z0 ) = 0.98 . f. p ( 0  Z  z0 ) = 0.38 .
c. p ( Z  z0 ) = 0.215 .
d. p ( X  z0 ) = 0.63 . 34. Sea X  N ( − 25, 10 2 ), determina x 0 .
e. p ( − z0  Z  z0 ) = 0.775 . a. p ( X  x0 ) = 0.125 .
f. p ( − z0  Z  z0 ) = 0.18 . b. p ( X  x0 ) = 0.635 .
g. p ( X  z0 ) = 0.001 . c. p ( X  x0 ) = 0.80 .
h. p ( X  z0 ) = 0.00001 . d. p ( X  x0 ) = 0.94 .
i. p ( X  z 0 ) = 0.0000001 .

31. Sea X  N ( 0, 12 ) , obtén z 0 .


Sección 1.2 Distribución binomial y distribución normal 73

35. Sea X  N ( 5, 22 ), determina x0 en 39. Las donas elaboradas por “Donuts S. A.”
cada caso. tienen un hueco cilíndrico con diámetro
a. p ( X  x0 ) = 0.22 . promedio de 2 centímetros y desviación
estándar 0.2 centímetros. Si los diámetros se
b. p ( X  x0 ) = 0.39 .
distribuyen normalmente.
c. p ( X  x0 ) = 0.96 .
a. ¿Qué porcentaje de las donas tienen hueco
d. p ( X  x0 ) = 0.62 . con diámetro mayor de 1.8 centímetros?
b. ¿Qué porcentaje de las donas tienen hueco
36. Cierta clase de lagartijas viven en promedio con diámetro entre 1.91 y 2.24 centímetros?
40 meses. Si sus tiempos de vida se c. ¿Qué porcentaje de las donas tienen hueco
distribuyen normalmente y tienen una con diámetro menor de 1.95 centímetros?
desviación estándar de 6.3 meses, determina
la probabilidad de que una lagartija viva: 40. Los radios internos de los balones que
a. Más de 32 meses. fabrica la “Estrella S. A.” se distribuyen
b. Menos de 28 meses. normalmente con un valor promedio de 15
c. Entre 37 y 49 meses. centímetros y desviación estándar de 0.03
centímetros.
37. Los virotes distribuidos por “Bizcochos S. a. ¿Qué proporción de ellos tienen un radio
A.” tienen una longitud promedio de 30 interno superior a los 15.75 centímetros?
centímetros, una desviación estándar de 2 b. ¿Cuál es la probabilidad de que un balón
centímetros. Supón que las longitudes están fabricado tenga radio interno comprendido
normalmente distribuidas. entre 14.97 y 10.03 centímetros?
a. ¿Qué porcentaje de los virotes miden más c. ¿Debajo de qué longitud de radio interno
de 31.7 centímetros de longitud? está el 15% de los balones?
b. ¿Qué porcentaje de los virotes miden entre
29.5 y 33.5 centímetros de longitud? 41. Las estaturas de 1000 granaderos está
c. ¿Qué porcentaje de los virotes miden menos de normalmente distribuida con un valor promedio
25.5 centímetros? de 174 .5 centímetros y desviación estándar de
6.9 centímetros. Si las alturas se registran
38. Los virotes distribuidos por “Bizcochos S.
cerrando los valores a los medios centímetros:
A.” tienen un grosor promedio de 8
a. ¿Cuántos granaderos tendrán estaturas
centímetros y una desviación estándar de 0.8
menores que 160 centímetros?
centímetros y están normalmente distribuidos.
b. ¿Cuántos granaderos tendrían estaturas
a. ¿Qué porcentaje de los virotes tienen un
entre 171 .5 y 182 centímetros inclusive?
grosor mayor a 7.7 centímetros?
c. ¿Cuántos granaderos tendrán estaturas de
b. ¿Qué porcentaje de los virotes tienen un
175 centímetros o menos?
grosor entre 0.72 y 8.04 centímetros?
d. ¿Cuántos granaderos tendrán estaturas
c. ¿Qué porcentaje de los virotes tienen un
mayores que o iguales a 188 centímetros?
grosor menor de 8.09 centímetros?
74 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

42. Los pesos de los perros Coker Spaniel con a. Si el fabricante de “Sunbeam” sólo desea
un año se distribuyen normalmente, con media reponer 1% de las licuadoras cuya vida útil es
de 8 kilogramos y desviación estándar de 0.9 menor al periodo promedio. ¿Qué tiempo de
kilogramos. Si se registran las mediciones y se garantía debe ofrecer?
cierran a décimas de kilogramos, determine la b. Si el fabricante de “Sunbeam” sólo desea
proporción de perros con peso: reponer 5% de las licuadoras cuya vida útil es
a. Superior a 9.5 kilogramos. menor al periodo promedio. ¿Qué tiempo de
b. Menor a 8.6 kilogramos. garantía debe ofrecer?
c. Entre 7.3 y 9.1 kilogramos inclusive.
46. “Bremen S. A.” envasa bombones en
43. La precipitación pluvial media (registrada bolsas de plástico, los pesos netos siguen una
en centésimas de milímetro) en Valle de Bravo, distribución normal con desviación estándar de
en el mes de agosto fue de 9.22 centímetros. 1.4 gramos. Si el 4 % de las bolsas con
Suponiendo una distribución normal con bombones pesan más de 350 gramos,
desviación estándar 2.83 centímetros, determina el peso promedio de las bolsas de
determine la probabilidad de que, en el próximo bombones.
mes de agosto, Valle de Bravo, tenga una
precipitación pluvial de: 47. “Bremen S. A.” envasa las gomitas en
a. Menos de 1.84 centímetros. bolsas de plástico, los pesos netos siguen una
b. Más de 5 centímetros, pero menos de 7 distribución normal, con valor promedio de
centímetros. 500 gramos.
c. Más de 13.8 centímetros. a. Si el 6% de las bolsas con gomitas pesan
más de 504 gramos, calcula la desviación
44. El tiempo que tarda Mamerto en estándar.
transportarse de su casa a su trabajo se b. Si el 2% de las bolsas con gomitas pesan
distribuye normalmente con valor medio de 40 más de 502 gramos, determina la desviación
minutos y desviación estándar de 4 minutos. estándar.
a. ¿A qué hora debe de salir de su casa para
tener una probabilidad del 95% de estar en su 48. Las barras de metal utilizadas en la
trabajo antes de las 8 horas? construcción de las perreras del antirrábico “El
b. ¿A qué hora debe de salir para tener una Perrón”, son cortadas de forma automática por
probabilidad del 99% de estar en su trabajo una máquina con longitud nominal de 60
antes de las 8 de la mañana? centímetros. Las longitudes reales se
distribuyen normalmente con valor medio de
45. El tiempo de vida de las licuadoras 60 centímetros y desviación estándar 0.6
“Sunbeam” se distribuye normalmente con centímetros.
media de cinco años y desviación estándar de a. ¿Qué proporción de las barras rebasan los
un año. límites de tolerancia que son de 59 a 61
centímetros?
Sección 1.2 Distribución binomial y distribución normal 75

b. ¿A qué valor debe ajustarse la desviación 51. El peso de la harina contenida en las cajas
estándar si el 98% de las barras debe estar de “Trigal” sigue una distribución normal con
dentro de los límites de tolerancia? un valor promedio de 600 gramos. La
máquina que efectúa el proceso de llenado, de
49. La distribución de los pesos de las cajas las cajas de “Trigal”, está diseñada para que
con aguacates del Sr. Plancarte es normal con vierta entre 590 y 610 gramos harina con una
un valor promedio de 10 kilogramos y probabilidad de 0.90 . ¿Cuál es el valor
desviación estándar 1 kilogramo. El servicio de máximo de la desviación estándar para
fletes desea establecer un valor de peso p 0 , a alcanzar tal necesidad?
partir del qué hará un cargo de tres pesos al Sr.
Plancarte. 52. La resistencia de las cajas en las que se
a. ¿Cuál es el valor del peso p 0 de manera envasa la mantequilla “Chipilo” se distribuye
que el 99% de las cajas de aguacates del Sr. normalmente. Si el 10% de las cajas tienen
Plancarte pesen un kilogramo menos del peso una resistencia que excede los 10.216
con cargo extra? kilogramos y el 5% tiene una resistencia
b. ¿Cuál es el valor del peso p 0 de forma que menor de 9.671 kilogramos. ¿Cuál es el valor
el 99% de las cajas con aguacates del Sr. promedio y cuál es la desviación estándar de
la distribución de la resistencia de las cajas?
Plancarte lo excedan en un kilogramo o más?

53. El peso de los mangos “paraíso” que


50. La puntuación promedio de los artilleros del
exporta “Frutitas S.A.” se distribuye
Ejército Mexicano es 500 y la desviación
normalmente. Si el 40% de los mangos
estándar 75 . Las puntuaciones se distribuyen
“paraíso” tiene un peso que excede los 250
en forma normal.
gramos y 5% tiene un peso menor a 200
a. ¿Qué porcentaje de artilleros tendrán
puntuaciones menores a 320 ? gramos, ¿cuál es el valor promedio y cuál es la
desviación estándar de los pesos de los
b. ¿Cuál es la puntuación mínima que tendrá el
20 % de los artilleros?
mangos “paraíso”?
c. ¿Cuál es la puntuación máxima que tendrá
el 10% de los artilleros?
76 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

1.3 RESUMEN Y
AUTOEVALUACIÓN
Sección 1.3 Resumen y autoevaluación 77

 ACTIVIDADES

SECCIÓN 1.1 Si la suma de los puntos de las caras es


mayor que 7 se ganan 20 pesos.
ACTIVIDAD 1 Si la suma de los puntos de las caras es igual
Observe el último dígito de 20 placas de a 7 se pierden 5 pesos.
automóviles que se encuentran en el Defina la variable aleatoria X “ganancia”.
estacionamiento del plantel en que estudia. Calcule E  X  y V  X  e interprételas.
Sea la variable aleatoria X  ”dígito en que
termina el número de la placa”. ACTIVIDAD 5
a. Construya la distribución de probabilidad La variable aleatoria Y es uniforme discreta
de X . 1
si su fdp es f Y  yi   para
b. Trace la gráfica de la fdp de X . n
c. Determine la FDA y trace su gráfica. i  1, 2, 3, 4 .
d. Calcule E  X  y V  X  e interprételas. a. Construya la FDA y trace su gráfica.
b. Calcule E  X  y V  X  e interprételas.
ACTIVIDAD 2
c. Compare E  X  y V  X  con x y s 2 ,
Un juego que consiste en lanzar 200 veces
¿Qué similitudes identificas? ¿Qué
un dado y observar el número de la cara que
diferencias observas?
queda hacia arriba.
a. Construya la distribución de probabilidades
para X . SECCIÓN 1.2
b. ¿Está bien balanceado el dado? Explique. ACTIVIDAD 1
Calcula la proporción de mujeres en el curso
ACTIVIDAD 3 de Estadística.
Sea la variable aleatoria Z  “número de a. Construya la distribución de probabilidades
mujeres entre las próximas cuatro personas para X .
que observa”, construya la fdp b. Calcule el valor esperado y la desviación
estándar, interprételas.
correspondiente (suponga que la probabilidad
ACTIVIDAD 2
de que la próxima persona que se observe
Establezca la regla empírica para la
sea mujer es 0.5 ).
distribución normal.
ACTIVIDAD 3
ACTIVIDAD 4
Verifique el teorema de Chebyshev para
Un juego consiste en lanzar dos dados y
K 2, K 3 y K 4 .
sumar los puntos que aparecen en las caras.
Si la suma de los puntos de las caras es
menor que 7 se pierden 20 pesos.
78 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

RESUMEN

SECCIÓN 1.1

Variable aleatoria. Transforma un evento de S en un número real x o en un


intervalo de números reales. Cuantifica un evento
Variable aleatoria discreta. Transforma un espacio muestral S en conjunto finito (o
infinito numerable) de números reales.
Variable aleatoria continua. Asocia a los eventos de un espacio muestral S un
intervalo de números reales.
Recorrido (rango) de una variable Todos los valores que asume.
aleatoria discreta ( VAD ).
Función de distribución de Función (puede presentarse en forma tabular) que
probabilidad. relaciona los valores asumidos por una variable aleatoria
con sus probabilidades asociadas.
Propiedades de una Función de No negativa.
distribución de probabilidad. Imágenes menores a uno.
Suma de imágenes igual a uno.
Función de probabilidad Función que proporciona la suma de las probabilidades
acumulada. hasta un número (inclusive) específico.
F  x0   p  X  x0    f x
x  x0
X

Propiedades de la Función de a. 0  F  xi   1 .
probabilidad acumulada (caso b. p  X  xi   F  xi 1 
discreto). c. p  X  xi   1  F  xi  .
d. p  X  xi   1  F  xi 1  .
e. p  X  xi   F  xi   F  xi 1  .
f. p  a  X  b   F  b   F  a  .
g. No negativa y no decreciente
h. Valor mínimo cero y valor máximo 1.
Propiedades de la Función de a. 0  F  x   1.
probabilidad acumulada (caso b. F  x0   p  X  x0   p  X  x0 
continuo). c. p  X  x0   1  F  x0  .
d. p  X  x0   1  F  x0  .
e. p  X  x0   0 .
f. p  a  X  b   F  b   F  a  .
Valor esperado o esperanza de E  X   x1  f X
 x1   x2  f X  x2     xn  f X  xn 
una VAD X .   xi  f  xi 
 xi

Propiedades del valor esperado a. E  c   c .


de una VAD X . b. E  cX   c  E  X  .
c. E  X  Y   E  X   E  Y  .
Sección 1.3 Resumen y autoevaluación 79

Varianza de una VAD X . Medida de la dispersión o variabilidad de una variable


aleatoria. Se conoce también como promedio de las
dispersiones cuadráticas de una variable aleatoria.
 
V  X   E  X  E  X      x i  E  X   f X  xi  .
2 2

xi

Desviación estándar de una VAD Raíz cuadrada positiva de la varianza


X. D.E  X    V  X  .
Propiedades de la varianza de a. V  c   c .
una VAD X . b. V  cX   c 2  V  X  .
c. V  X  Y   V  X   V  Y  si X , Y son variables
aleatorias independientes.

d. V  X   E X 2  E 2  X  . 
SECCIÓN 1.2
Ensayo Bernoulli. Experimento aleatorio con espacio muestral S   E , F  ,
el evento “ E ” se denomina éxito y el evento “ F ” se llama
fracaso. La probabilidad de éxito se representa por
P  E  p y la probabilidad de fracaso por
P  F  1  p  q .
Variable aleatoria binomial. X “Número de éxitos en n ensayos independientes”.
Experimento binomial. Es una secuencia de n ensayos idénticos ( n se fija antes
de realizar el experimento). Los experimentos son
independientes y la probabilidad de éxito es constante de un
ensayo a otro.
fdp binomial. Probabilidad de obtener x éxitos en n ensayos
independientes si la probabilidad de un éxito es p .
b  x, n, p   p x q n x , si X  0, 1, 2,  , n .
n
C x

FDA binomial. Probabilidad acumulada correspondiente hasta


X  0, 1, 2, ... x éxitos en n ensayos independientes, con
probabilidad de un éxito es p .
x
B  x, n, p   C p k q nk .
n
k
k 0
Relación entre la FDA b  x, n, p   B  x, n, p   B  x  1, n, p  .
binomial y la fdp binomial.
Parámetros de VAD a. E  X   n p .
Binomial. b. V  X   n p q .
c. DE  X   n p q .
fdp normal. 1  x 
2
1   
f  x ; ,    e 2  
, siempre que
 2
80 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

      ,   0 y    X   .
FDA Normal. 1  t  
2
1
x   
F  x    x    e 2  
dt .

 2
Notación 
X  N  , 2 . 
Parámetros de la VAC E  X   y V  X  2.
Normal.
Gráfico de la fdp normal f(x)
(curva Gaussiana o
campana de Gauss).

0 X
Propiedad de simetría f(x)
fX    x  fX    x  .

f (x-) f (x+ )

0 x-  x+  X
x=
Variable aleatoria normal X 
Z .
estándar. 
fdp de la variable aleatoria 1  2 z2
1
f  z ; 0, 1   e .
normal estándar. 2
Parámetros de VAC normal E  X    0 y V  X   2 1.
estándar.
Notación y lectura  
X  N  ,  2 , “la variable aleatoria continua X se
distribuye normalmente con valor medio   1 y varianza
 2  1 ”.
Sección 1.3 Resumen y autoevaluación 81

USO DE LAS TECNOLOGÍAS

CÁLCULO DE PROBABILIDADES BINOMIALES CON LA APLICACIÓN


“CALCULADORAS ONLINE”

EJEMPLO 4 BIS (OBTENCIÓN DE PROBABILIDADES BINOMIALES CON APPS)


Para la VAD X  “número de éxitos en 4 ensayos independientes”, con probabilidad de éxito
p  0.3 . Se tiene que n  4 y p  0.30 , entonces q  0.70 y fdp
b  x , 4 , 0.30   C  0.30   0.70 
4 4 x
x
x
, si X  0, 1, 2, 3, 4 .
x
Por otra parte, la FPA es B  x , 4 , 0.30   C k p k q 4k , si X  0, 1, 2, 3, 4 .
4

k 0

a. Utilizaremos la aplicación calculadora on-line con liga


[Link]
que permite calcular tanto probabilidades puntuales como probabilidades acumuladas de
una distribución binomial. Una vez que has ingresado al sitio antes señalado observarás en la
pantalla de tu dispositivo electrónico

Para calcular la probabilidad deseada debes ingresar el número de ensayos N realizados para
un evento, la probabilidad de éxito p de dicho evento, la fila que corresponda al evento deseado dar
click en la pestaña calcular.
Por ejemplo:
En el cálculo de probabilidades binomiales puntuales se utiliza la opción.

En el cálculo de probabilidades acumuladas hasta un número específico se utiliza la opción.

i. En el cálculo de b  0 , 4, 0.30  utilizamos la opción

Se observa en la pantalla
82 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

ii. Para calcular b  1 , 4, 0.30  utilizamos la opción

Se observa en la pantalla

iii. Para calcular b  2, 4, 0.30  utilizamos la opción

Se observa en la pantalla

iv. Para calcular b  3 , 4, 0.30  utilizamos la opción

Se observa en la pantalla
Sección 1.3 Resumen y autoevaluación 83

v. Para calcular b  4 , 4, 0.30  utilizamos la opción

Se observa en la pantalla

vi. En el cálculo de la probabilidad B  2 , 4 , 0.30  utilizamos la opción

vii. Para calcular B  3 , 4 , 0.30  utilizamos la opción

CÁLCULO DE PROBABILIDADES BINOMIALES CON LA APLICACIÓN


“MATHCRACKER”

EJEMPLO 4 TRIS (OBTENCIÓN DE PROBABILIDADES BINOMIALES CON APP)


Utilizaremos la aplicación calculadora on-line con liga
[Link]
Ingresando al enlace anterior se despliega
84 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

CALCULADORA DE PROBABILIDAD BINOMIAL


Instrucciones: Utilice nuestra Calculadora de probabilidad binomial para calcular probabilidades
binomiales utilizando el formulario a continuación. Escriba la proporción de población de éxito p, y el
tamaño de la muestra n, y proporcione detalles sobre el evento para el que desea calcular la
probabilidad (observe que los números que definen los eventos deben ser enteros):
Proporción de la población (p)=

Tamaño de muestra (n)=

Two-Tailed:

Left-Tailed:

Right-Tailed:

Calcular

i. Para calcular la Solution:

probabilidad binomial Necesitamos calcular una probabilidad de distribución binomial. Se proporciona la siguiente

puntual b  2, 4, 0.30 
información

Probabilidad de éxito de la población (p)= 0.3

completamos los campos Tamaño de muestra (n)= 4

requeridos y al digitalizar Evento de probabilidad = Pr( X = 3 )

la “pestaña” calcular, Esto implica que

observamos 4
Pr X  2   0 .32  0. 7 4  2  0.2646
2

Lo que significa que la probabilidad que estamos buscando es Pr  X  2   0 .2646

START OVER

ii. En el cálculo de la probabilidad binomial puntual b  3, 4, 0.30  completamos los campos


solicitados y oprimimos la “pestaña” calcular, obtenemos
Solution:

Necesitamos calcular una probabilidad de distribución binomial. Se proporciona la siguiente


información

Probabilidad de éxito de la población (p)= 0.3

Tamaño de muestra (n)= 4

Evento de probabilidad = Pr( X = 3 )

Esto implica que

4
Pr  X  3    0 .33  0.7 4  3  0 .0756
3

Lo que significa que la probabilidad que estamos buscando es Pr  X  3   0. 0756

START OVER
Sección 1.3 Resumen y autoevaluación 85

b  3, 4, 0.30   0.0756.
iii. En la determinación de la probabilidad binomial acumulada B  1 , 4 , 0.30  completamos los
campos solicitados y al oprimir la “pestaña” calcular, observamos

Solution:

Necesitamos calcular una probabilidad de distribución binomial. Se proporciona la siguiente


información

Probabilidad de éxito de la población (p)= 0.3

Tamaño de muestra (n)= 4

Evento de probabilidad = Pr( X  1 )

Por lo tanto, lo obtenemos


1 1
 n
Pr X  1   Pr  X  i    i  p 1  p  i n i

i 0 i 0
Esto implica que

Pr X  1   Pr  X  0  Pr  X  1 

4 0 4 0  4 1 4 1
   0.3  0. 7    0.3  0.7
0 1
 0 .2401  . 4116  0. 6517

Lo que significa que la probabilidad que estamos buscando es Pr X  2   0 .6117


START OVER

Luego B  1 , 4 , 0.30   0.6117 .

iv. En la obtención de la probabilidad binomial acumulada B  2 , 4 , 0.30  completamos los


campos solicitados y al oprimir la “pestaña” calcular obtenemos

Solution:

Necesitamos calcular una probabilidad de distribución binomial. Se proporciona la siguiente


información

Probabilidad de éxito de la población (p)= 0.3

Tamaño de muestra (n)= 4

Evento de probabilidad = Pr( X  2 )

Por lo tanto, lo obtenemos


2 2
n
Pr X  2    Pr  X  i     i  p 1  p 
i n i

i 0 i 0
Esto implica que

Pr X  2  Pr  X  0  Pr  X  1  Pr  X  2 
 4  4  4
  0 .3 0  0 .7 4 0   0 .31  0 .7 41   0 .3 2  0 .7 4  2
0
  1
   2
 0.2401 .4116  0. 2646  0.9163

Lo que significa que la probabilidad que estamos buscando es Pr X  2  0. 9163

START OVER

Entonces B  2 , 4 , 0.30   0.9163.


86 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

CÁLCULO DE PROBABILIDADES BINOMIALES CON APP PARA


MOVIL (CELULAR)

EJEMPLO 5 BIS (PROBABILIDADES BINOMIALES UTILIZANDO UNA APP PARA CELULAR)


Ahora utilizaremos la aplicación para teléfono celular: Probability Distributions, PhD. Bognar,
Matthew. Departament of Statistics and Actuarial Science. University of Iowa, 2017, en el cálculo de
las probabilidades binomiales solicitadas en el ejemplo 5 de la página 46.

a. Para determinar la b. Para determinar la c. Para calcular


probabilidad binomial probabilidad binomial b  5 , 19 , 0.75  completamos
acumulada B  7 , 19 , 0.45  , acumulada B  8 , 10 , 0.95  , los espacios que señala la
sólo es necesario rellenar rellenamos los espacios aplicación, observamos
adecuadamente los espacios pedidos, observamos
que corresponden.

por tanto, Así obtenemos


luego,
B  7 , 19 , 0.45   0.31693. b  5 , 19 , 0.75   0.00001
B  8 , 10 , 0.95   0.08614.

CÁLCULO DE PROBABILIDADES CON LA APLICACIÓN “CALCULADORA DE LA


DISTRIBUCIÓN NORMAL”

Utilizaremos la aplicación calculadora on-line de nombre “calculadora de la distribución normal” con


enlace en la WEB
Sección 1.3 Resumen y autoevaluación 87

[Link]
Ingresando el enlace anterior se despliega y ejecutando observamos en la pantalla del dispositivo
electrónico

CALCULADORA DE LA DISTRIBUCIÓN NORMAL

MED DESVT

Elige el tipo de z-valor


que quierescalcular

menú barrido izquierda

probabilidad

?
?
Cálculo directo Cálculo inverso

EJEMPLO 12 BIS (USO DE APP EN EL CÁLCULO DE PROBABILIDADES NORMALES)


a. En el cálculo de p  Z  1.20  , completamos b. Para calcular p  Z  1.60  , completamos
espacios, los espacios solicitados,

MEDIA 0 DESV.TÍPICA 1

Elige que tipo de probabilidad


que quieres calcular

menor Valor a calcular 1.2

?
?
Cálculo directo Cálculo inverso

entonces p  Z  1.20   0.8849. p  Z  1.60      1.60   0.0548.


88 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

c. Para calcular p  0  Z  1.20  , d. Para calcular p   0.90  Z  0  ,


completamos espacios y observamos. completamos los espacios correspondientes.

Entonces Entonces
p  0  Z  1.20   0.3849 p   0.90  Z  0   0.3159.

e. Para el cálculo de p  0.30  Z  1.56  , f. Para calcular p   0.20  Z  0.20  ,


completamos espacios, observamos rellenamos espacios y se despliega la pantalla,

entonces entonces
p  0.30  Z  1.56   0.3227 . p   0.20  Z  0.20   D  0.20   0.1585 .
Sección 1.3 Resumen y autoevaluación 89

g. En el cálculo de p  Z  0.20  h. En el cálculo de p  Z  2.30  ,


completamos espacios, se despliega la pantalla completamos espacios, observamos

luego entonces
p  Z  0.20     0.20   0.5793. p  Z  2.30   0.0107 .

CÁLCULO DE PROBABILIDADES NORMALES CON APLICACIONES PARA


MOVIL (CELULAR)

EJEMPLO 12 tris (PROBABILIDADES BINOMIALES CON UNA APP PARA CELULAR)


En la resolución de este ejemplo utilizaremos la APP para celular

Se descarga desde Play Store. Sea que Z  N  0 , 1  . Sólo hay que llenar los espacios
2

requeridos con los datos de interés.


90 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

a. Para determinar p  Z  1.20  , en la APP b. Para calcular p  Z  1.60  , en la APP


observamos observamos

por tanto,
entonces p  Z  1.20   0.8849. p  Z  1.60      1.60   0.0548.

c. Para calcular p  0  Z  1.20  , en la APP d. En el cálculo de p   0.90  Z  0  , en


notemos la APP observamos

Por tanto, Por tanto,


p  0  Z  1.20   0.38493. p   0.90  Z  0   0.31594.
Sección 1.3 Resumen y autoevaluación 91

e. Para determinar p  0.30  Z  1.56  , en la f. Para calcular p   0.20  Z  0.20  , en


APP observamos la APP observamos

por tanto,
entonces p  0.30  Z  1.56   0.32271. p   0.20  Z  0.20   0.15852.

g. En el cálculo de p  Z  0.20  , h. Para calcular p  Z  2.30  , en la APP


escribimos en la APP escribimos

observamos
Por tanto,
p  Z  2.30   0.01072.
p  0  Z  1.20   0.57926.
92 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

CÁLCULO DE CUANTILES NORMALES CON LA APLICACIÓN “CALCULADORA


DE LA DISTRIBUCIÓN NORMAL”

EJEMPLO 13 BIS (CÁLCULO DE CUANTILES AL 100% DE LA NORMAL UTILIZANDO APP)

a. Si p  Z  z 0   0.30 , b. Si p  Z  z0   0.875 ,

MED 0 DESVT 1

Elige el tipo de z-valor


que quieres calcular

menú barrido izquierda

probabilidad 0.525

?
?
Cálculo directo Cálculo inverso

entonces entonces
z30  0.5244. z87.5  1.1503.

EJEMPLO 14 BIS (CÁLCULO DE CUANTILES z 0 )


a. En el cálculo del cuantil p  Z  z0   0.525, b. En el cálculo del cuantil p  Z  z 0   0.11 ,
rellenamos espacios, observamos rellenamos espacios, obtenemos

por consiguiente por consiguiente


z0  0.063 . z 0  1.227 .
Sección 1.3 Resumen y autoevaluación 93

c. Para calcular el cuantil que corresponde a d. En el cálculo del cuantil que corresponde a
p   z0  Z  z0   0.45 , rellenamos espacios p   z0  Z  z0   0.90 , completamos
y observamos espacios y se despliega la pantalla

por tanto, en consecuencia


z0  0.598 . z0  1.645 .
94 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

 AUTOEVALUACIÓN

COMPLETA LOS ESPACIOS


SELECCIONA LAS PALABRAS FALTANTES DEL BLOQUE INFERIOR

1. Una ________________________es una característica de un problema (u objeto) que asume un


conjunto de valores.
2. Las ____________________________________ se caracterizan porque los valores que asumen
dependen del azar.
3. Una variable aleatoria discreta tiene como recorrido ___________________________________.
4. La expresión X  A  x indica que la variable aleatoria X
____________________________________________.
5. La probabilidad de que la variable aleatoria X asuma el valor xi se representa por
_________________________.
6. Las funciones que caracterizan el comportamiento de una variable aleatoria son:
________________________________________________________________________________.
7. Las dos características básicas de una fdp son: ____________________________________ y
que su suma es uno.
8. La FDA asociada a una VAD X , se construye _______________ las probabilidades
proporcionadas por la función de probabilidades f X  x  hasta un valor específico X  x0 .
9. Los ______________________________ de la VAD X proporciona información concisa e
inmediata sobre ella.
10. Los______________________________________ de la VAD X se calculan a partir de la fdp .
11. El valor esperado de una variable aleatoria es el ___________________________ a largo plazo.
12. El valor esperado de una variable aleatoria corresponde al __________________de la
distribución de probabilidades.
13. La varianza es el parámetro que mide la __________________________ de una variable
aleatoria X .
14. La variable aleatoria discreta:
X  “____________________________________________________ independientes”, se
denomina variable aleatoria binomial.
15. Una ______________________________________________tiene como recorrido un intervalo
de números reales.
16. Las variables aleatorias continuas asumen probabilidad________________________ para un
valor específico dado.
17. La _____________________________de una VAC con fdp f X  x  , se calcula a partir de
una “suma de áreas”.
Sección 1.3 Resumen y autoevaluación 95

18. Los _________________________ de la función de probabilidad normal, son su valor esperado


y su varianza.
19. El valor esperado de una variable aleatoria normal representa, en el plano cartesiano,
_____________________ de la distribución de probabilidades.
20. La varianza de una variable aleatoria normal representa el grado de _____________________
de la curva Gaussiana.
21. Una distribución normal varianza menor a otra presenta mayor
__________________________________.

agudez. promedio. variables aleatorias. altura. asigna al evento A el número real


x . cero. La función de distribución de probabilidades y la función de
distribución acumulada. “número de éxitos en n ensayos independientes”.
sumando. parámetros. valor que asumirá. conjunto finito de números.
dispersión. variable aleatoria continua. ser no negativa. función de distribución
acumulada. centro. f X  xi  . parámetros. variable.
parámetros.

CIERTO O FALSO
(Selecciona la opción que consideres correcta)

C F 1. El tiempo que tarda una persona en hablar por teléfono es una VAD .
C F 2. El número de cachorros que tendrá una perra en su próximo parto es VAD
C F 3. El recorrido de una variable aleatoria discreta es una parte de números enteros.
C F 4. En una distribución de probabilidad la suma de ellas es uno.
C F 5. En un histograma de probabilidades la suma de las áreas de los rectángulos es uno.
C F 6. La curva asociada a una FDA es decreciente.
C F 7. El valor esperado de una variable aleatoria puede ser negativo.
C F 8. El valor esperado de una variable aleatoria es una probabilidad.
C F 9. El valor esperado de una variable aleatoria también se denomina media aritmética.
C F 10. Todas las variables aleatorias tienen varianza.
C F 11. La varianza de una variable aleatoria es positiva o cero.
C F 12. La varianza de una variable aleatoria es una medida de su “dispersión”.
C F 13. La desviación estándar de una variable aleatoria es un parámetro de una fdp .
C F 14. La desviación estándar de una variable aleatoria es positiva o cero.
C F 15. El recorrido de una variable aleatoria binomial es un número entero.
C F 16. La variable aleatoria “tiempo transcurrido entre dos éxitos” no es binomial.
C F 17. El valor esperado de una variable aleatoria binomial indica el número de éxitos que
se espera obtener una vez que el experimento se ha efectuado un sin fin de veces.
C F 18. En una variable aleatoria binomial p  1  q .
96 CAPÍTULO I MODELOS DE PROBABILIDAD Y SUS APLICACIONES

C F 19. En una distribución continua el área bajo la curva asociada a la función de


probabilidad y la probabilidad son equivalentes.
C F 20. La distribución normal corresponde a una VAC .
C F 21. En la distribución normal la esperanza es positiva.
C F 22. La gráfica de la fdp normal es simétrica respecto al eje de las ordenadas.
C F 23. La desviación estándar en una distribución normal es una medida de la agudeza de
su curva gaussiana.
C F 24. La distribución normal estándar tiene valor esperado cero.
C F 25. El área de la región limitada por la curva asociada a una distribución normal
estándar, el eje de las abscisas y el eje de las ordenadas es 0.5 .
C F 26. La probabilidad de un valor puntual de una variable aleatoria normal es cero.
C F 27. La variable aleatoria normal estándar se caracteriza por tener valor esperado cero y
varianza uno.
C F 28. El recorrido de una variable aleatoria normal es un conjunto de números positivos.
C F 29. La varianza de una variable aleatoria normal representa una medida de su posición
respecto al origen.
C F 30. La varianza de la VAC normal define la altura de una curva gaussiana.

PROBLEMAS PROPUESTOS
1. S la VAD X sigue la distribución: 2. Sea la FDA asociada a la VAD X :
X 3 1 1 3  0 X  5

fX x 0.25 0.25 0.25 0.25 
F x  
0.2  5  X  2
.
Determina:  0.6 2 X  2
a. La fdp y dibuje su gráfica.  1 X 2
b. La FDA y dibuje su gráfica. Determina:
c. La esperanza matemática. a. La distribución de probabilidades.
d. La varianza y la desviación estándar. b. La fdp .
e. p   2  X  1  . c. La esperanza matemática.
f. p   2  X  1  . d. La varianza y la desviación estándar.
g. p   2  X  1  . e. p   2  X  3  .
h. p  X  1  . f. p   2  X  2  .
i. p  X  1  . g. p   2  X  3  .
j. p  X  1  . h. p  X  2  .
k. p  X  1  . i. p  X  2  .
j. p  X  2  .
k. p  X  2  .
Sección 1.3 Resumen y autoevaluación 97

3. Sea X  b  x , 6 , 0.40  , determina: 4. Si X  N  100, 252 , determine:


a. El recorrido. a. p  115  X  135  .
b. La fdp y su gráfico. b. p  95  X  130  .
c. La FDA y su gráfico. c. p  X  180  .
d. La esperanza matemática.
d. p  X  105  .
e. La varianza y la desviación estándar.
f. La probabilidad de que ocurran menos de 5
5. Si X  N  100, 252 , determine x 0 :
éxitos.
g. La probabilidad de que ocurran al menos de a. p  X  x0   0.9893.
5 éxitos. b. p  X  x0   0.0359.
h. La probabilidad de que ocurran exactamente c. p   x0  X  x0   0.4971.
5 éxitos.
i. La probabilidad de que ocurran entre 3 y 5 6. Si X  N   , 3 2  , determine  .
éxitos (incluya ambos extremos). a. p  X  5   0.2946.
j. La probabilidad de que ocurran más de 5 b. p  X  10   0.1379.
éxitos.
k. La probabilidad de que ocurran por lo menos 7. Si X  N  4 ,  2  , determine  .
3 éxitos.
a. p  X  6.3   0.1977 .
b. p  X  3.2   0.9573.
2.
ESTIMADORES E INTRODUCCIÓN
A LA INFERENCIA ESTADÍSTICA

PROPÓSITO
Al finalizar la unidad el alumno:
Analizará el comportamiento de los estimadores media y proporción, a
través del modelo Normal, para construir un vínculo entre la
probabilidad y la inferencia estadística

CONTENIDO
2.1 POBLACIÓN y MUESTRA
2.2 PARÁMETRO y ESTADÍSTICO
Sección 2.1 Población y muestra 99

2.1 POBLACIÓN
Y MUESTRA

¿Qué debe aprender?


1. Establece hipótesis o conjeturas del comportamiento de una variable en
una población a partir de los datos de una muestra, de manera informal,
en el contexto de una investigación o un problema.
2. Valora la importancia del azar en los procesos de muestreo.
3. Valora a los estimadores como variables aleatorias y como indicadores
del posibles puntual de sus correspondientes parámetros.

¿Por qué debe aprenderlo?


Para tener claro el proceso de construcción de una distribución muestral
es necesario haber comprendido los conceptos de: población, muestra
en el contexto de la inferencia estadística.
Las distribuciones muestrales son los mecanismos con los que se
efectúan inferencias estadísticas sobre los parámetros de interés. Las
poblaciones se caracterizan por los valores de sus parámetros, que
se estiman o infieren utilizando estadísticas adecuadas.

Temática
Población y muestra: Muestreo aleatorio simple con y sin reemplazo.
Parámetros y estadísticos: Variabilidad muestral.
100 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

¿CÓMO SE CLASIFICA LA ESTADÍSTICA?


El primer curso de estadística (estadística descriptiva) destaca como propósito la descripción
numérica y gráfica de grupos de datos sin tener en cuenta la forma en que se obtuvieron y, por tanto,
las conclusiones y afirmaciones que se obtengan de ellos sólo serán válidas para tal grupo de datos. A
diferencia de la estadística descriptiva, en la estadística inferencial (inferencia estadística) a partir de un
grupo “muy considerable” de datos la forma de selección de una parte de ellos se hace minuciosamente
y respetando ciertos principios previamente establecidos, es decir, es muy importante el proceso de
selección (que se denomina muestreo). La vinculación de la parte descriptiva de la estadística con la
PROBABILIDAD (bajo ciertos lineamientos que construiremos más adelante) da origen a la estadística
inferencial, misma que es objeto de estudio de la presente obra.

EJEMPLO 1 (VINCULACIÓN DE RAMAS DE LA ESTADÍSTICA)


Los tiempos de recorrido del circuito “Tacubaya – Tepalcates – Tacubaya” utilizados por 60 operadores
del “Metrobús” dieron origen a la distribución de frecuencias mostrada en la Tabla 1.

Límites reales Frecuencia


Lri Lrs fi

174 .5 179 .5 8

179 .5 184 .5 10

184 .5 189 .5 13

189 .5 194 .5 10

194 .5 199 .5 9

199 .5 204 .5 6

204 .5 209 .5 4
TABLA 1

Con base en la distribución de frecuencias mostrada en la tabla 1 podemos afirmar:


1. El promedio de recorrido del circuito “Tacubaya – Tepalcates – Tacubaya” es
190 minutos.
2. La desviación estándar en el recorrido del circuito “Tacubaya – Tepalcates – Tacubaya” es
8.765 minutos.
3. Incluso, sobre el histograma de probabilidades podemos trazar una curva suave que contenga los
puntos medios de las bases superiores y suponer que los tiempos se distribuyen en forma
aproximadamente normal.
Sección 2.1 Población y muestra 101

f fr

15 0.25

10 0.167

5 0.08

174.5 179.5 184.5 189.5 194.5 199.5 204.5 209.5 t

f fr

15 0.25

10 0.167

5 0.08

174.5 179.5 184.5 189.5 194.5 199.5 204.5 209.5 t

FIGURA 1

4. Sin embargo, las conjeturas anteriores, y que hicimos en forma categórica solo son “inferencias
informales” sobre el comportamiento de los tiempos de recorrido del circuito “Tacubaya – Tepalcates –
Tacubaya”, y de ninguna manera son válidas (solo son creencias) en el conjunto de todos los tiempos
de recorrido del circuito señalado.
5. Con toda certeza, si se selecciona (sin) otro grupo de tiempos de recorrido del circuito “Tacubaya –
Tepalcates – Tacubaya”, las conjeturas planteadas con base en ellos seguramente serían “muy
diferentes” considerando que la variable (tiempo de recorrido del…) está gobernada por
una combinación de circunstancias o de causas imprevisibles, complejas, sin plan previo y sin
propósito, que provocan que acontezca se obtenga una determinada medida que no está condicionada
por la relación de causa y efecto, ni por la intervención humana, es decir, parte de del tiempo medido se
debe a la casualidad, a lo fortuito o accidental, a lo involuntario, o sin una intención o un motivo
determinado o prefijado, a lo que no puede medirse u ocurre aleatoriamente.

La generación de conclusiones basadas en un grupo de datos tomados, sin cuidado alguno,


de otro grupo mayor sin duda alguna tendrá como resultados graves errores.

La “inferencia estadística” tiene como propósito analizar el comportamiento de características


(previamente seleccionadas) de conjuntos de objetos (muestras) para posteriormente (con fundamento
en la información contenida en ellas) inferir (o determinar) los rasgos fundamentales del total de datos
102 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

(población de estudio), por tanto, para comprender correctamente los procesos de la estadística
inferencial es necesario tener presentes y claros los conceptos de población, muestra y muestreo.

muestra se mide una datos


total de se toma característica
parte de x1 , x2 , ..., xn
objetos los objetos

se describe
ESTADÍSTICA DESCRIPTIVA
se realizan conclusiones respecto a al población
utilizando elementos probabilísticos

ESTADÍSTICA INFERENCIAL

FIGURA 2

DEFINICIÓN 1 (CARACTERISTICA O PROPIEDAD)


Una característica (o carácter) de un objeto (elemento o individuo) es una propiedad a partir de la que
es posible clasificarlo y estudiarlo.

Las características (propiedades) de los objetos se clasifican en:


i. Cualitativas, descriptivas o no medibles, cuando no admite ser medido o se distingue o compara
con otros a partir de uno o más atributos.
ii. Cuantitativas o medibles, si se pueden cuantificar asociándoles un número.
Los datos cualitativos son atributos, características o propiedades categóricas que identifican o
describen un aspecto de un objeto en lugar de medirlo y se relacionan con impresiones, opiniones y
perspectivas; describen diferencias de tipo o clase indicando la presencia o ausencia de cierta
característica. Los datos cuantitativos se relacionan con mediciones y se generan asignando un número
a una característica de un objeto, también pueden compararse entre ellos a partir de su magnitud
(longitud, peso, volumen, temperatura, etcétera.).

EJEMPLO 2 (CARACTERÍSTICAS)
Dada una población de ciudadanos:
a. Características cuantitativas (medibles) son: la estatura, el peso, la presión sanguínea, el coeficiente
intelectual, la envergadura, entre otras.
b. Características cualitativas (no medibles) son: el color de piel, el tono de voz, la belleza, entre otros.

Formalización:
Sección 2.1 Población y muestra 103

DEFINICIÓN 2 (VARIABLE, POBLACIÓN Y MUESTRA)


Sea  un objeto (elemento o individuo) de una población, entonces
a. X    representa la “característica de interés” del objeto  se denomina variable.
b. Si X     x , entonces x es la medida de la característica del objeto  .
c. Una población es el conjunto de todos los objetos (elementos o individuos) de los que se desea
estudiar una o más de sus características.
d. Una muestra es cualquier parte (o subconjunto) de la población.
e. Al número de objetos (elementos o individuos) se le llama tamaño de la muestra.

EJEMPLO 3 (POBLACIÓN ESTADÍSTICA Y MUESTRA ESTADÍSTICA)


a. El jefe de control de calidad de “La Continental” desea estudiar la proporción de neumáticos con
rodada defectuosa en su producción anual, entonces la población estadística está compuesta por todos
los neumáticos producidos por “La Continental” en el año, y son muestras:
i. Los neumáticos producidos por una máquina en los primeros 15 días de cierto mes.
ii. Si se fabrican los neumáticos uno tras otro, la muestra conformada por aquellos que tienen asignados
los números múltiplos de 100 .
iii. El grupo de los neumáticos producidas los martes antes de las 9 : 00 horas.
b. En el entorno de una institución educativa, digamos la UNAM que puede considerarse como
población al conjunto de todos los alumnos matriculados en ella, son muestras:
i. Los alumnos que miden más de 160 centímetros.
ii. Las alumnas que no adeudan materias.
iii. Los alumnos cuyo primer apellido comienza con la letra R .

En el proceso de estudio de una población, primero establece la característica de interés, misma


que se ve reflejada en todos los objetos de la población (y en consecuencia en todos los objetos de
todas las muestras) si la variable en estudio está gobernada por el azar evidentemente, el azar estará
presente en la toma de medidas de la característica de interés en cada objeto de la población y de la
muestra.
la variable de interés X se refleja en los objetos
al medir la característica de
de interés en cada objeto w i
muestra el azar se refleja en todos ellos

w1 , w2 , ..., w n Xi = X ( wi )
w1 , w2 , ...

¡cada X i es una variable aleatoria!

FIGURA 3
104 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

¿QUÉ ES UNA MUESTRA ALEATORIA SIMPLE?


Una muestra aleatoria simple, es un conjunto de variables aleatorias, independientes e
idénticamente distribuidas, que reflejan el comportamiento de la característica de la población en los
objetos seleccionados. Los conceptos señalados en el párrafo anterior definen una muestra aleatoria
simple. Una comprensión adecuadamente “muestra aleatoria simple” requiere de una revisión
exhaustiva de sus partes.
i. Se obtiene a partir de una variable aleatoria de interés presente en la población origen (característica
que es el objeto de estudio del investigador).
ii. Las medidas y los objetos que constituyen la constituye se han obtenido aleatoriamente y esto se
refleja en cada objeto.
iii. Aunado a lo anterior incluye el concepto de independencia entre los objetos de la muestra aleatoria
simple y, por tanto, no guardan relación entre ellos, es decir, el haber seleccionado a una de los objetos
no depende de los otros objetos seleccionados.
4. Por último, idénticamente distribuidas se refiere a que todas las variables aleatorias de la muestra
tienen la misma distribución de probabilidad.

Es común dar el mismo significado a muestra aleatoria simple y a muestra seleccionada


aleatoriamente, lo que es incorrecto.

DEFINICIÓN 3 (MUESTRA ALEATORIA SIMPLE (MAS))


Las variables aleatorias X 1 , X 2 ,  , X n , extraídas de la misma población estadística, componen una
muestra aleatoria simple de tamaño n si:
a. Son independientes entre sí.
b. Están idénticamente distribuidas, es decir, siguen una misma función de probabilidad.

En diversos textos de estadística las variables aleatorias X 1 , X 2 , , X n que constituyen una


muestra aleatoria simple se llama en forma simplificada idd , cuyo significado es variables aleatorias
independientes e idénticamente distribuidas. El lector debe tener presente la diferencia entre el grupo
de datos (números) x1 , x2 , , xn ¡ya están determinados!, de uso común en estadística descriptiva
puesto que sólo corresponden a una “asignación numérica” a las variables aleatorias X 1 , X 2 , , X n ,
y por tanto, nos referiremos a ellos como “realización” de la muestra aleatoria simple.

DEFINICIÓN 4 (REALIZACIÓN DE UNA MUESTRA ALEATORIA SIMPLE (MAS))


Sea X 1 , X 2 ,  , X n una MAS extraída de la misma población estadística, se llama realización de la
MAS (muestra aleatoria simple) a los números x1 , x2 , , xn , siempre que X 1  x1 , X 1  x 2 , etc.

La figura 4 ilustra el concepto de realización de una MAS.


Sección 2.1 Población y muestra 105

realización
MAS se mide una (medidas)
se toma característica
X1 , X 2 ,..., X n x1 , x2 , ..., xn

FIGURA 4

EJEMPLO 4 (REALIZACIÓNDE UNA MAS)


Si de un gran grupo de dados ordinarios (con sus caras numeradas del uno al seis) se extraen tres de
ellos, entonces:
a. La muestra aleatoria es X 1 , X 2 , X 3 .
b. Las ternas
 1, 4 , 2 ,  6, 2 , 2  ,  1 , 5 , 3 ,  3 , 1 , 5 ,
entre otras, son realizaciones de la MAS.

EJEMPLO 5 (REALIZACIÓN DE UNA MAS)


Si de un gran grupo de personas son seleccionados cinco de ellos y la característica de interés es su
estatura, entonces:
a. La muestra aleatoria simple es X 1 , X 2 , X 3 , X 4 , X 5 .
b. Los arreglos:
 1.661 , 1.648 , 1.646 , 1.662 , 1.650  ,  1.73 , 1.742 , 1.736 , 1.738 , 1.73  ,
 1.845 , 1.857 , 1.855 , 1.84 , 1.86  ,  1.690 , 1.68 , 1.685 , 1.692 , 1.690  y
 1.630 , 1.628 , 1.626 , 1.692 , 1.635  ,
son realizaciones de la MAS.

EJEMPLO 6 (REALIZACIÓN DE UNA MAS)


Si de un gran grupo de monedas ordinarias (sus caras marcadas, una de ellas con águila y la otra con
sol) son seleccionadas dos, posteriormente se lanzan y el carácter de interés es tomar nota de la cara
que se observa, entonces:
a. La muestra aleatoria simple es X 1 , X 2 .
b. Los pares ordenados  a , a  ,  a , s  ,  s , a  ,  s , s  , son realizaciones de la MAS.

Otro de los propósitos de la estadística inferencial es obtener información sobre los valores reales
o parámetros que tiene asociada una población, entre ellos se encuentran “los promedios”, las “medidas
de dispersión”, las proporciones, los totales, los porcentajes, etcétera.
106 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

¿QUÉ ES EL MUESTREO CON REEMPLAZAMIENTO?


En una población (estadística) los objetos que la componen tienen una (o más) característica en
común que es de interés para el investigador y en consecuencia desea conocer su valor real, por
ejemplo, si los objetos de la población son personas y la propiedad de interés es la estatura, esta puede
ser descrita a partir de sus medidas descriptivas, tales como la media real, la proporción real, el total, la
varianza poblacional, etcétera. Para su cálculo se requiere la obtención y el posterior análisis de ellas,
es decir, el nivel o grado bondad con que reflejan los valores reales. Imagine el gasto en recursos al
tener que medir una característica (estatura, peso, coeficiente intelectual, eficiencia, etc.) a todas las
personas de una ciudad o de un país, definitivamente esto resulta complicado y requiere de una gran
inversión en recursos (tiempo dinero, equipo, etcétera), por tanto, la elección de una muestra
representativa que refleje con la mayor precisión posible a un grupo más grande resulta muy adecuada
para el estudio de la característica de interés de la población. No se obtienen buenos resultados si, por
ejemplo, se toma la información de una muestra sin tomar en cuenta como fue obtenida y la bondad de
su representatividad, luego, es necesario conocer los elementos que contribuyen en una selección de
una muestra representativa.

DEFINICIÓN 5 (MUESTREO)
Proceso de selección y medición de la información en una parte de la población estadística.

Considerando que una muestra representativa es útil cuando no es posible medir la característica
de interés en todos los elementos de la población es adecuado señalar que existen dos métodos
básicos de selección de muestras de una población:
i. No aleatoria o de juicio, es práctica común seleccionar una muestra en forma intencional, de acuerdo
con opiniones o criterios personales, fundamentalmente con el objeto de obtener información sin mucho
costo. Este muestreo se conoce como muestreo no probabilístico, no aleatorio o de juicio y no involucra
aspectos aleatorios en el procedimiento de selección, es adecuado cuando solo se necesitan
estimaciones gruesas que no van a ser utilizadas para tomar decisiones importantes.
ii. Aleatoriamente, si en el proceso de selección de la muestra todos los objetos de la población tienen
la misma probabilidad de ser electos. Si de una población con N objetos se obtienen muestras
aleatorias de n de ellos, entonces cada objeto en cada muestra tiene la misma probabilidad de resultar
electo.

DEFINICIÓN 6 (MUESTREO CON REEMPLAZO Y MUESTREO SIN REEMPLAZO)


a. Si los objetos pertenecientes a una muestra (previamente extraída de una población) se observa y
se mide la característica de interés y posteriormente se regresan a la población de origen, para su
posible reelección, entonces el muestreo se efectúa con reemplazo.
b. Si al seleccionar de una muestra, los objetos que se extraen de la población se observan, se mide el
carácter de interés y no se regresan a ella, entonces el muestreo se efectuó sin reemplazo.
Sección 2.1 Población y muestra 107

MUESTREO CON REEMPLAZO MUESTREO SIN REEMPLAZO

carácter MUESTREO carácter MUESTREO

muestra muestra
datos estadística datos
estadística

REEMPLAZO

FIGURA 5

EJEMPLO 7 (MUESTREO CON REEMPLAZO Y MUESTREO SIN REEMPLAZO)


Suponga que una población está compuesta por los objetos a, b, c y d , entonces todas las muestras
de dos objetos que pueden obtenerse son:

a b c d

a aa ab ac ad

b ba bb bc bd

c ca ca cc cd

d da db dc dd

FIGURA 6

a. Si el muestreo importa el orden, se realiza con reemplazo y con repetición (los objetos pueden
repetirse), entonces todas las muestras de tamaño n  2 son
aa, ab, ac, ad, ba, bb, bc, bd, ca, cb, cc, cd, da, db, dc, dd
b. Si el muestreo importa el orden, se realiza con reemplazo y sin repetición (los objetos no pueden
repetirse), entonces todas las muestras de tamaño n  2 son
ab, ac, ad, ba, bc, bd, ca, cb, cd , da, db, dc
c. Si en el muestreo no importa el orden, se realiza sin reemplazo y sin repetición, entonces todas las
muestras de tamaño n  2 son
ab, ac, ad, bc, bd, cd .

Antes señalamos que una vez conocido el valor real de una característica de interés de una
población el estudio referente a ella ha concluido. Los valores reales de una población se llaman
parámetros.
108 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

¿QUÉ SON LOS NÚMEROS ALEATORIOS?


Para fines prácticos en la obtención de realizaciones de muestras aleatorias, existen diversos
métodos para seleccionarlas. En cualquier buscador (Google, Mozilla, entre otros) basta con teclear
“generador de números aleatorios” y se desplegará una lista con un número basto de generadores de
números aleatorios. También existen tablas de números aleatorios como la mostrada en el
apéndice A.3 , y de la que mostramos una de sus secciones.

FIGURA 7

El ejemplo 8 muestra uso de números aleatorios en la selección de realizaciones de una muestra


aleatoria.

EJEMPLO 8 (SELECCIÓN DE UNA MUESTRA UTILIZANDO NÚMEROS ALEATORIOS)


a. Si de un grupo que contiene N  1000 objetos se desea seleccionar una realización aleatoria de
tamaño n  8 :
i. Se etiquetan los objetos.
ii. Se selecciona al azar (digamos con los ojos cerrados) un número del “cuerpo” de la tabla de números
aleatorios, supongamos que hemos seleccionado el dígito que se encuentra en la fila 9 y la columna 3 ,
entonces la primera observación de la muestra puede ser la etiquetada como 567 .
iii. Para seleccionar los otros siete objetos debemos seleccionar otros 7 números de tres cifras, éstos
pueden ser los que se encuentran sobre esa línea, es decir, 025 , 968 , 434 , 487 , 453 , 490 y 858 .
Los datos pudieron escogerse de las columnas de la derecha, o de la izquierda o hacia arriba del punto
de inicio, entre otras formas. Si un número se repite simplemente no se considera y se toma el
siguiente.
b. Si de un grupo de 50 cartas etiquetadas de 1 a 50 se desea quiere seleccionar una realización de
muestra aleatoria de tamaño n  5 .
i. Primero etiquetamos las cartas, digamos c1 , c2 , ... , c50 .
ii. Seleccionamos aleatoriamente un dígito de la tabla de números aleatorios, si el número aleatorio
inicial seleccionado es el que se encuentra en la columna 2 y la fila 10 , es decir el seis.
iii. Por tanto, no se puede incluir la carta c62 en la muestra, si continuamos en la fila 10 observamos
que debemos incluir las cartas c16 , c09 , c04 , c 20 y c32 . Si en la selección de la muestra hubiese
Sección 2.1 Población y muestra 109

aparecido otro número mayor que 50 simplemente se omite y se selecciona otro.

¿CÓMO SE CARACTERIZA UNA POBLACIÓN ESTADÍSTICA?


Los números que sintetizan los aspectos más relevantes de una población (grupo de datos)
pueden obtenerse analizando toda la población o inferirse a partir de una parte representativa de ella y
reciben el nombre de parámetros.

DEFINICIÓN 5 (VALORES REALES O PARÁMETROS)


Son números que dependen de los valores de la población y que sintetizan sus aspectos más
relevantes.

Ejemplos de parámetros son: la media poblacional (real), la proporción poblacional (real), la


varianza poblacional (real), el total de una población (real), entre otros. En estadística inferencial, las
realizaciones de la MAS (cuyas variables aleatorias están definidas sobre la población) son
representativas de la población) lo que significa que reflejan las características y los valores reales de la
población de origen. Las variables aleatorias de una MAS se pueden combinar para dar origen a
relaciones o fórmulas que dependen de ellas; por ejemplo, si se toman como patrones las medidas
descriptivas muestrales, se obtienen variables aleatorias similares a estas medidas descriptivas.

DEFINICIÓN 6 (ESTADÍSTICA)
Se denomina estadística a cualquier función (o fórmula) obtenida a partir de la combinación de las
variables aleatorias de una MAS y que no contiene parámetros.

Si sumamos dos o más variables aleatorias obtenemos como resultado otra variable aleatoria, si
multiplicamos por un número (distinto de cero) a una variable aleatoria el resultado es una variable
aleatoria, si multiplicamos dos variables aleatorias obtendremos otra variable aleatoria.

MAS
estadística
se combinan
X1 , X 2 ,..., X n f ( X 1 , X2 , ..., X n )

FIGURA 8

En el desarrollo de la presente obra sólo trataremos las estadísticas: “media” y “proporción”, sin
embargo, debemos señalar que existen otras.
110 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

MAS
estadística
X1 , X 2 , ..., Xn f ( X1 , X2 , ..., Xn )
datos
x1 , x 2 , ..., x n
realización

FIGURA 9

Formalmente:

DEFINICIÓN 7 (MEDIA Y PROPORCIÓN)


Si X 1 , X 2 , , X n es una muestra aleatoria simple, entonces
 X1  X 2    X n 1 n
a. La variable aleatoria X 
n

n
X i 1
i se denomina media.

b. Si todas las variables aleatorias X 1 , X 2 ,  , X n asumen (su recorrido es) uno de los números del
X1  X 2    X n
conjunto  0 , 1 , entonces la variable aleatoria P se denomina proporción.
n

NOTA i. Tenga en cuenta la diferencia entre las variables aleatorias X 1 , X 2 ,  , X n que


constituyen la muestra aleatoria simple y su realización o conjunto de valores que asumen
x1 , x2 , , xn .

ii. La estadística X asume el valor x bajo la realización x1 , x2 , , xn de la MAS
X1 , X 2 , , X n .

iii. La estadística P adquiere el valor p cuando un número específico de las variables
aleatorias X 1 , X 2 , , X n asumen el valor 1 .
iv. En la práctica, al valor que asume una estadística también tiene el nombre de la
estadística.

EJEMPLO 9 (ESTADÍSTICAS)
a. Sea la muestra aleatoria simple X 1 , X 2 , X 3 , X 4 , correspondiente a cierto experimento.
La estadística
4
 X1  X 2  X 3  X 4 1
X 
n

n
X
i 1
i

varía de acuerdo con la realización de la muestra aleatoria simple X 1 , X 2 , X 3 , X 4 , por ejemplo:


i. Si 4 , 5 , 3 y 4 es una de sus realizaciones, entonces
Sección 2.1 Población y muestra 111

453 4
x1   4.
4
433 4
ii. Si 4 , 3 , 3 y 4 , es otra de sus realizaciones, entonces x1   3.5
4
b. En una consulta efectuada por cierto medio de comunicación se utilizó la MAS X 1 , X 2 ,  , X 2000 .
i. Si en una primera realización de X 1 , X 2 ,  , X 2000 se observó que 800 de ellos prefirieron la marca
A de cierto producto, entonces la estadística
X  X 2    X 2000
P 1 ( X  0 o 1)
n
asumió el valor
 800
p  0.40 .
2000
ii. Si en una segunda realización de X 1 , X 2 , , X 2000 se observó que 728 de ellos tienen preferencia
por la marca A del producto, entonces
 728
p  0.364 .
2000
112 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

PROBLEMAS PROPUESTOS

1. La muestra 3.8 , 4.5 , 3.2 , 7.1 , 2 .1 , 4.2 , Estima:


5 .3 , 1.1 , 4 .1 y 5 .8 fue extraída de cierta a. La verdadera proporción de todos los
proporción. “Estima informalmente”: estudiantes que portan celular Motorola.
a. La media y desviación estándar b. Si tres de los celulares APPLE eran i - 33
poblacionales. estime la proporción real de todos los
b. La proporción real de datos menores a 5 . estudiantes que portaban un celular i - 33.

2. La siguiente tabla de frecuencias representa 4. Obtén todas las muestras de tamaño 2 del
una muestra extraída cierta ciudad. conjunto S   2 , 4, 6, 8, 10  .

Estatura 5. Supón que cada una de las variables


Frecuencia
(centímetros) aleatoria X 1 , X 2 de la MAS sólo pueden
162 6 asumir los valores 0 y 2 .
164
a. Construye todas las realizaciones posibles.
14
b. Calcula la media aritmética de cada una de
166 20 las realizaciones.
170 18 c. Calcula la media aritmética del conjunto
formado por todas las medias aritméticas de
174 2
las realizaciones.

“Estima informalmente”: 6. En cada caso utilice números aleatorios y


a. La media y desviación estándar.
obtén una realización de tamaño n .
b. La proporción de estaturas superiores a los
a. N  100 y n  5 .
166 centímetros.
b. N  1000 y n  12 .
c. N  10000 y n  15 .
3. Una muestra de 20 estudiantes del primer
semestre de bachillerato proporcionó la
siguiente información, respecto a la marca del
celular que portaban (M = MOTOROLA, H =
HWAWEI, A = APPLE): M, M, H, H, H, A, A, M,
M, H, H, H, H, H, M, A, A, H, H, H.
2.2 PARÁMETROS Y
Y ESTADÍSTICOS

¿Qué debe aprender?


4. Inspecciona el comportamiento de la media y de la proporción muestrales
como variables aleatorias, obtenidas por medio de la simulación física y/o
computacional, dentro del contexto de un problema o investigación y en
términos de tendencia, distribución y dispersión.
5. Infiere que los estimadores media y proporción se distribuyen de manera
aproximadamente normal, al trabajar con muestras grandes.
6. Construye las distribuciones muestrales para la media y la proporción, bajo
las condiciones del Teorema del Límite Central y a partir de la expresión
para estandarizar la distribución normal.
7. Formula juicios acerca de la representatividad de una muestra, a partir de
la probabilidad para un valor de la media o de la proporción muestrales,
obtenidas por medio de la computadora o calculadora, dentro del
contexto de un problema o una investigación.
8. Establece hipótesis o conjeturas acerca del comportamiento de una variable
de una población. a partir de los datos de una muestra, de manera formal
en el contexto de una investigación o un problema.

¿Por qué debe aprenderlo?


Las distribuciones muestrales son los mecanismos a partir de los cuales se
efectúan inferencias estadísticas sobre los parámetros de interés. Las
poblaciones se caracterizan por los valores de sus parámetros, mismos
que suelen estimarse o inferirse utilizando estadísticas adecuadas.

Temática
Distribución muestral de medias. Distribución muestral de proporciones.
Teorema del Límite Central.
114 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

¿QUÉ ES UNA DISTRIBUCIÓN MUESTRAL?


La estimación e inferencia de los parámetros que describen a una población se efectúa a través de
la combinación de los datos de diversas realizaciones de una muestra aleatoria simple tomada de ella.
En particular, cuando el parámetro objetivo (el que se quiere determinar) es un promedio, la forma de
combinar las variables de la MAS (muestra aleatoria simple) es
n
X1 + X 2 +  + X n 1
X =
n
=
n
X i =1
i ,

siendo la realización de X 1 , X 2 , , X n el conjunto de números x1 , x 2 , , x n , y el estimador puntual


el resultado de la operación
x1 + x2 +  + xn
x= .
n
Dado X 1 , X 2 , , X n es una variable aleatoria, la combinación
X1 + X 2 +  + X n
X=
n
también lo es, y por tal razón tiene asociada una función de probabilidad, misma que se conoce como
distribución muestral.

DEFINICIÓN 1 (DISTRIBUCIÓN MUESTRAL)


La distribución de probabilidad de una estadística recibe el nombre de distribución muestral de la
estadística.

EJEMPLO 1 (DISTRIBUCIONES MUESTRALES)


a. La distribución de probabilidad de la estadística (variable aleatoria)
n
X1 + X 2 +  + X n 1
X=
n
=
n
X
i =1
i

se denomina “distribución muestral de la media”.


b. La distribución de probabilidad de la estadística
X
P=
n
se llama “distribución muestral de la proporción”.
c. La distribución de probabilidad de la estadística
n
T = X1 + X 2 +  + X n = X
i =1
i

se denomina “distribución muestral del total”.


d. La distribución de probabilidad de la estadística
n 2
1  −

S2 =
n
  Xi − X 
i =1  
se conoce como “distribución muestral de la varianza”.
Sección 2.2 Parámetro y estadístico 115

En particular, en este curso son de especial interés la “distribución muestral de la media” y la


“distribución muestral de la proporción”.

NOTA a. Los parámetros de la distribución muestral de la estadística X (distribución muestral de la


media) los representaremos como sigue:
i. Su valor esperado, representado por  X , se lee “media de la distribución muestral de la
media”.
Su varianza, representada por  X2 , se lee “varianza de la distribución muestral de la media”.
b. La distribución muestral de la estadística P (distribución muestral de la proporción) tiene
como parámetros:
i. Su valor esperado, representado por  P , se lee “media de la distribución muestral de la
proporción”.
ii. Su varianza, representada por  P2 , se lee “varianza de la distribución muestral de la
proporción”.

¿QUÉ PROPIEDADES TIENEN LAS DISTRIBUCIONES MUESTRALES?


Veamos algunas de ellas.

EJEMPLO 2 (DISTRIBUCIÓN MUESTRAL DE LA MEDIA)


Sea la población
S =  2, 4, 6  .
i. Tiene valor esperado
2+4+6
E X = =4.
3
ii. Tiene varianza

V  X =
( 2 − 4 )2 + ( 4 − 4 )2 + ( 6 − 4 )2 =
8
.
3 3
iii. Sea la MAS
X1, X 2 .
a. Las realizaciones de la muestra aleatoria simple
X1, X 2
(tamaño dos), y sus medias respectivas (tabla de la izquierda), la fdp (función de distribución, tabla de
la derecha) y su grafico se muestran a continuación
116 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

MUESTRA ASIGNACIONES xi

2+2
 2, 2 x ( 2, 2 )= =2
2
2+4
 2, 4 x ( 2, 4 )= =3
2
2+6
 2, 6 x ( 2, 6 )= =4 x fX (x)
2
4+2 1
 4, 2 x ( 4, 2 )= =3 2
9
2
4+4 2
 4, 4 x ( 4, 4 )= =4 3
2 9
6+4 3
 4, 6 x ( 6, 4 )= =5 4
9
2
6+2 2
 6, 2 x ( 6, 2 )= =4 5
2 9
6+4 1
 6, 4 x ( 6, 4 )= =5 6
2 9
6+6
 6, 6 x ( 6, 6 )= =6
2

f
1

0 2 3 4 5 6 x

FIGURA 1

b. Con valor esperado


 1   2   3   2   1  36
X = 2   + 3   + 4   + 5   + 6   = = 4 .
 9   9   9   9   9  9
Con varianza
 1  2 2  2 3  2 2  2 1 
 X2 = ( 2 − 4 )2   + (3− 4 )   + ( 4− 4 )   + (5− 4 )   + (6− 4 )   .
 9   9   9   9   9 
Así
Sección 2.2 Parámetro y estadístico 117

4
 X2 = .
3
8 4 V X 
c. Puesto que V  X  = , el tamaño de la muestra es n = 2 y  2 X = , entonces  X2 = , por
3 3 2
lo que es justificable establecer las conjeturas
V X ,
E  X  =  X y  2X =
n
es decir,
“La media de la distribución muestral de la media es igual a la media real (poblacional)” y “la
varianza de la distribución muestral de la media es igual la varianza de la población dividida por
el tamaño de muestra”.

EJEMPLO 3 (DISTRIBUCIÓN MUESTRAL DE LA PROPORCIÓN)


Una población está compuesta por 1 carta roja y 2 cartas blancas, es decir,  r1 , b2 , b3  .
a. Si se extrae aleatoriamente una carta y se define como éxito que sea roja, entonces la variable
aleatoria
X = “número de cartas rojas en una extracción”.
1
está distribuida binomialmente con p = y n = 1 , por tanto,
3
1
E X = p = , asimismo
3
 1  2  2 2
V  X  = ( 1 )   = y desviación estándar V  X  = .
 3  3  9 3
b. Por otra parte, todas las muestras de tamaño 2 del conjunto  r1 , b2 , b3  con su respectiva
proporción P de cartas rojas son:

Muestra
Muestra P
número
Muestra
1  r1 , r1  P1 = 1 número
Muestra P

 r1 , b2  P2 =
1 6  b2 , b3  P6 = 0
2
2
1
1 7  b3 , r1  P7 =
3  r1 , b3  P3 = 2
2
8  b3 , b2  P8 = 0
1
4  b2 , r1  P4 =
9  b3 , b3  P9 = 0
2
5  b2 , b 2  P5 = 0

c. La distribución muestral de la proporción de canicas rojas en la muestra es:


118 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

f
1
1
P 0 1
2
4 4 1
fP ( x )
9 9 9
0 0.5 1 x

FIGURA 2

d. Con:
valor esperado
 4   1  4   1  1
 P = E  P  = ( 0 )  +    + ( 1 )  =
 9   2  9   9  3
y varianza
2 2 2
 1   4   1 1   4   1   1  1
 P2 =  0 −   + −    +  1−    = .
 3   9   2 3   9   3   9  9
e.
i. La proporción de canicas rojas de la población está relacionada con la media de la distribución
1
E X = p = = P .
3
Es decir, “la proporción de canicas rojas de la población es igual a la media de la distribución muestral
de proporciones”.
ii. También es posible relacionar la varianza de la población con la varianza de la distribución muestral
de la proporción, note que
 1  2 
  
2  1  2   3  3 
V  X  = =   = =  P2
9  3  3  1
1 2
iii. En este problema p = , q = y n = 1 , por tanto, podemos establecer las conjeturas
3 3
pq
 P = p y también  P2 = , es decir,
n
La media de la distribución muestral de la proporción es igual a la proporción real (poblacional)”
y la varianza de la distribución muestral de la proporción es igual la varianza de la población
dividida por el tamaño de muestra”.

A continuación, damos formalidad a las conjeturas hechas sobre las distribuciones muestrales
señaladas en los dos ejemplos anteriores.
n
X1 + X 2 +  + X n 1
La estadística X =
n
=
n
X
i =1
i es una variable aleatoria que se genera combinando

la muestra aleatoria simple X 1 , X 2 , , X n , por tanto, tiene asociada una media y una varianza,
Sección 2.2 Parámetro y estadístico 119

entonces
 X1 + X 2 +  + X n 
X = E  X = E  ,
 n 
1 1
= E  X 1 + X 2 +  + X n  =  E  X 1  + E  X 1  +  + E  X n  ,
n n
considerando que las variables aleatorias X 1 , X 2 , , X n están idénticamente distribuidas ( idd ) y
que tienen el mismo valor esperado  , obtenemos

1  
 1
X =   +  +  +   = ( n ) =  .
n   
 n

n veces 
La varianza de la estadística X (que se representa por  X2 ) es
 X1 + X 2 +  + X n 
 X2 = V  X  = V  
 n 
1
=V  X1 + X 2 +  + X n 
n2
1
= 2  V  X 1  + V  X 1  +  + V  X n  .
n
Las variables aleatorias X 1 , X 2 , , X n están idénticamente distribuidas ( idd ) y cada una de ellas
tiene varianza  2 , entonces
  2
 X2 =
1
n2
 2
 2
+ +  2
+
 1
(
2
 = 2 n = )
n
.

 n veces  n

La formalización de las observaciones previas es la propiedad 1.

PROPIEDAD 1 (PROPIEDADES DE LA DISTRIBUCIÓN MUESTRAL DE LA MEDIA)


X1 + X 2 +  + X n
Sea la estadística X = constituida a partir de la MAS X 1 , , X n extraída de una
n
población con valor medio E  X  =  y varianza V  X  =  2 , entonces
i.  X =  .
2
ii.  X2 = .
n

La distribución muestral de la proporción P se puede tratar como un caso particular de la


distribución muestral de la media, sea X 1 , X 2 , , X n una muestra aleatoria simple, si X representa
el total de las variables aleatorias que asumen el valor de 1 en una de sus realizaciones, entonces las
X
restantes n − X asumen el valor de cero. Luego la variable aleatoria P = se distribuye
n
binomialmente, así mismo
120 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

 X1 + X 2 +  + X n  1 1
P = E  P  = E   = E  X  ==  np  = p ,
 n  n n
y también
 X  1 1 pq
 P2 = V  P  = V   = 2 V  X  = n 2 npq = n .
 n  n

Los cálculos y observaciones previas los formaliza la propiedad 2.

PROPIEDAD 2 (PROPIEDADES DE LA DISTRIBUCIÓN MUESTRAL DE LA PROPORCIÓN)


X
Si en la estadística P = , X representa el número de éxitos en la MAS X 1 , , X n extraída de una
n
población con valor medio E  X  = np y varianza V  X  = npq , entonces
i.  P = p .
pq
ii.  P2 = .
n

EJEMPLO 4 (PARÁMETROS DE LA DISTRIBUCIÓN MUESTRAL DE MEDIAS)


a. Suponga que “Productos Lácteos S.A.” distribuye queso en empaques con la leyenda peso  = 100
gramos y  = 10 gramos, entonces una muestra aleatoria de tamaño n = 25 de quesos tiene media,
varianza y desviación estándar
 2 10 2  10
 X =  = 100 ,  X2 = = =4 y X = = = 2 respectivamente.
n 25 n 25
b. Si el regimiento, comandado por el teniente Benito Camelo se caracteriza porque sus integrantes
tienen un peso medio de  = 68 con una desviación estándar  = 3 kilogramos de peso. Al seleccionar
una muestra aleatoria simple de tamaño n = 25 , tendremos
2 32 9  3
 X =  = 68 ,  X2 = = = y X = = = 0. 6 .
n 25 25 n 25
c. La fábrica de golosinas del Sr. Aquiles Baeza distribuye caramelos en bolsas con la leyenda: peso
neto  = 100 gramos y desviación estándar  = 10 gramos. Al ser seleccionada una muestra aleatoria
de n = 25 bolsas, entonces la media, la varianza y la desviación estándar de la distribución muestral de
2 10 2 10
la media son  X =  = 100 ,  X2 = = =4 y X = = 2 respectivamente.
n 25 25

EJEMPLO 5 (PARÁMETROS EN LA DISTRIBUCIÓN MUESTRAL DE PROPORCIONES)


a. Suponga que la proporción real de roedores que sobreviven más de 15 minutos al tragar una primera
dosis de veneno es p = 0.10 . Si se analiza una muestra aleatoria simple de n = 25 roedores que han
Sección 2.2 Parámetro y estadístico 121

ingerido el veneno, entonces: la media, la varianza y la desviación estándar de la distribución muestral


de la proporción son

 P = p = 0.10 ,  P2 =
( 0.10 )( 0.90 ) ( 0.10 )( 0.90 )
= 0.0036 y  P = = 0.06 respectivamente.
25 25
b. Suponga que sólo el 40 % de estudiantes de cierta institución educativa visitan la biblioteca, si se
utiliza una muestra aleatoria de 100 integrantes de la institución educativa, entonces la media, la
varianza y la desviación estándar de la distribución muestral de la proporción son:

 P = p = 0.40 ,  P2 =
( 0.40 )( 0.60 ) ( 0.40 )( 0.60 ) = 0.048989 respectivamente.
= 0.0024 y  P =
100 100
c. Una investigación demostró que el 64 % de los electores inscritos el padrón electoral de cierta
población recibió una despensa para votar por cierto partido. Si se toma una muestra aleatoria simple
de n = 25 electores, entonces: la media, la varianza y la desviación estándar de la distribución muestral
de la proporción son:

 P = p = 0.64 ,  P2 =
( 0.64 )( 0.36 ) ( 0.64 )( 0.36 )
= 0.009216 y  P = = 0.0959 .
25 25

¿CÓMO SE DISTRIBUYEN LAS DISTRIBUCIONES MUESTRALES?


Tanto la distribución muestral de la media como la distribución muestral de proporciones tienen
asignadas una función de probabilidad, por tanto, surgen las preguntas
¿cuál es su forma específica?, ¿cómo se distribuyen?
Las respuestas a las preguntas anteriores se relacionan con el origen de la muestra aleatoria y con su
tamaño, es decir:
i. La distribución de probabilidad de la población de donde fue extraída la muestra aleatoria simple (lo
que significa conocer los valores de sus parámetros).
ii. El tamaño de la muestra aleatoria simple.
Se puede justificar que, si la población origen de la muestra aleatoria simple está distribuida
normalmente, ambas distribuciones muestrales (de la media y de la proporción) se distribuirán
normalmente, o en su caso, si el tamaño de la muestra aleatoria simple es mayor o igual que 30 , el
TEOREMA DEL LÍMITE CENTRAL (O TEOREMA CENTRAL DEL LÍMITE) asegura que ambas
distribuciones muestrales tienen una función de probabilidades normal. Por tanto,
i. Si la MAS se obtuvo de una población con distribución normal, la distribución muestral asociada a
n
X1 + X 2 +  + X n 1
X =
n
=
n
X
i =1
i ,

Sigue una distribución normal.


ii. Si la MAS se obtuvo de una población con distribución no normal, pero su tamaño es mayor o igual a
30 (el tamaño de muestra es “grande”), la distribución de probabilidad de la distribución muestral de la
variable aleatoria
122 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

n
X1 + X 2 +  + X n 1
X =
n
=
n
X
i =1
i

es aproximadamente normal.

El TEOREMA DEL LÍMITE CENTRAL (o Teorema Central del Límite), es el resultado de mayor
utilidad e importancia en el cálculo de probabilidades y es la justificación analítica de la aproximación de
las diversas distribuciones de probabilidades a distribución la normal, su enunciado fue obra del
Matemático Aleksandr Liapunov en el Siglo XX, quien además lo demostró.

PROPIEDAD 3 (TEOREMA DEL LÍMITE CENTRAL)


Sea X 1 , , X n una sucesión de variables aleatorias independientes, idénticamente distribuidas y de
tamaño n (suficientemente grande o que aumenta indefinidamente) extraída de una población con
valor medio
E  X  =  y varianza V  X  =  2 (ambas finitas), entonces la variable aleatoria
 1 n


 n X i
−

Zn =  
i =i

2
n
converge en distribución a la variable aleatoria normal estándar.

NOTA −
a. En el contexto de la distribución muestral de la media X , el Teorema del Límite Central
afirma:
“la variable aleatoria
 X1 + X 2 +  + X n 
 −
 n 
Zn =
2
n
converge en distribución a la distribución de la variable aleatoria normal estándar Z ”.
b. En el contexto de la distribución muestral de la proporción P , la variable aleatoria
 X 
 − p
 n 
Zn =
pq
n
converge en distribución (se aproxima a la distribución) de la variable aleatoria normal
estándar Z .
c. En la práctica, la condición “tamaño de la muestra es suficientemente grande” se considera
satisfecha cuando n es mayor o igual que 30 .
Sección 2.2 Parámetro y estadístico 123

La figura 3 ilustra un caso particular del Teorema del Límite Central.


f
f
0.35
0.23

x 9 10 11 12 13 14 15 x
0 1 2 3 4 5 0 1 2 3 4 5 6 7 8
f
f
0.28 0.17

0 1 2 3 4 5 6 7 8 9 10 x x
0 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19
FIGURA 3

¿CÓMO SE CALCULAN PROBABILIDADES DE DISTRIBUCIONES


MUESTRALES?

EJEMPLO 6 (INGRESOS)
El monto promedio de ingresos (por tres horas de trabajo) de los “limpiaparabrisas” que operan en los
principales cruces de avenidas de la Ciudad de México es $ 125 con desviación estándar de $ 24 .
a. Si se seleccionan todas las muestras posibles de tamaño n = 36 , entonces la estadística X se
24
distribuyen normalmente con  X = 125 y  X = = 4 . El tamaño de muestra garantiza el que el
36
comportamiento normal del promedio es normal, por tanto, la probabilidad de que el ingreso promedio
(por tres horas) sea menor a $ 115 es
 115 − 125 
p ( X  115 ) = p  Z   = p ( Z  −2.5 ) =  ( − 2.5 ) = 0.0062 .
 4 
b. Si se selecciona una muestra aleatoria simple de 64 “limpiaparabrisas” (que operan en la Ciudad de
México), su tamaño garantiza que el comportamiento normal del ingreso medio (por tres horas) sea
menor o igual a $ 115 , por tanto, la variable aleatoria X se distribuye en forma normal con parámetros
24
 X = 125 y  X = = 3,
64
por tanto,
 115 − 125 
p ( X  115 ) = p  Z   = p ( Z  −3.33 ) =  ( − 3.33 ) = 0.0004 .
 3 
124 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

EJEMPLO 7 (DIÁMETROS)
El distribuidor de las tapaderas de las botellas de la compañía Coca Cola S. A., afirma que éstas se
distribuyen normalmente, tienen un diámetro promedio de  = 1.001 centímetros y desviación estándar
 = 0.003 centímetros, por tanto:
a. La probabilidad de que una muestra aleatoria de n = 9 tapaderas tenga un diámetro promedio
comprendido entre 1.009 y 1.012 (inclusive) centímetros se calcula como sigue:
0.003
Puesto que n = 9 , entonces  X = 1.001 y  X = = 0.001 , luego
9
 1.009 − 1.001 1.012 − 1.001 
p ( 1.009  X  1.012 ) = p  Z  = p ( 8  Z  11 ) = 0 .
 0.001 0.001 
b. La probabilidad de que una muestra aleatoria de n = 9 tapaderas tenga un diámetro promedio mayor
que 1.00102 centímetros se calcula como sigue
 1.00102 − 1.001 
p ( X  1.00102 ) = p  Z   = p ( Z  0.02 ) =  ( − 0.02 ) = 0.4920 .
 0.001 
c. Para responder la pregunta ¿sobre qué longitud de diámetro promedio se encuentra el 90 % de las
tapaderas producidas por el taller?, sea x 0 el diámetro promedio mínimo de las tapaderas, entonces
 x 0 − 1.001 
p ( X  x 0 ) = 0.90 , es decir, p  Z   = 0.90
 0.001 
de las tablas de la distribución normal obtenemos z 90 = 1.2816 , de donde,
x 0 − 1.001
= 1.2816 , o bien x 0 = ( 1.2816 )( 0.001 ) + 1.001 = 1.0022816 centímetros.
0.001

EJEMPLO 8 (TIEMPO DE TRANSPORTE)


El tiempo de espera de los pasajeros de los autobuses, “Anaranjados de la RTP”, se distribuye
normalmente con parámetros  = 8.2 minutos y  = 1.5 minutos. Se observa una muestra aleatoria de
49 personas que utilizan ese medio de transporte para ir a su hogar. De la información anterior
concluimos que la distribución muestral de X se distribuye en forma normal con parámetros
 1 .5
 X =  = 8.2 y  X = = = 0.214 .
n 49
Entonces:
 8 − 8.2 
a. p ( X  8 ) = p  Z   = p ( Z  −0.935 ) =  ( − 0.935 ) = 0.1740 .
 0.214 
 7.5 − 8.2 8.5 − 8.2 
b. p ( 7.5  X  8.5 ) = p  Z   = p ( − 3.27  Z  1.40 )
 0.214 0.214 
=  ( 1.40 ) −  ( − 3.27 ) = 0.9192 − 0.0005 = 0.9187 .
 7.5 − 8.2 
c. p ( X  7.5 ) = p  Z   = p ( Z  −3.27 ) =  ( 3.27 ) = 0.9995 .
 0.214 
Sección 2.2 Parámetro y estadístico 125

d. Sea t 0 el tiempo promedio máximo desconocido (los otros valores de la estadística son menores o
iguales), entonces p ( X  t 0 ) = 0.95 , luego
 t 0 − 8. 2 
p  Z   = 0.95 ,
 0.214 
el percentil correspondiente es
t 0 − 8.2
z 95 = 1.6449 , así = 1.6449 ,
0.214
es decir,
t 0 = ( 1.6449 )( 0.214 ) + 8.2 = 8.552 minutos.

En la evaluación de probabilidades referentes a la estadística P es necesario tener en cuenta las


correcciones por continuidad. Dado que en la vida real la exactitud no existe, se establece el concepto
de “precisión” que indica que tan próximo se encuentra la medida que toma la variable del valor real, por
tanto, se considera el error de precisión como la mitad de mínima graduación del aparato o instrumento
de medida. Si la mínima escala del instrumento de medida es, por ejemplo,
i. 1 kilogramo, entonces la precisión es  0.5 kilogramos.
ii. 1 metro, entonces la precisión es  0.5 metros.
iii. 1 milímetro, entonces la precisión es  0.5 milímetros.
iv. 1 litro, entonces la precisión es  0.5 litros.
La cantidad  0.5 se denomina corrección por continuidad. La tabla1 muestra cómo transformar una
cantidad discreta a continua:

Cantidad discreta Observación Transformación Forma continua


X =8 Incluye al 8 Sumar y restar 0.5 7 .5  X  8 .5
X 8 No Incluye al 8 Restar 0.5 X  7 .5
X 8 No Incluye al 8 Sumar 0.5 X  8 .5
X 8 Incluye al 8 Sumar 0.5 X  8.5
X 8 Incluye al 8 Restar 0.5 X  7 .5
TABLA 1

En proporciones, la corrección por continuidad toma la forma


1
 ,
2n
en donde n representa el tamaño de la muestra, la forma de operar es similar a la del cuadro anterior y
se muestra en la tabla 2.
126 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

Forma discreta Observación Transformación Forma continua


1 1 1
P = 0 .8 Incluye al 0.8 Sumar y restar 0.8 −  P  0.8 +
2n 2n 2n
1 1
P  0 .8 No Incluye al 0.8 Restar P  0.8 −
2n 2n
1 1
P  0 .8 No Incluye al 0.8 Sumar P  0.8 +
2n 2n
1 1
P  0 .8 Incluye al 0.8 Sumar P  0.8 +
2n 2n
1 1
P  0 .8 Incluye al 0.8 Restar P  0.8 −
2n 2n
TABLA 2

EJEMPLO 9 (PROPORCIÓN DE PALETAS)


Suponga que las bolsas de paletas “Chupa Chus” contienen 1000 unidades y que tres de cada diez
son de sabor “albóndiga roja”, entonces:
a. La probabilidad de que la proporción muestral de paletas sabor “albóndiga roja” sea mayor o igual a
0.29 se calcula como sigue
 0.29 − 21n −  P   0.29 − 2000
1
− 0.3 
p ( P  0.29 ) = p  Z   = p Z 
 


 P   0.0205 
= p ( Z  −0.537 ) =  ( 0.537 ) = 0.2979 .
b. La probabilidad de que la proporción muestral de paletas sabor “albóndiga roja” sea menor o igual a
0.31 es
 0.31 + 21n −  P 
p ( P  0.31 ) = p  Z  

  P 
 0.31 + 2000
1
− 0.3 
= p  Z   = p ( Z  0.537 ) =  ( 0.537 ) = 0.2979 .
0.0205 
 

EJEMPLO 10 (PROPORCIÓN DE APARATOS ELECTRÓNICOS)


Suponga que en uno de cada dos departamentos, de la unidad habitacional “Las Pocilgas”, existe un
aparato electrónico de la marca LG y que de la unidad habitacional se selecciona una muestra aleatoria
simple de 120 departamentos. Entonces
 P = p = 0.5 ,  P2 =
( 0.5 )( 0.5 ) = 0.0021 y  P = 0.0456 .
120
a. La probabilidad de que la proporción de aparatos electrónicos LG se encuentre entre él 40 % y el
60% inclusive (considere ambos extremos) es
Sección 2.2 Parámetro y estadístico 127

 0.40 − 240
1
− 0.5 0.60 + 240
1
− 0.5 
p ( 0.40  P  0.60 ) = p  Z 
 0.0456 0.0456 
 
= p ( − 2.28  Z  2.28 ) = D ( 2.28 ) = 0.9774 .
b. La probabilidad de que la proporción de aparatos electrónicos de la marca LG sea de 75 % o más es
 0.75 − 240
1
− 0.5 
p ( P  0.75 ) = p  Z   = p ( Z  5.391 ) =  ( − 5.391 )  0 .

 0.0456 
30
c. La proporción correspondiente a 30 departamentos con aparatos de esa marca es = 0.25 ,
120
entonces la probabilidad de que haya 30 o más departamentos con aparatos electrónicos de la marca
LG es
 0.25 − 240
1
− 0.5 
p ( P  0.25 ) = p  Z   = p ( Z  −5.5738 ) =  ( 5.5738 )  1 .

 0.0456 
d. La proporción correspondiente a 60 departamentos con aparatos electrónicos de la marca LG es
30
= 0.50 , por tanto, la probabilidad de que la mitad o menos de los departamentos incluyan aparatos
60
electrónicos de la marca señalada es
 0.5 + 240
1
− 0.5 
p ( P  0.50 ) = p  Z   = p ( Z  0.091 ) =  ( 0.091 )  0.535 .

 0.0456 

EJEMPLO 11 (PROPORCIÓN DE CONSUMIDORES)


Miguel Ángel Rodríguez afirma que el 5 % de los estudiantes con domicilio en Milpa Alta consume
algún tipo de enervante, entonces
 P = p = 0.05 ,  P2 =
( 0.05 )( 0.95 ) = 0.000792 y  = 0.02814 .
P
60
a. La probabilidad de que en un grupo de 60 estudiantes con domicilio en Milpa Alta, el 11 % o más
consuman algún tipo de enervante es
 0.11 − 120
1
− 0.05 
p ( P  0.11 ) = p  Z   = p ( Z  1.83 ) =  ( − 1.83 ) = 0.0336 .

 0.02814 
b. La probabilidad de que en un grupo de 60 estudiantes con domicilio en Milpa Alta menos del 3 %
consuman algún tipo de enervante es
 0.03 − 120
1
− 0.05 
p ( P  0.03 ) = p  Z   = p ( Z  −1.007 ) =  ( − 1.007 )  0.1562 .

 0.02814 
c. La probabilidad de que en un grupo de 60 estudiantes con domicilio en Milpa Alta más de la cuarta
parte consuman algún tipo de enervante, se calcula considerando que más de la cuarta parte
16
corresponde a 16 o más, en proporción a = 0.27 o más, por tanto,
60
128 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

 0.27 − 120
1
− 0.05 
p ( P  0.27 ) = p  Z   = p ( Z  7.52 ) =  ( − 7.52 )  0 .

 0.02814 
Sección 2.2 Parámetro y estadístico 129

PROBLEMAS PROPUESTOS

1. Se seleccionaron muestras de tamaño n de determina la media y la desviación estándar de


poblaciones con la media y varianza indicadas; la distribución muestral de proporciones si
determina la media y la desviación estándar de a. n = 64 y p = 0.25 .
la distribución muestral de medias. Supón b. n = 400 y p = 0.90 .
muestreo con reemplazo. c. n = 625 y p = 0.75 .
a. n = 25 ,  = 10 y  2 = 9 . d. n = 4 y p = 0.1 .
b. n = 49 ,  = 150 y  2 = 4 .
c. n = 36 ,  = 6 y  2 = 1 . 5. El diámetro de los buñuelos “medianos” que
expende “Mambo S.A.”, es una variable
2. Se seleccionaron muestras de tamaño n de aleatoria normal con  = 12 centímetros y una
poblaciones con la media y varianza desviación estándar de  = 0.04 centímetros.
señaladas, determina la media y la desviación a. Si X es el diámetro promedio de una
estándar de la distribución muestral de medias. muestra aleatoria de 16 buñuelos “medianos”
Supón muestreo con reemplazo. de “Mambo S.A.”, ¿cuál es el valor medio de la
a. n = 25 ,  = 1 y  2 = 16 . distribución muestral de medias y cuál es su
b. n = 64 ,  = 16 y  2 = 25 . varianza?
b. Responde las preguntas del inciso anterior
c. n = 16 ,  = 6 y  2 = 100 .
para una muestra de 64 buñuelos “medianos”.
c. Evalúe p ( 11.99  X  12.01 ) para n = 16
3. Se seleccionaron muestras de tamaño n de
buñuelos “medianos”.
poblaciones con proporción real p , determina
la media y la desviación estándar de la
6. La cantidad de minerales contenida en los
distribución muestral de proporciones.
garrafones de agua de la compañía “Acuafont
a. n = 100 y p = 0.4 .
S.A.” es una variable aleatoria con media
b. n = 400 y p = 0.01 .  = 4.0 gramos y una desviación estándar
c. n = 490 y p = 0.6 .  = 1.5 gramos.
d. n = 9 y p = 0.25 . Un camión de “Acuafont S.A.” transporta 100
garrafones.
4. Se seleccionaron muestras de tamaño n de a. ¿Cuál es la probabilidad de que la cantidad
poblaciones con proporción real p , media de minerales en los garrafones de
130 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

“Acuafont S.A.” esté entre 3.5 y 3.8 gramos? miligramos y  = 0.1 miligramos. Considere
b. ¿Cuál es la probabilidad de que la cantidad un racimo con 25 “plátanos machos”.
media de minerales en los garrafones de a. ¿Cuál es la probabilidad de que la cantidad
“Acuafont S.A.” sea superior a los 4.2 media de potasio en los 25 “plátanos machos”
gramos? sea superior a los 0.82 miligramos?
c. ¿Cuál es la probabilidad de que la cantidad b. ¿Cuál es la probabilidad de que la cantidad
media de minerales en los garrafones de media de potasio en los 25 “plátanos machos”
“Acuafont S.A.” sea inferior a los 3.9 gramos? sea menor a los 0.86 miligramos?
d. ¿Qué contenido medio máximo de minerales c. ¿Qué contenido promedio máximo de
tiene el 99 % de los garrafones de “Acuafont potasio existe en el 99 % de los 25 “plátanos
S.A.”? machos”?
d. ¿Qué contenido promedio mínimo de
7. La compañía “Oasis” talará 400 árboles de potasio existe en el 5 % de los 25 “plátanos
la Ciudad de México. La distribución de los machos”?
diámetros de los árboles es normal con
 = 44 centímetros y  = 4 centímetros. 10. Considera un lote de 100 bultos con la
a. Determina la probabilidad de que el diámetro leyenda “Harina la Estrella” seleccionados al
medio de los árboles talados por “ciudad de azar. Si el peso especificado en cada saco es
vanguardia” se encuentre entre 43 y 44 .5  = 50 kilogramos y la desviación estándar es
centímetros.  = 1 0 kilogramos, calcula:
b. Determina la probabilidad de que el diámetro
a. p ( 49.75  X  50.25 ).
medio de los árboles talados por “Oasis” se
encuentre entre 0 y 46 centímetros. b. Si  = 49.8 calcule
p ( 49.75  X  50.25 ) .
8. Los años de estudio de las personas adultas
de la Alcaldía de Tláhuac, tiene una media 11. El tiempo utilizado en llenar una solicitud
2
 = 11 años y varianza de  = 9 . Considera de trabajo se distribuye normalmente con
 = 10 y  = 2 minutos. Si 49 individuos
una encuesta aleatoria efectuada a 100
adultos. llenan la solicitud de trabajo por día.
a. ¿Cuál es la probabilidad de obtener un nivel a. ¿Cuál es la probabilidad de que el tiempo
medio de años de estudios entre 10 y 12 sea a lo más de 13 minutos?
años. b. ¿Cuál es la probabilidad de que el tiempo
b. ¿Cuál es la probabilidad de obtener un nivel medio sea mayor a 11 minutos?
medio de años de estudios sea mayor a 13 c. ¿Cuál es la probabilidad de que el tiempo
años? medio esté entre los 7 y los 11 minutos?
d. ¿Qué tiempo medio mínimo por día se
9. El contenido de potasio de un “plátano ocupará en llenar el 10 % de las solicitudes?
macho” una distribución normal con  = 0.8
Sección 2.2 Parámetro y estadístico 131

12. El tiempo medio que tarda una rata en 15. Se ha encontrado que el 2 % de los
devorar un trozo de pan es una variable habitantes de San Iván se levantan antes de
aleatoria normal con media  = 1.5 minutos y las 5 : 30 . Sea una muestra de 400
desviación estándar  = 0.35 minutos. A cinco habitantes de San Iván. Determina:
ratas se les proporciona un trozo de pan. a. La probabilidad de que la proporción de los
a. ¿Cuál es la probabilidad de que el tiempo que se levantan antes de las 5 : 30 sea de 3 %
medio que tarda la rata en devorarlo esté entre o más.
1 .7 y 1.8 minutos? b. La probabilidad de que la proporción de los
b. ¿Cuál es la probabilidad de que el tiempo que se levantan antes de las 5 : 30 sea de 2 %
medio que tarda la rata en devorarlo sea menor o menos.
de 2 minutos? c. La probabilidad de que la proporción real
c. ¿Cuál es la probabilidad de que el tiempo esté entre 13 % y 27 % (incluya ambos
medio que tarda la rata en devorarlo sea mayor extremos).
a los 1.48 minutos? d. La probabilidad de que la proporción real
d. ¿Cuál es la probabilidad de que el tiempo esté entre Esté entre 4 % y el 8 % (no incluya
medio que tarda la rata en devorarlo sea a lo
los extremos).
más de 1.7 minutos?
16. Un estudio demostró que el 46 % de los
13. La dureza de los cristales, fabricados por
últimos nacimientos en el hospital “CEE”
“Crisa”, se distribuye normalmente con  = 50
fueron hombres. Calcula la probabilidad de que
y  = 4.5 kilogramos.
en los próximos:
a. ¿Cuál es la probabilidad de que la dureza a. 200 nacimientos sea una mayoría de
media de una muestra aleatoria de 9 cristales hombres.
producidos por “Crisa” sea por lo menos de 52 b. 1000 nacimientos sea una mayoría de
kilogramos? hombres.
b. ¿Cuál es la probabilidad de que la dureza c. 200 nacimientos sean más de 105 mujeres.
media de una muestra aleatoria de 36 cristales
sea por lo menos de 52 kilogramos? 17. La proporción de “huevos pintos” que
ponen las gallinas de la granja “San Cristóbal”
14. Un profesor sólo resuelve correctamente el es 0.5 . Determine la probabilidad de que la
20 % de los problemas que presenta en clase. proporción de “huevos pintos” seleccionados
Si en un curso propone 64 problemas: por uno de los trabajadores, en las próximas
a. ¿Cuál es la probabilidad de que la 200 recolecciones sea de:
proporción de problemas que resuelve a. Menor al 40 % .
correctamente sea del 25 % o más? b. Entre 43 % y 57 % , inclusive.
b. ¿Cuál es la probabilidad de que la c. En las próximas 200 selecciones haya más
proporción de problemas que resuelva de 108 “huevos pintos”.
correctamente sea a lo más del 32 % ?
132 CAPÍTULO 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

18. El jefe de control de calidad de la fábrica de 20. Suponga que las “aspirinas” son efectivas
golosinas “El Cerezo”, afirma que el 5 % de los el 74% de las veces en que se utilizan en el
bombones que elaboran pesan más de 5 tratamiento del dolor de cabeza.
gramos. Cada bolsa contiene 100 bombones. a. A 16 personas con dolor de cabeza se les
Si hace una entrega de 1000 bolsas a cierto administran aspirinas. ¿Cuál es la probabilidad
almacén. de que más de 4 se recuperen del dolor de
a. ¿Cuántas bolsas tienen menos de 20 cabeza?
bombones con peso mayor a 5 gramos? b. A 140 personas que padecen dolor de
b. ¿Cuántas bolsas tienen 48 o más cabeza se les administran aspirinas, ¿cuál es
bombones con peso mayor a 5 gramos? la probabilidad de que más de 4 se recuperen
c. ¿Cuántas bolsas tienen menos de 90 del dolor de cabeza?
bombones con peso menor a 5 gramos?
d. ¿Cuántas bolsas tienen 98 o más 21. Una encuesta reveló que el 70% de los
bombones con peso menor a 5 gramos? taxistas que ingresaron frecuentemente a la
zona de “Peralvillo” habían sido asaltados por
19. En un estudio de mercado se determinó lo menos una vez en los últimos cinco años. Si
que el 78% de los habitantes de la región se selecciona una muestra de 200 taxistas
consumen el refresco “ArciCola”. Considere que ingresan frecuentemente a la zona de
una muestra de 50 personas de la región. “Peralvillo”.
a. ¿Cuál es la probabilidad de que la
Determina la probabilidad de que la proporción
proporción de taxistas asaltados por lo menos
de personas que consume el refresco
una vez en los últimos cinco años esté entre
“ArciCola”:
60 % y él 80 % ?
a. Sea superior al 80 % .
b. ¿Cuál es la probabilidad de que la
b. Sea superior al 20 % .
proporción de taxistas asaltados por lo menos
c. Menos de 30 afirmen consumir “ArciCola”. una vez en los últimos cinco años sea mayor al
d. Menos de 36 afirmen no consumir el 66 % ?
refresco “ArciCola”. c. ¿Cuál es la probabilidad de que la
proporción de taxistas asaltados por lo menos
una vez en los últimos cinco años sea menor al
74 % ?
Sección 2.3 Resumen y autoevaluación 133

2.3 RESUMEN Y
AUTOEVALUACIÓN
134 UNIDAD 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

 ACTIVIDADES

SECCIÓN 2.1 ACTIVIDAD 4


ACTIVIDAD 1 Consigue una bolsa de golosinas M&M,
Considera una población infinita con parámetros agítala y extrae aleatoriamente un número
específico de ellas. Cuente el número de
  8 y  2  9 suponga que se extrae una
golosinas verdes y calcule la proporción
muestra aleatoria de tamaño n de esa población.
muestral.
a. Completa la tabla:
Repite el proceso anterior (reemplazando
n 5 10 50 100 1000
las golosinas) varias veces y calcula la
X media las proporciones muestrales
 X2 obtenidas. Construye un intervalo centrado
X en la media obtenida, tan pequeño como
le sea posible, pero trate de que contenga
b. ¿Qué sucede conforme n se incrementa?,
a la proporción de golosinas verdes en la
¿qué puede concluir?
bolsa.
Compare la proporción poblacional y la
ACTIVIDAD 2
media de las proporciones.
Considera una población de tamaño N y una
muestra de tamaño n  10 .
a. Complete la siguiente tabla:
SECCIÓN 2.2
ACTIVIDAD 1
N 50 100 500 1000 10000
Calcula la proporción de mujeres en el
N n
curso de Estadística.
N 1
a. Construya la distribución de
b. ¿Qué sucede conforme N se incrementa? probabilidades para X .
¿Qué puede concluir? b. Calcule el valor esperado y la
desviación estándar, interprételas.
ACTIVIDAD 3
Considere una población infinita con proporción ACTIVIDAD 2
real p  0.8 y suponga que se extrae una Establece la regla empírica para la
muestra aleatoria de tamaño n . distribución normal.
a. Complete la tabla.
b. ¿Qué ocurre conforme n se incrementa?, ¿qué ACTIVIDAD 3
puede concluir? Verifica el teorema de Chebyshev para
n 50 100 500 1000 10000 K 2, K 3 y K 4.
N n
pq
N 1
Sección 2.3 Resumen y autoevaluación 135

RESUMEN

Sección 2.1
Característica Una característica (o carácter) de un objeto (elemento o individuo) es una
propiedad a partir de la que es posible clasificar y estudiar.
Población Conjunto de todos objetos que es posible seleccionar para ser objeto de
Estadística estudio.
Muestra Cualquier parte de una población o subconjunto de la población.

Tamaño de muestra El número de objetos (elementos o individuos) de la muestra.


Muestra aleatoria X 1 , X 2 , , X n variables aleatorias independientes con idénticamente
simple distribuidas.
Realización de una Cuando las variables aleatorias X 1 , X 2 , , X n de la MAS asumen los
Muestra aleatoria valores x1 , x2 , , xn respectivamente
simple
Muestreo Proceso de selección y medición de la información en una parte de la
población estadística.
Muestreo con Los objetos que se extraen de la población se observan y se regresan a
reemplazo la misma para su posible reselección.

Muestreo sin Los objetos que se extraen de la población se observan y no se regresan


reemplazo a la misma para su posible reselección.
Números aleatorios Conjunto de números.

Valores reales o Característica de interés de una población.


parámetros
Estadística Regla o fórmula que asocia a las observaciones aleatorias que contiene
un número determinado.
Media X1  X 2    X n 1 n
La variable aleatoria X 
n

n
X
i 1
i se denomina

media.
Proporción Si todas las variables aleatorias X 1 , X 2 , , X n asumen (su recorrido
es) uno de los números del conjunto  0 , 1 , entonces la variable
X1  X 2    X n
aleatoria P  se denomina proporción.
n
136 UNIDAD 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

Sección 2.2
Distribución Distribución de probabilidad de una estadística.
muestral

Distribución Función de probabilidades de la variable aleatoria


muestral de la X1  X 2    X n
X  .
media n

Distribución Función de probabilidades de la variable aleatoria


muestral de la X
P .
proporción n

Propiedades de la X1  X 2    X n
Sea la estadística X  asociada a la MAS
distribución n
muestral X 1 , , X n , que se extrajo de una población con valor medio
de la media
E  X    y varianza V  X    2 , entonces
i.  X   .
2
ii.  X2  .
n

Propiedades de la X
En la estadística P  , X representa el número de éxitos en la MAS
distribución n
muestral X 1 , , X n , misma que se extrajo de una población con valor medio
de la proporción
E  X   np y varianza V  X   npq , entonces
i.  P  p .
pq
ii.  P2  .
n

Teorema del Límite Sea X 1 , , X n una sucesión de variables aleatorias independientes,


Central idénticamente distribuidas y de tamaño n (suficientemente grande o que
(o Teorema Central aumenta indefinidamente) extraída de una población con valor medio
del Límite) E  X    y varianza V  X    2 (ambas finitas), entonces la variable
 1 n


 n X i


aleatoria Z n   i i  converge en distribución a la distribución
2
n
de la variable aleatoria normal estándar.
Sección 2.3 Resumen y autoevaluación 137

USO DE LAS TECNOLOGÍAS

Sección 2.1
Sugerimos utilizar las aplicaciones mencionadas en la unidad 1.
Sección 2.2
Sugerimos utilizar las aplicaciones mencionadas en la unidad 1.

 AUTOEVALUACIÓN

COMPLETA LOS ESPACIOS


SELECCIONA LAS PALABRAS FALTANTES DEL BLOQUE INFERIOR
1. De una población estadística se pueden extraer distintos tipos de muestras y también pueden
seleccionarse de diferentes maneras; las _______________________ respecto a un parámetro de
una población estadística dependen de la forma en que se efectúa la extracción de las muestras.
2. En un muestreo, conviene que las muestras seleccionadas sean _______________________ de
la población, esto quiere decir que reflejen sus características.
3. Si al seleccionar uno de los elementos que conforman la muestra, digamos xi , éste no puede
repetirse en otra muestra, entonces el muestreo se efectuó _______________________.
4. La _____________________________________ es el proceso estadístico mediante el cual la
información obtenida a partir de una muestra se utiliza para obtener y construir conclusiones sobre la
población de la que se extrajo.
5. La descripción de una muestra se efectúa por medio de la evaluación de sus medidas
descriptivas, que también se denominan _______________________.
6. Se considera que una población estadística está completamente determinada cuando: se conocen
los valores de sus _______________________.
7. Uno de los objetivos de la inferencia estadística es el relacionado con la estimación de sus
_______________________.
8. En una muestra aleatoria simple las variables son _______________________.
9. Una realización estadística es un conjunto de números asignados a un conjunto de variables
aleatorias de una ______________________________________.
10. Una tabla de ___________________________se utiliza con el fin de asignar una realización a
una muestra aleatoria simple.
11. Una distribución muestral es la función de _______________________ de una estadística.
12. La distribución muestral de la _______________________es igual a la media real de la
población.
13. La distribución muestral de la _______________________ se construye asignado los valores
cero y uno a la media aritmética.
14. El teorema del _______________________ se refiere a la distribución de probabilidad de la
variable aleatoria media aritmética.
138 UNIDAD 2 ESTIMADORES E INTRODUCCIÓN A LA INFERENCIA ESTADÍSTICA

15. El teorema del _______________________se refiere a la _______________________ en


distribución de la variable aleatoria media aritmética.

aleatorias. representativas. números aleatorios. media aritmética. inferencia estadística.


estadísticas. límite central. muestra aleatoria simple. límite central. probabilidad. parámetros.
proporción. convergencia. inferencias. sin reemplazo. parámetros.

CIERTO O FALSO
(Selecciona la opción que consideres correcta)
C F 1. Una variable aleatoria genera una población estadística.
C F 2. Una muestra también puede considerarse como una población.
C F 3. En un muestreo sin reemplazamiento las muestras son aleatorias simples.
C F 4. Una población estadística está compuesta por objetos que pueden tratarse como
variables aleatorias.
C F 5. Una muestra aleatoria simple es un conjunto de números.
C F 6. Con una tabla de números aleatorios es posible construir una MAS
C F 7. Una realización de una muestra aleatoria simple es una variable aleatoria.
C F 8. En el muestreo con reemplazo las muestras son aleatorias simples.
C F 9. Una muestra contiene parámetros.
C F 10. Los símbolos  y  representan parámetros.
C F 11. El cálculo de una probabilidad asociada a la media requiere de una estandarización
previa.
C F 12. El cálculo de una probabilidad de la variable aleatoria “proporción” requiere
corregirse por continuidad.
C F 13. Un parámetro específico tiene uno o más estimadores.
C F 14. La distribución muestral de la proporción se distribuye normalmente y no depende
del tamaño de la MAS.
C F 15. La distribución muestral de la media siempre se distribuye normalmente.
C F 16. La construcción de distribución muestral de la proporción se basa en la distribución
muestral de la media.
C F 17. Una distribución muestral se construye tomando como base un parámetro.
C F 18. La distribución muestral de la media es una función de probabilidades acumuladas.
C F 19. La distribución de probabilidad de un parámetro se denomina distribución muestral.
C F 20. La distribución muestral de  se denomina distribución muestral de la media.
C F 21. La distribución muestral de p se denomina distribución muestral de la proporción.
Sección 2.3 Resumen y autoevaluación 139

PROBLEMAS PROPUESTOS
1. Se seleccionaron muestras de tamaño n de 4. Si p  0.05 y n  60 determina:
ciertas poblaciones con la media y varianza a. p  0.15  P  0.20  .
indicadas, determine la media y la desviación b. p  P  0.10  .
estándar de la distribución muestral de medias.
c. p  P  0.30  .
Suponga muestreo con reemplazo.
d. p  P  0.08  .
a. n  100 ,   80 y  2  16 .
e. p  P  0.02  .
b. n  200 ,   150 y  2  25 .
c. n  625 ,   203 y  2  81 .

2. Se seleccionaron muestras de tamaño n de


poblaciones con proporción real p , determina
la media y la desviación estándar de la
distribución muestral de proporciones si
a. n  81 y p  0.45 .
b. n  100 y p  0.50 .
c. n  364 y p  0.65 .
d. n  625 y p  0.85 .

3. Si   3.0 ,   1 y n  81.
a. ¿Cuál es la probabilidad de que X esté
entre 3.1 y 3.3 ?
b. ¿Cuál es la probabilidad de X  3.2 ?
c. ¿Cuál es la probabilidad de X  2.9 ?
d. Si p  X  x 0   0.99 , calcula x 0 ,.
e. Calcula x 0 , para p  X  x 0   0.95 .
f. Si p  X  x 0   0.02 calcula x 0 .
3.
INFERENCIA
ESTADÍSTICA

PROPÓSITO
Al finalizar la unidad el alumno:
Realizará inferencias formalessobre los valores de los parámetros,
a partir del análisis de los estimadores, para fundamentar la toma de
de decisiones en una investigación estadística, consolidando la
formación de su pensamiento estadístico.

CONTENIDO
3.1 ESTIMACIÓN
3.2 PRUEBA DE HIPÓTESIS PARA LA MEDIA
Y LA PROPORCIÓN POBLACIONAL
Sección 3.1 Estimación 141

3.1 ESTIMACIÓN

¿Qué debe aprender?


1. Construye el concepto de estimación por intervalo a partir de un
problema.
2. Deduce las expresiones para el cálculo de intervalos de confianza
para la media o para la proporción, bajo las condiciones del Teorema
del Límite Central.
3. Estima la media y la proporción poblacionales por medio del intervalo
de confianza correspondiente, que haya generado en el contexto de
una investigación o un problema, comunicando su interpretación.

¿Por qué debe aprenderlo?


Uno de los propósitos de la inferencia estadística es la estimación tanto
puntual como por intervalos de los valores reales de una población con
cierta confiabilidad y posteriormente tomar una decisión.

Temática
Estimación puntual y por intervalos para la media y la proporción de
la población. Elementos que componen a un intervalo de confianza.
Aplicación e interpretación de resultados.
142 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

Una población estadística está constituida por todos los objetos (elementos o individuos) que
presentan un carácter o propiedad común (medible, definido o seleccionado por el investigador) que se
desea describir utilizando estadísticas. Por otra parte, el propósito de la Estadística Inferencial (
inferencia estadística) es inferir y/o estimar los parámetros (caracteres o números que la describen) de
una población que no es completamente observable (lo que puede deberse a su tamaño, su costo, su
complejidad, etcétera) en su totalidad, por tanto, se requiere utilizar partes de ella (muestras) con el fin
de conocerla (a través del análisis de las muestras y los elementos de probabilidad). Esto significa
calcular números y determinar su bondad, es decir, conocer que tan próximos son a los valores reales
(parámetros) de la población.

muestra
aleatoria
simple realizaciones de la MAS

X1 , X 2 , ..., Xn x 1 , x2 , ..., xn

inferencias
(conclusiones sobre la población)
FIGURA 1

DEFINICIÓN 1 (PARÁMETROS O VALORES REALES)


Un parámetro o un valor real de una población es un número que representa el valor de un carácter de
la variable (o variables) que la definen.

La figura 2 muestra el esquema de un parámetro de una población.


carácter


parámetro ¿cuánto vale  ?
(se desconoce) (¿quién es f ( x , ) ?)

FIGURA 2

EJEMPLO 1 (PARÁMETROS FACTIBLES DE ESTIMAR)


a. En una población con una característica medible y cuyos valores se representan por la variable X y
que se distribuye binomialmente el parámetro que es factible de estimar es p .
Sección 3.1 Estimación 143

b. Consideremos la población en que los valores de la característica variable (de interés) se


representan por X , y que se distribuye normalmente, entonces los parámetros factibles de estimar son
 y  2 (equivalentemente  ).

En el contexto de la estadística inferencial, el proceso de estimación de parámetros requiere del


uso “fórmulas, las fórmulas utilizadas presentan similitudes (y pueden tener la misma estructura y ser
similares) a las utilizadas en la descripción de una muestra estadística.

EJEMPLO 2 (ESTADÍSTICAS ÚTILES EN ESTIMACIÓN)


a. Si en una población el parámetro objetivo (parámetro que se desea estimar) es un promedio,
entonces una estadística útil es la media aritmética.
b. Si en una población el parámetro objetivo es una proporción o un porcentaje, entonces una
estadística útil es la estadística proporción.
c. Si en una población el parámetro objetivo es un total, entonces una estadística útil es el total
muestral.

A diferencia de la estadística descriptiva, en que los elementos componentes de las estadísticas


son números, en estadística inferencial los elementos que componen los estimadores son variables
aleatorias.

DEFINICIÓN 2 (ESTIMADOR Y ESTIMADOR PUNTUAL)



Sean:  un parámetro, X 1 , , X n una muestra aleatoria y   X 1 ,  , X n  la estadística
correspondiente a  , entonces:

a. La expresión   X 1 ,  , X n  se denomina estimador del parámetro  .
^ 
b. El valor (o número)  obtenido cuando en   X 1 ,  , X n  las variables X 1 ,, X n asumen los
valores x1 ,, xn se llama estimador puntual de  .

La figura 3 representa el proceso de estimación de un parámetro.


carácter
muestra realización
aleatoria x 1 , x2 , ..., xn
simple
 
 ( X1 , X 2 , ..., Xn ) 
 X1 , X 2 , ..., Xn
estimador estimador
(estadística) puntual de 
combinación
FIGURA 3
144 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

La tabla 1 incluye: el parámetro, la estadística o estimador y el estimador puntual del parámetro.


PARÁMETRO OBJETIVO ESTIMADOR ESTIMADOR PUNTUAL
POBLACIÓN 
 

 T  T
BINOMIAL p P p
n n
n n

NORMAL  
i 1
Xi
 x
i 1
i
X x
n n
n n

NORMAL  2 
2
 X
i 1
i X 2 
2
 x
i 1
i x 2
S  s 
n 1 n 1
TABLA 1

EJEMPLO 3 (ESTIMADORES PUNTUALES)


a. Se desea efectuar una inferencia con relación a la estatura media  de todos los alumnos de un
plantel del CCH con la suposición de que ésta (estatura media) se distribuye normalmente. Con este fin
se analiza una realización de la muestra aleatoria
X 1 , X 2 , X 3 , X 4 , X 5 , X 6 , X 7 , X 8 , X 9 , X 10
de diez de ellos, obteniéndose los datos
166, 168, 170, 172, 168, 164, 174, 170, 172, 166 .
A partir de ellos y utilizando la estadística
X  X 2  X 3  X 4  X 5  X 6  X 7  X 8  X 9  X 10
X 1
10
^
obtenemos un estimador puntual del parámetro  y obtenemos 
^ 166  168  170 172 168  164  174  170  172 166
x  169 .
10
b. Se desea efectuar una inferencia con relación a la proporción real p de alumnos “regulares”
matriculados en la UNAM, suponiendo que tal característica se distribuye binomialmente. Con este fin
se revisó una realización de una muestra aleatoria de diez alumnos, misma que condujo al resultado
R, I , I , R, R, R, R, R, I , I .
Con los datos anteriores calculamos un valor para la estadística
T  X 1  X 2  X 3  X 4  X 5  X 6  X 7  X 8  X 9  X 10 ,
en donde X i  1 si el alumno es regular y X i  0 si el alumno es irregular,
entonces
 6
T  1 0  0 11111 0  0  6 y p   0.6 .
10
Sección 3.1 Estimación 145

Con base en el valor calculado a partir de la estadística P se puede efectuar una inferencia sobre el
parámetro p . En este caso el parámetro p se ha estimado puntualmente utilizando el estimador

puntual p  0.6 .

Si deseamos caracterizar la variable X (lo que significa que debemos conocen sus parámetros y
como consecuencia su fdp ) que se refiere al comportamiento de una característica de una población,
y que sabemos tiene asociada una distribución de probabilidades que depende del parámetro 
(desconocido), entonces los problemas de inferencia que pueden darse son:
i. De estimación, en los que se busca un valor (estimación puntual) para el parámetro  .
ii. Un conjunto de valores posibles para el mismo (estimación por intervalos de confianza).
iii. De contraste, cuyo objetivo es comprobar si es cierta o falsa cierta suposición sobre el parámetro  .

EJEMPLO 4 (VALORES DE LOS ESTIMADORES)


a. Sea: una población con distribución normal y parámetros  y  2 ,
X1, X 2 , X 3 , X 4 , X 5 , X 6
una muestra aleatoria y
1, 3, 5, 7, 6, 8
una de sus realizaciones.
i. Para estimar el parámetro  utilizaremos la estadística
X1  X 2  X 3  X 4  X 5  X 6
X
n
y el estimador puntual del parámetro  es el número
1 3  5  7  6  8
x  5.
6
ii. Para estimar el parámetro  2 utilizaremos la estadística
n


2
 X
i 1
i X 2
S 
n 1
2
y el estimador puntual de  es el número

s2 
 1  5 2   3  5 2   5  5 2   7  5 2   6  5 2   8  5 2  6.8 .
6 1
b. Sea una población con distribución binomial de parámetro p ,
si X 1 , X 2 , X 3 , X 4 , X 5
es una muestra aleatoria y
1, 0, 0, 0, 1
es una de sus realizaciones, entonces para estimar el parámetro p utilizaremos la estadística
146 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

T  X1  X 2  X 3  X 4  X 5 .
por tanto,
T  1  0  0  0  1  2 , entonces
 2 1
p  es el estimador puntual de p .
6 3

El uso de un estimador (puntual) inadecuado en la estimación del parámetro  , vea la figura 4, en


puede proporcionar estimadores puntuales que varían grandemente para las distintas realizaciones de
la muestra aleatoria; en este caso resulta de mayor utilidad utilizar un intervalo numérico como
estimador del parámetro, vea la figura 5.


 1 
2
 3
  4
 6 5
7 


parámetro estimador del parámetro 
FIGURA 4


1

4 estimadores por intervalo
 del parámetro 
3

2

 
parámetro estimador del parámetro 
FIGURA 5

EJEMPLO 5 (ESTIMADORES)
i. Si deseamos estimar el tiempo promedio de duración de 100 llamadas telefónicas, proporcionar un
“número” como estimador puntual no es tan significativo como el proporcionar un intervalo en el que se
espera se encuentre el tiempo promedio de las llamadas.
ii. Si afirmamos que en un estudio hecho por un profesor, el estimó que la calificación media (promedio)
en las asignaturas de matemáticas oscila entre los 64 y los 76 puntos, y que la investigación se hizo
Sección 3.1 Estimación 147

con un nivel de confianza de 90% , entendemos que la verdadera calificación promedio será un valor
comprendido entre los dos números anteriores y que la probabilidad de que el intervalo  64 , 76  (o
en su caso el intervalo  64 , 76  ) incluya la calificación media real es 0.90 ; en el sentido de: si
efectuamos la estimación un número específico de veces, digamos 50 , las realizaciones de la muestra
aleatoria proporcionarán alrededor de 45 intervalos de confianza que incluirán el promedio real de la
calificación.


Un estimador (aleatorio) por intervalo  del parámetro  , es una estadística de la forma
 
 

  i  X 1 , , X n ,  s  X 1 , , X n
 
en donde los extremos dependen de la realización x1 ,, xn de la MAS X 1 ,, X n e n el cálculo de
 
los estimadores puntuales  I y  S conocidos como extremo inferior y superior, del intervalo, por tanto,
 
son valores específicos de los estimadores  i  X 1 ,, X n y  s  X 1 ,, X n  respectivamente,
vea la figura 6.
realización de la muestra

estimadores por intervalo


 

del parámetro 
5  5i 5s
 
4  4i  4s
 
3  3i 3s
aleatoria

 
2 2i  2s
 
1  1i 2s

 
parámetro

FIGURA 6

En un estimador por intervalos la probabilidad de que el parámetro  esté contenido en un


intervalo específico se representa por 1   y se llama nivel de confianza. Así, para la realización
 
x1 ,, xn de X 1 ,, X n con los estimadores  I y  S en
  

p  I    S   1  
 
se obtiene el estimador
 
 I  S
148 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

llamado “intervalo de confianza de  1    100% para el parámetro  ” o “estimador por intervalo del
parámetro  ”. La formalización de los conceptos anteriores se encuentra en la definición 3.

DEFINICIÓN 3 (INTERVALO DE CONFIANZA O ESTIMADOR POR INTERVALO)


 
Sean:  un parámetro, X 1 ,, X n una muestra aleatoria,  I y  S estadísticas correspondientes al
parámetro  , entonces:
a. p   I     S   1   es el intervalo aleatorio de confianza para  .
 

 
 
b. Si x1 ,, xn , es una realización de la MAS X 1 , , X n , entonces  I     S es un intervalo de
confianza para el parámetro  con el nivel de confianza 1   .
 
c.  I es el límite inferior de confianza y  S es el límite superior de confianza.
 
d. L   S   I es la amplitud del intervalo de confianza.

La figura 7 ilustra los elementos que involucra un intervalo de confianza.

f
distribución
del
estadístico

nivel de
confianza
( 
) 
  
S estadístico
I parámetro
límite inferior límite superior
de confianza de confianza

FIGURA 7

El nivel de confianza 1   indica la fiabilidad del estimador por intervalo, esto es, la probabilidad
de que contenga al parámetro de interés, habitualmente se toman niveles de confianza como 90% ,
95% o 99% (correspondientes a las probabilidades  de 0.10 , 0.5 y 0.01 respectivamente, de que
el valor del parámetro objetivo no esté contenido en el estimador por intervalo o intervalo de confianza).
El lector debe tener en cuenta que el uso de un alto nivel de confianza en la construcción de un
intervalo de confianza implica una amplitud relativamente grande de él(a mayor nivel de confianza
seleccionado, mayor amplitud del intervalo de confianza), por tanto, se pierde precisión en la estimación
real del parámetro objetivo. En la construcción del intervalo de confianza del  1    100% para un
parámetro específico  , se utiliza una estadística (variable aleatoria) que lo incluya y la distribución de
Sección 3.1 Estimación 149

probabilidad correspondiente. Dado que la distribución de probabilidad normal modela el


comportamiento de poblaciones que incluyen parámetros  y  2 , el desarrollo metodológico que
realizaremos se referirá a poblaciones normales (o aproximadamente normales).
En la construcción del intervalo de confianza para  supondremos que la varianza real (o
poblacional)  2 de la población es conocida (o si es el caso que el tamaño de la muestra es mayor o
igual que 30 ), por tanto, bajo estas hipótesis la distribución muestral de la estadística X (de acuerdo
con el teorema del límite central) se comporta normalmente y tiene parámetros:
2
 X  E  X    ,  X2  V  X   .
n
Sean: 100  1    % el nivel de confianza y z 2 el cuantil que deja área (o probabilidad)  2 a su
derecha (equivalentemente un área o probabilidad de 1  z 2 a su izquierda) vea la figura 8. El
intervalo aleatorio de confianza es

p  z 2  Z  z 2  1   , 
pero
X 
Z ,
 n
entonces
 X  
p   z 2   z 2   1 .

  n 

f(z)

 

 
( )
- z z  z

FIGURA 8

Multiplicando por

n
todos los miembros de la inecuación anterior obtenemos
   
p   z 2  X    z 2   1   ,
 n n 
150 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

   
o bien p   X  z 2     X  z 2   1   .
 n n 
Multiplicando por  1 los miembros de las desigualdades y reacomodándolos obtenemos el intervalo
aleatorio de confianza
   
p  X  z 2    X  z 2   1  
 n n 
Para obtener el estimador por intervalo del parámetro  se realiza la muestra aleatoria
X 1 , , X n (extraída de una población con varianza conocida  2 ) y se estiman, tanto ŝ 2 como
X  x , luego
  s s
x  z 2    x  z 2 , o bien x  z 2    x  z 2 .
n n n n

PROPOSICIÓN 1 (INTERVALO DE CONFIANZA O ESTIMADOR POR INTERVALO PARA  )


Sea x1 ,, xn una realización de la MAS X 1 ,, X n extraída de una población normal con
parámetro  .
a. Si  0 es conocida, entonces un intervalo de confianza de  1   100% para  es
 
x  z 2 0    x  z 2 0 .
n n
b. Si  0 es desconocida pero n  30 , entonces un intervalo de confianza de  1   100% para 
es
s n1 s n1
x  z 2    x  z 2 .
n n
En ambos casos z 2 es el valor de la distribución normal estándar Z que deja un área (o
probabilidad) de  2 a su derecha.

Un proceso similar al anterior conduce a un intervalo de confianza para la proporción real p .

PROPOSICIÓN 2 (INTERVALO DE CONFIANZA O ESTIMADOR POR INTERVALO PARA p )



Sea p la proporción de éxitos en la ejecución de las variables aleatorias X 1 ,, X n de tamaño
n  30 , el intervalo de confianza de  1   100% para el parámetro binomial p es
   
 pq  pq
p  z 2  p  p  z 2 ,
n n
donde z 2 es el valor de la distribución normal estándar Z que deja un área (o probabilidad) de  2
 x
a su derecha, p  el valor de la proporción y x la cantidad de éxitos.
n
Sección 3.1 Estimación 151

EJEMPLO 6 (INTERVALO DE CONFIANZA PARA  )


Se midió la concentración de azúcar en el contenido de una muestra de 49 refrescos Pascual cuyo
envase indica “contenido 355 mililitros”. Se encontró una media aritmética de 36 gramos; si suponemos
que la desviación estándar del contenido de azúcar en la población es   4 , entonces un intervalo de
confianza del 95% para la concentración media de azúcar se construye de la siguiente forma.
La confianza del 95% implica  1   100%  95% , es decir,   0.05 y  2  0.025, el valor del
percentil correspondiente es
z0.025  1.96 ,
por tanto,
4 4
36  1.96    36  1.96 ,
49 49
o bien
34.88    37.12 .
Se tiene una confianza de 95% , de que el verdadero valor de  se encuentra entre los números
34.88 y 37.12 : También el 95 % de las realizaciones de la muestra aleatoria tienen un contenido
medio de azúcar entre 34.88 y 37.12 gramos.

EJEMPLO 7 (INTERVALO DE CONFIANZA PARA  )


Cierta institución bancaria financió a las personas que deseaban cambiar su automóvil. Al revisar 200
solicitudes encontró una solicitud de préstamo promedio de 120000 pesos. Si se supone que
  20000 y una distribución normal en el monto de préstamos, un intervalo de confianza de 90%
para el préstamo medio se construye como sigue:
si  1    100%  90% ,
entonces
  0.10 y  2  0.05 .
En las tablas de percentiles normales observamos
z0.05  1.645,
por tanto,
20000 20000
120000 1.9645    120000 1.9645 ,
200 200
o bien
117673.62    122326.38 .
Se tiene una confianza del 90% de que el valor medio de los préstamos se encuentra en el intervalo
117673.62    122326.38
(el 90% de las realizaciones de la muestra aleatoria tiene un valor medio comprendido entre
117673.62 y 122326.38 pesos).
152 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

EJEMPLO 8 (INTERVALO DE CONFIANZA PARA p )


Un estudio sobre los gustos musicales realizado a n  500 estudiantes universitarios (seleccionados al
azar) mostró que x  340 de ellos escuchan la estación radiofónica “La Zeta”. Construyamos un
intervalo de confianza del 98% para la proporción real de universitarios que escuchan “La Zeta”.
i. De  1    100%  98% obtenemos   0.02 o bien  2  0.01.
En las tablas de los percentiles normales observamos z0.025  2.326 .
ii. El estimador puntual de la proporción real p es

p  340 500  0.68 .
iii. El intervalo de confianza es:

0.68  2.326
 0.68  0.32   p  0.68  2.326  0.68  0.32  ,
500 500
o bien
0.631 p  0.729.
iv. Se tiene una confianza del 95% de que la proporción real de estudiantes que escucha “La Zeta” se
encuentra en el intervalo
 0.631 , 0.729  .

EJEMPLO 9 (INTERVALO DE CONFIANZA PARA p )


Un vendedores timó la proporción real de estudiantes que desayunan “una torta” algún día de la
semana. Seleccionó una muestra aleatoria de n  100 estudiantes y observó que x  64 lo hacen. En
la construcción de un intervalo de confianza de 99% para la verdadera proporción de estudiantes que
desayunan “una torta” algún día de la semana:
i. De  1   100%  99% obtenemos   0.01, en consecuencia  2  0.005 .
En las tablas de los cuantiles normales observamos z 0.005  2.576 .
El estimador puntual de la proporción real p es

p  64 100  0.64 .
ii. Por tanto,

0.64  2.575
 0.64  0.36   p  0.64  2.575  0.64  0.36  ,
100 100
o bien
0.516  p  0.764 .
iii. Se tiene una confianza del 99% de que la verdadera proporción p de los estudiantes que
desayunan “una torta” algún día de la semana se encuentra en el intervalo
0.5164  p  0.7636.
Sección 3.1 Estimación 153

En un intervalo de confianza, un aumento en el nivel de confianza implica un aumento en su amplitud;


así mismo, un aumento en la variabilidad (error e ) del estimador puntual respecto al valor real del
parámetro, vea la figura 9.

f(Z) f(Z)

 
 
    

Z Z
- z   z  - z   z 
 
error máximo error máximo
amplitud del intervalo amplitud del intervalo

f(Z) f(Z)

 
 
     
Z Z
- z   z  - z   z 
 
error máximo error máximo
amplitud del intervalo amplitud del intervalo

FIGURA 9

La proposición 3 (dos partes) formaliza las observaciones anteriores y proporciona un método para
calcular el tamaño de muestra n cuando se conocen ciertas características del estimador por intervalos.

PROPOSICIÓN 3.a. (ERROR MÁXIMO RELATIVO, TAMAÑO DE MUESTRA)


Sean: un intervalo de confianza del  1   100% para  , y x un estimador puntual del parámetro
 , entonces:
i. El error máximo que se cometerá será menor a

e  z 2 .
n
ii. El error será menor que e si el tamaño de muestra es
2
 z 2 
n    .

 e 
154 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

PROPOSICIÓN 3.b. (ERROR MÁXIMO RELATIVO, TAMAÑO DE MUESTRA)



Sean: un intervalo de confianza del  1   100% para p y p el estimador puntual de p , entonces:
 
pq
i. El error máximo que se cometerá será menor a e  z 2 .
n
2
 z   
ii. Si el error cometido es menor que e , entonces el tamaño de muestra será n    2  p q .
 e 
z 2 2
iii. El error cometido no excede e cuando el tamaño de muestra es n  .
4e 2

EJEMPLO 10 (ERROR MÁXIMO Y TAMAÑO DE MUESTRA EN UNA MEDIA)


El estimador por intervalo del valor real de la media de las estaturas de los niños menores a 10 años
matriculados en cierta escuela primaria arrojó como resultado
98    106 , si x  102 ,   10
y se utilizó un nivel de confianza es 99% .
a. Para determinar el error máximo que se comete ( e ) al utiliza x como estimador puntual del
parámetro  , utilizando
 
 S  x  z 2
n
obtenemos e  ˆS  x , por tanto,
e  106  102  4 .
b. El tamaño de la muestra utilizada si el error cometido es menor que e es
2
   2.58 10 
2
 z 2
n        42 .
 e   4 

EJEMPLO 11 (ERROR MÁXIMO Y TAMAÑO DE MUESTRA)


La organización médica “Santísima” obtuvo
4.45    5.15
como estimador por intervalo, en referencia al número promedio de días de hospitalización requeridos
por los pacientes sometidos a cierta cirugía. La realización de una muestra aleatoria proporcionó una
estancia promedio de 4.8 días con una desviación estándar de 2.6 días y se utilizó el nivel de
confianza del 90% .
a. El error máximo cometido ( e ) al utilizar x como estimador puntual del parámetro  , es
 
 S  x  z 2
n
o bien
Sección 3.1 Estimación 155


e  S  x .

De x  4.8 y  S  5.15 , obtenemos e  5.15  4.8  0.35 .
b. Para determinar el tamaño de muestra utilizado ( n ), de  1   100%  90% obtenemos   0.10
y en las tablas de percentiles normales observamos
z 2  z 0.05  1.645 .
Si s  2.6 es estimador puntual de  , entonces
  1.645  2.6  
2
n   149 .
 0.35 

EJEMPLO 12 (ERROR MÁXIMO Y TAMAÑO DE MUESTRA)


Se estimó, con una confianza del
 1    100%  95% ,
que los plátanos machos de la compañía “Bananas Juanita”, tienen una longitud media de 18.5

centímetros. Si el error es menor que 0.05 cuando se utiliza p  0.12 como estimador puntual de la
proporción real p , puesto que e  0.05 ,
 1    100%  95% y z 0.25  1.96 ,
entonces el tamaño de muestra es
2
 1.96 
n   0.12  0.88   162 .
 0.05 

EJEMPLO 13 (ERROR MÁXIMO Y TAMAÑO DE MUESTRA EN UNA PROPORCIÓN)


La proporción de naranjas con peso menor a 150 gramos en las cajas de la compañía frutera “Yus
S.A.” es desconocida. Para determinar el tamaño de muestra, con una confianza 95% de que el error

cometido en la estimación sea menor a 0.05 , dado que es desconocido el estimador puntual p de la
proporción real p y que e  0.05 ,  1   100%  95% y z 0.25  1.96 , tendremos
2 2
 z 2   1.96 
n     
   384 ,
 2 EMáx   2  0.05  
aproximadamente 384 naranjas.
156 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

PROBLEMAS PROPUESTOS

1. ESTIMADORES PUNTUALES 3. ESTIMADORES POR INTERVALO


Sean: una población con distribución normal Determina estimadores por intervalo en cada
con parámetros  y  2 , la muestra aleatoria una de las siguientes situaciones:
X1 , X 2 , X 3 , X 4 , X 5 , X 6 , X 7 , X 8 a. Su ingreso promedio para el próximo año.
b. Proporción de votos que obtendrá el PRI
y 2, 6, 5, 7, 5, 7, 5, 8 una de sus
en las próximas elecciones federales.
realizaciones. c. Su tiempo de vida.
i. Determina el estimador puntual de  d. El número de frijoles en una bolsa que
utilizando la estadística X . contiene un kilogramo.
ii. Determina el estimador puntual de  2 e. El número de litros de agua que utiliza en
utilizando la estadística una semana.
f. La proporción de mujeres que estudian en el
 X 2
n

i X plantel Oriente del CCH.


S2  i 1
. g. La proporción de refrescos de cola que
n 1
b. Sea una población con distribución binomial consumirás el próximo mes.
y parámetro p , si
4. CARACTERÍSTICAS DE LOS
X1, X 2 , X 3 , X 4 , X 5 , X 6 , X 7 , X 8
ESTIMADORES
es una muestra aleatoria y la realización Determina: el parámetro objetivo, el nivel de
1, 0, 1, 1, 0, 0, 0, 1 de la muestra aleatoria. confianza, la longitud del intervalo y los límites
Determine el estimador puntual de p de confianza.
utilizando T (total).   

a. p  I    S   0.98 y
 
2. ESTIMADORES PUNTUALES 10.4    16.8 .
a. Proporciona tres ejemplos de posibles   

estimadores de puntuales para  . b. p  I  p  S   0.90 con
 
b. ¿Qué estimadores puntuales de  2 0.72  p  0.93 .
conoce?   

c. ¿Cómo estimaría el número de pelos que c. p  I    S   0.99 y
 
tiene un perro?
0.4    10.3 .
d. ¿Cómo estimaría el número de alumnos de
la escuela dónde estudia?
Sección 3.1 Estimación 157

5. Ordena los intervalos de confianza para  10. Un examen sobre las habilidades físicas
respecto a su nivel de confianza. aplicado a 120 aspirantes a Guardias
a. 10.4    16.8 . Nacionales dio una calificación media de 77.8
b. 10.8    16.2 . y una desviación estándar de 11.1 ;
suponiendo que la población de calificaciones
c. 10.0    17.8 .
se distribuye normalmente. Construye
intervalos al 95 % de confianza para la media
6. Ordena los siguientes intervalos de
real de las calificaciones de habilidades físicas
confianza para la proporción real p respecto a
de los aspirantes.
su nivel de confianza.
a. Del 95% .
a. 0.4  p  0.82 .
b. Del 99% .
b. 0.33  p  0.89 .
c. 0.45  p  0.78 .
11. El jefe de personal de “Gorilas” S. A. tomó
33 estaturas de los aspirantes al puesto de
7. ¿Son posibles los intervalos de confianza
vigilante, observó: x  165 centímetros y
para la proporción real p ? Justifica tu
s  2.4 centímetros.
respuesta. a. Construye un intervalo al 95% de confianza
a. 1.74  p  7.12 .
para la media real de las estaturas de todos los
b. 10.74  p  17.98 . aspirantes a vigilantes.
c. 0.53  p  0.88 . b. Construye un intervalo de confianza para la
media real de las estaturas de los aspirantes a
8. Construye intervalos de confianza vigilantes.
apropiados para estimar  . a. Del 95 % .
a. n  100 , x  10 ,   2 y   0.05 . b. Del 90% .
b. n  625, x  125,   9 y 1    0.99 .
c. n  64 , x  100 ,   12 y 1    0.95 . 12. Suponga que el tiempo de vida útil de las
baterías “Energizer” alcalinas en cierto
9. Se analizó una muestra aleatoria de 100 dispositivo electrónico se distribuye
edades de ciudadanos de una población con normalmente; se probó una muestra aleatoria
media desconocida  y desviación estándar de 77 baterías ellas para determinar su tiempo
  4.5 . Si una ejecución promedió x  28.3 de vida, la muestra produjo x  152 minutos y
años construya un intervalo de confianza para s  5 minutos. Construye un intervalo al 99%
 . Determina el ancho de cada intervalo y de confianza para el verdadero tiempo
compara los resultados. promedio de funcionamiento de las baterías
a. 90% . Energizer utilizadas en ese tipo de dispositivo
electrónico.
b. 95% .
c. 99% .
158 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

13. Construya intervalos de confianza a. Determine el error máximo cometido en la


apropiados para estimar la proporción real p estimación anterior sí 1    0.99 .
si: b. Construya un intervalo del 99 % de
a. n  400 , x  100 ,   0.05 . confianza para la verdadera proporción de
b. n  500 , x  125 , 1    0.90 . roedores que mueren al ser fumigadas con
c. n  1500 , x  900 , 1    0.98 . “Bayer”.

14. Un estudio efectuado a 672 solicitudes 18. De 350 estudiantes encuestados acerca
sobre devolución de impuestos emitidas por el del tipo de cerveza preferida, 161 de ellos
“SAT”, mostró que 448 dieron lugar a pagos indicaron que prefieren la cerveza obscura
adicionales. sobre cualquier otro tipo. Construya intervalos
a. Construya un intervalo del 95 % de de confianza para la proporción real de
estudiantes que prefieren la cerveza obscura.
confianza para estimar la verdadera proporción
de todas las solicitudes de devolución de a. De 99 % .
impuestos, emitidas por el SAT que dan lugar a b. De 98% .
pagos adicionales.
b. Determine el error máximo cometido en la 19. Una muestra aleatoria de 249 fumadores,
estimación anterior. mostró que 87 % considera que el fumar es un
placer.
15. Los oxímetros de la marca “NK” utilizados a. Construya un intervalo del 92 % de
por 500 marineros de la aduana de Manzanillo confianza para la verdadera proporción de
fallaron en 20 ocasiones. fumadores que considera el fumar un placer.
a. Construya un intervalo del 95 % de b. Construya un intervalo del 90 % de confianza
confianza para la proporción real de oxímetros para la verdadera proporción de fumadores
que fallarán, interprete su resultado. que considera el fumar un placer.
b. Determine el error máximo cometido en la
estimación anterior. 20. Un tratamiento contra las “diarreas
cerebrales” en las personas, da esperanza de
16. Se revisó el contenido de una muestra disminuirlas, e incluso a producido bastantes
aleatoria de 25 “cocas” con la leyenda curas. Un especialista en el tratamiento de ese
“contenido neto 600 mililitros”. Se observó que mal afirma que una nueva técnica las
sólo 20 de ellas tuvieron el contenido indicado. disminuyó considerablemente en 50 de 104
Construya un intervalo del 95% de confianza personas. Construye un intervalo de confianza
para la verdadera proporción de “cocas” que no para la proporción real de personas en las que
contienen la cantidad indicada en la etiqueta el tratamiento hace disminuir significativamente
la “diarrea cerebral”.
17. Al fumigar con “Bayer” cierto terreno baldío, a. De 95 % .
38 de 60 roedores que fueron recolectadas b. De 99% .
murieron 5 minutos después.
Sección 3.1 Estimación 159

21. En un estimador por intervalos para  : 25. Un grupo estudiantil quiere estimar el
e  0.0413 y   0.6 con un nivel de porcentaje de personas que están satisfechas
confianza de 95% . con la comida que se expende en la cafetería
a. ¿Qué tamaño de muestra utilizó? del plantel. Determina el tamaño del grupo que
b. Si x  3.6 , ¿cuáles son los límites de debe estudiarse si se quiere tener un 92 % de
confianza? confianza en que la verdadera proporción de
p difiere en menos de un punto porcentual de
22. Para estimar la media real de los diámetros 
la estimación p .
de los tornillos que produce “Rugo” S. A. se
utilizó una muestra aleatoria de tamaño n . Si
e  0.01 y s  0.1 milímetros. Con un nivel de 26. Sea una población distribuida
confianza de 99 % , determina n si se utiliza x normalmente, con varianza conocida. ¿Cuál es
el nivel de confianza?
para estimar  , interpreta el resultado.
 
a. x  2.81    x  2.81 .
n n
23. Para estimar la longitud media de las
 
alturas de los tornillos, en milímetros, que b. x  1.73    x  1.73 .
n n
expende Ferro S. A. se utilizó una muestra
aleatoria de tamaño n de ellos. Si e  0.005 ,
27. Una muestra aleatoria de 50 bolsas de
s  0.4 y el nivel de confianza es 98% ,
caramelos, envasados por una máquina
determina n si se utiliza x para estimar  , automática, mostró un contenido promedio de
interpreta el resultado. 251 gramos con s  10.5 gramos, determina
el nivel de confianza para e  0.06 .
24. Un pediatra quiere estimar el porcentaje de
oxígeno en la sangre de los recién nacidos, y 28. Una cafetera automática se ajusta de modo
un estudio previo ha sugerido que este valor es que libere cierta cantidad de café en un vaso
del 68% . donde será mezclado con agua caliente. De
a. Si desea no errar por más de 2 % con un una muestra aleatoria de 36 bebidas se
nivel de confianza de 90% , encuentra el obtiene x  300 mililitros con una desviación
tamaño de muestra requerido. estándar s  1 mililitros. Sí e  0.3 determina
b. Si no se cuenta con una estimación previa, el nivel de confianza sí e  0.3 .
¿qué tan grande debe ser la muestra?
3.2 PRUEBA DE HIPÓTESIS PARA LA MEDIA
Y LA PROPORCIÓN POBLACIONAL

¿Qué debe aprender?


4. Analiza el concepto de prueba de hipótesis, para una media y para
una proporción, bajo las condiciones del Teorema del Límite Central.
5. Construye pruebas de hipótesis para la media y la proporción,
preferentemente con el uso de la calculadora o la computadora en
el contexto de una investigación o un problema.
6. Mide la validez de una hipótesis estadística para la media o para la
proporción, en el contexto de una investigación o problema.
7. Evalúa las características de interés en una población, de manera
formal, a partir de los datos de una muestra, en el contexto de una
investigación o un problema.

¿Por qué debe aprenderlo?


Frecuentemente en un problema de inferencia estadística no es el
estimar un parámetro (puntualmente o por un intervalo), sino conocer
cuál de dos hipótesis relativas al valor de un parámetro es la correcta.
Los métodos y elementos teóricos para lograr esto pertenecen a la
parte de la inferencia estadística conocida como prueba de hipótesis.

Temática
Elementos que componen una prueba de hipótesis.
Aplicación e interpretación de resultados.
Sección 3.2 Pruebas de hipótesis para la media y la proporción 161

Es posible inferir los valores reales (parámetros) poblacionales de distintas formas, utilizando un
estimador por intervalo o a partir de un estimador puntual. En inferencia estadística una prueba de
hipótesis es un proceso utilizado para decidir cuándo se puede aceptar o rechazar una afirmación
hecha sobre el valor de un parámetro de una población (o de su distribución de probabilidad) en función
de las evidencias que proporcionan un conjunto de datos obtenidos de ella (muestra). Así, cuando el
objeto de la investigación se relaciona con la determinación de cuál de dos suposiciones, sobre un
parámetro, es la correcta, los métodos y técnicas relacionadas para decidir sobre esta problemática
forman parte de la inferencia estadística denominada prueba de hipótesis.

EJEMPLO 1 (HIPÓTESIS ESTADÍSTICAS)


a. Si X ~ b  x , 12 ,   , entonces la afirmación   0.8 es una hipótesis estadística.
b. Si X ~ N   , 16  , entonces la afirmación   130 es una hipótesis estadística.

Un proceso de prueba de hipótesis es esencial en la justificación de la decisión que se toma en


relación a la selección de uno de dos enunciados (o hipótesis, competitivos entre sí, mutuamente
excluyentes y complementarios), respecto al valor de un parámetro de la población en estudio. Los
enunciados competitivos se conocen como hipótesis nula y alternativa, respectivamente. Con base en lo
antes señalado es necesario señalar los atributos que deben poseer las hipótesis:
i. Deben referirse a una situación real.
ii. Las variables presentes en su planteamiento son precisas, comprensibles, concretas y estar
relacionadas con técnicas disponibles para probarlas.
iii. Los términos y las relaciones planteadas son observables y medibles.
La hipótesis inicialmente favorecida como verdadera, se llama hipótesis nula y se representa por H 0 ,
esta hipótesis se refiere al no cambio del parámetro objetivo y se plantea en términos de alguna de las
frases: “es igual”, “no mejora”, “no cambia”, etc., y se formula con la intención de rechazarla; la otra
hipótesis involucrada es la hipótesis alterna y es la negación de la hipótesis nula, se representa por H a ,
representa la conclusión que el investigador quiere demostrar o afirmar tras su estudio, es decir, validar.
La certeza de una hipótesis estadística no se conoce de manera absoluta, a menos que se estudie
completamente la población (lo que generalmente es impráctico o imposible), entonces “su aceptación”
sólo significa que los datos muestrales no proporcionan la suficiente evidencia como para rechazarla,
por tanto, “su rechazo” significa que la evidencia muestral la contrasta”.
Formalmente:

DEFINICIÓN 1 (HIPÓTESIS ESTADÍSTICAS)


a. Una hipótesis estadística es una afirmación sobre el valor de un parámetro de una población.
b. La hipótesis nula es una afirmación acerca de un parámetro que inicialmente se supone válida, se
representa por H 0 .
c. La hipótesis alternativa es la afirmación que se contrapone a la hipótesis nula, se representa por Ha
162 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

EJEMPLO 2 (HIPÓTESIS ESTADÍSTICAS)


a. Para una población distribuida normalmente y con parámetros  y  2 , son ejemplos de hipótesis
estadísticas:
i. H :   20 .
ii. H :  2  16 .
iii. H :    0 .
b. Si una población sigue una distribución Binomial con parámetro p , la proporción de éxitos, las
siguientes afirmaciones son hipótesis estadísticas:
i. H : p  0.20 .
ii. H : p  0.16 .
iii. H : p  p0 .
iv. H : p  0.1 .

El proceso que conduce a tomar una decisión sobre una hipótesis estadística particular recibe el
nombre de prueba de hipótesis y dependen del uso de la información contenida en la realización de una
muestra aleatoria de la población de interés, incluye:
a. La hipótesis nula representada por H 0 , es la hipótesis de investigación sobre el valor del (los)
parámetro(s) objetivo(s),
b. La hipótesis alternativa, representada por H a es negación o contrastación de la hipótesis nula.
c. Un procedimiento de prueba incluye una regla (basada en la información contenida en una muestra)
que se utiliza para determinar si se rechaza o no se rechaza H 0 . Este procedimiento de prueba incluye
las partes:
i. El cálculo de un valor específico de una estadística de prueba sobre la que se basa la decisión de
aceptar o rechazar H 0 .
ii. La regla de decisión, incluye todos los valores de la distribución muestral para los que se rechaza la
hipótesis nula H 0 y que se conoce como región de rechazo o región crítica ( RR ).
iii. La toma de una decisión, fundamentada en la estadística de prueba y en la región de rechazo (o
región crítica). Si para la realización x1 , x2 , x3 , , xn de la MAS el valor calculado de la estadística
de prueba se localiza en la región de rechazo, se rechaza la hipótesis nula H 0 y se acepta la hipótesis
alternativa H a . Si el valor calculado de la estadística de prueba no se localiza en la región de rechazo,
simplemente no se rechaza H 0 .

Para un parámetro objetivo  existen tres formas de plantear la hipótesis nula H 0


correspondiente, ellas son:
H 0 :    0 ,    0 o también    0 ,

y en todos los casos se representan por H0 :    0 , teniendo en cuenta su contexto inicial.


Sección 3.2 Pruebas de hipótesis para la media y la proporción 163

EJEMPLO 3 (PLANTEAMIENTO DE UNA HIPÓTESIS ALTERNATIVA)


a. Si H 0 :   10 , entonces la hipótesis alterna es
H a :   10 ,
Si H 0 :   10 , entonces la correspondiente hipótesis alterna es
H a :   10 .
Si H 0 :   10 , entonces la hipótesis alterna es
H a :   10 .
b. Si H 0 : p  0.31, la hipótesis alterna es
H a : p  0.31.
Si H 0 : p  0.10 , entonces
H a : p  0.10 .
Si H 0 : p  0.28 , a hipótesis alterna es
H a : p  0.28 .

Un proceso de prueba de hipótesis se clasifica de acuerdo con el tipo de hipótesis alternativa


planteada, vea la definición 2.

DEFINICIÓN 2 (TIPOS DE PRUEBAS DE HIPÓTESIS)


a. Si H 0 :    0 contra H a :    0 , entonces la prueba se denomina bilateral o de dos colas.
b. Si H 0 :   0 contra H a :    0 , la prueba se denomina unilateral derecha o de cola derecha.
c. Si H 0 :    0 contra H a :    0 , la prueba se denomina unilateral izquierda o de cola izquierda.

EJEMPLO 4 (PLANTEAMIENTO DE UNA HIPÓTESIS ALTERNATIVA)


a. Si se afirma: “la proporción de desempleados de cierta ciudad es
H 0 : p  0.34 , entonces H a : p  0.34
y se requiere una prueba bilateral o de dos colas.
b. Para la afirmación “la proporción de alumnos que no utilizan tenis es menor al 30% ”, es decir
H 0 : p  0.30 (se escribe p  0.30 ), entonces H a : p  0.30 ,
se requiere una prueba unilateral derecha o de una cola derecha.
c. Para la afirmación “la edad promedio de los estudiantes que cursan estadística es mayor a 19 años”,
entonces
H 0 :   19 y H a :   19
y se requiere una prueba unilateral izquierda o de una cola izquierda.
d. Para la afirmación “el peso promedio de las tortas que expenden en cierto comercio es menor a 220
gramos”, la hipótesis nula es
164 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

H 0 :   220 (se escribe   220 ), H a :   220


y se requiere una prueba unilateral de cola derecha o de cola derecha
e. En la afirmación “el tiempo promedio en que un estudiante termina su bachillerato es tres años”,
H 0 :   3 , por tanto, H a :   3
y se requiere efectuar prueba bilateral o de dos colas.

En el proceso de prueba de hipótesis la región crítica o región de rechazo está constituida por los
valores de la distribución del estadístico más lejanos del supuesto valor de la hipótesis nula, por tanto,
resulta poco probable que el estadístico de prueba los asuma suponiendo que H 0 es verdadera. La
figura 1 muestra la región de rechazo (o región crítica) y de aceptación (no rechazo) de la hipótesis nula
H 0 respecto a un parámetro específico.

e e e
H := vs Ha :  = a s H :> vs Ha :   a s H :< vs Ha :   a s
0 0 0 0 0 0
t t t
a a a
d d d
í í í
s s s
t t t
i i i
c c c
o o o
  
región región región región
de de de estadístico de
rechazo rechazo rechazo rechazo

FIGURA 1

La probabilidad asociada a los valores del estadístico para los que la hipótesis nula H 0 se rechaza
se conoce como nivel de significación o nivel de significancia y se representa por el símbolo  .

EJEMPLO 5 (REGIONES DE RECHAZO O REGIONES CRÍTICAS)


a. La contrastación
H 0 :   2.5 contra H a :   2.5 ,
requiere de una prueba unilateral derecha.
b. La contrastación
H 0 : p  0.58 contra H a : p  0.58 ,
requiere de una prueba unilateral izquierda.

En una de prueba de hipótesis es posible cometer errores en la toma de una decisión (lo que
puede deberse a que la información que proporciona la muestra aleatoria es limitada), por ejemplo, el
rechazar la hipótesis nula siendo verdadera o no rechazarla siendo falsa, en ambos casos se ha
cometido un error y en cada caso el error recibe un nombre específico, vea el cuadro 1.
Sección 3.2 Pruebas de hipótesis para la media y la proporción 165

H0
no se
rechaza se rechaza

decisión error
verdadera
correcta Tipo I
H0
error decisión
falsa
Tipo II correcta

CUADRO 1

La definición 3: formaliza los errores antes señalados, les asigna una probabilidad y establece la
notación y el nombre con el que nos referiremos a ellos.

DEFINICIÓN 3 (TIPOS DE ERRORES EN PRUEBAS DE HIPÓTESIS)


a. Si se rechaza la hipótesis nula H 0 :    0 siendo verdadera se comete error tipo I .
b. Si se no se rechaza la hipótesis nula H 0 :   0 siendo falsa se comete error tipo II .
c. La probabilidad de cometer error tipo I se denomina nivel de significación (o significancia) y se
denota por la letra griega  (alfa).
d. La probabilidad de cometer error tipo II se representa por la letra griega  (beta).

El lector debe tener en cuenta:


i. Las probabilidades  y  no corresponden a eventos complementarios.
ii. Las probabilidades  y  no corresponden a eventos complementarios, es decir, los errores tipo
error tipo I y error tipo II no son eventos complementarios.
iii. Al incrementarse  disminuye  y viceversa, al incrementarse  disminuye  .

 

0
0 + c
región de no rechazo región de rechazo

FIGURA 2

La figura 2 muestra la relación entre los errores antes señalados, observe:


166 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

i. Un desplazamiento a la derecha de la línea punteada implica un aumento del tamaño de la región de


no rechazo y, por tanto, una disminución de la probabilidad  pero también un incremento de la
probabilidad  .
ii. Un desplazamiento a la izquierda de la línea punteada implica una disminución del tamaño de la
región de no rechazo y, por tanto, un aumento de la probabilidad  pero también una disminución de la
probabilidad  .
Para facilitar su cálculo, la probabilidad de cometer error tipo I o tipo II se pueden escribir en
función de la región de rechazo (o región crítica) como sigue:
  p  cometer error tipo I   p  rechazar    0 siendo verdadero 
  p  el valor  0 está en la región de rechazo y    0 es verdadera  .
Similarmente
  p  cometer error tipo II   p  aceptar    0 siendo falsa 
  p  el valor de  0 está en la región de no rechazo y  a es verdadera .

EJEMPLO 6 (CÁLCULO DE ERRORES TIPO I Y TIPO II)


El director de un colegio afirma que sólo 25% de los alumnos de recién ingreso a bachillerato terminan
su primer año en forma regular. Con el objeto de verificar la afirmación del directivo se selecciona una
muestra aleatoria de n  20 estudiantes de primer ingreso al término de su primer año escolar, y se
decide rechazar la hipótesis del director si se detectan que menos de ocho ( X  7 ) de ellos lo terminan
siendo regulares. Entonces:
i. Se contrastan: H 0 : p  0.25 contra H a : p  0.25 .
ii. Sea X  Número de alumnos que termina el primer año siendo regulares.
iii. La región de rechazo la constituyen los datos:
X  0, 1, 2, 3, 4, 5, 6, 7 .
La región de no rechazo la constituyen las asignaciones
X  8, 9, 10, 11, 12, 13, 14, 15, 16, 17, 18, 19, 20 .
a. Calculemos el nivel de significación  .
  p  cometer error tipo I   p  rechazar p  0.25 siendo verdadera 
 p  X  7 cuando p  0.25  .
La VAD X se distribuye en forma binomial con parámetros p  0.25 y n  20 , entonces
  p  X  7 cuando p  0.25   B  7 , 20 , 0.25   0.8992.
b. Calculemos  para la alternativa
H a : p  0.20 .
Puesto que
  p   0 está en la región de no rechazo y  a es verdadera 
  p  X  8, si p  0.20   1  B  7 , 20 , 0.20   0.0321.
Sección 3.2 Pruebas de hipótesis para la media y la proporción 167

EJEMPLO 7 (CÁLCULO DE ERRORES TIPO I Y TIPO II)


Un ingeniero desarrolla un nuevo tipo de varilla para los castillos empleados en la industria de la
construcción, afirma que tienen una resistencia media a la ruptura de 15 toneladas con una desviación
estándar de 0.5 toneladas. Para probar la hipótesis H 0 :   15 toneladas contra la alternativa H a :
  15 toneladas se utiliza una muestra aleatoria de 50 varillas. La región de rechazo se define como
0  X  14.9 .
i. Se contrastan
H 0 :   15 contra H a :   15 .
ii. Sea la variable aleatoria: X  resistencia media de las varillas seleccionadas.
iii. Se rechazará H 0 si 0  X  14.9 y no se rechazará cuando X  14.9 (específicamente X  14.9 ).
a. Para determinar el nivel de significación  :
Si H 0 verdadera y X se distribuye normalmente, entonces
 0.5
 X    15 y  X    0.0707 ,
n 50
luego
  p  cometer error tipo I   p  rechazar   15 siendo verdadera 
 0  15 14.9  15 
  p  0  X  14.9 y  X  15   p  Z  
 0.0707 0.0707 
 p   212.16  Z  1.41      1.41      212.16   0.0793 0  0.0793.
b. Para calcular  utilizando la alternativa   14.8 :
Si H 0 :   15 es falsa, la hipótesis alternativa X  14.9 es verdadera y no se rechaza, por tanto,
  p  0 está en la región de no rechazo y  a es verdadera 
 p  X  14.9 sí  X  14.9 
 14.9  14.8 
 p Z    p  Z  1.41      1.41   0.0793.
 0.0707 

EJEMPLO 8 (CÁLCULO DE ERRORES TIPO I Y TIPO II)


Un cantinero afirma que la máquina que deposita la cerveza en los vasos lo hace de manera
aproximadamente normal con media   200 mililitros y desviación estándar de   15 mililitros. Un
inspector, para verificar el contenido de cerveza en los vasos, tomó una muestra de n  9 vasos y
midió el volumen. Estableció la regla: un volumen medio de cerveza en el intervalo 195  X  205
mililitros, indica que la máquina opera adecuadamente; en otro caso se considera que la máquina no
opera correctamente y el volumen medio de cerveza que deposita es   200 mililitros.
i. Se contrastan las hipótesis
H 0 :   200 contra H a :   200 .
ii. Sea la variable aleatoria: X  volumen medio de cerveza en los vasos.
168 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

iii. Se rechaza H 0 , si X  195o bien X  205 mililitros.


a. Determinemos el nivel de significación  considerando   200 verdadera.
  p  cometer error tipo I   p  rechazar   200 siendo verdadera 
  p  X  195 si  X  200   p  X  205 si  X  200  .
Si H 0 :   200 es verdadera, entonces X se distribuye normalmente y
 15
 X    200 ,  X    5.
n 9
 195  200   205  200 
  p Z    p Z    p  Z  1   p  Z  1 
 5   5 
 1  p   1  Z  1   1  D  1   0.3173.
b. Para evaluar la probabilidad de cometer error tipo II , sea H 0 :   200 es falsa y en consecuencia
H a :   210 es verdadera.
 15
 X    210 y  X    5.
n 9
  p   0 está en la región de no rechazo y  a es verdadera 
 195  210 205  210 
p  195  X  205 y  X  210   p  Z  
 5 5 
 p   3  Z  1   0.1587  0.0013 0.1574 .

Revisados los elementos que constituyen una prueba de hipótesis estudiemos los casos
específicos:
a. Prueba de hipótesis para:  con  conocida.
b. Prueba de hipótesis para:  con  conocida o  desconocida pero n  30 .
c. Prueba de hipótesis para: p con n  30 .
Para efectuar una prueba de hipótesis utilizaremos el proceso:
1. Identificar el parámetro objetivo (media o proporción).
2. Determinar el valor nulo, establecer la hipótesis nula y formular la hipótesis alternativa.
3. Efectuar el cálculo del estimador puntual de la estadística de prueba.
4. Utilizar el nivel de significación y establecer la región de rechazo.
5. Localizar el valor del estimador puntual de la estadística de prueba en el gráfico de la
distribución de la estadística de prueba.
6. Determinar si H 0 debe ser o no rechazada y establecer la conclusión en el contexto del
problema.
a. y b. Para:  con  conocida o n  30 .
En estos casos, la muestra aleatoria
X 1 , X 2 , X 3 , , X n
Sección 3.2 Pruebas de hipótesis para la media y la proporción 169

de tamaño n extraída de una población normal la estadística X se distribuye normalmente con


X   y  X   n o  X  s n ,
la estadística Z toma la forma
X  0
Z
 n
bajo la suposición de que la hipótesis H 0 :    0 es verdadera.
Hipótesis nula: Posibles Hipótesis alternativas:
H 0 :   0 H a :   0 , H a :   0 o H a :   0 .
x  0
Estadística de prueba z  .
 n
Región de rechazo para la prueba al nivel  .
f(z) f(z) f(z)

   
- z z  Z z Z - z 0 Z
0 0
región de región de no región de región de no rechazo región de región de región de no rechazo
rechazo rechazo rechazo rechazo rechazo
c. Para: p con n  30 .
Hipótesis nula: Posibles Hipótesis alternativas:
H 0 : p  p0 H a : p  p0 , H a : p  p 0 y H a : p  p0 .
pˆ  p0 x  np0
Estadística de prueba z   .
p0 q0 n n p0 q0
Región de rechazo para la prueba al nivel  .
f(z) f(z) f(z)

   
- z z  Z z Z - z 0 Z
0 0
región de región de no región de región de no rechazo región de región de región de no rechazo
rechazo rechazo rechazo rechazo rechazo

EJEMPLO 9 (PRUEBA DEHIPÓTESIS PARA  )


Para contrastar H 0 :   175 contra H a :   175 , utilizando una realización de una muestra de
tamaño n  49 , suponiendo x  177 y s  7.7 unidades y utilizando un nivel de significación del 5% .
170 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

1. El parámetro objetivo es  .
2. H0 :   175 contra H a :   175.
x  0 177  175
3. Estadístico de prueba z    1.82 ,
s n 7.7 49
(se utilizó la desviación estándar muestral s  7.7 como estimador puntual de  ).
4. Región de rechazo.
Si   0.05 , en las tablas de los percentiles normales se observa
 z 0.025  1.96 y z 0.025  1.96 .
Por tanto, se rechaza H 0 :   175 sí z  1.96 o  z  1.96 .
5. Localización del estadístico de prueba.
f(z)

z = 1.82

0.025 0.025
Z
- 1.96 0 1.96
región de región de no región de
rechazo rechazo rechazo

6. Conclusión: Puesto que el valor de la estadística de prueba no se encuentra sobre la región de


rechazo, no se rechaza la hipótesis H 0 :   175 .

EJEMPLO 10 (PRUEBA DEHIPÓTESIS PARA  APLICACIÓN)


Una cocinera afirma: el contenido medio de queso en los “huaraches” que expende es superior a 50
gramos, sin embargo, un consumidor de esos “antojitos”, piensa que el contenido medio de queso es
menor a 50 gramos. Por otra parte, una realización de una muestra de 25 huaraches proporcionó una
media muestral de 48 gramos de queso con desviación estándar 6 gramos. Suponiendo normalidad y
que se conoce la varianza real, ¿debe rechazarse la hipótesis nula al nivel   0.10 ?
1. Parámetro objetivo  .
2. H 0 :   50 vs H a :   50 .
x  0 48  50
3. Estadístico de prueba z    1.67 .
s n 6 25
4. Región de rechazo.
Si   0.10 , entonces las tablas de la distribución normal dan z  z 0.10  1.282 , entonces se
rechaza H 0 :   50 cuando Z  1.282 .
Sección 3.2 Pruebas de hipótesis para la media y la proporción 171

5. Ubicación del estadístico de prueba.


f(z)

z = - 1.67

0.10
Z
- 1.282 0
región de región de no rechazo
rechazo
6. Conclusión.
Se rechaza H 0 :   50 , a favor de H a :   50 al nivel de significación dado. Se concluye que el
contenido de queso en los huaraches es menor a 50 gramos.

EJEMPLO 11 (PRUEBA DEHIPÓTESIS PARA  APLICACIÓN)


Los diámetros de los pernos producidos por “Ferromex” tienen una desviación estándar real de 0.001
centímetros. Una muestra aleatoria de 10 pernos dio un diámetro medio de 0.2546 centímetros. Para
contrastar la hipótesis “el diámetro medio verdadero es menor a 0.2526centímetros” utilizando el nivel
  0.05 :
1. Parámetro objetivo  .
2. H0 :   0.2526 vs H a :   0.2526.
x  0 0.2546  0.2526
3. Estadístico de prueba z    6.32 .
 n 0.001 10
4. Región de rechazo.
Si   0.05 , de las tablas de percentiles de la distribución normal obtenemos, z  z0.05  1.645, por
tanto, se rechaza H 0 : p  0.2526 en caso de Z  1.645 .
5. Ubicación del estadístico de prueba.
f(z)

z = 6.32

0.05
Z
0 1.645
región de no rechazo región de
rechazo
6. Conclusión.
172 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

Puesto que z  6.32 se localiza en la región de rechazo, se rechaza la hipótesis nula H 0 :   0.2526,
a favor de H a :   0.2526. En realidad, el diámetro medio de los pernos es mayor a   0.2526
centímetros.

EJEMPLO 12 (PRUEBA DE HIPÓTESIS PARA p , APLICACIÓN)


El 60 % de los jóvenes prefiere la coca cola sobre cualquier otra bebida. En una encuesta efectuada a
100 jóvenes se encontró que 70 prefirieron coca cola.
a. Para verificar si la información obtenida es evidencia suficiente para concluir que la proporción de
jóvenes que prefiere coca cola es menor al indicado por el estudio, utilizando   0.05 .
1. Parámetro objetivo p .
2. H 0 : p  0.6 vs H a : p  0.6 .
x  np0 70  60
3. Estadístico de prueba z    2.04 .
n p0 q0 100 0.6  0.4 
4. Región de rechazo.
Si   0.05 , de las tablas de la distribución normal obtenemos z  z 0.05  1.645, por tanto, se
rechaza H 0 : p  0.6 si Z  1.645.
5. Ubicación del estadístico de prueba.
f(z)

z = 2.04

0.05
Z
0 1.645
región de no rechazo región de
rechazo
6. Conclusión.
La estadística de prueba se encuentra en la región de rechazo, se rechaza H 0 : p  0.6 al nivel de
significación indicado, por tanto, la proporción jóvenes que prefieren consumir coca cola es mayor a la
de otras bebidas.
b. La probabilidad que limita el número z  2.04 a su derecha es    2.04   0.0207 , por tanto,
  0.0207 o 2.07% es el nivel de significación mínimo a partir del cual se rechaza la hipótesis nula
H 0 : p  0.60 .
Sección 3.2 Pruebas de hipótesis para la media y la proporción 173

PROBLEMAS PROPUESTOS
1. Sea  0  123 la hipótesis nula b. H 0 :   8 contra H a :   8 .c. H 0 :
correspondiente a un proceso de prueba, si la p  0.33 contra H a :   0.40 .
hipótesis alterna es: d. H 0 :   2.33 contra H a :   2.33 .
a.   100 . b.   123 . Justifique su respuesta.
c.   123. d.   90 .
e.   123 . f.   105 . 6. Si se pretende verificar la hipótesis nula: el
g.   125 . h.   120 . viagra es eficaz. Explique:
Clasifique el tipo de prueba como unilateral o a. En qué condiciones se comete error tipo I .
bilateral. b. En qué condiciones se comete error tipo II .

2. Sea la afirmación “el promedio final de un 7. El director de un Colegio afirma “al menos el
alumno del CCH Oriente es   7.83 ”. Plantee 40% de los estudiantes del quinto semestre es
la hipótesis nula y una hipótesis alterna. irregular”, explique. cómo el director podría
a. El promedio final del alumno no es   7.83 . cometer:
b. El promedio final del alumno es menor a a. Un error tipo I .
  7.83 . b. Un error tipo II .
c. El promedio final del alumno es mayor a
  7.83 . 8. Un administrador quiere verificar, si un
empleado es el ideal para asumir la jefatura de
3. Para la afirmación “la proporción de una sección.
a. ¿Qué tipo de error comete?, si rechaza
estudiantes que alguna vez probó cierta droga”
equivocadamente la hipótesis nula “el empleado
es 37.3% , plantee la hipótesis nula y la
es ideal para la jefatura de la sección”.
hipótesis alternativa.
b. ¿Qué tipo de error comete?, si acepta
4. ¿Cuáles de las afirmaciones no representan equivocadamente la hipótesis nula “el empleado
hipótesis estadísticas? ¿Por qué? es ideal para la jefatura de la sección”.
a. H : p  12 .
9. El director de una escuela se interesa en la
b. H : x  8 . eficiencia de un “curso gratuito” para lograr que
c. H : x  0.33 . más estudiantes se integren a su grupo político.
d. H :   2.33 . a. ¿Qué hipótesis prueba si comete un error del
tipo I al rechazar de manera errónea que el
5. ¿Cuáles pares de afirmaciones no
“curso gratuito” no es efectivo?
corresponden a hipótesis estadísticas, ¿por
b. ¿Qué hipótesis prueba si comete un error del
qué?
tipo II al aceptar de manera errónea que el
a. H 0 :   12 contra H a :   13 .
curso gratuito es efectivo?
174 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

10. El encargado de la fonda “El Hijo de Nada” una muestra aleatoria de tamaño 100 .
considera que la proporción de tortas que a. ¿Cuál es la probabilidad de cometer un error
requieren menos de 8 minutos en su tipo I si se rechaza la hipótesis nula cuando
elaboración es p  0.6 . X  78 centímetros, y de otra manera se
Si en una muestra aleatoria de 10 tortas se acepta?
observa que tres o más requirieron 8 minutos o b. ¿Cuál es la probabilidad de cometer un error
más minutos en su elaboración, entonces la tipo II , si en realidad   77.5 centímetros?
hipótesis p  0.6 debe rechazarse a favor de la
alternativa p  0.6 . 14. Para una población normal con   20
a. ¿Cuál es el nivel de significación si la centímetros se contrastan las hipótesis
verdadera proporción es p  0.6 ?  0  255 contra  a  255 centímetros; con
b. ¿Cuál es el valor de  , si el verdadero valor base en una muestra aleatoria de tamaño
para la proporción es p  0.3 ? n  36 . Se rechaza la hipótesis nula cuando
X  245centímetros o bien, si X  262
Utiliza la distribución Binomial.
centímetros.
a. Determina la probabilidad de cometer un
11. Un químico afirma “el nuevo solvente
error tipo I ;
aplicado a los chicles que se encuentran
pegados en el piso elimina el 70% de ellos”. b. Determina la probabilidad de cometer un
Para verificar su afirmación, el solvente se error tipo II , sí  0  258 .
utilizará a 12 chicles pegados en el piso
(elegidos al azar). Si al menos de 11 chicles 15. Una compañía cosmetóloga desarrolla
son eliminados, se acepta la hipótesis p  0.70 actualmente un nuevo champú y está
en cualquier otro caso se concluye que interesada en la altura de la espuma en
p  0.70 . milímetros que éste genera. La altura de la
espuma se distribuye de forma
a. Evalúe  sí p  0.70 .
aproximadamente normal con   20
b. Evalúe  sí p  0.90 . milímetros. La compañía confronta H 0 :
Utiliza la distribución Binomial.  0  175 contra H a :   175 milímetros,
utilizando una ejecución de una muestra
12. La Dra. Morales afirma: más del 40% de
aleatoria con n  10 . Para la región crítica
los asistentes a su clínica tienen hongos en los
X  185 .
pies. Para probar tal afirmación se revisan siete
pacientes asignados a la doctora. Si tres o más a. Determina  .
de ellos presentan hongos en los pies se acepta b. Determina  si realmente   195
la hipótesis nula H 0 : p  0.40 , de otro modo milímetros.
se concluye H a : p  0.40 . 16. Al encargado del departamento de control
de calidad de la Tres Estrellas, le preocupa que
a. Evalúa  sí H 0 : p  0.40 . el contenido promedio de fibra de las galletas
b. Evalúa  para la alternativa H a : p  0.30 . dietéticas que produce pueda no ser de la
Utiliza la distribución Binomial. cantidad deseada, misma que es de 24
gramos por caja. Si  es el promedio de la
13. En una población distribuida normalmente población de referencia, contraste  0  24
con   8.4 centímetros, se contrastan gramos por caja vs  a  24 gramos por caja.
 0  80 vs  a  80 centímetros con base en
Si una ejecución de una muestra aleatoria de
Sección 3.2 Pruebas de hipótesis para la media y la proporción 175

280 cajas de “galletas dietéticas” proporcionó 20. Se afirma que el 40 % de los fumadores
x  24.08 y s  1 gramos por caja, concluye refieren la marca “delicados”. En una
que se debe rechazar la hipótesis nula y que  realización de una muestra aleatoria de 120
es significativamente diferente a 24 gramos por consumidores de cigarrillos 50 de ellos
caja. Usa   0.05 . prefirieron la marca “delicados”. ¿Estos
resultados presentan evidencia suficiente para
17. Se desea verificar la afirmación “los concluir que la proporción de fumadores
políticos corruptos pasan en promedio 12.8 “delicados” es superior a la indicada por el
meses en prisión”. Un ciudadano analiza una estudio?
realización de una muestra aleatoria de 60 a. Utiliza el nivel de significación   0.05 .
casos y obtiene x  11 meses y s  3.5 b. Utiliza el nivel de significación   0.01.
meses. c. ¿Cuál es el nivel de significación a partir del
a. Contrasta  0  12.8 meses vs  a  12.8 que se rechaza la hipótesis nula?
meses en el nivel de significación de   0.01.
b. Contrasta  0  12.8 vs  a  12.8 meses en 21. Una realización de una muestra aleatoria de
n  1000 caramelos mostró que x  306 de
el nivel de significación de   0.01.
ellos tenían peso distinto al especificado en su
etiqueta.
18. El encargado de la seguridad de cierta
a. ¿Proporcionan los datos evidencia para
empresa quiere verificar la hipótesis “el
suponer p  0.31? Utiliza una probabilidad de
promedio de tiempo real requerido por el
velador para realizar una ronda es 25 minutos. cometer error tipo I de 0.05 .
Una ejecución de una muestra aleatoria de 32 b. ¿Proporcionan los datos evidencia que
rondas del velador promedió 25.8 minutos con indique p  0.31 ? Utiliza una probabilidad de
una desviación estándar de 1.5 minutos: cometer error tipo I de 0.01 .
a. Determina en el nivel 0.05 de significación si
tiene evidencia suficiente para rechazar la 22. Un distribuidor de la revista “Nenas” supone
hipótesis nula  0  25 . que el 58 % de sus clientes renovarán su
b. Determina en el nivel 0.10 de significación si suscripción. Para verificar su afirmación
tiene evidencia suficiente para rechazar la entrevistó a 200 de ellos y 112 le indicaron
hipótesis nula  0  25 a favor de  a  25 . que sí lo harían.
a. ¿Qué hipótesis alternativa debe escoger el
19. Una realización de una muestra aleatoria de editor para determinar si los datos proporcionan
54 camisas, promedió una vida útil media de suficiente evidencia de una reducción de la
65 lavadas y una desviación estándar de 6 proporción p de suscriptores a la revista
lavadas. Se afirma que en condiciones de clima “Nenas”?
templado las camisas tienen una vida útil b. Efectúa la prueba para   0.05 y concluye.
promedio de 80 lavadas. c. Efectúa la prueba para   0.01 y concluye.
a. ¿Puede concluirse, en el nivel de 0.05 de d. Efectúa la prueba para   0.001 y
significación, que su uso en un clima tropical concluye.
reduce la vida útil promedio de las camisas? e. ¿Cuál es el nivel de significación mínimo con
b. ¿Puede concluirse, en el nivel de 0.01 de el que se debe rechazar la hipótesis nula?
significación, que su uso en un clima tropical
reduce la vida útil promedio de las camisas? 23. Un administrador de la línea de autobuses
“Estrella Blanca” sostiene que menos del 6 %
176 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

de los equipajes extraviados no se recuperan. 26. En una realización de una muestra aleatoria
a. Pruebe esta afirmación, si en una ejecución se observó que 80 de 140 accidentes
de una muestra aleatoria 14 de 200 equipajes industriales fueron consecuencia de errores de
extraviados no se encontraron y la probabilidad los trabajadores. Suponga normalidad.
de cometer un error tipo I es 0.01 . a. Utilice el nivel de significación del 0.05 para
b. ¿Cuál es el nivel de significación mínimo probar la hipótesis “el 0.5 de los accidentes
(unilateral) para rechazar la hipótesis: 0.06 de industriales son consecuencia de los errores
todos los equipajes perdidos no se recuperan? del trabajador”.
b. ¿Cuál es nivel de significación mínimo
24. Para contrastar la afirmación del jefe del (bilateral) para rechazar la hipótesis: “el 0.5 de
departamento de transporte de la Cruz Roja, los accidentes industriales es error de los
“por lo menos 40 % de todas las llamadas que trabajadores?
recibe son emergencias de vida o muerte”, se
tomó una muestra aleatoria de sus registros y 27. Se toma una realización de una muestra
se encontró que 49 de 150 llamadas fueron aleatoria de 50 botellas de leche de la marca
emergencias de vida o muerte. “La vaquita” y se detectan 14 con exceso de
a. ¿Qué puede concluirse, sobre la afirmación grasa.
anterior, si la probabilidad de cometer un error a. ¿Podemos rechazar H 0 : p0  0.12 a favor
tipo I debe ser menor a 0.08 ? de H a : pa  0.12 con el nivel 0.002 de
b. ¿Qué puede concluirse, sobre la afirmación significación?
anterior, si la probabilidad de cometer un error b. ¿Podemos rechazar la hipótesis nula
tipo I debe ser menor de 0.20 ? p0  0.12 a favor de H a : pa  0.12 con el
nivel 0.01 de significación?
25. Un médico afirma: el 10 % de todas las c. ¿Cuál es el nivel de significación mínimo
personas expuestas a cierta cantidad de (unilateral) en el que se puede rechazar la
radiación X tendrá secuelas. Si en una hipótesis alternativa antes señalada?
realización de una muestra aleatoria de 180
personas expuestas a la radiación únicamente
20 de ellas presentaron secuelas.
a. Pruebe H 0 : p0  0.10 contra H a :
pa  0.10 en el nivel de significación 0.05 .
b. ¿Cuál es el nivel de significación mínimo
(unilateral) en el que se rechaza la hipótesis
nula antes señalada?
3.3 RESUMEN Y
AUTOEVALUACIÓN
178 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

 ACTIVIDADES

SECCIÓN 3.1 ACTIVIDAD 4 (Efecto del tamaño de muestra)


Calcula intervalos de confianza para p si
ACTIVIDAD 1 (Estimadores puntuales) x  10 ,  1    100%  90% y:
a. Calcula el estimador puntual del tiempo a. n  16 .
media de sus llamadas telefónicas del último
b. n  25 .
mes.
c. n  36 .
b. Calcula el estimador puntual del monto
d. n  49 .
diario que utilizó en transportarse a la
e. n  81 .
escuela en las dos últimas semanas.
f. ¿Qué puedes decir acerca del tamaño de un
c. Calcula el estimador puntual de la intervalo de confianza conforme aumenta el
proporción de materias que ha acreditado. tamaño de la muestra?

ACTIVIDAD 2 (Efecto del tamaño de ACTIVIDAD 5 (Efecto del nivel de confianza)


muestra) 2. Calcula intervalos de confianza para p sí
Calcula intervalos de confianza para  , si pˆ  0.30 , n  64 y:
  1 , x  12 ,  1   100%  90% , y: a.  1    100%  90% .
a. n  16 . b.  1   100%  95% .
b. n  25 . c.  1   100%  98% .
c. n  36 .
d.  1    100%  99% .
d. n  49 .
f. ¿Qué puedes afirmar sobre el tamaño de un
e. ¿Qué puedes decir acerca del tamaño de
intervalo de confianza conforme aumenta el
un intervalo de confianza conforme aumenta nivel de confianza?
el tamaño de la muestra?

ACTIVIDAD 3 (Efecto del nivel de confianza)


SECCIÓN 3.2
ACTIVIDAD 6
Calcula intervalos de confianza para  , si
Haz una realización de una muestra aleatoria
  1 , x  12 , n  16 y: de tamaño n  10 de su grupo de estadística
a.  1   100%  90% . (al que debe considerar como una población).
b.  1   100%  95% . Plantee una hipótesis referente al peso
promedio de los elementos del grupo.
c.  1   100%  98% .
¿Proporcionan estos datos evidencia de los
d.  1   100%  99% . miembros de su grupo tiene pesos distintos al
e. ¿Qué puedes afirmar sobre el tamaño de peso promedio supuesto? Utiliza el nivel de
un intervalo de confianza conforme aumenta significación de:
el nivel de confianza? a.   0.05 .
b.   0.01.
c.   0.1 .
Discute sus resultados.
Sección 3.3 Resumen y autoevaluación 179

RESUMEN

SECCIÓN 3.1
Estimador Función que depende de una variable aleatoria y que se utiliza
para inferir el valor de un parámetro
Estimador puntual. Valor asociado por un estadístico a una realización de la MAS
que se utiliza para inferir el valor del parámetro de una
población.
Intervalo aleatorio de Intervalo de la forma  I     S , en el que los extremos son
confianza. funciones que dependen de una MAS.
Estimador por intervalo o Intervalo de valores ˆI    ˆS , con una confianza
intervalo de confianza. previamente establecida, en el que se estima que contiene el
valor de un parámetro. ˆI y ˆS dependen del valor de la
estadística o del estimador.
Nivel de confianza Probabilidad de que el parámetro a estimar se encuentre en el
intervalo de confianza.
Elementos de un a. Límite inferior de confianza ˆI .
intervalo de confianza b. Límite superior de confianza ˆS .
p  ˆI    ˆS   1   .
c. Parámetro objetivo  .
d. Coeficiente o nivel de confianza 1   .
e. Confianza  1   100% .
f. Longitud del intervalo L  ˆS  ˆI .
Intervalo de confianza  
x  z 2    x  z 2 , z 2 es el valor del percentil z
para  , con  conocida. n n
que deja un área de  2 a su derecha.
Intervalo de confianza s s
x  z 2    x  z 2 , z 2 es el valor del percentil z
para  , con n  30 . n n
que deja un área de  2 a su derecha.
Error máximo cometido al 
E Máx  z 2 .
estimar  . n
Tamaño de la muestra n  z 2  
2

n    .

 E MAX 
Intervalo de confianza pˆ qˆ pˆ qˆ
pˆ  z 2  p  pˆ  z 2 , z 2 el valor del percentil z
para p . n n
que deja un área de  2 a su derecha.
180 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

Error máximo cometido al EMáx  z 2 pˆ qˆ n


estimar p .
Tamaño de la muestra n  z 2 
2

si se conoce p̂ . n    pˆ qˆ .

 EMáx 
Tamaño de la muestra n  z 2 
2

si no se conoce p̂ . n    .

 2 EMáx 

SECCIÓN 3.2
Hipótesis Estadística. Suposición acerca del valor de un parámetro.
Hipótesis nula Suposición acerca del valor de un parámetro que indica que
la situación no cambia.

Hipótesis Alternativa. Aquella suposición que se contrapone a la hipótesis nula.


Error tipo I . Rechazar la hipótesis nula siendo verdadera.
Error tipo II . Aceptar la hipótesis nula siendo falsa.
Nivel de significación  . Probabilidad de cometer error tipo I .
. Probabilidad de cometer error tipo II .
Estadístico de prueba. Es el valor de una función que depende de los datos
muestrales, y sobre el que se basa la decisión de aceptar o
rechazar
Región crítica o región de Conjunto de valores para los que se rechaza la hipótesis
rechaza. nula.
Toma de una decisión. Si el valor calculado del estadístico de prueba cae en la
región de rechazo, se rechaza la hipótesis nula H 0 y se
acepta la hipótesis alternativa H a . Si el valor calculado del
estadístico de prueba no se encuentra en la región de
rechazo, no se rechaza H 0 .
Hipótesis Si H 0 :  0 , entonces la hipótesis alternativa
alternativa correspondiente es H a :    0 y la prueba se denomina
bilateral. bilateral o de dos colas.
Hipótesis alternativa Si H 0 :    0 ó H 0 :    0 , entonces la hipótesis
unilateral. alternativa correspondiente es H a :    0 o H a :  0
respectivamente, la prueba se denominan: unilateral
izquierda o derecha respectivamente.
Sección 3.3 Resumen y autoevaluación 181

Características de una prueba de hipótesis para 


Hipótesis nula : H 0 :    0 .
x  0
Estadística de prueba: z  .
 n
Hipótesis alternativa Región de rechazo al nivel de confianza  .
H a :   0 z  z 2 o z   z 2
H a :   0 z  z
H a :   0 z   z
Regiones de rechazo correspondientes:
f(z) f(z)
f(z)

/2 /2  
- z/2 0 z /2 0 z - z 0 Z
región de región de región de región de región de
región de no rechazo región de no rechazo
rechazo no rechazo rechazo rechazo rechazo

Características de una prueba de hipótesis para p


Hipótesis nula: H 0 : p  p0 .
p p x  np0
Estadística de prueba: z  ˆ 0  .
p0 q0 n n p0 q0
Hipótesis alternativa Región de rechazo al nivel de confianza  .
H a : p  p0 z  z 2 o z   z 2
H a : p  p0 z  z
H a : p  p0 z   z
Regiones de rechazo correspondientes:
f(z) f(z)
f(z)

/2 /2  
- z/2 0 z /2 0 z - z 0 Z
región de región de región de región de región de
región de no rechazo región de no rechazo
rechazo no rechazo rechazo rechazo rechazo
182 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

USO DE LAS TECNOLOGÍAS

SECCIÓN 3.1
EJEMPLO 6 BIS (INTERVALO DE CONFIANZA PARA  CON APPS).
Se midió la concentración de azúcar en el contenido de una muestra de 49 refrescos Pascual cuyo
envase indica “contenido 355 mililitros”. Se encontró una media aritmética de 36 gramos; si suponemos
que la desviación estándar del contenido de azúcar en la población es   4 , entonces un intervalo de
confianza del 95% para la concentración media de azúcar se construye de la siguiente forma.
DATOS:
Tamaño de muestra n  49 .
Media aritmética x  36 .
Desviación estándar de la población   4 .
Nivel de confianza del 95% .
a. Con la aplicación “APRENDER SOBRE LA ELECTRÓNICA”, con liga
[Link]
Una vez que ingresaste al sitio, solo debes completar los campos solicitados y dar click Izquierdo en la
pestaña “calcular”.
Aprender sobre la electrónica
Inicio Artículos Proyectos Foros

Calculadora del intervalo de confianza

95%
la media
límite límite
inferior superior
Introduzca los números en notación español (ejemplos 1.020,5; 1.2; 12,4)
Introduzca la Media: 36
Introduzca la Desviación estándar: 4
Introduzca el tamaño de muestra: 49
Seleccione el Intervalo de Confianza: 95%
Intervalo de Confianza:
34.88 (Límite inferior) a 37.12 (límite
superior)

Calcular

b. Con la aplicación “MATHCRACKER”, con liga


[Link]
Sección 3.3 Resumen y autoevaluación 183

Una vez que ingresaste al sitio, solo debes completar los campos solicitados y dar click Izquierdo en la
pestaña “calcular”.

Instrucciones: Utilice nuestra Calculadora de intervalos de confianza para calcular un intervalo de


confianza para la media poblacional  , en el caso de que se conozca la desviación estándar
poblacional  . Escriba la media de la muestra, la desviación estándar de la población, el tamaño de la
muestra y el nivel de confianza, y el intervalo de confianza se calculará automáticamente.
Media de la muestra ( X ) 36

Desviación Estándar Población (  ) 4

Tamaño de muestra ( N ) 49

Nivel de Confianza 95%

CALCULAR

Solution:

Necesitamos construir el intervalo de confianza 95% para la media poblacional μ. Se proporciona la


siguiente información:

Media de la muestra ( X )

Desviación Estándar Población ( s )

Tamaño de muestra ( N )

El valor crítico para  = 0.02 es z c = z 1 - = 2.326. El intervalo de confianza correspondiente se


calcula como se muestra a continuación:

CI = ( X - z c  n  X + z c n )
= ( 36 -  449  36 +  449 )
= ( 34.88   )
Por lo tanto, según los datos proporcionados, el intervalo de confianza 95% para la media de la
población es 34.88 < μ < 37.12, lo que indica que estamos 95% seguros de que la media de la
población real μ está contenida en el intervalo (34.88, 37.12).

EJEMPLO 8 BIS (INTERVALO DE CONFIANZA PARA p CON APPS).


Un estudio sobre los gustos musicales realizado a n  500 estudiantes universitarios (seleccionados al
azar) mostró que x  340 de ellos escuchan la estación radiofónica “La Zeta”. Construyamos un
intervalo de confianza del 98% para la proporción real de universitarios que escuchan “La Zeta”.
DATOS:
184 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

Tamaño de muestra n  500 .


Número de casos favorables x  340.
Nivel de confianza del 98% .
a. Con la aplicación “MATHCRACKER” on-line con liga
[Link]
Una vez que has ingresado al sitio, solo debes completar los campos solicitados y dar click Izquierdo en
la pestaña “calcular”. Obtienes

Intervalo de confianza para calculadora de


proporciones
Instrucciones: Utilice este intervalo de confianza paso a paso para la calculadora
de proporciones, proporcionando los datos de muestra en el siguiente formulario:

Número de casos favorables ( X ) 340

Tamaño de muestra ( N ) 500

Proporción de la muestra (proporcione en


lugar de X si se conoce)
Nivel de confianza (Ej.: 0.95, 95, 99, 99%)= 98

CALCULAR

Solution:

Necesitamos construir el intervalo de confianza 98% para la proporción de población. Se nos ha


proporcionado la siguiente información sobre el número de casos favorables:

Casos favorables X =

Tamaño de muestra N

La proporción de la muestra se calcula de la siguiente manera, basada en el tamaño de la muestra


N = 500 y el número de casos favorables X = 340:
340
p= X =

N 500

El valor crítico para  = 0.02 es z c = z = 2.326. El intervalo de confianza correspondiente se


1 - 
calcula como se muestra:

CI (Proportion) = ( p - z   p(1 n- p) , p + z   p(1n- p) )


c
  

c
 

= ( 0.68 -  
 0.68(1 - 0.68)
500 
, 0.68 -   0.68(1 - 0.68)
500
)
= ( 0.631 ,  )
P or lo tanto, según los datos proporcionados, el intervalo de confianza 98% para la proporción de la
población es 0.631 < p < 0.729, lo que indica que estamos 98% seguros de que la proporción de
la población real p está contenida en el intervalo (0.631 , 0.729).
Sección 3.3 Resumen y autoevaluación 185

SECCIÓN 3.2
EJEMPLO 11 BIS (PRUEBA DEHIPÓTESIS PARA  CON APPS)
Los diámetros de los pernos producidos por “Ferromex” tienen una desviación estándar real de 0.001
centímetros. Una muestra aleatoria de 10 pernos dio un diámetro medio de 0.2546 centímetros. Para
contrastar la hipótesis “el diámetro medio verdadero es menor a 0.2526centímetros” utilizando el nivel
  0.05 :
DATOS:
Parámetro objetivo  .
Tipo de prueba: H 0 :   0.2526 vs H a :   0.2526.
Tamaño de muestra n  10 .
Media aritmética x  0.2546 .
Desviación estándar s  0.001.
Nivel de significación   0.05 .

a. Con la aplicación “MATHCRACKER” on-line con liga


[Link]
Una vez que ingresaste al sitio, solo debes completar los campos solicitados y dar click Izquierdo en la
pestaña “calcular”. Obtienes,

Se ha proporcionado la siguiente información:


Media de la población hipotética (  )= 0.2546

Desviación estándar de la población (  )= 0.001

Tamaño de muestra ( n )= 10

Media muestral ( X ) = 0.2546

Nivel de significación (  ) 0.05

( 1 ) Hipótesis nula y alternativas:


H 0 :   0.2526
H a :   0.2526
Esto corresponde a una prueba de hipótesis de cola derecha, para la cual se utilizará una prueba Z ,
para la media con una desviación estándar de población conocida.
( 2 ) Región de rechazo
Según la información proporcionada, el nivel de significación es   0.05 , y el valor crítico para una
prueba de hipótesis de cola derecha es zC  1.64 .
La región de rechazo para esta prueba de hipótesis de prueba derecha es R   z : z  1.645 .
( 3 ) Estadística de prueba
La estadística z se calcula de la siguiente manera:
x  0
z
 n
186 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

0.2546  0.2526
z
0.001 10
 6.325
( 4 ) Decisión sobre la hipótesis nula
Dado que se observa z  6.325  Z C  1.645 , entonces se concluye que la hipótesis nula es
rechazada.
( 5 ) Conclusión
Se concluye que la hipótesis nula H 0 es rechazada. Por tanto, no hay suficiente evidencia para afirmar
que la media poblacional  es mayor que 0.2546, al nivel de significancia   0.05 .

EJEMPLO 11 BIS (PRUEBA DEHIPÓTESIS PARA  CON APPS)


Los diámetros de los pernos producidos por “Ferromex” tienen una desviación estándar real de 0.001
centímetros. Una muestra aleatoria de 10 pernos dio un diámetro medio de 0.2546 centímetros. Para
contrastar la hipótesis “el diámetro medio verdadero es menor a 0.2526centímetros” utilizando el nivel
  0.05 :
DATOS:
Parámetro objetivo  .
Tipo de prueba, H 0 :   0.2526 vs H a :   0.2526.
Tamaño de muestra n  10 .
Media aritmética x  0.2546 .
Desviación estándar s  0.001.
Nivel de significación   0.05 .

Con la aplicación “MATHCRACKER” on-line con liga


[Link]
Una vez que ingresaste al sitio, solo debes completar los campos solicitados y dar click Izquierdo en la
pestaña “calcular”. Obtienes,

Se ha proporcionado la siguiente información:


Media de la población hipotética (  )= 0.2546

Desviación estándar de la población (  )= 0.001

Tamaño de muestra ( n )= 10

Media muestral ( X ) = 0.2546

Nivel de significación (  ) 0.05

( 1 ) Hipótesis nula y alternativas:


H 0 :   0.2526
H a :   0.2526
Sección 3.3 Resumen y autoevaluación 187

Esto corresponde a una prueba de hipótesis de cola derecha, para la cual se utilizará una prueba Z ,
para la media con una desviación estándar de población conocida.
( 2 ) Región de rechazo
Según la información proporcionada, el nivel de significación es   0.05 , y el valor crítico para una
prueba de hipótesis de cola derecha es zC  1.64 .
La región de rechazo para esta prueba de hipótesis de prueba derecha es R   z : z  1.645 .
( 3 ) Estadística de prueba
La estadística z se calcula de la siguiente manera:
x  0
z
 n
0.2546  0.2526
z
0.001 10
 6.325
( 4 ) Decisión sobre la hipótesis nula
Dado que se observa z  6.325  Z C  1.645 , entonces se concluye que la hipótesis nula es
rechazada.
( 5 ) Conclusión
Se concluye que la hipótesis nula H 0 es rechazada. Por tanto, no hay suficiente evidencia para afirmar
que la media poblacional  es mayor que 0.2546, al nivel de significancia   0.05 .

EJEMPLO 12 (BIS) (PRUEBA DE HIPÓTESIS PARA p , CON APPS)


El 60 % de los jóvenes prefiere la coca cola sobre cualquier otra bebida. En una encuesta efectuada a
100 jóvenes se encontró que 70 prefirieron coca cola.
Para verificar si la información obtenida es evidencia suficiente para concluir que la proporción de
jóvenes que prefiere coca cola es menor al indicado por el estudio, utilizando   0.05 .
x  np0 70  60
3. Estadístico de prueba z    2.04 .
n p0 q0 100 0.6  0.4 
4. Región de rechazo.
Si   0.05 , de las tablas de la distribución normal obtenemos z  z 0.05  1.645, por tanto, se
rechaza H 0 : p  0.6 si Z  1.645.
C

DATOS:
Parámetro objetivo p .
Tipo de prueba, H 0 : p  0.6 vs H a : p  0.6 .
Tamaño de muestra n  100 .
Casos favorables 70 .
Nivel de significación   0.05 .

Con la aplicación “MATHCRACKER” on-line con liga


[Link]
188 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

Una vez que ingresaste al sitio, solo debes completar los campos solicitados y dar click Izquierdo en la
pestaña “calcular”. Obtienes,

(1) Hipótesis nulas y alternativas


Deben probarse las siguientes hipótesis nulas y alternativas para la proporción de población:
H 0 : p  0.6
H a : p  0.6
Esto corresponde a una prueba de hipótesis de cola derecha, para la cual se utilizará una prueba z para
una proporción de población.
(2) Región de rechazo
Según la información proporcionada, el nivel de significancia es   0.05 , y el valor crítico para una
prueba de hipótesis de cola derecha es z C  1.64 .
La región de rechazo para esta prueba de hipótesis de cola derecha es R   z : z  1.64 .
(3) Estadísticas de prueba
La estadística z se calcula de la siguiente manera:

p p0
z
p0  1  p0 
n
0.70  0.60 
 p
0.6 1.0.6 
100
 0.2041
(4) Decisión sobre la hipótesis nula
Dado que se observa que z  2.041 z C  1.645 , entonces se concluye que la hipótesis nula es
rechazada.
(5) Conclusión
Se concluye que la hipótesis nula H 0 es rechazada. Por lo tanto, no hay suficiente evidencia para
afirmar que la proporción de población p es mayor que 0.6 , al nivel de significancia   0.05 .
Sección 3.3 Resumen y autoevaluación 189

 AUTOEVALUACIÓN

COMPLETA LOS ESPACIOS


SELECCIONA LAS PALABRAS FALTANTES DEL BLOQUE INFERIOR

1. La ________________________________se basa en el análisis de las realizaciones de una muestra


aleatoria simple.
2. El término _______________________ se refiere a la determinación de un parámetro de una
población estadística en términos de la probabilidad.
3. Un ________________ es una regla que depende de las realizaciones de una muestra aleatoria
simple que establece la forma en que se calculan los dos números que forman los extremos de un
intervalo.
4. Algunas de las características óptimas de una estimación por intervalo es la de contener al
________________ y ser lo menos amplio posible.
5. Mientras mayor sea la longitud del intervalo de confianza p  ˆI    ˆS   1   , se tendrá una
mayor certeza de __________________________ al objetivo  .
6. Si se ________________________________ el tamaño de las muestras la longitud del intervalo
disminuye.
7. Si se incrementa el ___________________________ en un estimador por intervalo, entonces su
amplitud aumenta.
8. El ________________________________ cometido al estimar puntualmente  utilizando la media

aritmética es E Máx  z 2 .
n
9. Si la _____________________________ es conocida, entonces un estimador por intervalo para  es
s s
x  z 2    x  z 2 .
n n
10. En los intervalos de confianza para la ________________________________ el número z 2 se
refiere al área o probabilidad que se encuentra a su derecha.
11. Los métodos y técnicas relacionados con la problemática de determinar cuál de dos
_____________________________, acerca de un parámetro, es la correcta es el proceso conocido
como prueba de hipótesis.
12. Las ________________________________constituyen uno de los métodos para inferir acerca del
posible valor de un parámetro.
13. Una prueba de hipótesis es un proceso que se utiliza utilizan para analizar si una afirmación
tentativa sobre el valor de un parámetro se ve apoyada o rechazada por las evidencias encontradas en
realizaciones de ________________________________.
190 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

14. La “aceptación” de una hipótesis estadística sólo significa que la información contenida en la
realización de una muestra aleatoria simple no proporciona la suficiente evidencia como para
________________________________.
15. La ________________________________se plantea en términos de alguna de las frases “es igual”,
“no mejora”, “no cambia”, etc.
16. La hipótesis alternativa es la ________________________________ de la hipótesis nula.
17. La ______________________________ determina el criterio para aceptar o rechazar H 0 .
18. La región crítica está compuesta por el conjunto de todos los valores
___________________________ para los cuales se no se acepta la hipótesis nula H 0 .
19. El ________________________________, también denotado por la letra griega alfa, es la
probabilidad de rechazar la hipótesis nula cuando es verdadera.
20. Se comete ________________________________cuando se acepta una hipótesis estadística
siendo falsa.
21. Si en una muestra específica el valor calculado del estadístico de prueba se encuentra en la región
crítica, entonces se rechaza la hipótesis nula y se concluye que la
________________________________ debe aceptarse.
22. Si se plantea una hipótesis nula en términos de una ____________________, entonces el proceso
de prueba se conoce como unilateral o de una cola.

muestras aleatorias simples. Inferencia. ̂ . incrementa. negación error máximo. hipótesis


alternativa. varianza poblacional . del estadístico de prueba. media y para la proporción.
suposiciones. Las pruebas de hipótesis. hipótesis nula. contener. estimador. nivel de
significancia. parámetro objetivo y ser lo menos. rechazarla. inferencia estadística. error tipo
dos. desigualdad. nivel de confianza. región de rechazo o región crítica.

CIERTO O FALSO
(Selecciona la opción correcta)

C F 1. Un estimador puntual es una estimación respecto al valor de un estadístico.


C F 2. Un estimador puntual es una fórmula de una MAS que se utiliza para estimar un
parámetro.
C F 3. Un estimador por intervalos es un par de números llamados límites entre los que se
encuentra el valor del parámetro objetivo.
C F 4. Los extremos de un intervalo de confianza son estimadores puntuales.
C F 5. Los términos “estimación por intervalo” e “intervalo de confianza” son equivalentes”.
C F 6. Los extremos de un estimador por intervalo son variables aleatorias.
C F 7. En un intervalo de confianza, el nivel de confianza puede ser superior al 100% .
C F 8. En un intervalo de confianza, la confianza depende del tamaño de la muestra.
Sección 3.3 Resumen y autoevaluación 191

C F 9. En un intervalo de confianza el error máximo cometido en la estimación depende del


tamaño de muestra.
C F 10. Los intervalos aleatorios de confianza para la media siempre se distribuyen
normalmente.
C F 11. Los intervalos aleatorios de confianza para la proporción siempre se distribuyen
normalmente.
C F 12. Con un intervalo de confianza para la media real se pretende estimar la media
aritmética.
C F 13. Si el tamaño de una muestra es inferior a 30 , podemos concluir que nunca es útil el
s s
estimador por intervalo x  z 2    x  z 2 .
n n
C F 14. La hipótesis nula se plantea con el objeto de rechazarse.
C F 15. El proceso de prueba de hipótesis se utiliza para estimaciones puntuales.
C F 16. La probabilidad de rechazar una hipótesis siendo falsa es una decisión correcta.
C F 17. Una hipótesis nula se plantea con la finalidad de no rechazarse.
C F 18. La hipótesis alternativa se plantea con la intención de aceptarse.
C F 19. Si se rechaza la hipótesis nula, la hipótesis alterna se acepta.
C F 20. El nivel de significación y el error tipo II son conceptos equivalentes.
C F 21. El nivel de significación es una probabilidad.
C F 22. En el proceso de prueba de hipótesis sobre una proporción siempre debe utilizarse
una distribución de probabilidades normal.
C F 23. La estadística de prueba para la proporción siempre es positiva.
192 CAPÍTULO 3 INFERENCIA ESTADÍSTICA

PROBLEMAS PROPUESTOS
1. A partir de p  1.7    4.2   0.98 n  50 , se define la región crítica
determina: 0  X  11.5 .
a. Las estimaciones de los límites de a. Determina el nivel de significación 
confianza. cuando   12 es verdadera.
b. La confianza. b. Evalúa  para la alternativa   11.8 .
c. La longitud del intervalo.
9. Sean H0 : p  0.30 y n  22 .
2. Sea n  121, x  23.8 y s  1.24 .
a. Determina el nivel de significación  si se
Determina los límites de confianza de 95%
rechaza H 0 cuando 10  X  15 .
para  .
b. Determina  para sí H a : p  0.25 .
3. Si 1.8    4.2 , x  3 , n  36 y   2
10. Prueba H 0 :   125 contra H a :
determina:
  125 para una muestra de tamaño n  81
a. El error máximo cometido si se utiliza x
como estimador de  . suponiendo que x  120 y s  3.8 unidades,
utilice un nivel de significación del 2% .
b. El nivel de confianza.
11. Determina el nivel de significación
4. Sea n  144 y pˆ  0.6 . Determine los
mínimo para el cual se rechaza:
límites de confianza del 98% para p . H 0 :   12.8 contra H a :   12.8 sí
x  14 ,   4 y n  25 .
5. Si 0.40  p  0.70 , pˆ  0.55 y n  30
determina: 12. Determina el nivel de significación
a. El error máximo cometido si se utiliza p̂ máximo para el cual se rechaza:
como estimador de p . H 0 :   6.13 contra H a :   6.13 sí
b. El nivel de confianza. x  5.8 ,   2 y n  100 .

6. Si 0.32  p  0.64 y pˆ  0.48 determine: 13. Prueba H 0 : p  0.74 a favor de H a :


a. El error máximo cometido, si se utiliza p̂ p  0.74 para una muestra de tamaño
como estimador de p . n  36 suponiendo que X  24 , utilice un
b. El tamaño de muestra utilizado si la nivel de significación de 1% .
confianza es de 98% .
14. Prueba H 0 : p  0.38 a favor de H a :
7. Sean H 0 :   12 , H a :   12 , n  100 p  0.38 para una muestra de tamaño
con   10 , se define la región crítica n  144 suponiendo que X  56 , utilice un
X  9 o X  15 . nivel de significación del 4% .
a. Determina el nivel de significación 
cuando   12 es verdadera. 15. Determina el nivel de significación para el
b. Evalúa  para la alternativa   11.8 . cual se rechaza: H 0 : p  0.6 contra H a :
p  0.6 sí X  70 , y n  100 .
8. Sean H 0 :   12 , H a :   12 ,   7 y
APÉNDICE A. TABLAS

A.1 Probabilidades binomiales


acumuladas

A.2 Probabilidades y
percentiles normales

A.3 Números aleatorios


194 APÉNDICE A. TABLAS

A.3 Probabilidades binomiales acumuladas

x
B  x , n , p  C p k 1  p n k de n = 1 a n = 9
k
0
k 0
Apéndice A.1 Probabilidades binomiales acumuladas 195

x
B  x , n , p  C p k 1  p n k de n = 9 a n = 1 3
k
0
k 0
196 APÉNDICE A. TABLAS

x
B  x , n , p  C p k 1  p n k de n = 14 a n = 1 7
k
0
k 0
Apéndice A.1 Probabilidades binomiales acumuladas 197

x
B  x , n , p  C p k 1  p n k de n = 17 a n = 1 9
k
0
k 0
198 APÉNDICE A. TABLAS

x
B  x , n , p  C p k 1  p n k de n = 22 a n = 24
k
0
k 0
Apéndice A.1 Probabilidades binomiales acumuladas 199
200 APÉNDICE A. TABLAS

x
B  x , n , p  C p k 1  p n k de n = 24 a n = 25
k
0
k 0
APÉNDICE A.2 Probabilidades y percentiles normales 201

A.2 Probabilidades y percentiles normales

f(z) f(z) f(z)

-z 0 0 z -z 0 z Z
Z Z
-  < z < 1.59
202 APÉNDICE A. TABLAS

-  < z < 3.59 | z > 1.60


APÉNDICE A.2 Probabilidades y percentiles normales 203

z( Φ) z( D)

0 z0 Z
-z 0 z0 Z
0

0 < z ( Φ ) < 29.9


204 APÉNDICE A. TABLAS

30 < z ( Φ ) < 65.9


APÉNDICE A.2 Probabilidades y percentiles normales 205

66 < z ( Φ ) < 99.9


Apéndice B.1 Soluciones a problemas propuestos 207

APÉNDICE B. SOLUCIONES

B.1 Soluciones a problemas


propuestos

B.2 Soluciones a autoevaluaciones


208 APÉNDICE B. SOLUCIONES

NOMBRE

B.1 SOLUCIONES A PROBLEMAS


PROPUESTOS

UNIDAD 1
1. a. X  0, 1, 2, 3, 4, 5, , 100 . b. Y  0, 1, 2, 3, 4, 5, , 30 . c. Z  0, 2, 4 .

D , D , D ,  D , D , E ,  D , E , D ,  E , D , D  

2. S    . a. X  0, 1, 2, 3 . b.
 E , E , D ,  E , D , E ,  D , E , E ,  E , E , E  

Y  0, 1, 2, 3 .
3. a. X  0, 1, 2, 3, 4, 5, , n . b. S   I , DI , FI , DFI , FDI ,   X  I   1 , X  DI   2 ,
X  FI   2 , X  DFI   3 , X  FDI   3 .
4. a. X  0, 1, 2, 3, 4, 5, 6, 7, 8, 9, 10 . b. Y  6,  5,  4,  3,  2,  1, 0, 1, 2, 3, 4 . 5. a.
X  0, 1, 2, 3, 4 . b. Y  0, 1, 2, 3, 4 .
6. a. X  2, 3, 4, 5, 6, 7, 8, 9, 10, 11, 12 . b. Y 1, 2, 3, 4, 5, 6 .
c. Z  4,  3,  2,  1, 0, 1, 2, 3, 4, 5, 6, 7, 8, 9, 10, 11.
  1, 1, 1 ,  1, 1, 2 ,  1, 2 , 1 ,  2 , 1, 1  
7. S    a. X  3, 4, 5, 6 . b. Y 1, 2 . c.
  2 , 2 , 1  ,  2 , 1 , 2  ,  1 , 2 , 2  ,  2 , 2 , 2  
Z  0, 1, 2, 3 .
8. a.
x 2 3 4 5 6 7 8 9 10 11 12
fX  x  1
36
2
36
3
36
4
36
5
36
6
36
5
36
4
36
3
36
2
36
1
36

b.
x 1 2 3 4 5 6

fX  x  11
36
9
36
7
36
5
36
3
36
1
36

9. a. d.
10.
a. b. c.
x 3 4 5 6 y 1 2 z 0 1 2 3
fX x 1
8
3
8
3
8
1
8
fY  y  7
8
1
8
fZ z 1
8
3
8
3
8
1
8

 1
x  3, 6  7
y 1  1
z  0, 3
fX  x    8
. fY  y    8
. fZ  z    8


3
8
x  4, 5 
1
8
y2 
3
8
z  1, 2

C x3C33 x
11. a. f X  x   si X  0, 1, 2, 3 .
C36
Apéndice B.1 Soluciones a problemas propuestos 209

 0 Y 0
 1
 20 0 Y 1
Cx6C44 x
x
C k6 C34k
12. a. fX  x   X  0, 1, 2, 3, 4, 5, 6 . b. 
F  x    10 1Y  2 . b. F  x    .
C310 20
 19 k 0 C310
 20 2 X 3
 1 3 X
13.
a. b. c. d.
 0.28 x  2  0.1 x  2  1 x 1  0.3 x  0

0.55 x  1   63 
 0.5 x  1 x3 0.3 x  1
fX  x    y  
gX  x    6

 0.13 x  3 fX  x    0,2 x  0 gX  x    0,2 x  3
  0 x4


 0.04 x  5 0.1 x  1  2 0 x4
 x5 
 6
 0 X  2  0.1 x  2  0.2 x5
 0 X 1
 0. 28  2  X 1  0 X  2  1  0 X 0
F  x    0.83 1  X  3   6 1 X  3 
0.1  2  X  1  0.3 0  X  1
 0.96 3  X  5
 G  x    64 3  X  4 . 
 0.6 1  X  0  4  0.6 1  X  3
 Fx   6 4 X 5 G x    .
 1 5 X  0.8 0  X 1  0,8 3  X  4
 1 5 X
 0.9 1 X  2  0.8 4  X  5
 
 1 2 X  1 5 X
14.
a. F( x)
b. F( y)

 0 X 1 1  0 Y  3 1
 
 0.3 1  X  3  0.12  3 Y 0
Fx  Fy 
 0.8 3  X  5  0.18 0  Y  3
 0.1 5 X  1 3Y
0 1 3 5 X -3 0 1 3 Y

c.
 0 Y 0 F( y)

 1 0 Y 1 1
 18
F  y    183 1  Y  2
0.5
 10 2  Y  3
 18
 1 3Y 0 1 2 3 Y

15. 16. 17. 18.


a. a. a. 0.4 .  0.4  3

x 0 1 2 3 X 0 3 b. 0.4 . f Z  x    0.5 z  1 .
x  0.1 z  0
fX x 1
8
3
8
3
8
1
8
fX 0.5 0.5 c. 0.4 . 
b. b. 0.5 . d. 0.4 .
 0 X 0 c. 0 . e. 0.4 .
 1
0  X 1 d. 0.5 . f. 0.4 .
 8
 e. 0.5 . g. 1 .
F  x    84 1 X  2 .
 7 2 X 3 f. 0.5 . h. 0.8 .
 8
 1 3 X
210 APÉNDICE B. SOLUCIONES

19. b. F( x)

a. K  0.2 .  0 X 1 1

 0.6 1 X  3
F  x   .
 0.8 3 X 5

 1 5 X
-2 0 2 4 X

20. b.
F( x)

a. K  0.2 .  0 X  1 1


 0.2 1 X  0
F  x   .
 0.8 0 X 2

 1 2 X -1 0 X
1 2

21. a. K  4 .b. V  X   27 , DE  X   27 . 22. a. K  0.30 . b. V  X   1.05 ,


DE  X   1.0247. 23. a. E  X   3.24 . b. V  X   0.6224 , DE  X   0.7889. 24. a.
E  X   30 . b. V  X   100 , DE  X   10 .
25. a. 26. a. 27. a. 28. E  X   5 , no jugar.
 0 X 1  0 X 1 E  X   0.8
29. E  X   25 , jugar.
 4 1 X  2  1 1 X  2 b.
 10  10 30. E  X    365 , no
V  X   0.64 ,
F  x    107
2  X  3. F  x    103 2  X  3 . jugar.
 9 3 X 4  6 3 X  4 DE  X   0.8 .
 10  10
31. E  X   0 , no se
 1 4 X  1 4 X pierde, no se gana.
b. V  X   1 , DE  X   1 . b. V  X   1 , DE  X   1 .
32. a.  7 . b.  5 . c. 32 . d. 53 . 33. a.  14 . b. 12.7 . c.  0.76 . d.  1.76 . 34. a. 1.6 . b. 8.4 . c.
0.024. b. 8.4 . 35. a. 29 48
.c. 1484
300
. b. 192
11
. d. 1436
300
. 37. a. 0.6 . b. 0.2 . c. 0.2 . d. 0.8 . 38. a. 167 .b. 14 .
c. 8
16 . d. 15
16 . 39. a. A  12 . b. 1
25
.c. 24
25
. d. 1
100
.

SECCIÓN 1.2
1. a. 0.2185. b. 0.0449. c. 0.9964. d. 0.9994. e. 0.3598. f. 0.6813. g. 0 .
2. a. 0 . b. 0 . c. 0.1201. d. 0.7312. e. 0.0072. f. 0.8269. g. 0.4399. h. 0.9786.
3. a. b  x , 6 , 0.2   C x6  0.2 x  0.8 6 x b. b  x , 3 , 0.4   C x3  0.4 x  0.6 3 x .
c. b  x , 8 , 0.2   C x8  0.2 x  0.8 8 x . d. b  x , 10 , 0.4   C 10
x  0.4   0.6 
x 10 x
.
4. a. b  x , 7 , 0.2   C x  0.2   0.8  . b. b  x , 12 , 0.2   C x  0.2   0.8 12 x .
7 x 7 x 12 x

c. B  x , 4 , 0.2   C x4  0.2 4  0.6 4 x . d. b  x , 12 , 0.2   C 12 x  0.2   0.8 


x 12 x

d. B  x , 8 , 0.2   C x  0.2   0.8  . 5. a. 0.0015. b. 0.03487. c. 0.9999. d. 0.0016. 6. a.


8 x 8 x

0.0212. b. 0.0250. c. 0.0994. d. 0.9006. e. 0.5026. 7. a. 0.0000. b. 0.5487 . 8. a. 0.0000. b.


1.0000. c. 0.8702. d. 0.0000 . 9. a. 0.3277. b. 0.2592. c. 0.5282. 11. a. 0.1681. b. 0.5282.
12. a.
X 0 1 2 3
fX x  0.008 0.096 0.384 0.512
Apéndice B.1 Soluciones a problemas propuestos 211

b. 0.9920. 13. a. 0.0282. b. 0.2001. c. 0.0016. d. 0.3828. e. 0.8497. 14. a. 0.0000. b. 0.0007.
c. 0.9999. d. 0.8287. e. 0.0042. 15. a. E  X   12 y V  X   4.8 . b. E  X   17 y
V  X   2.55 . c. E  X   12 y V  X   8.4 . 16. E  X   3 y DE  X   2.7 . 17.
f X  x   C x20  0.5   0.5 
20 x
x
, X  0, , 20 . 18. 1 . 19. a. 0.0031. b. 0.0002. c. 0.9997. d. 15
y 6 respectivamente. 20. a. 0.1181. b. 0.2066. c. 0.4032. d. 9 y 3.6 respectivamente. 21. a. 1.0 .
b. 1.2 . c. 7.2 . d. 1 . e. 1.0 . 22. a. 0.1762. b. 0.0000. c. 8.5 . d. 1.35 . 24. a. 99 . b. 116 o 117 . 25.
a. 0.3280. b. 1.0000. c. 3 . 26. f X  x   C x25  0.4 x  0.6 25 x , X  0,  , 25 . 27. a. 0.0027. b.
0.9973. c. 0.6157 d. 0.3655. e. 0.6273.f. 0.1977. g. 0.7422.h. 0.2661. i. 0.4647. 28. a.
0.4649. b. 0.2204. c. 0.0228. d. 0.8643. e. 0.1822. f. 0.1151. 29. a. 0.0668. b. 0.0062. c. 1 . d.
0.9861. e. 1 . f. 1 . 30. a.  1.8119. b. 2.0537. c.  0.7892. d. 0.3319. e.
p   z 0  Z  z 0   0.775 . f. p   z 0  Z  z 0   0.18 . g.  3.0902. h.  4.2667 . i.  5.212 . 31.
a.  1.150 . b. 1.405. c.  1.254 . d. 0.994. e. 0.454. f. 1.405 . g. 3.090 . h.  3.090 . i. 0 . 32. a.
 0.311. b. 1.563. c. 0.573. d.  0.412 . e.  1.655 . f.  0.196 . 33. a. 0.440.b. 1.46 . c. 0.283 . d.
 1.838 . e.  0.385 . f. 1.175 . 34. a.  36.5 . b.  21.55 . c.  33.416. d.  40.548 . 35. a.
x0  3.456 . b. x0  0.58 . c. x0  1.498 . d. x0  4.39 .36. a. 0.8962. b. 0.02870. c. 0.6030. 37.
a. 19.77 . b. 55.86 . c. 1.22 . 38. a. 64.80 . b. 51.99 . c. 54.38 . 39. a. 84.13 . b. 55.85 . c. 40.13 .
40. a. 0 . b. 0.6827. c. 15.0311 centímetros. 41. a. 18 . b. 526 . c. 528 . d. 26 . 42. a. 0.00475. b.
0.7486. c. 0.6711. 43. a. 0.0047. b. 0.1496. c. 0.0537. 44. a. Aprox. 7 : 14 . b. Aprox. 7 : 17 . 45.
a. Aprox. 2.67 años. b. Aprox. 6.65 años. 46. 347.55 gramos. 47. a. 2.57 gramos. b. 0.974
gramos. 48. a. 0.9051. b.   0.423 centímetros. 49. a. 8.674 kilogramos. b. 6.674 kilogramos. 50.
a. 0.82 % . b. 563.12 . c. 403.88 . 51.   6.079 . 52.   10.035 ,   0.1413. 53.   243.334 ,
  26.343.

SECCIÓN 2.1
      1  1
1. a.   4.12 ,   1.65517. b. p  0.70 . 2. a.   166.6 ,   3.04 . b. p  . 3. a. p  , b.
3 4
 3
p .
20
  2 , 2 ,  2 , 4 ,  2 , 6  ,  2 , 8  ,  2 , 10  
  4 , 2 ,  4 , 4 ,  4 , 6  ,  4 , 8  ,  4 , 10  
 
4.   6 , 2 ,  6 , 4 ,  6 , 6  ,  6 , 8  ,  6 , 10  .
  8 , 2 ,  8 , 4 ,  8 , 6  ,  8 , 8  ,  8 , 10  
 
  10 , 2  ,  10 , 4  ,  10 , 6  ,  10 , 8  ,  10 , 10 
 0 , 0 ,  0,2    x12  0 , x12  1 
5. a.   . b.   . c. x  1 .
 2 , 0 ,  2,2   x 21  1 , x 22  2 

SECCIÓN 2.2
212 APÉNDICE B. SOLUCIONES

1.a.  X  10 y  X  0.6 . b.  X  150 y  X  0.2857. c.  X  6 y  X  0.1666. 2. a.  X  1 y


 X  0.8 . b.  X  16 y  X  0.625. c.  X  6 y  X  2.5 .3. a.  P  0.4 y  P  0.0489 . b.
 P  0.01 y  P  0.00049. c.  P  0.6 y  P  0.0221. d.  P  0.25 y  P  0.1443. 4. a.
 p  0.25 y  p  0.0541. b.  p  0.90 y  p  0.015 . c.  p  0.75 y  p  0.0173. d.  p  0.1 y
 p  0.1500. 5. a.  X  12 ,  X2  0.0001. b.  X  12 ,  X2  0.000025. c. 0.6827. 6. a. 0.914 .
b. 0.918. c. 0.2456. d. 4.34 miligramos. 7. a. 0.9938. b. 1 . 8. a. 0.9991. b. 0 . 9. a. 0.1587. b.
0.9987. c. 0.8168 miligramos. d. 0.8081 miligramos. 10. a. 0.1974. b. 0.1537 . 11. a. 1 . b.
0.0002. c. 0.9998. d. 10.3662. 12. a. 0.0722. b. 0.5871. c. 0.5478. d. 0.9933. 13. a. 0.0918. b.
0.0038. 14. a. 0.2005 . b. 0.9946 . 15. a. 0.1056. b. 0.5714. c. 0.0000. d. 0.0012. 16. a. 0.1131.
b. 0.0052. c. 0.5832. 17. a. 0.0019. b. 0.9696. c. 0.1151. 18. a. 1000 bolsas. b. 0 bolsas. c.
Aproximadamente 6 . d. Aproximadamente 125 .19. a. 0.3050. b. 1.0000 . c. 0.0006. d. 0.8830.
20. a. 1.0000. b. 1.0000.21. a. 0.9973. b. 0.8770. c. 0.8770.

SECCIÓN 3.1
1. a. 5.625 y 3.4107 . b. 0.5
 
4. a. Media real,  1   100%  98% , l  6.4 ,  i  10.4 y  S  16.8 .
 
b. Proporción real,  1   100%  90% , l  0.21,  i  0.72 y  S  0.93 .
 
c. Desviación estándar real,  1   100%  99% , l  9.9 ,  i  0.72 y  S  10.3 .
5. De mayor a menor: 10.0    17.8 , 10.4    16.8 , 10.8    16.2 .
6. De mayor a menor: 0.33  p  0.89 , 0.4  p  0.82 , 0.45  p  0.78 .
7. a. No, la proporción es un número comprendido entre cero y uno (inclusive). b. No, la proporción
es un número comprendido entre cero y uno (inclusive). c. sí.
8. a. 9.608    10.392 . b.. 124.071   125.929 . c.. 97.060    102.940 .
9. a. 90% . 27.588    29.043. b. 27.418    29.182. c. 27.139    29.461.
10. a. 75.82    78.89 . b. 75.180    80.41 . 11. a. 164.1812   165.8185. b.
164.3123   165.6875. 12. 150.5323   153.4677. 13. a. 0.208  p  0.292 . b.
0.218  p  0.282 . c. 0.571 p  0.629 . 14. a. 0.63445 p  0.70555. b. e  .03555. 15. a.
0.02282 p  0.5718. b. e  0.01718. 16. 0.0432 p  0.3568. 17. a. e  0.1603 b.
0.6139 p  0.6897 . 18. a. 0.392  p  0.528. b. 0.4  p  0.52 . 19. a. 0.8326 p  0.9073. b.
0.8349 p  0.9051. 20. a. 0.3131 p  0.4884 . b. 0.286  p  0.5160. 21. a. 811. b.
3.5587  p  3.6413. 22. n  66348. 23. n  34635. 24. a. n  1472. b. n  1691. 25. n  7663.
26. a. 95% . b. 91.64% . 27.  1   100%  96.8% . 28.  1   100%  92.81%

SECCIÓN 3.2
1. a. Unilateral izquierda. b. Unilateral derecha. c. Bilateral. d. Unilateral izquierda o bilateral. e.
Unilateral izquierda. f. Unilateral izquierda o bilateral. g. Unilateral derecha o bilateral. h. Bilateral.
Apéndice B.1 Soluciones a problemas propuestos 213

2. a. H 0 :  0  7.83 , H a :  a  7.83 . b. H 0 :  0  7.83 , H a :  a  7.83 . c. H 0 :  0  7.83 ,


H a :  a  7.83 . 3. H 0 : p0  0.373, H a : p a  0.373. 4. a. y d. incluyen parámetros. 5. b., c. y d.
están mal planteadas. 6. a. Siendo el viagra eficaz y rechazando la afirmación. b. Que el viagra no
sea eficaz y aceptando la afirmación. 7. a. Rechazando la afirmación “al menos el 40% de los
estudiantes del quinto semestre de esa escuela, es irregular” siendo verdadera. b. Aceptando la
afirmación “al menos el 40% de los estudiantes del quinto semestre de esa escuela, es irregular”
siendo verdadera. 9. a. Qué el curso gratuito es efectivo. b. Qué el curso gratuito no es efectivo. 10.
a. 0.9877. b. 0.3828.12. a. 0.4199. b. 0.3529. 13. a. 0.0087. b. 0.2776. 14. a. 0.9808. b.
0.1151. 15. a. 0.943. b. 0.570. 16. z  39.89 , rechazar H 0 . 17. z  3.98 a. Rechazar H 0 . b.
Rechazar. H 0 . 18. z  3.01. a. Rechazar H 0 . b. Rechazar H 0 . 19. a. Rechazar H 0 . b. Rechazar
H 0 . c.   0.0226. 20. a. No rechazar H 0 . b. No rechazar H 0 . c. 28.2% . 21. a. No rechazar
H 0 . b. No rechazar H 0 . 22. a. No rechazar H 0 . b. No rechazar H 0 . c. No rechazar H 0 . d. No
rechazar H 0 . d. 28.33% . 23. a. No rechazar H 0 . b. 13.76% . 24. a. Rechazar H 0 . b. Rechazar
H 0 . 25. a. No rechazar H 0 . b.   0.3260. 26. a. No rechazar H 0 . b.   0.0727. 27. a. Rechazar
H 0 . b. Rechazar H 0 . c.   0.0226.
214 APÉNDICE B. SOLUCIONES

NOMBRE

B.2 SOLUCIONES A LA
AUTOEVALUACIÓN

UNIDAD 1

COMPLETA LOS ESPACIOS


1. variable. 2. variables aleatorias. 3. conjunto finito de números. 4. asigna al evento A el
número real x .
5. f X  xi  . 6. La función de distribución de probabilidades y la función de distribución
acumulada.7. ser no negativa. 8. sumando. 9. parámetros. 10. parámetros. 11. valor que
asumirá. 12. promedio. 13. dispersión. 14. “número de éxitos en n ensayos independientes”.
15. variable aleatoria continua. 16. cero. 17. función de distribución acumulada. 18.
parámetros. 19. centro. 20. agudez. 21. altura.

CIERTO O FALSO
1. F. 2. C. 3. F. 4. C. 5. C. 6. C. 7. C. 8. F. 9. F. 10. C. 11. C. 12. C. 13. C. 14. C. 15. F. 16. C.
17. C. 18. F. 19. C. 20. C. 21. F. 22, F. 23. F. 24. C. 25. C. 26. C. 27. C. 28. F. 29. F. 30. C.

PROBLEMAS PROPUESTOS
 0 si x  3

 0.25 si  3  X  1
1. a. fX  x   0.25 si X  3,  1, 1, 3 . b. F  x    0.50 si 1 X 1 . c. E  X  0 . d. V  X  5 . e.
 0.75 si 1 X  3

 1 si X 1

p   2  X  1   F  1   F   1   0.75  0.50  0.25 . f. p   2  X  1   F  1   F   1   0.75  0.50  0.25 .


g. p   2  X  1   F   1   F   1   0.50  0.50  0.25 . h. p  X  1   F   1   0.50  0.25 . i.
p  X  1   1  p  X  1   1  F   1   1  0.25  0.75 . j. p  X  1   F  1   0.75 . k.
p  X  1   F  1   F   1   0.75  0.50  0.25 .

2. a.
Apéndice B.2 Solución a la autoevaluaciones 215

X 5 2 2
fX x 0.2 0.4 0.4
 0.2 X  5

b. La fdp fX  x    0.4 X  2 c. E  X   1. d. V  X   11.2 y DE.  X   3.346 . e.
 0.4 X 2

p   2  X  3   F  3   F   1   1  0.6  0.4 . f. p   2  X  2   F  2   F   1   1  0.6  0.4 . g.
p   2  X  3   F  2   F   1   1  0.6  0.4 . h. p  X  2   F  1   0.6 . i.
p  X  2   1  p  X  1   1  0.6  0.4 . j. p  X  2   F  1   0.6 . k. p  X  2   F  2   F  1   1  0.6  0.4 .
6
3. Sea X  b  x , 6 , 0.40  a. X  0, 1, 2, 3, 4, 5, 6 . b. fX  x   C x  0.40 x  0.60 6 x si
x

C
6
X  0, 1, 2, 3, 4, 5, 6 . c. F  x   0.40 k  0.60 6k .d. E  X    6  0.40   2.4 . e.
k
k 0

V  X   6  0.40  0.60   1.44 y DE  X   1.2 . f. 0.9590 . g. 0.0410 . h. 0.0349 . i. 0.4516 . j. 0.0041.k.


0.4547 . 4. a. 0.1935. b. 0.4642 . c. 0.0007 . d. 1 . 5. a. 157.5 . b. 145 . c. 116.75 . 6. a. 6.62 . b. 6.73 .7. a.
p  X  6.3   0.1977 . b. p  X  3.2   0.9573.

UNIDAD 2

COMPLETA LOS ESPACIOS


1. inferencia. 2. representativas. 3. sin reemplazo. 4. inferencia estadística. 5. estadísticas. 6.
parámetros. 7. parámetros. 8. aleatorias. 9. muestra aleatoria simple. 10. números aleatorios.
11. probabilidades. 12. media aritmética. 13. proporción. 14. límite central. 15. límite central,
convergencia.

CIERTO O FALSO
1. C. 2. C. 3. F. 4. C. 5. F. 6. F. 7. F. 8. F. 9. F. 10. C. 11. C. 12. C. 13. C. 14. F. 15. F. 16. C. 17. C.
18. F. 19. F. 20. C. 21. F.

PROBLEMAS PROPUESTOS
1. a.  X  80 y  X  0.40 . 2. a.  P  0.45 y  P  .0553.
b.  X  150 y  X  0.3536. b.  P  0.50 y  p  0.05 .
c.  P  0.65 y  P  0.025
c.  X  203 y  X  0.36 .
d.  P  0.85 y  P  0.0143.
216 APÉNDICE B. SOLUCIONES

3. Si   3.0 ,   1 y n  81. 4.
a. 0.1806. b. 0.0035. a. 0.0006. b. 0.0694.
c. 0.1841. d. x 0  2.7415. c. 0 . d. 0.2206.
e. x 0  3.183. f. x 0  2.772. e. 0.2206.

UNIDAD 3

COMPLETA LOS ESPACIOS


1. inferencia estadística. 2. Inferencia. 3. estimador ̂ . 4. parámetro objetivo y ser lo menos.
5. contener. 6. incrementa. 7. nivel de confianza . 8. error máximo. 9. varianza poblacional .10.
media y para la proporción. 11. suposiciones. 12. Las pruebas de hipótesis. 13. muestras
aleatorias simples. 14. rechazarla. 15. hipótesis nula. 16. negación. 17. región de rechazo o
región crítica. 18. del estadístico de prueba. 19. nivel de significancia. 20. error tipo dos. 21.
hipótesis alternativa. 22. desigualdad.

CIERTO O FALSO
1. F. 2. C. 3. F. 4. C. 5. C. 6. C. 7. F. 8. F. 9. C. 10. F. 11. F. 12. F. 13. F. 14. C. 15. C. 16. C. 17.
F. 18. F. 19. C. 20. F. 21. C. 22, F. 23. C.

PROBLEMAS PROPUESTOS
1. a. Li  1.7 y Ls  4.2 . b. 98 % . c. L  2.5 . 2. 23.58    23.85 . 3. a. E Máx  1.2 . b.
92.82 % . 4. a. E Máx  0.6 . b. 30 . 5. a. E Máx  0.15 . b. 91% . 6. a. E Máx  0.16 . b. n  53 .7. a.
0.0027. b. 0.9967. 8. a. 0.3065. b. 0.6179. 9. a. 0.0016. b. 0.9084.10. Rechazar H 0 en favor
de H a :   125 . 11. 6.68 % . 12. 4.95 % .13. No se rechaza H 0 : p  0.74 , se requieren mayores
evidencias. 14. No se rechaza H 0 : p  0.38 al nivel de significación del 4% .15. 5 % .
BIBLIOGRAFÍA 217

BIBLIOGRAFÍA

Christensen, H. (1997) Estadística paso a paso. Trillas.

Chao, L. (1987) Introducción a la Estadística. CECSA.

Triola, M., (2018) Estadística (12 ed.). Pearson.

Introducción a la probabilidad y a la Cengage


Mendenhall, W. (2014)
estadística. Learning.

Estadística matemática con aplicaciones Cengage.


Mendenhall, W. (2010)
(10a ed). Learning

Cengage
Johnson, R. (2008) Estadística Elemental ( 10a ed.)
Learning.

Probabilidad y Estadística para Pearson


Walpole, R. (2012)
Ingeniería y ciencias (9a ed.). Educación.

Probabilidad y Estadística para


Devore, J. (2008) Itemex.
ingeniería y ciencias (7a ed.).

También podría gustarte