0% encontró este documento útil (0 votos)
4 vistas110 páginas

Estadística Descriptiva: Población y Muestra

El documento aborda la estadística descriptiva, centrándose en los conceptos de población y muestra, así como la importancia de la observación en la recolección de datos. Se define la población como el conjunto total de elementos observados y la muestra como un subconjunto que permite hacer inferencias sobre la población completa. Además, se introduce el concepto de variable estadística, que se refiere a características que pueden medirse, contarse o clasificarse.

Cargado por

Martina Menendez
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
4 vistas110 páginas

Estadística Descriptiva: Población y Muestra

El documento aborda la estadística descriptiva, centrándose en los conceptos de población y muestra, así como la importancia de la observación en la recolección de datos. Se define la población como el conjunto total de elementos observados y la muestra como un subconjunto que permite hacer inferencias sobre la población completa. Además, se introduce el concepto de variable estadística, que se refiere a características que pueden medirse, contarse o clasificarse.

Cargado por

Martina Menendez
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

lOMoARcPSD|4133870

Notas

Seminario de Práctica Notarial y Registral de Escribanía (Universidad Siglo 21)

Escanea para abrir en Studocu

Studocu no está patrocinado ni avalado por ningún colegio o universidad.


Descargado por Martu Menendez (martinamenendezgarro@[Link])
lOMoARcPSD|4133870

Capı́tulo 1

Estadı́stica descriptiva

1.1. Población y muestra.


Los humanos observamos porque es la forma en que podemos obtener información sobre los
fenómenos de nuestro interés. El proceso de observar nos permite realizar descubrimientos
significativos. En nuestro quehacer cientı́fico, la observación es una parte esencial del método
que utilizamos para estudiar fenómenos. En esta lectura presentamos formalmente el concepto
de observación y nos avocaremos a dos conceptos que podemos matematizar por medio de
este proceso: Población y Muestra. Para ello es necesario que tengamos en cuenta ciertos
rudimentos matemáticos que nos permitan expresar nuestras ideas. Por lo tanto denotamos
por N al conjunto de los números naturales {1, 2, 3, . . .}. Denotamos por R al conjunto de los
números reales que bien coincide con el intervalo (−∞, ∞). Por otro lado recordemos que el
sı́mbolo ∈ indica pertenencia, esto es, cada vez que escribamos n ∈ N lo que queremos decir
es que: n es un número natural, es decir, que n puede tomar algún valor entre los valores
1, 2, 3, . . .. De forma similar, si escribimos x ∈ R queremos decir que x es un valor cualquiera
en el intervalo (−∞, ∞).

Definición 1.1.1. La observación es el acto de mirar un fenómeno con atención y deteni-


miento para adquirir algún conocimiento sobre su comportamiento o sus caracterı́sticas. Un
dato es el resultado de una observación. Una colección de datos se conoce como conjunto de
datos; un solo dato es un dato puntual. Si n ∈ N, simbólicamente escribimos a un conjunto
de n datos en la forma
{x1 , x2 , x3 , . . . , xn },
o bien, en forma simplicada como
{xi }ni=1 .

Comentario 1.1.1. Recordemos que a las expresiones del tipo xi las leemos como ‘ equis
sub i’, tal como a x1 lo leemos ‘como equis sub uno’, a x2 lo leemos como ‘equis sub dos’,
y ası́ sucesivamente. A la letra i le llamamos indizante porque es la encargada de indicar
fundamentalmente el orden en el que se han expresado los datos. De aquı́ su nombre de
notación de subı́ndice. Ası́ pues en la Definición 1.1.1, la notación {x1 , x2 , x3 , . . . , xn } para
un conjunto de datos, podemos decir que expresa la importancia del orden de los datos. El
número n indica cuantos datos hay en el conjunto de datos. También es importante que
notemos que los datos poseen, en cierto modo la unidad de medida de la observación, es
decir, los debemos expresar en la unidad descrita por el fenómeno que observamos. Ası́ pues

1
Descargado por Martu Menendez (martinamenendezgarro@[Link])
lOMoARcPSD|4133870

2 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

el proceso de observación es algo profundo en el sentido a que va intrisicamente ligado a


un proceso de mirar un fenómeno y a los datos que resultan el acto de mirar al fenómeno.
Es a través de la observación cuidadosa y sistemática que cuando invetigamos podemos
crear hipótesis, diseñar experimentos, recolectar datos y llegar a conclusiones. La observación
también nos permite hallar propiedades, patrones y relaciones entre los fenómenos de interés.
En resumen, observamos en ciencias porque es la forma más efectiva de comprender el
mundo natural y hacer descubrimientos significativos en campos como la biologı́a, la quı́mica,
la fı́sica y la astronomı́a.
Ejemplo 1.1.1. El señor JJ , responsable de RRHH en una empresa puede observar el
fenómeno de la puntualidad de los empleados el dı́a lunes, para poder estudiar la tasa de
impuntualidad de sus empleados ese dı́a en particular. Supongamos que decide realizar la
observación el primer lunes del mes de febrero. En tal situación obtendrá un dato puntual
tal como
{3},
el cual indica que el dı́a que realizó la observación tres empleados llegaron tarde. Sin embargo
si el señor JJ decide observar durante los cuatro lunes del mes de febrero obtendrá un conjunto
de datos tal como
{3, 1, 0, 4},
lo cual indica que el primer lunes que realizó la observación tres empleados llegaron, el segundo
lunes un empleado llegó tarde, el tercer lunes ningún empleado llegó tarde y finalmente el
cuarto lunes cuatro empleados llegaron tarde. En caso del dato puntual podemos usar la
notación
x1 = 3,
y para el caso del conjunto de datos

x1 = 3, x2 = 1, x3 = 0, y , x4 = 4

Ejemplo 1.1.2. El responsable de una fábrica de mesas de maderas puede observar el


fenómeno de las mesas que resultan defectuosas a causa de los errores humanos de los em-
pleados, cometidos durante la producción, ya sea por cortes mal hechos, por malas clavadas
en la madera, pintadas defectuosas, entre otros. Supongamos que el responsable de la fábrica
decide realizar la observación sobre un lote de 20 mesas. En tal situación obtendrá un dato
puntual tal como
{4},
el cual indica que hay cuatro mesas defectuosas en el lote. Sin embargo si responsable de
la fábrica decide observar las mesas defectuosas de cinco lotes distintos de 20 mesas puede
obtener un conjunto de datos de la forma

{0, 4, 3, 3, 2},

lo cual indica que en el primer lote observado no hubo mesas defectuosas, en el segundo hubo
cuatro mesas defectuosas, en el tercero hubo tres mesas defectuosas, en el cuarto hubo dos
mesas defectuosas y en el último hubo dos mesas defectuosas. En esta situación, en el caso
del dato puntual podemos usar la notación

x1 = 4,

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.1. POBLACIÓN Y MUESTRA. 3

y para el caso del conjunto de datos

x1 = 0, x2 = 4, x3 = 3, x4 = 3 y x5 = 2.

Comentario 1.1.2. Al momento de realizar una observación, siempre debemos delimitar sus
alcances. De este modo es necesario presentar con claridad exhaustiva al conjunto completo
de todos los elementos o individuos que observamos. Esto es, necesitamos identificar con
precisión que objetos de estudio tenemos en mente. En otras palabras, necesitamos tener una
extrema claridad en el conjunto total de unidades que conforman la totalidad del universo que
deseamos observar. Este conjunto presenta una relevancia como objeto matemático bastante
interesante y lo presentamos a continuación de manera formal como Población.

Definición 1.1.2. Una población es el conjunto de todos los elementos que estamos obser-
vando.

Ejemplo 1.1.3. Consideremos a un conjuntos de 5 personas que denotamos por

{A, B, C, D, E}.

Supongamos que sobre este conjunto realizamos alguna observación. Es decir, que diseñamos
un procedimiento por medio del cual extraemos un dato de cada uno de los individuos del
conjunto. Entonces esto convierte a estas cinco personas automáticamente en una población.

Comentario 1.1.3. Podemos notar que estudiar una población completa puede ser un pro-
ceso inviable, imposible o muy costoso. Por lo tanto, si tomamos subconjuntos de la pobla-
ción, es posible que obtengamos información precisa y confiable sobre la población completa.
Además el proceso de estudiar un subconjunto de la población puede ser viable, eficiente y
económico.

Definición 1.1.3. Una muestra es un subconjunto de la población. Si la muestra posee n


elementos entonces n es llamado tamaño de la muestra.

Comentario 1.1.4. El gran logro de una muestra radica en que esta pueda proporcionar
información suficiente para hacer inferencias sobre la población completa con un nivel de
precisión aceptable. En caso de selecciona una muestra representativa aplicar un análisis
estadı́stico apropiado, es posible que logremos realizar inferencias precisas sobre la población
completa manipulando solo los datos de la muestra. En caso contrario, podemos llegar a
conclusiones erróneas sobre la población. Por lo tanto, es muy importante diseñar procesos que
permitant seleccionar muestras adecuadas y representativas para garantizar que los resultados
que obtengamos sean precisos y confiables.

Ejemplo 1.1.4. Consideremos la población A, B, C, D, E. Supongamos que sobre este con-


junto realizamos alguna observación. Entonces esto convierte a estas cinco personas automáti-
camente en una población. Ahora bien, todas las muestras de tamaño 3 vienen formadas por
todas las posibilidades que tenemos de elegir tres personas entre las cinco que tenemos, y
estas formas vienen dadas por mediante el conjunto:
 
{A, B, C}, {A, B, D}, {A, B, E}, {A, C, D}, {A, C, E},
.
{B, C, D}, {B, C, E}, {B, D, E}, {C, D, E} {A, D, E},

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

4 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Análogamente todas muestras de tamaño 4 vienen formadas por todas las posibilidades que
tenemos de elegir cuatro personas entre las cinco que tenemos, y estas formas vienen dadas
por mediante el conjunto:


{A, B, C, D}, {A, B, C, E}, {A, B, D, E}, {B, C, D, E}, {A, C, D, E}
Comentario 1.1.5. Como bien venimos recalcando, en una población, una muestra repre-
sentativa refleja las caracterı́sticas relevantes de la población. En otras palabras, una muestra
representativa es un subconjunto de la población copia las caracterı́sticas que la población
en las mismas proporciones. Dejamos esta idea formalmente expresada y la retomaremos en
capı́tulos posteriores, ya que habremos creado herramientas para poder determinar mecanis-
mos para poder hallarlas.
Definición 1.1.4. Una muestra representativa es una muestra que contiene las caracterı́sticas
relevantes de la población en las mismas proporciones en que están incluidas en tal población

1.2. Variables estadı́stica


La población viene ligada al concepto de observación, y la observación viene ligada a la
generación de datos. Tales datos naturalmente puede ser variables, por lo tanto en estadı́stica
permanentemente estamos recurriendo al concepto de variable, entendido generalmente como
una caracterı́stica que podemos medir, contar o clasificar. Presentamos formalmente esta idea
a continuación.
Definición 1.2.1. Una variable estadı́stica es una propiedad que puede fluctuar y cuya
variación es susceptible de adoptar diferentes valores, los cuales pueden medirse, contarse u
clasificarse
Ejemplo 1.2.1. Trabajemos sobre la población del Ejemplo 1.1.4, la cual está formada
por 5 personas cuyos nombres son A, B, C, D, E. dedicaremos este ejemplo a estudiar tres
observaciones sobre ella.
1. Supongamos que deseamos oberservar sus edades en años. Una vez hecha la observación,
obtenemos el siguiente conjunto de datos {21, 23, 25, 27, 30}. Ası́ pues, en este contexto
podemos definir la variable estadı́stica mediante:

X := La edad de los elementos de la población.


Notemos que la variable estadı́stica X, toma valores en el conjunto {0, 1, . . . , 120},
asumiendo que un ser humano no vive mas de 120 años y que en cierto modo las edades
corresponden a números enteros no negativos.
2. Su pongamos ahora que decidimos oberservar sus estaturas en metros. Una vez hecha
la observación, obtenemos el siguiente conjunto de datos {1.5, 1.61, 1.79, 1.75, 1.62}.
Ası́ pues, podemos definir la variable estadı́stica mediante
Y := La estatura en metros de los elementos de la población,

Notemos que la variable estadı́stica Y , toma valores en el intervalo [0, 3]. Asumiendo
que un ser humano no mide mas de 3 metros y tales valores no se pueden contar.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.2. VARIABLES ESTADÍSTICA 5

3. Podemos también observar los talles de remeras. Una vez hecha la observación obtene-
mos el siguiente conjunto de datos {S, S, XXL, XL, M }. Ası́ pues, podemos definir
la variable estadı́stica

Z := El talle de las remeras de elementos de la población.

Y finalmente, notemos los valores de Z no son números, pero si son caracterśticas que
indican de forma categórica que tan grande o chica es la remera.

Ası́ pues sobre un conjunto de cinco personas hemos estudiado a tres variables estadı́sticas.
Notemos que la variable estadı́stca X solo toma valores enteros no negativos, la variable
estadı́stca Y toma valores numéricos reales no negativos y la variable estadı́stca Z solo toma
valores en letras que podemos pensar como categorı́as que indican tamaños de remeras. Los
valores de la variable estadı́stica X se miden en a nos, los valores de Y se miden en metros y los
valores de Z se expresan en letras. Esto evidencia que los datos que surgen de la observación
pueden ser de distintas naturaleza. También debemos notar que el conjunto observado en
los tres casos es el mismo, pero al medir tres variables distintas, generamos tres poblaciones
distintas. Con esto queremos decir que el concepto de población va intrı́nsicamente ligado a
la observación y esta a la variable estadistica.
Comentario 1.2.1. Es importante notar que la población, de forma intrı́nsica, está ligada
a la variable estadı́stica, mas aún, la variable estadı́stica es inherente al proceso de observa-
ción que es realizado sobre la población, es decir, la población, la variable y la observación
están ligadas de forma inseperable. Presentamos a continuación una clasificación bastante
general de las variables estadı́sticas. Pero antes es necesario destacar una caracterı́stica de
los conjuntos relativa a su infinitud.
Definición 1.2.2. Un conjunto es contable si lo podemos expresar de la forma

{x1 , . . . , xn }

o en la forma
{x1 , x2 , x3 , . . . , }.
En caso contrario diremos que el conjunto no es contable.
Comentario 1.2.2. La Definición 1.2.2 da nombre al tipo de conjuntos que en cierto sentido
intuitivo: lo podemos listar o contar, tales conjuntos son los conjuntos contables. Podemos
notar que pueden ser finitos o infinitos. El descubrimiento de la diferencia entre conjuntos
contables y no contables, particularmente cuando los conjuntos son infinitos, se debió a las
investigaciones de Georg Ferdinand Ludwig Philipp Cantor (845-1918) sobre los conjuntos
infinitos. Cantor fue el primero capaz de formalizar y clasificar la noción de infinito en ma-
temáticas. Una consecuencia de estas ideas es que los procesos de contar y medir son distintos
en todo el sentido de las variables estadı́sticas numéricas.
Ejemplo 1.2.2. Cualquier conjunto con una cantidad finita de elementos es contable.
Ejemplo 1.2.3. El cojunto de los número naturales N = {1, 2, 3, . . .} es contable.
Ejemplo 1.2.4. El cojunto de los número enteros Z = {0, −1, 1, −2, 2, −3, 3, . . .} es con-
table.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

6 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Ejemplo 1.2.5. El cojunto de los número reales R es no contable. Este fue uno de los
descubrimientos mas sorprendentes de la matemáticas. En cierto sentido pone en relieve
que el proceso de contar y el de medir son procesos diferentes, que existen distintos tipos de
conjuntos infinitos y por ende debemos tener sumo cuidado al momento de trabajar con ellos.
Este es uno de los resultados mas hermosos de la matemática. En particular fue descubierto
por George Cantor y fue un gran avance en cuanto a la comprensión de los números reales.
Ejemplo 1.2.6. Cualquier intervalo real no vacı́o y que no conste de un punto es no contable.
Comentario 1.2.3. Los conjuntos contables y no contables nos permiten formalizar dos
tipos de variables estadı́sticas numéricas muy importantes. Esto es principalmente aquellas
que cuentan y aquellas que miden.
Definición 1.2.3. Dada una población y una variable estadı́stica X definida en ella, entonces
X es llamada variable estadı́stica cuantitava si toma valores numéricos. Mas aún
1. X es llamada variable cuantitativa discreta si solo puede tomar valores en un conjunto
contable.

2. X es llamada variable cuantitativa continua si solo puede tomar valores en un conjunto


no contable.
Por otro lado X es llamada variable cualitativa nominal si sus valores pueden ser clasifi-
cados de acuerdo a categorı́as.
Comentario 1.2.4. Podemos pensar en que una variable estadı́stica es discreta si sus valores
pueden ponerse en correspondencia uno a uno con un subcojunto de los números naturales,
y es continua si sus valores pueden ponerse en correspondencia uno a uno con uno o mas
intervalos de los números reales.
Ejemplo 1.2.7. En el Ejemplo 1.2.1 definimos tres variables estadı́sticas. Notemos que la
variable estadı́stica X, la edad de los elementos de la población, es una variable estadı́stica
discreta ya que las edades se miden en números naturales y por tanto están en correspondencia
con un subconjunto de ellos. Sin embargo la variable estadı́stica Y , la estatura en metros de los
elementos de la población, es una variable estadı́stica continua ya que a esta la podemos poner
en correspondencia con un intervalo de números reales. Finalmente la variable estadı́stica Z
que da el talle de remera de los elementos de la población toma valores de letras que son
categóricos, por lo tanto Z es una variable cualitativa.

1.3. Valores estadı́sticos y Parámetros


Los tamaños de las poblaciones suelen ser muy grandes a la hora de estudiarlas. Pero a las
muestras, al momento de elegirlas nos permite controlar su tamaño. Por eso en esta sección
presetaremos el concepto de estadı́stico que resulta ser una potente herramienta para el es
estudio de las muestras, y luego presentaremos su versión cuando la muestra coincide con
la población en cuyo caso recibe el nombre de parámetro. Para poder presentar el concepto
de estadı́stico en su mejor versión tengamos en cuenta que: si tomamos una muestra de
tamaño n de una población, esencialmente lo que tenenemos es un conjunto {p1 , p2 , . . . , pn }
formado por n elementos de la población. Ahora bien, si tenemos una variable estadı́stica

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.3. VALORES ESTADÍSTICOS Y PARÁMETROS 7

cuantitativa X, definida sobre la población, podemos observarla en cada uno de los elementos
p1 , p2 , . . . , pn y obtener un conjunto de n datos, producto de las n observaciones realizadas
en la muestra, que corresponden a valores númericos de la variable X. Por simplicidad los
denotamos por (x1 , x2 , . . . , xn ), donde cada xi es el valor que toma la variable estadı́stica X
en el elemeto pi de la muestra, para i = 1, 2, . . . , n. Este conjunto de n datos ordenados en una
n-tupla de la forma (x1 , x2 , . . . , xn ), es un elemento del conjunto Rn . Ahora bien, si tomamos
todas las muestras de tamaño n y formamos el conjunto S formado por todas las n-tuplas
(x1 , x2 , . . . , xn ) posibles, entonces podemos tratar de estudiar a la población, estudiando a
los elementos del conjunto S. Elegimos la letra S debido a la palabra inglesa ’sample’ que
significa muestra. Bajo esta óptica podemos notar que todas las muestras {p1 , p2 , . . . , pn }
de tamaño n se identifican con la n-tupla de la forma (x1 , x2 , . . . , xn ) que les corresponde al
momento de medir la variable estadı́stica numérica X en cada elemento.
Ejemplo 1.3.1. Retornemos al Ejemplo 1.1.4 en donde hemos medimos la variable estadı́stica
X como la edad en años de sus individuos, de una población de cinco elementos. Tenı́amos que
las observaciones arrojaba el conjunto de datos {21, 23, 25, 27, 30}. Ahora bien, si tomamos
todas las muestras {p1 , p2 , p3 } de tamaño 3 y medimos a la variable estadı́stica en cada
muestra, entonces tenemos al conjunto
 
m = (21, 23, 25), m2 = (21, 23, 27), m3 = (21, 23, 30), 
 1
 
m4 = (21, 25, 27), m5 = (21, 25, 30), m6 = (21, 27, 30)
S3 = .
 m7 = (23, 25, 27), m8 = (23, 25, 30), m9 = (23, 27, 30), 
 
m10 = (25, 27, 30)
el cual está formado por todas las tripletas (x1 , x2 , x3 ) armadas con las edades de todos
las posibles muestras {p1 , p2 , p3 } que podemos elegir de la población.
Análogamente si tomamos todas las muestras {p1 , p2 , p3 , p4 } de tamaño 4 y medimos a
la misma variable estadı́stica en cada muestra, entonces tenemos al conjunto


S4 = {21, 23, 25, 27}, {21, 23, 25, 30}, {21, 23, 27, 30}, {23, 25, 27, 30}, {21, 25, 27, 30}

el cual está formado por todas las cuatro-uplas (x1 , x2 , x3 , x4 ) armadas con las edades de
todos las posibles muestras {p1 , p2 , p3 , p4 } que podemos elegir de la población.
Comentario 1.3.1. Naturalmente podemos notar que cuando tenemos una población en
términos generales esta suele ser grande, como también podemos notar que si tomamos todas
las muestras de esta población el conjunto formado S de todas esas muestras es un conjun-
to, a menudo, también muy grande. Entonces, estudiar a las poblaciones o estudiar a los
conjuntos de muestras de cierto tamaño fijo, es un tema computacionalmente dificil, ya sea
sea por temas operativos, de costos o de acceso a la información, entre otros. Esto nos lleva
diseñar técnicas que nos permitan estudiar a las muestras de algún modo que podamos inferir
afirmaciones acerca de las poblaciones de donde las extraemos. Una potente herrmienta para
iniciar el estudio de estas técnicas es el concepto de estad́istico o estadı́grafo que presentamos
a continuación
Definición 1.3.1. Sea n ∈ N y supongamos que el conjunto S está formado por todas las
n-tuplas que formamos con las muestras de tamaño n en una población. Un estadı́stico es
una función f : S → R, tal que para cada conjunto de datos (x1 , x2 , . . . , xn ) ∈ S f describe
alguna caracterı́stica de la población.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

8 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Comentario 1.3.2. A los estadı́sticos los represantamos generalmente con letras latinas.
En términos simples: un estadı́stico es un valor numérico que describe alguna caracterı́stica
de una muestra. A continuación presentaremos una serie de estadı́sticos con el objetivo de
ilustrarlos en su forma mas formal, es decir como funciones de la forma f : S → R. La
manera mas habitual de trabajar con ellos es trabajar sobre muestras individuales. Es muy
importante en cuanto a la notación que por la naturaleza del estadı́stico, este toma una
n-tupla de la forma (x1 , x2 , . . . , xn ) y devuelve un valor real f (x1 , x2 , . . . , xn ). Esto es muy
engorroso de escribir, entonces por simplicidad escribiremos a menudo

f = f (x1 , x2 , . . . , xn ).

Pero siempre es importante recordar que el valor f viene variando en función de la muestra
(x1 , x2 , . . . , xn ).

Definición 1.3.2. Definimos al estadı́stico del Máximo Xmax : S → R como el que toma
una muestra x1 , . . . , xn y la envı́a al valor

Xmax = Máx{x1 , . . . , xn }, (1.1)

el cual elige el máximo valor de los datos {x1 , . . . , xn }.

Ejemplo 1.3.2. En el Ejemplo 1.3.1 obtuvimos el conjunto S3 que resulta de realizar com-
pletamente un muestreo aleatorio simple, sobre una población de cinco elementos sobre
la cual hemos medido la variable estadı́stica de la edad. Podemos evaluar al estadı́stico
Xmax : S3 :→ R. En particular, calcularemos el el estadı́stico Xmax para la muestras m1 ,
m2 y m3 , es decir, formalmente calcularemos los valores Xmax (m1 ), Xmax (m2 ) y Xmax (m3 ) .
Para esto procedemos como sigue:

Xmax (21, 23, 25) = Max{21, 23, 25} Por ecuación (1.1)

= 25 Calculando el máximo.

Xmax (21, 23, 27) = Max{21, 23, 27} Por ecuación (1.1)

= 27 Calculando el máximo.

Xmax (21, 23, 30) = Max{21, 23, 30} Por ecuación (1.1)

= 30 Calculando el máximo.
Y si aplicamos el estadı́stico Xmax al resto de las muestras podemos mostrar a la función
Xmax en el Tabla 1.1

Muestra m1 m2 m3 m4 m5 m6 m7 m8 m9 m10
Xmax 25 27 30 27 30 30 27 30 30 30

Tabla 1.1: Esta tabla describe completamente al estadı́stico Xmax en S3

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.3. VALORES ESTADÍSTICOS Y PARÁMETROS 9

Definición 1.3.3. Definimos al estadı́stico del Mı́nimo Xmin : S ⊂ Rn → R, como el que


toma una muestra x1 , . . . , xn y la envı́a al valor

Xmin = Mı́n{x1 , . . . , xn }, (1.2)

el cual selecciona el mı́nimo valor de los datos {x1 , . . . , xn }.

Ejemplo 1.3.3. En el Ejemplo 1.3.1 obtuvimos el conjunto S3 que resulta de realizar com-
pletamente un muestreo aleatorio simple, sobre una población de cinco elementos sobre
la cual hemos medido la variable estadı́stica de la edad. Podemos evaluar al estadı́stico
Xmin : S3 :→ R. En particualr, calcularemos el el estadı́stico Xmin para la muestras m1 , m8 y
m10 , es decir, formalmente calcularemos los valores Xmin (m1 ), Xmin (m8 ) y Xmin (m10 ) . Para
esto procedemos como sigue:

Xmin (21, 23, 25) = Mı́n{21, 23, 25} Por ecuación (1.2)

= 21 Calculando el mı́nimo.

Xmin (23, 25, 30) = Mı́n{23, 25, 30} Por ecuación (1.2)

= 23 Calculando el mı́nimo.

Xmin (25, 27, 30) = Mı́n{25, 27, 30} Por ecuación (1.2)

= 25 Calculando el mı́nimo.

Y si aplicamos el estadı́stico Xmin al resto de las muestras en el conjunto S3 podemos


mostrar a la función Xmin en la Tabla 1.2

Muestra m1 m2 m3 m4 m5 m6 m7 m8 m9 m10
Xmin 21 21 21 21 21 21 23 23 23 25

Tabla 1.2: Esta tabla describe completamente al estadı́stico Xmin en S3

Definición 1.3.4. Definimos al estadı́stico del recorrido o rango R : S ⊂ Rn → R como la


difrencia entre el estadı́stico Xmax y el estadı́stico Xmin , es decir

R = Xmax − Xmin . (1.3)

Ejemplo 1.3.4. En el Ejemplo 1.3.1 obtuvimos el conjunto S3 que resulta de realizar comple-
tamente un muestreo aleatorio simple, sobre una población de cinco elementos sobre la cual
hemos medido la variable estadı́stica de la edad. Podemos evaluar al estadı́stico R : S3 :→ R.
Ahora bien, calcularemos el estadı́stico R para la muestras m1 , m3 y m4 , es decir, formalmente
calcularemos los valores R(m1 ), R(m3 ) y R(m4 ) . Para esto procedemos como sigue:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

10 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

R(21, 23, 25) = Xmax (21, 23, 25) − Xmin (21, 23, 25) Por la ecuación (1.3.4)

= 25 − 21 Por las ecuaciones (1.1) y (1.2)

= 4 Simplificando

R(21, 23, 30) = Xmax (21, 23, 30) − Xmin (21, 23, 30) Por la ecuación (1.3.4)

= 30 − 21 Por las ecuaciones (1.1) y (1.2)

= 9 Simplificando

R(21, 25, 27) = Xmax (21, 25, 27) − Xmin (21, 25, 27) Por la ecuación (1.3.4)

= 27 − 21 Por las ecuaciones (1.1) y (1.2)

= 6 Simplificando

Y si aplicamos el estadı́stico R al resto de las muestras podemos mostrar a la función R en


la Tabla 1.3

Muestra m1 m2 m3 m4 m5 m6 m7 m8 m9 m10
R 4 6 9 6 9 9 4 7 7 5

Tabla 1.3: Esta tabla describe completamente al estadı́stico R en U3

Comentario 1.3.3. A veces tenemos un conjunto de valores a1 , a2 , . . . , an ∈ R que desea-


mos sumar. Convenimos en representar la suma anterior de una forma compacta llamada
sumatoria o notación sigma. PPara indicar esta operación, de forma simplicada, usamos la
letra griega sigma mayúscula . Ası́ pues, introducimos la siguiente notación:
n
X
a1 + a2 + · · · + an = ai .
i=1

De este modo obtenemos una forma simplificada de como indicamos la sumatoria de valores
los a1 , a2 , . . . , an .

Definición 1.3.5. Para cada n ∈ N, definimos al estadı́stico de la media muestral n-ésima


como la función X : S → R como el que toma cada conjunto de datos dado por la n-tupla
(x1 , . . . , xn ) y la envı́a al valor
n
1X
X= xi (1.4)
n i=1

Ejemplo 1.3.5. Continuamos apoyados en los resultados del Ejemplo 1.3.1, ası́ pues, pode-
mos evaluar al estadı́stico X : S3 :→ R. Calcularemos el estadı́stico X para la muestras m1 ,

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.3. VALORES ESTADÍSTICOS Y PARÁMETROS 11

m2 y m3 , es decir, formalmente calcularemos los valores X(m1 ), X(m2 ) y X(m3 ) . Para esto
procedemos como sigue:
21+23+25
X(21, 23, 25) = 3
Por la ecuación (1.4)

69
= 3
Simplificando el numerador

= 23 Simplificando

21+23+27
X(21, 23, 27) = 3
Por la ecuación (1.4)

71
= 3
Simplificando el numerador

= 23, 67 Simplificando el numerador

x1 +x2 +x3
X(21, 23, 30) = 3
Por (1.4) con n = 3

21+23+30
= 3
Reemplazando los valores

74
= 3
Simplificando el numerador

= 24, 67 Simplificando
Y si aplicamos el estadı́stico X al resto de las muestras podemos mostrar a la función X
en la Tabla 1.4

Muestra m1 m2 m3 m4 m5 m6 m7 m8 m9 m10
X 23 23.67 24.67 24.33 25.33 26 25 26 26.67 27.33

Tabla 1.4: Esta tabla describe completamente al estadı́stico X en S3

Definición 1.3.6. Para cada n ∈ N se define el desvı́o medio muestral n-ésimo Dm : S → R


como el que toma una muestra x1 , . . . , xn y la envı́a al valor
n
1X
Dm = |xi − X|, (1.5)
n i=1

donde X es el promedio medido en el punto (x1 , x2 , . . . , xn ).

Comentario 1.3.4. En otras palabras Dm es el promedio de las distancias entre cada valor
de la muestra xi y la media aritmética X en toda la muestra.

Ejemplo 1.3.6. De nuevo, nos apoyamos en los resultados del Ejemplo 1.3.1. Ası́ pues,
podemos evaluar al estadı́stico Dm : S3 :→ R. Calcularemos el estadı́stico Dm para la
muestras m1 , m2 y m3 , es decir, formalmente calcularemos los valores Dm(m1 ), Dm(m2 ) y
Dm(m3 ) . Para esto procedemos como sigue:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

12 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

|21−X|+|23−X|+|25−X|
Dm(21, 23, 25) = 3
Por la ecuación (1.5)

|21−23|+|23−23|+|25−23|
= 3
Por el Ejemplo 1.3.5

2+0+2
= 3
Evaluando los valores absolutos

4
= 3
Simplificando al numerador

= 1.33 Simplificando

|21−X|+|23−X|+|27−X|
Dm(21, 23, 27) = 3
Por (1.5) con n = 3

|21−23.67|+|23−23.67|+|27−23.67|
= 3
Por el Ejemplo 1.3.5

2.67+0.67+3.33
= 3
Evaluando los valores absolutos

6.67
= 3
Simplificando al numerador

= 2.22 Simplificando

|21−X|+|23−X|+|30−X|
Dm(21, 23, 30) = 3
Por (1.5) con n = 3

|21−24.67|+|23−24.67|+|30−24.67|
= 3
Por el Ejemplo 1.3.5

3.67+1.67+5.33
= 3
Evaluando los valores absolutos

10.67
= 3
simplificando el numerador

= 3.56 simplificando

Y si aplicamos el estadı́stico Dm al resto de las muestras podemos mostrar a la función


Dm en la Tabla 1.5

Muestra m1 m2 m3 m4 m5 m6 m7 m8 m9 m10
Dm 1.33 2.22 3.56 2.22 3.11 3.33 1.33 2.67 2.44 1.78

Tabla 1.5: Esta tabla describe completamente al estadı́stico Dm en S3

2
Definición 1.3.7. Para cada n ∈ N definimos la varianza muestral n-ésima Sn−1 : S → R,
como la función que a cada conjunto de datos (x1 , x2 , . . . , xn ) lo envı́a al valor
n
2 1 X
Sn−1 = (xi − X)2 (1.6)
n − 1 i=1

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.3. VALORES ESTADÍSTICOS Y PARÁMETROS 13

2
donde X es la media aritmética muestral de (x1 , x2 , . . . , xn ). Por simplicidad escribimos Sn−1
2
en lugar de Sn−1 (x1 , x2 , . . . , xn ) siempre que no haya duda sobre los datos x1 , x2 , . . . , xn a
los cuales hacemos referencia.
Ejemplo 1.3.7. Continuamos apoyados en los resultados del Ejemplo 1.3.1, ası́ pues, pode-
2
mos conocer al estadı́stico X : S3 :→ R. Calcularemos el estadı́stico S3−1 para la muestras
2 2 2
m1 , m2 y m3 , es decir, formalmente calcularemos los valores S3−1 (m1 ), S3−1 (m2 ) y S3−1 (m3 ).
Para esto procedemos como sigue:

2 (21−X)2 +(23−X)2 +(25−X)2


S3−1 (21, 23, 25) = 3−1
Por la ecuación (1.6)

(21−23)2 +(23−23)2 +(25−23)2


= 2
Por el Ejemplo 1.3.5

4+0+4
= 2
Simplificando las potencias

8
= 2
Simplificando al numerador

= 4 simplificando

2 (21−X)2 +(23−X)2 +(27−X)2


S3−1 (21, 23, 27) = 3−1
Por la ecuación (1.5)

(21−23,67)2 +(23−23,67)2 +(27−23,67)2


= 2
Por el Ejemplo 1.3.5

7.13+0.45+11.09
= 2
Simplificando las potencias

18.67
= 2
simplificando al numerador

= 9.34 simplificando

2 (21−X)2 +(23−X)2 +(30−X)2


S3−1 (21, 23, 30) = 3
Por la ecuación (1.5)

(21−24,67)2 +(23−24,67)2 +(30−24,67)2


= 2
Por el Ejemplo 1.3.5

13.47+2.79+28.41
2
Simplificando las potencias

44.67
= 2
simplificando

= 22.34 simplificando
2
Y si aplicamos el estadı́stico S3−1 al resto de las muestras podemos mostrar a la función
2
S3−1en la Tabla 1.6

Muestra m1 m2 m3 m4 m5 m6 m7 m8 m9 m10
2
S3−1 4 9.34 22.34 9.33 20.34 21 4.01 13.01 12.33 6.33
2
Tabla 1.6: Esta tabla describe completamente al estadı́stico S3−1 en S3

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

14 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Finalmente el desvı́o medio muestral de toda la población viene a ser 2.64.

Definición 1.3.8. Se define el estadı́stico variación estándard mediante


q
2
Sn−1 = Sn−1 . (1.7)

Ejemplo 1.3.8. Con ayuda del los resultados obtenidos en el Ejemplo 1.3.9 y el Ejemplo
1.3.9 , podemos evaluar al estadı́stico S3−1 en el conjunto S3 . En particular en la muestra
m1 = (21, 23, 25) del conjunto U tenemos que:

S3−1 (21, 23, 25) = 4 Por la ecuación (1.7) y el Ejemplo 1.3.7

= 2 simplificando

Y si aplicamos el estadı́stico S3−1 al resto de las muestras podemos mostrar a la función


2
S3−1 en la Tabla 1.7

Muestra m1 m2 m3 m4 m5 m6 m7 m8 m9 m10
S3−1 2 3.06 4.73 3.05 4.51 4.58 2 3.61 3.51 2.52

Tabla 1.7: Esta tabla describe completamente al estadı́stico S3−1 en S3

Definición 1.3.9. El coeficiente de variación o dispersión relativa es la relación entre la


desviación tı́pica de una muestra y su media. Es decir
S
CV = 100 % (1.8)
X
Ejemplo 1.3.9. Con ayuda de los resultados obtenidos en el Ejemplo 1.3.9 y el Ejemplo
1.3.5, podemos evaluar al estadı́stico CV en el conjunto U . En particular en la muestra
m1 = (21, 23, 25) del conjunto S3 tenemos que:

2
CV (21, 23, 25) = 23
100 % Por la ecuación (1.8) y las tablas 1.7 y 1.4

= 0.0869 × 100 % Simplificando el cociente

= 8.69 % Simplificando el porcentaje

Y si aplicamos el estadı́stico CV al resto de las muestras podemos mostrar a la función


CV en la Tabla 1.7

Muestra m1 m2 m3 m4 m5 m6 m7 m8 m9 m10
CV en % 8.69 12.93 19.17 12.53 17.61 17.61 8 13.89 13.16 9.22

Tabla 1.8: Esta tabla describe completamente al estadı́stico CV en S3

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.4. VALORES DE POSICIÓN Y DE DISPERSIÓN. 15

Definición 1.3.10. Un parámetro es el valor que toma un estadı́stico cuando la muestra


coincide con la población.
Comentario 1.3.5. Algunos parámetros suelen representarse con letras griegas. En particu-
lar la media poblacional o simplemente media es denotada mediante la letra griega mu: µ. La
varianza poblacional o simplemente Varianza es denotada por la letra griega sigma elevada
al cuadrado: σ 2 . Sin embargo, en el caso especial de la varianza, el cálculo difiere levemente
de la varianza muestral. Esto se debe a un detalle técnico que no trataremos en este trabajo
ya que exige algo mas de tratamiento teórico. En fı́n, si una población arroja el conjunto de
datos {x1 , x2 , . . . , xN }, donde N ∈ N, entonces la varianza poblacional se define mediante
N
1 X
σ2 = (xi − µ)2 (1.9)
N i=1

donde µ es la media aritmética poblacional del conjunto de datos {x1 , x2 , . . . , xN }. Y natu-


ralmente obtenemos que el desvı́o stándar poblacional resulta ser

σ = σ2. (1.10)
Ejemplo 1.3.10. Retornemos al Ejemplo 1.1.4 en donde hemos medimos la variable es-
tadı́stica X como la edad en años de sus individuos, de una población de cinco elementos.
Allı́ presentamos que la variable arrojaba el siguiente conjunto de datos:
{21, 23, 25, 27, 30}.
En la Tabla 1.9 mostramos los parámetros poblacionales para esta población

Parámetro Valor
Xmax 30
Xmin 21
R 9
µ 25.2
Dm 2.64
σ2 9.76
σ 3.12
CV 12.38 %

Tabla 1.9: Esta tabla describe los parámetros de nuestra población

1.4. Valores de posición y de dispersión.


Definición 1.4.1. Un valor estadı́stico de posición de una variable estadı́stica, es el valor
de un estadı́stico que se caracteriza por la posición que ocupa dentro del conjunto de valores
posibles de la variable estadı́stica.
Ejemplo 1.4.1. El estadı́stico del máximo Xmax es un estadı́stico de posición. El valor de este
estadı́stco en una muestra indica que todos los valores de la muestra son menores o iguales
que este valor. O en otras palabras, que a partir de esta posición la muestra no contiene
valores.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

16 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Ejemplo 1.4.2. El estadı́stico del mı́nimo Xmin es un estadı́stico de posición. El valor de


este estadśitco en una muestra indica que todos los valores de la muestra son mayores o
iguales que este valor. O en otras palabras, que antes de esta posición la muestra no contiene
valores.

Ejemplo 1.4.3. Dada una lista de n datos numéricos, podemos pensar en pesos iguales que
los ubicamos en una balanza con la forma del eje real x, y que cada dato representa un
lugar donde va un peso. Ası́ en el valor de un dato xi irá un peso. En este caso la media
aritmética representa el lugar donde debemos poner la base de la balanza para que los datos
dejen balanceada a la balanza, esto es, sin que la balanza se recarge hacia algún lado.
Para ilustrar esta idea, consideremos que tenemos el conjunto de datos

{3, 4, 8},
y ubiquemos un peso en cada valor, tal como lo vemos en la Figura 1.1

−2
−1 3

1 2 3 4 5 6 7 8
5

Figura 1.1: Los pesos ubicados en 3, 4, 8, se balancean si la base de la balanza se coloca en


el valor µ = 5 (Creado por Gonzalo Medina )

La media (muestral o poblacional) que coincide con el centro de masa de los datos. Además
podemos notar que: la suma de las desviaciones con respecto a la media aritmética es cero.

Definición 1.4.2. Un valor de dispersión es el valor de un estadı́stico que se caracteriza por


medir la heterogeneidad de los datos, es decir, que tan separados están entre sı́.

Ejemplo 1.4.4. El recorrido R de una muestra es un estadı́stico de dispersión. Nos da una


idea de que tan separados están los datos mas extremos. En cuanto mayor es el recorrido,
más lejos están los datos extremos y no da información sobre los valores internos.

Ejemplo 1.4.5. El desvı́o medio muestral es un estadı́stico de dispersión. Escencialmente, el


desvı́o medio es el promedio de las distancias de los datos a la media muestral de los mismo.
Por lo tanto, da la información relacionada con cuánto se desvı́an las distancias los datos a
su media muestral.
2
Ejemplo 1.4.6. La varianza muestral Sn−1 es un estadı́stico de dispersión. Esta es precisa-
n
mente el promedio de los errores cuadráticos multiplicado por un factor de n−1 . Por lo tanto,
la desviación tı́pica muestral, resulta ser un estadı́stico de dispersión.

Ejemplo 1.4.7. El coeficiente de apertura muetral es un estadı́stico de dispersión.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.5. FRECUENCIAS. 17

1.5. Frecuencias.
Normalmente, es muy dificil estudiar a una población completa, y naturalmente es mucho
mas complicado estudiar al conjunto de todas sus muestras de un tamaño en particular. Esto
nos obliga a crear ténicas que permitan estudiar a las muestras de forma individual, esto
es, si tenemos simplemente un conjunto de datos producto de tomar una en una población.
Esto nos lleva a distintos conceptos de frecuencias que abordaremos a continuación. En esta
sección trabajaremos fundamentalmente con datos ordenado de menor a mayor, por lo que
introducimos la siguiente definición

Definición 1.5.1. Un conjunto de datos {xi }ni=1 se dice que es una serie simple de datos si
cumple que:

x1 ≤ x2 ≤ x4 ≤ . . . ≤ xn (1.11)

Comentario 1.5.1. Intuititivamente hablando, la ecuación (1.11) dice que el conjunto de


datos es una serie simple de datos si está ordenado de menor a mayor.

Ejemplo 1.5.1. Los conjuntos de datos dado por

{−1, −1, 0, 0, 0, 2, 2, 4, 4, 4, 4, 5, 6, 6},

y
{1, 1, 1, 1, 4, 4, 4, 4, 4, 4, 5, 5, 6, 6}
son series simples de datos ya que satisfacen la desigualdad de la ecuación (1.11). Sinembargo,
el conjunto de datos dado por
{−1, 0, 0, 0, 3, 2, 2},
no es una serie simple de datos ya que falla al menos una de las desigualdades en la ecuación
(1.11). Mas precisamente,

x5 = 3 6≤ 2 = x6 .
Pero, si podemos reordenar a los datos como sigue:

{−1, 0, 0, 0, 2, , 2, 3, }

y este nuevo conjunto de datos si es una serie simple formada a partir de una serie que no
era simple.

Comentario 1.5.2. El hecho de poder convertir un conjunto de datos en una serie simple de
datos permite estudiarlos de manera sencilla. Supongamos que n, k ∈ N y consideremos una
población de la cual extraemos una muestra de n elementos la cual contiene k datos distintos:
x1 , x2 , . . . , xk . Si además x1 ≤ x2 ≤ · · · ≤ xk entonces la muestra se puede convertir en una
serie simple de datos de la siguiente forma:

x 1 , x 1 , . . . , x 1 , x 2 , x2 , . . . , x 2 , . . . x k , xk , . . . , x k .
Esto permite introducir k estadı́sticos como sigue: Si denotamos por fj la cantidad de veces
que aparece el dato j-ésimo entonces tenemos:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

18 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

x 1 , x 1 , . . . , x 1 , x 2 , x 2 , . . . , x 2 , . . . xk , x k , . . . , x k ,
| {z }| {z } | {z }
f1 veces f2 veces fk veces

donde cada valor fj ∈ N para j = 1, . . . , k. En resumen, tenemos k datos distintos x1 , . . . , xx


ordenados de menor a mayor y cada dato xj de esta lista aparece fj veces para j = 1, 2, . . . k.
Esta manera de organizar los datos nos permite definir k estadı́sticos nuevos que introducimos
en la siguiente definición

Definición 1.5.2. Dado un conjunto de datos cuya serie simple es de la forma:

x 1 , x 1 , . . . , x 1 , x 2 , x2 , . . . , x 2 , . . . , x k , x k , . . . , x k ,
| {z }| {z } | {z }
f1 veces f2 veces fk veces

entonces definimos la frecuencia absoluta i-ésima (i = 1, 2, . . . , k) como la cantidad fi de


veces que aparece el dato xi en la muestra.

Comentario 1.5.3. Notemos que para determinar la frecuencia absoluta de un dato, no es


necesario generar la serie simple, solo basta con contar cuantas veces aparece en el conjunto
de datos. Sin embargo el ordenarlo como serie simple nos permitirá realizar ciertos cálculos
de manera mas sencilla. Podemos estudiar las frecuencias absolutas confecionando una tabla
de frecuencias.

Ejemplo 1.5.2. En el conjunto de datos dado mediante la serie simple

m1 = {1, 1, 1, 1, 4, 4, 4, 4, 4, 4, 5, 5, 6}

podemos notar que:

Cuando i = 1, tenemos que x1 = 1 , y este dato aparece 4 veces en la serie, por lo tanto

f1 = 4.

Cuando i = 2, tenemos que x2 = 4, y este dato aparece 6 veces en la serie, por lo tanto

f2 = 6.

Cuando i = 3, tenemos que x3 = 5, y este dato aparece 2 veces en la serie, por lo tanto

f3 = 2.

Cuando i = 4, tenemos que x4 = 6, y este dato aparece 2 veces en la serie, por lo tanto

f4 = 1.

A toda esta información la podemos ordenar en una tabla de frecuencias absolutas tal y
como lo presentamos en la Tabla 1.10:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.5. FRECUENCIAS. 19

i xi fi
1 1 4
2 4 6
3 5 2
4 6 1

Tabla 1.10: Tabla de frecuencias absolutas para el conjunto m1

Ejemplo 1.5.3. El conjunto de datos dado por

m2 = {−1, −1, 0, 0, 0, −2, 0, 1, 1, 1, 1, 1, 2, 2, 2},

no es una serie simple. Esto no impide que podamos contar cuantos datos hay de cada tipo.
Ası́ pues, podemos notar que los datos que aparecen, ordenando de menor a mayor son:

x1 = −2, x2 = −1, x3 = 0, x4 = 1, x5 = 2.

También podemos notar que las respectivas frecuencias absolutas son:

f1 = 1, f2 = 2, f3 = 4, f4 = 5, f5 = 3.
Toda esta información la podemos ordenar en una tabla de frecuencias absolutas tal como lo
expresamos en la Tabla 1.11

i xi fi
1 -2 1
2 -1 2
3 0 4
4 1 5
5 2 3

Tabla 1.11: Tabla de frecuencias absolutas para el conjunto m2

Este ejemplo muestra que no es necesario tener una serie simple para encontrar las frecuencias
absolutas.

Teorema 1.5.1. Si tenemos un conjunto de n datos, donde figuran exactamente los valores
x1 , . . . , xk distintos, con frecuencias absolutas f1 , . . . , fk respectivamente, entonces
k
X
fi = n, (1.12)
i=1

es decir, la suma de las frecuencias absolutas de los datos es igual a la cantidad de datos n.

Comentario 1.5.4. El Teorema 1.5.1 dice esencialmente que en la columna de frecuencias


absolutas la suma total debe sumar el total de datos.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

20 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Ejemplo 1.5.4. En el Ejemplo 1.5.2 y en el Ejemplo 1.5.7 trabajamos con la muestras

m1 = {1, 1, 1, 1, 4, 4, 4, 4, 4, 4, 5, 5, 6},

y
m2 = {−1, −1, 0, 0, 0, −2, 0, 1, 1, 1, 1, 1, 2, 2, 2}.
Ahora bien, m1 posee 13 elementos es decir, n = 13. Hay 4 valores distintos en m1 , es decir
k = 4. Por lo tanto tenemos que
4
X
fi = f1 + f2 + f3 + f4 Expandiendo la suma
i=1
=4+6+2+1 Por la Tabla 1.10

= 13 Simplificando

tal y como lo indica la ecuación (1.12).


Por otro lado, m2 posee 15 elementos es decir, n = 15. Hay 5 valores distintos en m1 , es decir
k = 5. Por lo tanto tenemos que
5
X
fi = f1 + f2 + f3 + f4 + f5 Expandiendo la suma
i=1

=1+2+4+5+3 Por la Tabla 1.11

= 15 Simplificando

tal y como lo indica la ecuación (1.12).

Comentario 1.5.5. A menudo el valor de la suma de las frecuencias absolutas de un conjunto


de datos, lo escribimos en una linea de totales en el último renglón de la tabla de frecuencias
abolutas. Ete valor nos sirve para verificar si hemos realizado un conteo correcto de los datos,
esto es, si la suma de las frecuencias absolutas de un conjunto de datos no coincide con la
cantidad total de datos, entonces hay al menos un error en al menos una frecuencia absoluta.

Teorema 1.5.2. Dado un conjunto de n datos donde aparecen los valores x1 , . . . , xk con
frecuencias absolutas f1 , . . . , fk respectivamente, entonces vale que:

1. La media muestral es

k
1X
Xn = xi f i (1.13)
n i=1

2. La varianza muestral es

k
2 1 X
Sn−1 = (xi − X)2 fi (1.14)
n − 1 i=1

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.5. FRECUENCIAS. 21

3. El desvı́o medio muestral es

k
1X
Dm = |xi − X|fi (1.15)
n i=1

Ejemplo 1.5.5. Calculemos los estadı́sticos de la media muestral, varianza muestral y desvı́o
medio para muestra m2 usando la tabla de frecuencias consignadas en la Tabla 1.11.

1.
1
X̄ = 15
(x1 f1 + x2 f 2 + x3 f 3 + x4 f 4 + x5 f 5 ) Por la ecuación (1.13)

1
= 15
((−2)1 + (−1)2 + (0)4 + (1)5 + (2)3) Por la Tabla 1.11

1
= 15
((−2 − 2 + 0 + 5 + 6) Resolviendo productos

7
= 15
Simplificando
2
2. S15−1
1
= 15−1
((x1 − X̄)2 f1 + (x2 − X̄)2 f2 + (x3 − X̄)2 f3 + (x4 − X̄)2 f4 + (x5 − X̄)2 f5 ) (1.14)

1
= 14
((−2 − 72 )2 1 + (−1 − 27 )2 2 + (0 − 27 )2 4 + (1 − 27 )2 5 + (2 − 27 )2 3) 1.11

= 1.4 Simplificando

Dm
1
= 15
(|x1 − X̄|f1 + |x2 − X̄|f2 + |x3 − X̄|f3 + |x4 − X̄|f4 + |x5 − X̄|f5 ) (1.15)

1
= 15
(| − 2 − 72 |1 + |1 − 27 |2 + |0 − 72 |4 + |1 − 27 |5 + |2 − 27 |3) 1.11

= 0.97 Simplificando

Definición 1.5.3. Dado un conjunto de n datos, donde figuran exactamente los valores
x1 , . . . , xk , con frecuencias absolutas f1 , . . . , fk respectivamente, se define la frecuencia abso-
luta acumulada Fi hasta el dato i-ésimo, por
i
X
Fi = fj , (1.16)
j=1

para cada i = 1, 2, . . . , k. Mas precisamente, vale la siguiente recursión:

F1 = f1
(1.17)
Fi = Fi−1 + fi Si i = 2, 3, . . . , k

Ejemplo 1.5.6. El conjunto de datos dado por m1 = {1, 1, 1, 1, 4, 4, 4, 4, 4, 4, 5, 5, 6},

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

22 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Cuando i = 1, tenemos que

F1 = f1 Por la ecuación (1.17)

=4 Por la Tabla 1.10.

por lo tanto la primera frecuencia absoluta acumulada es 4, es decir: F1 = 4.

Cuando i = 2, tenemos que

F2 = F1 + f2 Por la ecuación (1.17)

=4+6 Por la Tabla 1.10,

= 10 Simplificando,

por lo tanto la segunda frecuencia absoluta acumulada es 10, es decir: F2 = 10.

Cuando i = 3, tenemos que

F3 = F2 + f3 Por la ecuación (1.17)

= 10 + 2 Por la Tabla 1.10,

= 12 Simplificando,

por lo tanto la tercera frecuencia absoluta acumulada es 12, es decir: F3 = 12.

Cuando i = 4, tenemos que

F4 = F3 + f4 Por la ecuación (1.17)

= 12 + 1 Por la Tabla 1.10,

= 13 Simplificando,

por lo tanto la primera frecuencia absoluta acumulada es 4, es decir: F4 = 13.

Y podemos resumir completamente esta información mediante la tabla de frecuencias como


sigue:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.5. FRECUENCIAS. 23

i xi fi Fi
1 1 4 4
2 4 6 10
3 5 2 12
4 6 1 13
Total 13

Tabla 1.12: Tabla de frecuencias absolutas acumuladas para el conjunto de datos m1

Ejemplo 1.5.7. Para el conjunto de datos dado por

m2 = {−1, −1, 0, 0, 0, −2, 0, 1, 1, 1, 1, 1, 2, 2, 2},

Tenemos el resumen de sus frecuencncias absolutas acumuladas en la tabla

i xi fi Fi
1 -2 1 1
2 -1 2 3
3 0 4 7
4 1 5 12
5 2 3 15
Total 15

Tabla 1.13: Tabla de frecuencias absolutas acumuladas para el conjunto m2

Definición 1.5.4. Dado un conjunto de n datos con valores x1 , x2 , . . . , xk cuyas frecuencias


absolutas son f1 , f2 , . . . , fk , definimos para i = 1, 2, . . . , k la frecuencia relativa f ri del i-
ésimo dato, por
fi
f ri = . (1.18)
n
Ejemplo 1.5.8. El conjunto de datos dado por m1 = {1, 1, 1, 1, 4, 4, 4, 4, 4, 4, 5, 5, 6}
consiste de 13 datos, es decir, n = 13, y tiene cuatro valores 1, 4, 5, 6, con frecuencias
absolutas 4, 6, 2, 1, respectivamente (Ver la Tabla 1.10). Las frecuencias absolutas relativas
las computamos como sigue:
Cuando i = 1, tenemos que

f1
f r1 = n
Por la ecuación (1.18)

4
= 13
Por la Tabla 1.10

= 0.3076 Simplificando
por lo tanto la primer frecuencia absoluta relativa es 0.3076, es decir,

f r1 = 0.3076.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

24 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Cuando i = 2, tenemos que

f2
f r2 = n
Por la ecuación (1.18)

6
= 13
Por la Tabla 1.10

= 0.4615 Simplificando
por lo tanto la segunda frecuencia absoluta relativa es 0.4615, es decir,

f r2 = 0.4615.

Cuando i = 3, tenemos que

f3
f r3 = n
Por la ecuación (1.18)

2
= 13
Por la Tabla 1.10

= 0.1538 Simplificando
por lo tanto la tercera frecuencia absoluta relativa es 0.1538, es decir,

f r3 = 0.1538.

Cuando i = 4, tenemos que

f4
f r4 = n
Por la ecuación (1.18)

1
= 13
Por la Tabla 1.10

= 0.0769 Simplificando
por lo tanto la cuarta frecuencia absoluta relativa es 0.0769, es decir,

f r4 = 0.0769.

Y podemos resumir completamente esta información en la Tabla 1.14, donde además pre-
sentamos los resultados de las demás frecuencias estudiadas hasta ahora sobre este conjunto
de datos.

i xi fi Fi f ri
1 1 4 4 0.3076
2 4 6 10 0.4615
3 5 2 12 0.1538
4 6 1 13 0.0769
Total 13 0.9998

Tabla 1.14: Tabla de frecuencias relativas para el conjunto de datos m1

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.5. FRECUENCIAS. 25

Ejemplo 1.5.9. Para el conjunto de datos dado por

m2 = {−1, −1, 0, 0, 0, −2, 0, 1, 1, 1, 1, 1, 2, 2, 2},

presentamos el resumen de las frecuencias relativas en la Tabla 1.15, donde además presen-
tamos los resultados de las demás frecuencias estudiadas hasta ahora sobre este conjunto de
datos.

i xi fi Fi f ri
1 -2 1 1 0.0667
2 -1 2 3 0.1333
3 0 4 7 0.2666
4 1 5 12 0.3333
5 2 3 15 0.2
Total 15 0.9999

Tabla 1.15: Tabla de frecuencias relativas para el conjunto m2

Comentario 1.5.6. Podemos notar que en el Ejemplo 1.5.8 la suma de la frecuencias re-
lativas resulta ser 0.998, y en el Ejemplo 1.5.9 la suma de la frecuencias relativas resulta
ser 0.9999. Este valor teóricamente debe dar 1, sinembargo por causas de redondeos lo mas
común es que tal suma resulte ser valores como los anteriores o eventualmente 1.001, 1.002,
entres otros valores similares. Esta idea la formalizamos en el siguiente Teorema.

Teorema 1.5.3. Dado un conjunto de datos con valores x1 , x2 , . . . , xk cuyas frecuencias


relativas son f r1 , f r2 , . . . , f rk , entonces
k
X
f ri = 1. (1.19)
i=1

Comentario 1.5.7. En otras palabras, el Teorema 1.5.3 dice que la suma de las frecuencias
relativas es igual a 1 en un conjunto de datos. Pero como bien hemos podido notar, cuando
relaizamos una tabla de frecuencias, a causa de los redondeos, la igualdad de la ecuación
(1.19) no suele ser exacta.

Definición 1.5.5. Dado un conjunto de n datos datos con valores x1 , x2 , . . . , xk cuyas fre-
cuencias relativas son f r1 , f r2 , . . . , f rk , definimos la frecuencia relativa acumulada i -ésima
F ri , mediante
i
X
F ri = Fj (1.20)
j=1

para cada i = 1, 2, . . . , k. Mas precisamente las frecuencias relativas acumuladas satisfacen


la siguiente recursión:

F r 1 = f r1
. (1.21)
F ri = F ri−1 + f ri Si i = 2, 3, . . . , k

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

26 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Ejemplo 1.5.10. Al conjunto de datos dado por m1 = {1, 1, 1, 1, 4, 4, 4, 4, 4, 4, 5, 5, 6, },


ya le hemos estudiado sus frecuencias relativas tales resultados los encontramso en la Tabla
1.14. Calcularemos las frecuencias relativas acumuladas como sigue:
Cuando i = 1, tenemos que
F r 1 = f r1 Por la ecuación (1.21)

= 0.3076 Por la Tabla 1.14

y por lo tanto concluı́mos que la primer frecuencia relativa acumulada de correspon-


diente al dato x1 = 1 es 0.3076, es decir,
F r1 = 0.3076.

Cuando i = 2, tenemos que


F r 2 = F r 1 + f r2 Por la ecuación (1.21)

= 0.3076 + 0.4615 Por la Tabla 1.14

= 0.7691 Simplificando

y por lo tanto concluı́mos que la segunda frecuencia relativa acumulada al correspon-


diente al dato x2 = 4 es 0.7691, es decir,
F r2 = 0.7691.

Cuando i = 3, tenemos que


F r 3 = F r 2 + f r3 Por la ecuación (1.21)

= 0.7691 + 0.1538 Por la Tabla 1.14

= 0.9229 Simplificando

y por lo tanto concluı́mos que la tercera frecuencia relativa acumulada al correspon-


diente al dato x3 = 5 es 0.9229, es decir,
F r2 = 0.9229.

Cuando i = 4, tenemos que


F r 4 = F r 3 + f r4 Por la ecuación (1.21)

= 0.9229 + 0.0769 Por la Tabla 1.14

= 0.9998 Simplificando

y por lo tanto concluı́mos que la cuarta frecuencia relativa acumulada al correspondiente


dato x4 = 6 es 0.9998, es decir,
F r4 = 0.9998.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.5. FRECUENCIAS. 27

Y podemos resumir completamente esta información en la Tabla 1.16, donde además presen-
tamos los resultados de las demás frecuencias estudiadas hasta ahora sobre este conjunto de
datos.

i xi fi Fi f ri F ri
1 1 4 4 0.3076 0.3076
2 4 6 10 0.4615 0.7691
3 5 2 12 0.1538 0.9229
4 6 1 13 0.0769 0.9998
Total 13 0.9998

Tabla 1.16: Tabla de frecuencias relativas para el conjunto de datos m1

Ejemplo 1.5.11. Para el conjunto de datos dado por

m2 = {−1, −1, 0, 0, 0, −2, 0, 1, 1, 1, 1, 1, 2, 2, 2},

presentamos el resumen de las frecuencias relativas en la Tabla 1.17, donde además presen-
tamos los resultados de las demás frecuencias estudiadas hasta ahora sobre este conjunto de
datos.

i xi fi Fi f ri F ri
1 -2 1 1 0.0667 0.0667
2 -1 2 3 0.1333 0.2
3 0 4 7 0.2666 0.4666
4 1 5 12 0.3333 0.7999
5 2 3 15 0.2 0.9999
Total 15 0.9999

Tabla 1.17: Tabla de frecuencias relativas acumuladas para el conjunto m2

Comentario 1.5.8. Mas generalmente para estudiar las frecuencias de un conjunto de datos,
solemos ordenar una tabla de frecuencias como sigue:

i dato fi Fi f ri F ri
1 x1 f1 F1 f r1 F r1
2 x2 f2 F2 f r2 F r2
.. .. .. .. .. ..
. . . . . .
k xk fk n f rk 1

Tabla 1.18: Tabla de frecuencias genérica

Ordenar la información de este modo permite introducir una familia de estadı́sticos de posi-
ción muy importante. Esto lo hacemos a continuación

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

28 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

Definición 1.5.6. Dada una serie simple de datos y un valor p ∈ (0, 1) el cuantil Qp es el
valor para el cual la frecuencia relativa acumulada es p. Los cuantiles mas importantes son

p Qp
0.5 Mediana
0.25, 0.5, 0.75 Cuartiles
0.1, 0.2,...,0.9 Deciles
0.01,0.02,...,0.99 Centiles

Comentario 1.5.9. El cuantil Q0.5 que llamamos mediana representa el valor de la variable
para el cual hemos acumulado el 50 % de los datos. El cuantil Q0.25 que llamamos primer
cuartil representa el valor de la variable para el cual hemos acumulado el 25 % de los datos. El
cuantil Q0.75 que llamamos tercer cuartil representa el valor de la variable para el cual hemos
acumulado el 75 % de los datos. El segundo cuartil concide con la mediana. El cuantil Q0.1
que llamamos primer decil representa el valor de la variable para el cual hemos acumulado el
10 % de los datos. El cuantil Q0.2 que llamamos primer decil representa el valor de la variable
para el cual hemos acumulado el 20 % de los datos. Y este razonamiento se extiende a los
demás deciles. Vale la pena notar que el quinto decil coincide con el segundo cuartil y con
la mediana. Como en general el cuantil Qp indica el valor que acumuló el 100 × p % de los
datos, entonces los cuantiles estadı́sticos de posción.

Ejemplo 1.5.12. Con la información suministrada por la Tabla 1.16 en su columna de


frecuencias relativas acumuladas podemos afirmar que:

1. La mediana es
Q0.5 = 4

2. Los cuartiles primero y tercero son

Q0.25 = 1, Q0.75 = 4,

3. En cuanto a los deciles tenemos

Q0.1 = Q0.2 = Q0.3 = 1, Q0.4 = Q0.5 = Q0.6 = Q0.7 = 4, Q0.8 = Q0.9 = 5

Analogamente con la información suministrada por la Tabla ?? en su columna de fre-


cuencias relativas acumuladas podemos afirmar que:

1. La mediana es
Q0.5 = 1

2. Los cuartiles primero y tercero son

Q0.25 = 0, Q0.75 = 1,

3. En cuanto a los deciles tenemos

Q0.1 = Q0.2 = −1, Q0.3 = Q0.4 = 0, Q0.5 = Q0.6 = Q0.7 = 1, Q0.8 = Q0.9 = 2

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.6. DATOS AGRUPADOS 29

1.6. Datos agrupados


Por lo general la cantidad de datos n es muy grande. Cuando el conjunto de datos es
numéricos podemos usar una técnica que consiste en agruparlos en clases ordenadas. Es-
ta ténica permite estudiar al conjunto de datos de la misma manera que lo hemos venido
haciendo. Ası́ pues, la técnica consiste en los siguientes pasos:
1. Determinamos el máximo valor de los datos, que denotamso por xmax
2. Determinamos el máximo valor de los datos, que denotamso por xmin
3. Determinamos el rango o recorrido de los datos que denotamos por R. Recordemos que
R = xmax − xmin . (1.22)

4. Establecemos el número de clases k en que se van a agrupar, el cual podemos aproximar


mediante el Método Sturges que propone que:
k = 1 + 3, 332Logn, (1.23)
donde n es tamaño muestral.
5. Determinamos la amplitud C de clase para agrupar

R
C= . (1.24)
k
6. Determinamos los lı́mites de clase de cada clase que se forman mediante

Li = xmin + C(i − 1), (1.25)


donde i = 1, . . . , k + 1. O alternativamente de forma recursiva

L0 = xmin
(1.26)
Li = Li−1 + C Si i = 1, . . . , k
Estos valores son los lı́mites de las clases en las cuales enmarcaremos nuestros datos.
Tales clases resultan ser intervalos de la forma

[L0 , L1 ), [L1 , L2 ), [L2 , L3 ), . . . [Lk−2 , Lk−1 ), [Lk−1 , Lk ],

El intervalo de números reales definido mediante


[Li−1 , Li )
es la case i-ésima para i = 1, . . . , k−1, y el intervalo de números reales definido mediante
[Lk−1 , Lk ],
es la k-ésima clase. Al extremo inferior de cada intervalo que define a una clase, le sole-
mos llamar también Lı́mite inferior de la clase, y al extremo superior de cada intervalo
que define a una clase, le solemos llamar también Lı́mite superior de la clase.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

30 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

7. Construı́mos las marcas de clase Mi mediante la expresión


Li + Li−1
Mi = , (1.27)
2
donde i = 1, . . . , k. O alternativamente de forma recursiva

L1 +L0
M1 = 2
(1.28)
Mi = Mi−1 + C Si i = 2, . . . , k.

La marca de clase Mi es un valor que representa a toda la clase formada por el intervalo
el intervalo [Li , Li+1 )

Ejemplo 1.6.1. Consideremos el conjunto de datos

3, 11, 12, 19, 22, 23, 24, 25, 27, 29, 35, 36, 37, 45, 48.

Realicemos una tabla de frecuencias usando la técnica de datos agrupados explicada


anteriormente. Iniciamos notando que hay 15 datos, es decir el tamaño muestral es n = 15.
Ası́ pues

1. El dato mas pequeño es 3, por lo tanto concluı́mos que

xmin = 3.

2. El dato mas grande es 48, por lo tanto concluı́mos que

xmax = 48.

3. Calculamos el Rango de los datos como sigue:

R = xmax − xmin Por la ecuación (1.22)

= 48–3 Sutituyendo valores

= 45 Simplificando

4. Calculamos ahora el número clases mediante:

k = 1 + 3.33Log(n) Por la ecuación (1.23)

= 1 + 3.33Log(15) Sutituyendo valores

= 4.88 Simplificando

≈5 Aproximando a un entero

por tanto elegimos k = 5

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.6. DATOS AGRUPADOS 31

5. Calculamos la longitud de clase mediante:

R
C = k
Por ecuación (1.24)

45
= 5
Reemplazando valores

=9 Simplificando

6. Ahora bien, vamos a calcular los extremos de las clases, es decir calcularemos los Li
que correspondererán a los lı́mites de las clases

Si i = 0
L0 = xmin Por ecuación (1.26)

=3 Reemplazando el valor
Si i = 1
L1 = L1 + C Por ecuación (1.26)

=3+9 Reemplazando valores

= 12 Simplificando
Si i = 2
L2 = L1 + C Por ecuación (1.26)

= 12 + 9 Reemplazando valores

= 21 Simplificando
Si i = 3
L3 = L2 + C Por ecuación (1.26)

= 21 + 9 Reemplazando valores

= 30 Simplificando
Si i = 4
L4 = L3 + C Por ecuación (1.26)

= 30 + 9 Reemplazando valores

= 39 Simplificando
Si i = 5
L5 = L4 + C Por ecuación (1.26)

= 39 + 9 Reemplazando valores

= 48 Simplificando

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

32 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

De esta forma podemos notar que las clases que nos interesan vienen dadas mediantes los
intervalos

[3, 12), [12, 21), [21, 30), [30, 39), [39, 48]

Ahora procedemos a calcular las marcas de clase, o los representantes de clase. Esto lo hacmos
como sigue:

Si i = 1
L0 +L1
M1 = 2
Por ecuación (1.28)

3+12
= 2
Reemplazando valores

= 7.5 Simplificando

Si i = 2
M2 = M1 + C Por ecuación (1.28)

= 7.5 + 9 Reemplazando valores

= 16.5 Simplificando

Si i = 3
M 3 = M2 + C Por ecuación (1.28)

= 16.5 + 9 Reemplazando valores

= 25.5 Simplificando

Si i = 4
M 4 = M3 + C Por ecuación (1.28)

= 25.5 + 9 Reemplazando valores

= 34.5 Simplificando

Si i = 5
M 5 = M4 + C Por ecuación (1.28)

= 34.5 + 9 Reemplazando valores

= 43.5 Simplificando

Por lo tanto concluı́mos que las marcas de clase son

7.5, 16.5, 25.5, 34.5, 43.5

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.6. DATOS AGRUPADOS 33

Ahora continuamos contando cuantos elementos del conjuntos de datos entran en cada
clase, y este conteo genera las frecuencias absolutas de las clases y el resto de las frecuencias se
analiza de forma similar a como se estudian en el caso donde no debemos agrupar a los datos.
Ahora bien, tenemos a continuación este conteo indicando por medio de distintos colores los
elementos que pertenecen a las distintas clases.

3, 11, 12, 19, 22, 23, 24, 25, 27, 29, 35, 36, 37, 38, 48.
Ahora ya estamos en condiciones de presentar un resumen en una tabla de frecuencias el
estudio de los datos

i Clases Marcas fi Fi f ri F ri
1 [3, 12) 7.5 2 2 0.1333 0.1333
2 [12, 21) 16.5 2 4 0.1333 0.2666
3 [21, 30) 25.5 6 10 0.4 0.6666
4 [30, 39) 34.5 4 14 0.2667 0.9333
5 [39, 40) 43.5 1 15 0.0667 1

Tabla 1.19: Tabla de frecuencias para un conjunto de datos agrupados

i [Li , Li+1 ) Mi fi fai Fi Fai Mi f i (Mi − X)2 fi


1 [xmin , L2 ) M1 f1 fa1 F1 Fa1 M1 f 1 (M1 − X)2 f1
2 [L2 , L3 ) M2 f2 fa2 F2 Fa2 M2 f 2 (M2 − X)2 f2
.. .. .. .. .. .. .. .. ..
. . . . . . . . .
k [Lk , xmax ) Mk fk n Fk 1 Mk f k (Mk − X)2 fk

Teorema 1.6.1. Supongamos que tenemos un conjunto de n datos numéricos distribuidos en


k clases, para i = 1, . . . , k los valores Mi son los representates de clases, y cuyas frecuencias
absolutas son fi respectivamente. Entonces

1. la media se calcula mediante

k
X
X= Mi f i (1.29)
i=1

2. la varianza muestral se calcula mediante

k
2 1 X
Sn−1 = (Mi − X)2 fi (1.30)
n − 1 i=1

3. La mediana se calcula n
2
− fi−1
M e = Li + C (1.31)
fi

i es la clase que contiene la mediana

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

34 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

4. La moda se calcula

fi − fi−1
M0 = Li + C (1.32)
(fi − fi−1 ) + (fi − fi+1 )

i es la clase que contiene la moda

1.7. Gráficos estadı́sticos.

Definición 1.7.1. Un diagrama de barras, gráfico de barras o gráfico de columnas es un


gráfico en el cual a cada dato o clase de datos le asociamos una barra de altura igual a su
frecuencia absoluta o relativa.

Ejemplo 1.7.1. Para el caso de la muestra m1 = {1, 1, 1, 1, 4, 4, 4, 4, 4, 4, 5, 5, 6, }, pode-


mos dibujar un diagrama de barras de frecuencia absoluta usando la información de la Tabla
1.16 tal y como lo mostramos en la Figura 1.2

6
6
Frecuencias absolutas

4
4

2
2
1

1 4 5 6
Datos de la muestra

Figura 1.2: Diagrama de barras de frecuencias absolutas para la muestra m1

Analogamente podemos dibujar un diagrama de barras de frecuencia relativas usando la


información de la Tabla 1.16 tal y como lo mostramos en la Figura 1.3

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.7. GRÁFICOS ESTADÍSTICOS. 35

0.5 0.46

Frecuencias absolutas
0.4
0.31
0.3

0.2
0.15

0.1 7.69 · 10−2

1 4 5 6
Datos de la muestra

Figura 1.3: Diagrama de barras de frecuencias relativas para la muestra m1

Definición 1.7.2. Dado un conjunto de datos, el cual ha sido distribuı́do ya sea de forma
individual o por clases o categorı́as, llamamos histograma a una representación gráfica de
una variable en forma de barras, donde el área encerrada por cada barra correspondiente al
dato, a la clase o a la categorı́a es proporcional a la frecuencia de los valores representados.

Ejemplo 1.7.2. Para el caso de la muestra m2 = {−1, −1, 0, 0, 0, −2, 0, 1, 1, 1, 1, 1, 2, 2, 2},


podemos dibujar un histograma de frecuencias absolutas usando la información de la Tabla
1.17 tal y como lo mostramos en la Figura 1.4

0
−2 −1 0 1 2

Figura 1.4: Histograma de frecuencias absolutas para la muestra m2

Analogamente podemos dibujar un histograma de frecuencias relativas usando la información


de la Tabla 1.17 tal y como lo mostramos en la Figura 1.5

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

36 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

0.4

0.3

0.2

0.1

0
−2 −1 0 1 2

Figura 1.5: Histograma de frecuencias relativas para la muestra m2

Definición 1.7.3. Dado un conjunto de datos, el cual ha sido distribuı́do ya sea de forma
individual o por clases o categorı́as, llamamos polı́gono de frecuencia a al gráfico que se realiza
a partir de un histograma de frecuencia, en los cuales se utilizan columnas verticales para
expresar las frecuencias y el polı́gono lo creamos al unir los puntos medios de máxima altura
dentro las columnas de las barras.

Ejemplo 1.7.3. Para el caso de la muestra m2 = {−1, −1, 0, 0, 0, −2, 0, 1, 1, 1, 1, 1, 2, 2, 2},


podemos dibujar un polı́gono de frecuencias absolutas usando la información de la Tabla 1.17
tal y como lo mostramos en la Figura 1.6

0
−2 −1 0 1 2

Figura 1.6: Polı́gono de frecuencias absolutas para el conjunto m2

Analogamente podemos dibujar un polı́gono de frecuencias relativas usando la información


de la Tabla 1.17 tal y como lo mostramos en la Figura 1.7

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

1.7. GRÁFICOS ESTADÍSTICOS. 37

0.5

0.4

0.3

0.2

0.1

0
−2 −1 0 1 2

Figura 1.7: Polı́gono de frecuencias relativas para el conjunto m2

Definición 1.7.4. Un diagrama circular o diagrama de sectores o diagrama de pastel o


diagrama de torta entre otros nombres, es una representación gráfica en sectores circulares,
en la que cada dato, categorı́a o clase se le asigna una proción en forma de sector circular
proporcional a su frecuencia relativa.

Ejemplo 1.7.4. Para el caso de la muestra m1 = {1, 1, 1, 1, 4, 4, 4, 4, 4, 4, 5, 5, 6, }, pode-


mos dibujar un diagrama de barras de frecuencia absoluta usando la información de la Tabla
1.16 tal y como lo mostramos en la Figura 1.8

46.15 %

30.76 %
15.38 %

5 7.69 % 1

Figura 1.8: Diagrama de Torta para la muestra m1

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

38 CAPÍTULO 1. ESTADÍSTICA DESCRIPTIVA

30.76 %

15.38 % 46.15 %
5

7.69 % 4

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

Capı́tulo 2

Probabilidad

Girolamo Cardano (1501- 1576), escribe hacia 1520 el primer tratado sitemático sobre
las probabilidades. Esto fue un siglo antes de los trabajos de Blaise Pascal (1623-1662) y
Pierre de Fermat (1601-1665). La idea de probabilidad tuvo un gran auge durante varios
siglos debido a la manera como aborda la comprensión de los juegos de azar. Pero tuvimos
que esperar hasta los avances teóricos de Andrei Kolmogorov (1903- 1987) para poder tener
un formalismo axiomático moderno para el desarrollo matemático del concepto.

2.1. Espacio Muestral


Definición 2.1.1. Un experimento es el proceso de obtener un resultado observado de un
fenómeno.

Ejemplo 2.1.1. Extraer una carta de un mazo de naipes de póker de 52 cartas y observar
la carta extraida, es un experimento.

Ejemplo 2.1.2. Lanzar una moneda al aire y ver que lado sale, es un experimento.

Ejemplo 2.1.3. Lanzar dos monedas al aire y ver la pareja de lados que salen, es un expe-
rimento.

Ejemplo 2.1.4. Lanzar un dado al aire y ver el resultado que sale, es un experimento.

Ejemplo 2.1.5. Lanzar dos dados al aire y sumar el par de números resultantes, es un
experimento.

Ejemplo 2.1.6. Tomar un libro y contar los errores ortográficos que contiene, es un experi-
mento.

Ejemplo 2.1.7. Observar una esquina determinada en una ciudad y contar los accidentes
de tránsito ocurridos durante una semana, es un experimento.

Ejemplo 2.1.8. Observar un tramo de ruta y contar cuantos animales son atropellados en
dicho tramo durante un dı́a especı́fico, es un experimento.

Ejemplo 2.1.9. Contar cuantas llamadas ingresan a una central telefónica durante cierta
hora del dı́a, es un experimento.

39
Descargado por Martu Menendez (martinamenendezgarro@[Link])
lOMoARcPSD|4133870

40 CAPÍTULO 2. PROBABILIDAD

Ejemplo 2.1.10. Extraer una carta de un mazo de 52 cartas (un mazo para juagar al póker)
y ver a cual carta corresponde.

Definición 2.1.2. El conjunto S de todos los resultado posibles de un experimento es llamado


espacio muestral.

Ejemplo 2.1.11. El espacio muestral de extraer una carta de un mazo de 52 cartas es

 

 2♥ 3♥ 4♥ 5♥ 6♥ 7♥ 8♥ 9♥ 10♥ J♥ Q♥ K♥ A♥ 

 
2♦ 3♦ 4♦ 5♦ 6♦ 7♦ 8♦ 9♦ 10♦ J♦ Q♦ K♦ A♦
S= .

 2♠ 3♠ 4♠ 5♠ 6♠ 7♠ 8♠ 9♠ 10♠ J♠ Q♠ K♠ A♠ 

 
2♣ 3♣ 4♣ 5♣ 6♣ 7♣ 8♣ 9♣ 10♣ J♣ Q♣ K♣ A♣

Ejemplo 2.1.12. Si convenimos en escribir C cundo salió cara y S cuando que salió Seca
(sello o cruz), el espacio muestral del experimento de lanzar una moneda al aire y ver que
lado resulta al caer es:

S = {C, S},

Ejemplo 2.1.13. El espacio muestral del experimento de lanzar un dado al aire y ver que
lado resulta al caer es:
S = {1, 2, 3, 4, 5, 6}

Ejemplo 2.1.14. El espacio muestral del experimento de lanzar dos dados distinguidos entre
ellos al aire y ver el par resultante es:
 

 (1,1) (1,2) (1,3) (1,4) (1,5) (1,6) 

 


 (2,1) (2,2) (2,3) (2,4) (2,5) (2,6) 


 
(3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
S=

 (4,1) (4,2) (4,3) (4,4) (4,5) (4,6) 
 


 (5,1) (5,2) (5,3) (5,4) (5,5) (5,6) 

 
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)

Ejemplo 2.1.15. El espacio muestral del experimento lanzar dos dados y sumar el par de
números que aparecen es:

S = {2, 3, 4, 5, 6, 7, 8, 9, 10, 11, 12}

Ejemplo 2.1.16. Un grupo de 73 egresados de la Universidad Siglo 21 se reencuentran.


Tenemos que: 21 egresados hicieron el curso de python, 19 egresados hicieron el curso de
SQL y 8 hicieron ambos cursos. Seleccionamos un egresado al azar para dar el discurso de
apertura de el reencuentro.
A continuación usaremos la técnica de diagramas de Venn para ilustrar toda la información
de la situación. Para ello comenzamos definiendo las propiedades de nuestro de interés. Sean

A := Los egresados que estudiaron Python


B := Los egresados que estudiaron SQL

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.1. ESPACIO MUESTRAL 41

Como 8 hicieron ambos cursos entonces comenzamos consignando en un diagrama de


Venn esta información como vemos en la Figura

S
A B

Figura 2.1: holamundo

Como 21 hicieron Python y ya contamos los 8 en común con SQL entonces completamos
el cı́rculo que corresponde a al conjuntos A con los 13 egresados que hacen falta tal y como
vemos en la Figura

S
A B

13 8

Figura 2.2: holamundo

Como 19 hicieron SQL y ya contamos los 8 en común con Python entonces completamos
el cı́rculo que corresponde a al conjuntos B con los 11 egresados que hacen falta tal y como
vemos en la Figura

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

42 CAPÍTULO 2. PROBABILIDAD

S
A B

13 8 11

Figura 2.3: holamundo

Como bien podemos observar hemos contado un total de 13+8+11=32 egresados. Y para
completar a los 73 egresados hacen falta 41 que ponemos fuera de los cı́rculos que comprenden
a los conjuntos A y B, tal y como lo vemos en la figura

S
A B

13 8 11

41

Figura 2.4: Hola mundo

De este modo hemos podido presentar el espacio muestral S con toda la información
presentada den la situación.

Comentario 2.1.1. Un método útil para expresar espacios muestrales es ordenando los
resultados obtenidos mediante las tablas de contingencia, las cuales definimos a continuación.

Definición 2.1.3. Una tabla de contingencia es una tabla que registra la asociación entre
dos o más variables.

Comentario 2.1.2. Habitualmente la naturaleza de las variables estudiadas en las tablas de


contingencia son cualitativas (nominales u ordinales). Empleamos para registrar y analizar
la asociación entre dos o más variables, habitualmente de naturaleza cualitativa (nominales
u ordinales). Se trata de tablas en cuyas celdas figuran probabilidades, y en la cual podemos
determinar unas probabilidades conociendo otras de la tabla.

Ejemplo 2.1.17. Una empresa revisa los estados civiles de 47 empleados y encuentra que:
de ellos 31 son mujeres de las cuales hay 13 mujeres casadas. Además el total de personas

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.1. ESPACIO MUESTRAL 43

casadas es 19. Seleccionamos un empleado y revisamos su información. Para poder expresar


al espacio muestral en esta situación podemos proceder definiendo

X := Hombre o Mujer

Y := Casado o Soltero.
A cada empleado le corresponde un par ordenado del tipo (X, Y ). Claramente escribir tales
47 pares ordenados es un trabajo arduo y analizar esto presupone una labor dificultosa. Sin
embargo podemos describir el espacio muestral de este experimento como sigue, creanado la
siguiente tabla

Hombre Mujer Totales


Casado
Soltero
Totales

Tabla 2.1: Hola mundo

La información de nuestra situación es que hay 47 empleados de ellos 31 son mujeres


de las cuales hay 13 mujeres casadas y el total de personas casadas es 19, Estos datos los
consignamos en

Hombre Mujer Totales


Casado 13 19
Soltero
Totales 31 47

Tabla 2.2: Hola mundo

como bien podemos notar hay varias posiciones en la tabla que no conocemos. Usamos
variables a, b, c, d, e paracompletar la tabla

Hombre Mujer Totales


Casado a 13 19
Soltero b c d
Totales e 31 47

Tabla 2.3: Hola mundo

1. De la fila de Casado tenemos que:

a + 13 = 19

2. De la fila de Soltero tenemos que:


b+c=d

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

44 CAPÍTULO 2. PROBABILIDAD

3. De la fila de Totales tenemos que:

e + 31 = 47

4. De la columna de Hombre tenemos que:

a+b=e

5. De la columna de Mujer tenemos que:

13 + c = 31

6. De la columna de Totales tenemos que:

19 + d = 47

En resumen tenemos el siguiente sistema de ecuaciones lineales.




 a + 13 = 19




 b+c =d

e + 31 = 47


 a+b =e



 13 + c = 31


19 + d = 47

La solución del anterior sistema es bastante sencilla. Las variables a, e, c y d son de fácil
despeje y finalmente es sencillo hallar la variable b. Exponemos los anteriores resultados en
la siguiente tablas

Hombre Mujer Totales


Casado 6 13 19
Soltero 10 18 28
Totales 16 31 47

Tabla 2.4: Hola mundo

Comentario 2.1.3. Como podemos notar, calcular un espacio muestral puede ser tedioso
si solo pensamos en encontrar todos los elementos. Sin embargo, podemos aplicar distintas
técnicas que nos permiten encontrar o expresar los espacios muestrales de forma sistemática.
entre ellas tenemos una muy usual llamada diagrama de árbol que introducimos a continua-
ción.
Definición 2.1.4. Un diagrama de árbol es una representación gráfica de los posibles resul-
tados del experimento, el cual consta de una serie de pasos, donde cada uno de estos tiene
un número finito de maneras de ser llevado a cabo.
Comentario 2.1.4. Dentro de las caracterı́sticas de diagrama de árbol tenemos que:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.1. ESPACIO MUESTRAL 45

1. Permite visualizar el orden de ocurrencia entre los sucesos.

2. Permite analizar experimentos de forma detallada.

3. Es muy comunicativo en términos visuales al mostrar la relación entre distintos sucesos


del experimentos.

Ejemplo 2.1.18. Consideremos el experimento de lanzar dos modedas y ver el resultado


final. A este experimento lo podemos ver realizable en dos sucesos como sigue:

1. En un primer suceso podemos lanzar la primera moneda y obtener

Co S

y para ello realizamos una lı́nea por cada resultado desde un nodo inicial.

2. El final de cada linea anterior genera un nuevo nodo. En cada nodo nuevo volvemos a
lanzar la moneda y obtenemos dos posibilidades

C, o S

y para ello realizamos una lı́nea por cada resultado desde el nodo correspondiente.

La ilustración de este procedimiento la presentamos completa en la Figura 2.5

(C, C)
C

S
C
(C, S)

S (S, C)
C

S
(S, S)

Figura 2.5: Diagrama de árbol para el lanzamiento de dos monedas

Ejemplo 2.1.19. Una experimento consta de lanzar una moneda y ver que cae. Si cae Cara
entonces lanzamos un dado que solo posee números pares (2, 3, 6). De otro lado si cae sello se
lanza un dado que solo posee números impares (1, 3, 5). A esta situación la podemos estudiar
mediante el diagrama de árbol en la Figura 2.6:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

46 CAPÍTULO 2. PROBABILIDAD

(C, 2)
=
2

4
•H / (C, 4)
6
!
C
(C, 6)

S (S,
=
1)
1

 3
• / (S, 3)
5
!
(S, 5)

Figura 2.6: Diagrama de árbol para el lanzamiento de moneda-dado descrito

De donde concluı́mos que el espacio muestral del experimento viene dado mediante:

S = {(C, 2) (C, 4) (C, 6) (S, 1) (S, 3) (S, 5)}.

2.2. Eventos
Los espacios muestrales aparecen de forma natural con cada experimento. Pero son tam-
bién importantes los subconjuntos de un espacio muestral. En esta sección estudiaremos a los
subconjuntos de un espacio muestral, comprendiendo las operaciones de unión, intersección
y complemento que podemos realizar entre tales subconjuntos, además de abordar distintas
relaciones que surgen ellos.

Definición 2.2.1. Dado un experimento con espacio muestral S, si E es un subconjunto de


S entonces E es llamado evento de S, es decir, E es un evento de S si E ⊂ S.

Ejemplo 2.2.1. El espacio muestral S es en sı́ mismo un evento, ya que S ⊂ S. El evento


vacı́o φ (el evento que no posee elementos) también es un evento ya que el conjunto vacı́o
está contenido en el espacio muestral S.

Ejemplo 2.2.2. En el ejemplo 2.1.11, hemos trabajado con el experimento de extraer una
carta de un mazo (inglés o de póker) de 52 cartas. Podemos extraer varios eventos en este
experimento, entre ellos tenemos

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.2. EVENTOS 47

1. El evento definido mediante

A := extraer un siete,
consiste de todas aquellas carta en el espacio muestral que continene un 7. Este evento
corresponde al conjunto:
 

 7♥ 

 
7♦
A= .
 7♠ 

 

7♣

2. El evento definido mediante

B := extraer una carta negra,

consiste de todas aquellas cartas cuyo palo sea de color negra, es decir tréboles o picas.
Este evento corresponde al conjunto:

 
2♠ 3♠ 4♠ 5♠ 6♠ 7♠ 8♠ 9♠ 10♠ J♠ Q♠ K♠ A♠
B= .
2♣ 3♣ 4♣ 5♣ 6♣ 7♣ 8♣ 9♣ 10♣ J♣ Q♣ K♣ A♣

3. El evento definido mediante

C : extraer un as o un rey,

corresponde a aquellas cartas las cuales poseen un rey ( o una letra K de King) o una
A, y esto es independiente del color o del palo de la carta. Este evento corresponde al
conjunto:
 

 K♥ A♥ 

 
K♦ A♦
C= .

 K♠ A♠ 

 
K♣ A♣

4. El evento definido mediante

D := extraer un dos negro o un tres negro,

consiste de todas las cartas que poseen un dos en el número o bien poseen un tres en
el número, además deben corresponder a un palo negro. Este evento corresponde al
conjunto:
 
2♠ 3♠
D=
2♣ 3♣

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

48 CAPÍTULO 2. PROBABILIDAD

5. Similarmente el evento

E : extraer una carta roja con cara (rey, reina o jota),

corresponde al conjunto:  
J♥ Q♥ K♥
E=
J♦ Q♦ K♦

Ejemplo 2.2.3. Del Ejemplo 2.1.14 podemos extraer los siguientes eventos

1. El evento A: que ámbos números sean impares, el cual corresponde al conjunto:


 
 (1,1) (1,3) (1,5) 
A= (3,1) (3,3) (3,5)
 
(5,1) (5,3) (5,5)

2. El evento B: que la suma sea par, el cual corresponde al conjunto:


 

 (1,1) (1,3) (1,5) 

 


 (2,2) (2,4) (2,6) 


 
(3,1) (3,3) (3,5)
B=

 (4,2) (4,4) (4,6) 

 


 (5,1) (5,3) (5,5) 


 
(6,2) (6,4) (6,6)

3. El evento C: el segundo dado muestre un resultado mayor al del primero


 

 (1,2) (1,3) (1,4) (1,5) (1,6) 

 

 (2,3) (2,4) (2,5) (2,6) 

(3,4) (3,5) (3,6)
 


 (4,5) (4,6) 


 
(5,6)

Comentario 2.2.1. Dado un experimento con espacio muestral S, es muy importante que
notemos que los eventos son subconjuntos de S y que los podemos nombrar tanto enunciando
la propiedad que cumplen o bien mostrando todos sus elementos. Por otro lado Como los
eventos son conjuntos dentro del espacio muestral, entonces podemos realizar operaciones
conjuntistas tales como: extraer complemento, tomar unión o tomar intersección entre ellos.

Definición 2.2.2. Supongamos que un experimento tiene un espacio muestral S y A es un


evento de S. Definimos el nuevo evento llamado complemento de A por

Ac = {x ∈ S/ x ∈
/ A}. (2.1)

Comentario 2.2.2. La ecuación (2.1) nos dice que el evento Ac consiste de los elementos que
no pertencen al evento A. Si el evento A está expresado mediante una propiedad, entonces el
evento Ac consiste en los elementos del espacio muestral que no satisfacen la propiedad que
define al evento A. Mediante la representación de diagramas de Venn tenemos en la Figura

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.2. EVENTOS 49

?? presentamos un diagrama que llamamos diagrama de Venn, el cual nos ayuda a visualizar
al complemento de un evento.

Ac

Definición 2.2.3. Dado un experimento con un espacio muestral S y dos eventos A, B ⊂ S


entonces decimos que A y B son eventos complementarios si

B = Ac , (2.2)

esto es, que el evento B es el complemento del evento A.


Ejemplo 2.2.4. En el experimento del ejemplo 2.1.14, el de lanzar dos dados y anotar el par
números que aparecen, podemos obtener los siguientes pares de eventos complementarios.

1. Para el evento A: que ámbos números sean impares, tenemos el complemento

Ac : al menos un número sea par,

el cual viene dado por


 

 (1,2) (1,4) (1,6) 

 


 (2,1) (2,2) (2,3) (2,4) (2,5) (2,6) 


 
(3,2) (3,4) (3,6)
Ac = ,

 (4,1) (4,2) (4,3) (4,4) (4,5) (4,6) 

 


 (5,2) (5,4) (5,6) 


 
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)

y al espacio muestral lo podemos ver como sigue:


 

 (1,1) (1,2) (1,3) (1,4) (1,5) (1,6) 

 


 (2,1) (2,2) (2,3) (2,4) (2,5) (2,6) 


 
(3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
S= .

 (4,1) (4,2) (4,3) (4,4) (4,5) (4,6) 

 


 (5,1) (5,2) (5,3) (5,4) (5,5) (5,6) 


 
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)

2. Para el evento B: que la suma sea par, cuyo complemento es

B c =la suma sea impar,

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

50 CAPÍTULO 2. PROBABILIDAD

y viene dado por

 

 (1,2) (1,4) (1,6) 

 


 (2,1) (2,3) (2,5) 


 
(3,2) (3,4) (3,6)
Bc =

 (4,1) (4,3) (4,5) 

 


 (5,2) (5,4) (5,6) 


 
(6,1) (6,3) (6,5)

el espacio muestral puede ser visto como

 

 (1,1) (1,2) (1,3) (1,4) (1,5) (1,6) 

 


 (2,1) (2,2) (2,3) (2,4) (2,5) (2,6) 


 
(3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
Bc =

 (4,1) (4,2) (4,3) (4,4) (4,5) (4,6) 

 


 (5,1) (5,2) (5,3) (5,4) (5,5) (5,6) 


 
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)

3. Para el evento C: el segundo dado muestre un resultado mayor al del primero, su


complemento es el evento

C c : el segundo dado muestre un resultado menor o igual al del primero

 

 (1,1) 

 


 (2,1) (2,2) 


 
(3,1) (3,2) (3,3)
Cc =

 (4,1) (4,2) (4,3) (4,4) 

 


 (5,1) (5,2) (5,3) (5,4) (5,5) 


 
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)

y el espacio muestral se puede ver ası́

 

 (1,1) (1,2) (1,3) (1,4) (1,5) (1,6) 

 


 (2,1) (2,2) (2,3) (2,4) (2,5) (2,6) 


 
(3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
S=

 (4,1) (4,2) (4,3) (4,4) (4,5) (4,6) 

 


 (5,1) (5,2) (5,3) (5,4) (5,5) (5,6) 


 
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)

Definición 2.2.4. Supongamos que un experimento posee un espacio muestral S y sean A


y B dos eventos de S. Definimos el nuevo evento llamado unión de A con B por

A ∪ B = {x ∈ S/ x ∈ A o x ∈ B} (2.3)

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.2. EVENTOS 51

Comentario 2.2.3. El evento A ∪ B está formado por los elementos que se encuentren en
el evento A o que se encuentren en el evento B. Esto es, el evento A ∪ B está formado por
los elementos que forman parte del alguno de los eventos A o B. Cuando a los los eventos
A y B los expresamos por medio de propiedades, la unión de ellos queda indicada uniendo
a las propiedades con el conector lógico ‘o’. Podemos representar al evento A ∪ B mediante
el diagrama de Venn en la Figura 2.7. En esta figura podremos ver a levento A ∪ B en color
gris.

S
A∪B

A B

Figura 2.7: holamundo

Ejemplo 2.2.5. Consideremos de nuevo el lanzamiento de dos dados distinguidos y anotar


el par de números que salen. Ahora bien, para cada i = 1, 2 . . . , 6 definamos los eventos

Ai := El segundo número sea i.

Podemos colorear en el espacio muestral los seis eventos que acabamos de definir, como
sigue:
 

 (1,1) (1,2) (1,3) (1,4) (1,5) (1,6) 

 


 (2,1) (2,2) (2,3) (2,4) (2,5) (2,6) 


 
(3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
S=

 (4,1) (4,2) (4,3) (4,4) (4,5) (4,6) 

 


 (5,1) (5,2) (5,3) (5,4) (5,5) (5,6) 


 
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)

El evento A1 corresponde a la primera columna del espacio muestral, el evento A2 corres-


ponde a la segunda columna del espacio muestral S, el evento A3 corresponde a la tercera
columna del espacio muestral S, y ası́ susecivamente. Es decir, para cada i = 1, 2 . . . , 6 la
columna columna i-ésima corresponde exactamente al evento Ai .
Consideremos a continuación distintas unionoes de eventos.

1. El evento A1 ∪ A6 viene dado mediante los elementos del espacio muestral S que per-
tenecen a A1 o que pertenecen a A2 . Esto es, A1 ∪ A6 está formado por los elementos

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

52 CAPÍTULO 2. PROBABILIDAD

de la primera columna o la sexta columna. Por lo tanto obtenemos que:


 

 (1,1) (1,6) 

 


 (2,1) (2,6) 


 
(3,1) (3,6)
A1 ∪ A6 =

 (4,1) (4,6) 

 


 (5,1) (5,6) 


 
(6,1) (6,6)

2. El evento A2 ∪ A5 viene dado mediante los elementos del espacio muestral S que per-
tenecen a A2 o que pertenecen a A5 . Esto es, A2 ∪ A5 está formado por los elementos
de la segunda columna o la quinta columna. Por lo tanto obtenemos que:

 

 (1,2) (1,5) 

 


 (2,2) (2,5) 


 
(3,2) (3,5)
A2 ∪ A5 =

 (4,2) (4,5) 

 


 (5,2) (5,5) 


 
(6,2) (6,5)

3. El evento A3 ∪ A4 viene dado mediante los elementos del espacio muestral S que per-
tenecen a A3 o que pertenecen a A4 . Esto es, A3 ∪ A4 está formado por los elementos
de la tercera columna o la cuarta columna. Por lo tanto obtenemos que:

 

 (1,3) (1,4) 

 


 (2,3) (2,4) 


 
(3,3) (3,4)
A3 ∪ A4 =

 (4,3) (4,4) 

 


 (5,3) (5,4) 


 
(6,3) (6,4)

Definición 2.2.5. Supongamos que un experimento posee un espacio muestral S y sean A


y B dos eventos de S. Definimos el nuevo evento llamado la intersección del evento A con el
evento B por
A ∩ B = {x ∈ S/ x ∈ A y x ∈ B} (2.4)

Comentario 2.2.4. El evento A ∩ B está formado por los elementos que se encuentren en
el evento A y que se encuentren en el evento B. Esto es, el evento A ∩ B está formado por
los elementos que forman parte ambos eventos A y B. Cuando a los los eventos A y B los
expresamos por medio de propiedades, laintersección de ellos queda indicada uniendo a las
propiedades con el conector lógico ‘y’. Podemos representar al evento A ∩ B mediante el
diagrama de Venn en la Figura 2.8. En esta figura podremos ver a levento A ∩ B en color
gris.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.2. EVENTOS 53

S
A∩B

A B

Figura 2.8: Intersección de conjuntos

Comentario 2.2.5. Dado un experimento con espacio muestral S, si A y B son eventos,


vale la pena que notemos el hecho que Ac , A ∪ B y A ∩ B son también eventos, ya que esto
están contenidos en S. A menudo en vez usar los sı́mbolos ∪ y ∩ solemos usar las conectores
o e y respectivamente, es decir, AoB o AyB para la unión y la interseción de eventos. En
cuanto al complemento lo usual es la palabra no.
Definición 2.2.6. Dado un experimento con un espacio muestral S y dos eventos A, B ⊂ S
entonces decimos que A y B son eventos mutuamente excluyentes si

A∩B =∅ (2.5)
En este caso, debemos recordar que

A ∩ B = {x ∈ S/x ∈ A y x ∈ B} (2.6)

Es decir dos eventos A y B son mutuamente excluyentes si uno y sólo uno de ellos puede
tener lugar a un tiempo. En otras palabras si se da el evento A entonces B no puede suceder,
si se da el evento B entonces A no puede suceder.
Ejemplo 2.2.6. En experimento de lanzar dos dados tomar el par de números que aparece
y sumarlos tenemos que:
1. Los eventos

A: la suma de un total de cinco puntos


B: haya un cinco en un dado.

son mutuamente excluyentes, ya que

A = {(1, 4), (2, 3), (3, 2), (4, 1)}


B = {(1, 5), (2, 5), (3, 5), (4, 5), (5, 5), (6, 5), (5, 1), (5, 2), (5, 3), (5, 4), (5, 6)},

y como es posible notar

A ∩ B = ∅.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

54 CAPÍTULO 2. PROBABILIDAD

De hecho algebraicamente este problema puede ser abordado como sigue: si un elemento
(x, y) ∈ A ∩ B entonces el debe cumplir que (x, y) ∈ A y por tanto x + y = 5 y como
(x, y) ∈ B entonces x = 5 o y = 5, y en cualquier caso

5+y =5 o x+5=5

de donde se desprende que x = 0 o y = 0 y esto es imposible ya que no hay un 0 en los


dados. En otras palabras
A ∩ B = ∅,
es decir que, A y B son eventos mutuamente excluyentes.

2. Los eventos

A: la suma de un total de siete puntos


B: haya un número par de puntos en ambos dados

son mutuamente excluyentes ya que si (x, y) ∈ A ∩ B entonces el debe cumplir que


(x, y) ∈ A y por tanto
x+y =7
y como (x, y) ∈ B entonces
x, y son pares.
y este hecho -que ambos son pares- implica que x + y es par, por tanto no es posible
que x + y = 7. De donde se desprende

A ∩ B = ∅,

es decir que, A y B son eventos mutuamente excluyentes.

3. El experimento de lanzar dos dados tomar el par de números que aparece y sumarlos
uno tiene que los eventos

A: la suma de total de ocho puntos


B: haya un número impar de puntos en ambos dados

Basta notar que (5, 3) ∈ A ∩ B ya que: 5 + 3 = 8 implica que (5, 3) ∈ A y 5 y 3 son


ambos impares entonces (5, 3) ∈ B . De donde se desprende

A ∩ B 6= ∅,

es decir que, A y B no son eventos mutuamente excluyentes.

4. El experimento de lanzar dos dados tomar el par de números que aparece y sumarlos
uno tiene que los eventos

A: la suma de un total de nueve puntos


B: haya un dos en uno de los dados.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.2. EVENTOS 55

Si un elemento (x, y) ∈ A ∩ B entonces el debe cumplir que (x, y) ∈ A y por tanto


x + y = 9 y como (x, y) ∈ B entonces x = 2 o y = 2, y este hecho -que alguno sea
2- implica que x = 7 o y = 7 lo cual no es posible ya que este número aparece en los
dados y por ende tenemos que:
A ∩ B = ∅,
es decir que, A y B son eventos mutuamente excluyentes.

5. El experimento de lanzar dos dados tomar el par de números que aparece y sumarlos
uno tiene que los eventos

A: La suma de un total de diez puntos


B: haya un cuatro en un dado

En cuyo caso basta notar que (4, 6) ∈ A ∩ B por lo cual

A ∩ B 6= ∅,

es decir, A y B no son mutuamente excluyentes.

Definición 2.2.7. Supongamos que un experimento posee un espacio muestral S y sean A


y B dos eventos de S. Definimos el nuevo evento llamado la difrencia del evento A con el
evento B por
A \ B = {x ∈ S/ x ∈ A y x ∈
/ B} (2.7)
Además definimos el nuevo evento llamado la difrencia simétrica del evento A con el evento
B por
A∆B = (A \ B) ∪ (B \ A) (2.8)

Comentario 2.2.6. Una representación por medio de diagramas de Ven para el evento de
la diferencia entre los eventos A y B la vemos en

S
A\B

A B

Figura 2.9: ey

Una representación por medio de diagramas de Ven para el evento de la diferencia entre
los eventos B y A la vemos en

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

56 CAPÍTULO 2. PROBABILIDAD

S
B\A

A B

Figura 2.10: ey

Una representación por medio de diagramas de Ven para el evento de la diferencia simétri-
ca entre los eventos A y B se

S
A∆B

A B

Figura 2.11:

2.3. Probabilidad
Muchos experimentos satisfacen la propiedad de que su espacio muestral muestral asociado
S posee finitos elementos. En particular si A es un evento de S entonces A posee también
finitos elementos. Abordaremos el concepto de la probabilidad, como una medidad de la
certidumbre de que ocurra un evento A dentro del espacio muestral S. En cierto sentido esta
irá asociada a que proporción de elementos de A hay en S.
Definición 2.3.1. Dado un experimento con un espacio muestral S y un evento A ⊂ S. Se
define la probabilidad el evento A como:
cantidad de elementos de A casos favorables
P (A) = = (2.9)
cantidad de elementos de S casos posibles
Ejemplo 2.3.1. Usando los resultados obtenidos en el Ejemplo 2.2.2, determinemos las
probabilidades de los siguientes eventos al extraer una carta de una baraja estándar de 52
cartas:
1. Extraer un siete.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.3. PROBABILIDAD 57

2. Extraer una carta negra.

3. Extraer un as o un rey.

4. Extraer un dos negro o un tres negro.

5. Extraer una carta roja con cara (rey, reina o jota).

El espacio muestral S de este experimento posee 52 elementos, que vienen a ser los casos
favorables.

1. El evento A =Extraer un siete, posee 4 elementos. Por lo tanto

4
P (A) = 52
Por la ecuación(2.9)
.
= 0.0769 Simplificando

2. El evento B = Extraer una carta negra, posee 26 elementos. Por lo tanto

26
P (B) = 52
Por la ecuación(2.9)
.
= 0.5 Simplificando

3. El evento C = Extraer un as o un rey, posee 8 elementos. Por lo tanto

8
P (C) = 52
Por la ecuación(2.9)
.
= 0.1538 Simplificando

4. El evento D = Extraer un dos negro o un tres negro, posee 4 elementos. Por lo tanto

4
P (D) = 52
Por la ecuación(2.9)
.
= 0.0769 Simplificando

5. El evento E = Extraer una carta roja con cara, posee 6 elementos. Por lo tanto

6
P (D) = 52
Por la ecuación(2.9)
.
= 0.1153 Simplificando

Ejemplo 2.3.2. En el Ejemplo 2.1.16 usamos la técnica de diagramas de Venn para poder or-
ganizar la información suministrada por los eventos A := Los egresados que estudiaron Python
y B := Los egresados que estudiaron SQL. Y toda la infomración del espacio muestral la ex-
presamos por medio del siguiente diagrama de Venn

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

58 CAPÍTULO 2. PROBABILIDAD

S
A B

13 8 11

41

Figura 2.12: Hola mundo

Ahora podemos abordar el cómputo de las siguientes probabilidades:

1. El evento que: el egresado haya estudiado el curso de Python es A y vale que:

13+8
P [A] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 2877 Simplificando

2. El evento que: el egresado haya estudiado el curso de SQL es B y vale que

8+11
P [B] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 2603 Simplificando

3. El evento que: el egresado haya estudiado ambos curso es A ∩ B


8
P [A ∩ B] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 1096 Simplificando

4. El evento que: el egresado haya estudiado solo el curso de python es A \ B


13
P [A \ B] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 1781 Simplificando

5. El evento que: el egresado haya estudiado solo el curso de SQL es B \ A


11
P [B \ A] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 1507 Simplificando

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.3. PROBABILIDAD 59

6. El evento que: el egresado haya estudiado alguno de los cursos es A ∪ B


13+8+11
P [A ∪ B] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 4384 Simplificando

7. El evento que: el egresado haya estudiado solo uno de los cursos es A∆B
13+11
P [A∆B] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 3288 Simplificando

8. El evento que: el egresado no haya estudiado ninguno de los cursos es (A ∪ B)c


41
P [(A ∪ B)c ] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 5616 Simplificando

9. El evento que: el egresado no haya estudiado ningún curso o haya estudiado Python es
(A ∪ B)c ∪ A

41+13+8
P [(A ∪ B)c ∪ A] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 8493 Simplificando

10. El evento que: el egresado no haya estudiado ningún curso o solo haya estudiado Python
es (A ∪ B)c ∪ (A \ B)

41+13
P [(A ∪ B)c ∪ (A \ B)] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 7397 Simplificando

11. El evento que: el egresado no haya estudiado ningún curso o haya estudiado el curso
de SQL es (A ∪ B)c ∪ B
41+8+11
P [(A ∪ B)c ∪ B] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 8219 Simplificando

12. El evento que: el egresado no haya estudiado ningún curso o solo haya estudiado SQL
es (A ∪ B)c ∪ (B \ A)
41+11
P [(A ∪ B)c ∪ (B \ A)] = 73
Por la ecuación(2.9) y la Figura 2.14
.
= 0, 7123 Simplificando

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

60 CAPÍTULO 2. PROBABILIDAD

De este modo podemos resumir alguna información en el diagrama de Venn

S
A B

0.1781 0.1096 0.1507

0.5616

Figura 2.13: Hola mundo

Ejemplo 2.3.3. En el Ejemplo 2.1.17 hemos podido expresar toda información del espacio
muestral, por medio de una tabla de contigencias como sigue:

Hombre Mujer Totales


Casado 6 13 19
Soltero 10 18 28
Totales 16 31 47

Tabla 2.5: Hola mundo

Definimos los siguientes eventos


A1 := Ser Hombre, A2 := Ser Mujer, B1 := Ser Casado, B2 := Ser Soltero

Si se selecciona una persona al azar, podemos estudiar los siguientes eventos y sus res-
pectivas probabilidades:
1. El evento que sea hombre resulta tener probabilidad:
16
P (A1 ) = 47
Por la ecuación(2.9)
.
= 0.3404 Simplificando

2. El evento que sea mujer resulta tener probabilidad:


31
P (A2 ) = 47
Por la ecuación(2.9)
.
= 0.6596 Simplificando

3. El evento que sea casado resulta tener probabilidad:


19
P (B1 ) = 47
Por la ecuación(2.9)
.
= 0.4743 Simplificando

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.3. PROBABILIDAD 61

4. El evento que sea soltero resulta tener probabilidad:


28
P (B2 ) = 47
Por la ecuación(2.9)
.
= 0.5957 Simplificando

5. El evento que sea un egresado hombre casado resulta ser A1 ∩ B1 y:


6
P (A1 ∩ B1 ) = 47
Por la ecuación(2.9)
.
= 0, 1277 Simplificando

6. El evento que sea un egresado hombre soltero resulta ser A1 ∩ B2 y:


10
P (A1 ∩ B2 ) = 47
Por la ecuación(2.9)
.
= 0, 2128 Simplificando

7. El evento que sea un egresado mujer casada resulta ser A2 ∩ B1 y:


13
P (A2 ∩ B1 ) = 47
Por la ecuación(2.9)
.
= 0, 2766 Simplificando

8. El evento que sea un egresado mujer soltera resulta ser A2 ∩ B2 y:


18
P (A2 ∩ B2 ) = 47
Por la ecuación(2.9)
.
= 0, 3830 Simplificando

9. El evento que sea un egresado hombre o casado resulta ser A1 ∪ B1 y:


6+10+13
P (A1 ∪ B1 ) = 47
Por la ecuación(2.9)
.
= 0, 6170 Simplificando

10. El evento que sea un egresado hombre o soltero resulta ser A1 ∪ B2 y:


6+10+13
P (A1 ∪ B1 ) = 47
Por la ecuación(2.9)
.
= 0, 6170 Simplificando

Parte de la información anterior también la podemos consignar en una tabla de con-


tingencia que contiene solo probabilidades tal y como vemos en la Figura

Hombre Mujer Totales


Casado 0.1277 0.2766 0.4043
Soltero 0.2128 0.3830 0.5957
Totales 0.3404 0.6596 1

Tabla 2.6: Hola mundo

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

62 CAPÍTULO 2. PROBABILIDAD

2.4. Leyes de la probabilidad


Las discusiones sobre el concepto de probalidad fueron amplias durante los siglos XVII,
XVIII y XIX. Sin embargo en 1933, Andrey Kolmogorov, en sus trabajos propuso una defini-
ción formal de probabilidad que aún usamos hasta nuestros dı́as. La idea es bastante simple:
Kolmogorov considera un experimento el cual tiene asociado un espacio muestral S. Luego
considera un conjunto Ω cuyos elementos son los posibles eventos A que podemos definir en
el espacio muestral S. Ahora bien, Kolmogorov provee las condiciones mı́nimas para la cual
una función P : Ω → R definida en ω sea una función de probabilidad. Presentamos este
connjunto de axiomas en l siguiente definición.
Definición 2.4.1. Supongamos que un experimento tiene espacio muestral asociado S y
supongamos que e Ω s el conjunto de posibles eventos definidos en S. Una función P : Ω → R
definida en Ω es llamada función de probbilidad si satifasce:
1. Para cualquier evento A, P [A] ≥ 0

2. P [S] = 1

3. Para cualquier par de eventos evento A, B, si A ∩ B = ∅ (son mutuamente excluyentes)


entonces
P [A ∪ B] = P [A] + P [B] (2.10)

Comentario 2.4.1. El tercer numeral de la Definición 2.4.1, fue enunciado de forma mas
general por Kolmogorov. Nosotros hemos usado una versión mas simple adaptada a nuestras
necesidades. Nos disponemos a presentar algunas propiedades que satisface una función de
probabilidad, en relación con algunas operaciones entre eventos.
Teorema 2.4.1. Sea A cualquier evento de un espacio muestral S, entonces

P [A] = 1 − P [Ac ]. (2.11)


Ejemplo 2.4.1. Supongamos que en un experimento un evento A cumple que: P [Ac ] = 0.3.
Entonces
P [A] = 1 − 0.3 Por la ecuación 2.11

= 0.7 Simplificando
Ejemplo 2.4.2. En un grupo social la probabilidad de encontrar un mayor de 18 años es
0.65. Encontremos la probabilidad de que una persona tenga una edad inferior o igual a 18
años.
Procedemos fijando la notación como sigue: Tomamos el evento

A := la persona tiene mas de 18 años,

y por lo tanto resulta que:

Ac := la persona tiene una edad inferior o igual a 18 años.

.
Ahora bien, como dato del problema tenemos P (A) = 0.65 entonces vale que:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.4. LEYES DE LA PROBABILIDAD 63

P (Ac ) = 1 − 0.65 Por la ecuación 2.11

= 0.35 Simplificando
Teorema 2.4.2. Si A y B son dos eventos de un mismo espacio muestral S. Entonces

P [A ∪ B] = P [A] + P [B] − P [A ∩ B]. (2.12)

Ejemplo 2.4.3. Supongamos que A, y B son eventos de un mismo espacio muestral, tal que
P [A] = 0.6, P [B] = 0.3 y P [A ∩ B] = 0.1. Entonces para calcular la probabilidad P [A ∪ B]
procedemos como sigue

P [A ∪ B] = 0.6 + 0.3 − 0.4 Por la ecuación 2.12

= 0.7 Simplificando
Ejemplo 2.4.4. En un grupo de estudiantes de idiomas, la probabilidad de que un estudiante
halla cursado Francés es 0.6, la probabilidad de que un estudiante halla cursado Ingés es 0.4
y la probabilidad de que haya cursado ambos cursos es 0.1. Hallemos la probabilidad de que
un estudiante elegido al azar halla cursado Francés o Iglés.
Para poder abordar esta situación comenzamos por dar nombre a los evento que nos interesan.
Ası́ pues, tenemos que:

A := Un estudiante halla cursado Frances,


B := Un estudiante halla cursado Inglés.
Según las hipótesis de la situación

P [A] = 0.6, P [B] = 0.4, P [A ∩ B] = 0.1.

Por lo tanto, el evento de que un estudiante elegido al azar halla cursado Francés o Iglés
corresponde al evento A ∪ B y vale que

P [A ∪ B] = 0.6 + 0.4 − 0.1 Por la ecuación 2.12

= 0.9 Simplificando
Teorema 2.4.3. Si A y B son dos eventos mutuamente excluyentes entonces

P [A ∪ B] = P [A] + P [B] (2.13)

Ejemplo 2.4.5. En un grupo de estudiantes de idiomas, la probabilidad de que un estudiante


halla cursado Francés es 0.3, la probabilidad de que un estudiante halla cursado Ingés es 0.1.
Hallemos la probabilidad de que un estudiante elegido al azar halla cursado Francés o Inglés
sabiendo que ningún estudiante cursó ambos cursos.
Para poder abordar esta situación comenzamos por dar nombre a los evento que nos interesan.
Ası́ pues, tenemos que:

A := Un estudiante halla cursado Frances,

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

64 CAPÍTULO 2. PROBABILIDAD

B := Un estudiante halla cursado Inglés.

Según las hipótesis de la situación A y B son eventos mutuamente excluyente y vale que:

P 1[A] = 0.6, P [B] = 0.4, P [A ∩ B] = 0.

Por lo tanto, el evento de que un estudiante elegido al azar halla cursado Francés o Iglés
corresponde al evento A ∪ B y vale que

P [A ∪ B] = 0.3 + 0.1 Por la ecuación 2.13

= 0.9 Simplificando

2.5. Probabilidad condicional


Supongamos que Tenemos un experimento el cual tiene asociado un espacio muestral S.
Supongamos además, que ha ocurrido un evento al que denominamos B. Bajos este marco,
trataremos el problema de encontrar la probabilidad de cualquier otro evento A ocurra bajo
la nueva información de que haya ocurrido el evento B.

Definición 2.5.1. Supongamos que un experimento tiene asociado un espacio muestral S,


y que A, B son dos eventos de S. Llamamos al evento A dado B que denotamos por A|B al
evento A sabiendo que B ocurrió previamente.

Comentario 2.5.1. Para poder realizarnos una idea intuitiva sobre el evento A|B, debemos
detenernos por un momento en una lı́nea temporal. En tal lı́nea temporal ubicaremos dos
sucesos: El primero es la ocurrencia del evento B y el segundo es la ocurrencia del evento
A sujeto a a la información que el evento B ocurrió previamente. Esta idea la podemos
simplificar en un diagrama
B A|B
• /• / •.

En cierto sentido, el espacio muestral de A|B es por un momento el conjunto B. El diagrama


anterior también lo solemos usar escribiendo las probabilidades como una ayuda ilustrativa
de la siguiente manera:
P [B]
• / • P [A|B]/ • .

Ejemplo 2.5.1. En el Ejemplo 2.1.16 usamos la técnica de diagramas de Venn para poder or-
ganizar la información suministrada por los eventos A := Los egresados que estudiaron Python
y B := Los egresados que estudiaron SQL. Y toda la infomación del espacio muestral la ex-
presamos por medio del siguiente diagrama de Venn

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.5. PROBABILIDAD CONDICIONAL 65

S
A B

13 8 11

41

Figura 2.14: Hola mundo

Ahora podemos abordar el cómputo de las siguientes probabilidades:

1. Para el evento que un estudiante curse Francés dado estudia Inglés, que coincide A|B
y viene dada por
8
P [A|B] = 19 Por la ecuación (2.9)

= 0.4211 Simplificando.

2. Para el evento que un estudiante no curse Francés dado que estudia Inglés, que coincide
Ac |B y viene dada por
11
P [Ac |B] = 19
Por la ecuación (2.9)

= 0.5789 Simplificando.

3. Para el evento que un estudiante curse Inglés dado que estudia Francés, coincide B|A
y viene dada por
8
P [B|A] = 21 Por la ecuación (2.9)

= 0.3809 Simplificando.

4. Para el evento que un estudiante no curse Inglés dado que estudia Francés, que coincide
B c |A y viene dada por
13
P [B c |A] = 21
Por la ecuación (2.9)

= 0.5789 Simplificando.

5. Para el evento que un estudiante curse Francés dado que no estudia Inglés, que coincide
A|B c y viene dada por
13
P [A|B c ] = 54
Por la ecuación (2.9)

= 0.2407 Simplificando.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

66 CAPÍTULO 2. PROBABILIDAD

6. Para el evento que un estudiante no curse Francés dado que no estudia Inglés, que
coincide A|B c y viene dada por
41
P [A|B c ] = 54
Por la ecuación (2.9)

= 0.7593 Simplificando.

7. Para el evento que un estudiante curse Inglés dado que no estudia Francés, que coincide
B|Ac y viene dada por
11
P [B|Ac ] = 52
Por la ecuación (2.9)

= 0.2115 Simplificando.

8. Para el evento que un estudiante no curse Inglés dado que no estudia Francés, que
coincide B c |Ac y viene dada por
41
P [B c |Ac ] = 52
Por la ecuación (2.9)

= 0.7884 Simplificando.

Pensemos ahora, que evento ocurre primero.

1. Si el evento en ocurrir primero es el evento A, entonces con ayuda de los resultados del
Ejemplo 2.5.1 podemos construir el siguiente diagrama:

8 •.
P [B|A]

@•

P [A] P [B c |A]
&

P [Ac ]
8 •
P [B|Ac ]



P [B c |Ac ]
&

2. Si el evento en ocurrir primero es el evento B, entonces con ayuda de los resultados del
Ejemplo 2.5.1 podemos construir el siguiente diagrama:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.5. PROBABILIDAD CONDICIONAL 67

8• .
P [A|B]

@•

P [B] P [Ac |B]


&

8•
P [B c ] P [A|B c ]



P [Ac |B c ]
&

Ejemplo 2.5.2. En el Ejemplo 2.1.17 hemos podido expresar toda información del espacio
muestral, por medio de una tabla de contigencias como sigue:

Hombre Mujer Totales


Casado 6 13 19
Soltero 10 18 28
Totales 16 31 47

Tabla 2.7: Hola mundo

Podemos seleccionar una persona al azar y computar las siguientes probabilidades condi-
cionales:

1. Para el evento ser Hombre dado que la persona seleccionada era casada, el cual coincide
con H|C, vale que:

6
P [H|C] = 19
Por la ecuación (2.9)

= 0.3158 Simplificando.

2. Para el evento ser Mujer dado que dado la persona seleccionada era Casada, el cual
coincide con M |C, vale que:

13
P [M |C] = 19
Por la ecuación (2.9)

= 0.6842 Simplificando.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

68 CAPÍTULO 2. PROBABILIDAD

3. Para el evento ser Hombre dado que dado la persona seleccionada era Soltera, el cual
coincide con H|S, vale que:
10
P [H|S] = 28
Por la ecuación (2.9)

= 0.3571 Simplificando.

4. Para el evento ser Mujer dado que dado la persona seleccionada era Soltera, el cual
coincide con M |S, vale que:
18
P [M |S] = 28
Por la ecuación (2.9)

= 0.6429 Simplificando.

5. Para el evento ser Casada dado que la persona seleccionada era Hombre, el cual coincide
con C|H, vale que:
6
P [C|H] = 16
Por la ecuación (2.9)

= 0.375 Simplificando.

6. Para el evento ser Soltero dado que dado la persona seleccionada era Hombre, el cual
coincide con S|H, vale que:
10
P [S|H] = 16
Por la ecuación (2.9)

= 0.625 Simplificando.

7. Para el evento ser Casada dado que dado la persona seleccionada era Mujer, el cual
coincide con C|M , vale que:
13
P [C|M ] = 31
Por la ecuación (2.9)

= 0.4194 Simplificando.

8. Para el evento ser Soltera dado que dado la persona seleccionada era Mujer, el cual
coincide con S|M , vale que:
18
P [S|M = 31
Por la ecuación (2.9)

= 0.5806 Simplificando.

Comentario 2.5.2. Supongamos que tenemos un espacio muestral y dos eventos A y B


en S. Si sabemos que B ocurrió y estamos interesados en saber, con esta información la
probabilidad de A ocurra, entonces intuitivamente nuestro espacio muestral se reduce a B.
Por otro lado si ocurre A entonces por el hecho de que ocurrió B entonces nuestros casos
favorables serán los elementos de A ∩ B. Esta idea permite introducir la siguiente deficnión.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.6. TEOREMA DE LA PROBABILIDAD TOTAL 69

Definición 2.5.2. Sea S un espacio muestral y dos eventos A y B en S. La probabilidad


condicional del evento A|B está definida por

P (A ∩ B)
P (A|B) = (2.14)
P (B)
Teorema 2.5.1. Regla de la multiplicación Para cualquier par de eventos A y B

P (A ∩ B) = P (B)P (A|B) = P (A)P (B|A)


Definición 2.5.3. Dado un experimento con un espacio muestral S y dos eventos A, B ⊂ S
entonces decimos que A y B son independientes si la probabilidad de ocurrencia de alguno no
afecta la probabilidad de ocurrencia del otro. En caso contrario diremos que son dependientes.
Ejemplo 2.5.3. Consideremos que en una urna se tienen 3 bolas azules y 4 rojas. Se extraen
2 bolas y se consideran los siguiente eventos
A1 : Extraer una bola azul en la primera extracción
A2 : Extraer una bola azul en la segunda extracción
R1 : Extraer una bola roja en la primera extracción
R2 : Extraer una bola roja azul en la segunda extracción

1.
2.
3.

2.6. Teorema de la Probabilidad total


Definición 2.6.1. Dado un experimento con espacio muestral S, una colección de eventos
A1 , A2 , . . . , Ak son una partición de S si son eventos mutuamente excluyentes dos a dos (es
decir Ai ∩ Aj = para cada i 6= j) y además son exaustivos en el sentido:

S = A1 ∪ A2 ∪ . . . ∪ Ak (2.15)
Ejemplo 2.6.1. Consideremos el experimento de lanzar dos dados y anotar el par de números
que salen. Los eventos

Ai : El segundo número sea i donde i = 1, 2 . . . , 6,


es una partición de S. Podemos ver claramente mediante el diagrama
{(1,1) (1,2) (1,3) (1,4) (1,5) (1,6)
(2,1) (2,2) (2,3) (2,4) (2,5) (2,6)
(3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
(4,1) (4,2) (4,3) (4,4) (4,5) (4,6)
(5,1) (5,2) (5,3) (5,4) (5,5) (5,6)
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)}
Donde cada columna corresponde a exactamente un evento Ai , ası́ notamos claramente
que son mutamente excluyentes y que su unión alcanza a ser todo S.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

70 CAPÍTULO 2. PROBABILIDAD

Ejemplo 2.6.2. Considere el lanzamiento de lanzar dos dados y anotar el par de números
que salen. Los eventos

Ai : la suma del par sea i donde i = 2 . . . , 12,


es una partición de S. Podemos ver claramente mediante el diagrama
{(1,1) (1,2) (1,3) (1,4) (1,5) (1,6)
(2,1) (2,2) (2,3) (2,4) (2,5) (2,6)
(3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
(4,1) (4,2) (4,3) (4,4) (4,5) (4,6)
(5,1) (5,2) (5,3) (5,4) (5,5) (5,6)
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)}
Donde cada diagonal de izquierda a derecha corresponde a exactamente un evento Bi , ası́
notamos claramente que son mutamente excluyentes y que su unión alcanza a ser todo S.

Teorema 2.6.1. (Teorema de la probabilidad total.) Dado un experimento con espacio mues-
tral S, y dada partición A1 , A2 , . . . , Ak de S, entonces para cualquier evento A de S vale que

k
X
P (A) = P (A1 )P (A|A1 ) + . . . + P (Ak )P (A|Ak ) = P (Ai )P (A|Ai ) (2.16)
i=1

Este teorema es llamado el teorema de la probabilidad total.

Ejemplo 2.6.3. Se sabe que el 65 % de los accidentes de tráfico que se producen durante
la noche de los sábados se deben a la ingesta excesiva de alcohol, el 25 % se deben a la
imprudencia del conductor (sobrio) y el resto a otras causas, (fallo mecánico...etc.). En estos
accidentes, el resultado es nefasto el 30 % de las veces en el primer caso, el 20 % en el segundo
y el 5 % en el tercero. Calcular la probabilidad de que uno de estos accidentes tenga resultado
nefasto.
Llamemos:
A1 : tener un accidente por circular con una ingesta excesiva de alcohol
A2 : tener un accidente por imprudencia del conductor
A3 : tener un accidente por otras causas.
Estos sucesos son una partición del espacio muestral por lo que se verifica las hipótesis del
teorema de la probabilidad total. Si definimos
A: tener resultado nefasto
Entonces

P (A) = P (A1 )P (A|A1 ) + P (A2 )P (A|A2 ) + P (A3 )P (A|A3 )


= 0, 65 × 0, 3 + 0, 25 × 0, 2 + 0, 1 × 0, 05
= 0, 25

Ejemplo 2.6.4. Se dispone de tres cajas con bombillas. La primera contiene 10 bombillas, de
las cuales hay cuatro fundidas; en la segunda hay seis bombillas, estando una de ellas fundida,
y la tercera caja hay tres bombillas fundidas de un total de ocho. Hallar la probabilidad de
que al tomar una bombilla al azar de una cualquiera de las cajas, esté fundida
Llamemos:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

2.7. TEOREMA DE BAYES 71

A1 : la bombilla proviene de la caja 1.


A2 : la bombilla proviene de la caja 2 .
A3 : la bombilla proviene de la caja 3 .
Estos sucesos son una partición del espacio muestral (de todas als bombillas) por lo que se
verifica las hipótesis del teorema de la probabilidad total. Si definimos
A: extraer una bombilla fundida
Una ilustaraciı́on en un diagrama de árbol ayuda mucho
Entonces
a (Caja 1, Buena)
B ue n
F un
dida

1 (Caja 1, F undida)
a
aj
C
a (Caja 2, Buena)
B ue n
Caja 2
Inicio F un
dida

C (Caja 2, F undida)
aj
a3

a (Caja 3, Buena)
B ue n
F un
dida
(Caja 3, F undida)

P (A) = P (B1 ) × P (A|B1 ) + P (B2 ) × P (A|B2 ) + P (B3 ) × P (A|B3 )

1 4 1 13
= 3 10
+ 3
+ 38

113
= 360

2.7. Teorema de Bayes


Teorema 2.7.1. Teorema de Bayes. Dado un experimento con espacio muestral S, y dada
partición A1 , A2 , . . . , Ak de S, entonces para cualquier evento A de S y para todos los j =
1, 2 . . . , k vale que

P (Aj )P (A|Aj )
P (Aj |A) = k
(2.17)
X
P (Ai )P (A|Ai )
i=1

Este teorema es llamadola regla de Bayes.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

72 CAPÍTULO 2. PROBABILIDAD

Ejemplo 2.7.1. La probabilidad de que haya un accidente en una fábrica que dispone de
alarma es 0.1. La probabilidad de que suene esta sı́ se ha producido algún incidente es de
0.97 y la probabilidad de que suene si no ha sucedido ningún incidente es 0.02.
En el supuesto de que haya funcionado la alarma. Hallar la probabilidad de que no haya
habido ningún incidente.
Llamamos
B1 : hubo incidente
B2 : no hubo incidente

y
A: Sonó la alarma
0. 97
0. 03
0. 1

Inicio
0. 9
0. 02
0. 98

P (B2 )P (A|B2 )
P (B2 |A) = P (B1 )P (A|B1 )+P (B2 )P (A|B2 )

0.9∗0.02
= 0.1∗0.97+0.9∗0.02

= 0.157

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

Capı́tulo 3

Variables aleatorias.

El espacio muestral asociado a un experimento nos ofrece la posibilidad de conocer todos los
resultados de un experimento. Sin embargo, muchas veces nuestros conteos o mediciones de
interés sobre los resultados del espacio muestral, pueden ser expresados mediante una función
matemática que toma valores en el conjunto de los números reales. Esta particularidad es la
que nos compete estudiar en este capı́tulo. Esta idea de que una función que podamos definir
en el espacio muestral cuente o mida lo que nos interesa es precisamente concepto de variable
aleatoria. En adelante denotamos por R al conjunto de los números reales.

3.1. Variables aleatorias discretas


Definición 3.1.1. Supongamos que S es el espacio muestral de un experimento. Una Variable
aleatoria es una función definida en el espacio muestral S de la forma

X:S→R

..
Comentario 3.1.1. Notemos que el concepto de variable aleatoria viene ligado de forma
profunda al experimento, ya que, está definida sobre un espacio muestral que consiste de
todos los resultados de un experimento. También vale la pena que comprendamos que una
variable aleatoria X asocia a cada elemento e ∈ S, es decir, a cada elemento e del espacio
muestral, un valor real X(e) = x. Esto es, por cada valor e que sea un posible resultado
del experimento, X(e) es un número real. Ası́ pues, dada una variable aleatoria X podemos
notar que su imagen (el conjunto de valores que toma) es un subconjunto de R.
Ejemplo 3.1.1. Recordemos que si tenemos una población y una variable estadı́stica numéri-
ca medida en ella, podemos formar el conjunto de todas las muestras posibles de un tamaño
definido n. Ahora bien, este procedimiento es un experimento. Al conjunto de tales muestras
lo denotamos por S y resulta ser el espacio muestral (notemos en este punto porque le hemos
dado ese nombre). Ahora bien, recordemos que en la Definición 1.3.1, definimos el concepto
de estadı́stico precisamente como una función cuyo dominio es S y el conjunto de llegada es
el conjunto de los número reales, es decir, un estadı́stico es precisamente una función definida
en S de la forma f : S → R. En otras palabras, todos los estadı́sticos son variables aleatorias.
Ası́ pues tenemos entonces ya un repertorio de ejemplos de variables [Link] de
2
ellos son Xmax , Xmin , R, X, Dm, Sn−1 , Sn−1 , entre otros.

73
Descargado por Martu Menendez (martinamenendezgarro@[Link])
lOMoARcPSD|4133870

74 CAPÍTULO 3. VARIABLES ALEATORIAS.

Definición 3.1.2. Dado un experimento con espacio muestral S, una variable aleatoria
X : S → R es llamada variable aleatoria discreta si su imagen es contable, es decir que su
imagen es finita de la forma
{x1 , x2 , . . . , xn }
o infinita de la forma
{x1 , x2 , . . .}.
Comentario 3.1.2. Siempre que definimos una variable aleatoria, es importante que indi-
quemos cuales son los valores que toma. En caso de que una variable aleatoria discreta X
tome finitos valores, podemos indicarlos de la siguiente forma:

X = x 1 , x 2 , . . . , xn ,

o bien en el caso que tome infinitos valores, podemos indicarlos de la siguiente forma:

X = x1 , x 2 , . . . .

En particular si X es una variable aleatoria discreta y queremos expresar una idea sobre sus
valores solemos usar la expresión x ∈ Im(X) para referirnos a los valores que toma la variable
aletatoria X. Con esto atrapamos tanto el hecho de que Im(X) sea finita o bien infinita.
Ejemplo 3.1.2. En el experimento de lanzar una moneda y esperar a ver que cae, el espacio
muestral es S = {c, s}. Si tomamos la función X : S → R definida por
(
1 Si e = c
X(e) = ,
0 Si e = s
entonces X es una variable aleatoria. Y como bien podemos notar, X solo toma dos valores: 0
y 1, y por tanto resulta ser una variable aleatoria discreta. A esta variable aleatoria también
la podemos expresar como
X := número de caras en los elementos de S,
y
X = 0, 1.
Ejemplo 3.1.3. En el experimento de lanzar dos monedas distinguidas, el espacio muestral
viene dado por S = {(c, c), (c, s), (s, c), (s, s)}. Podemos definir en S la variable aleatoria

2 si e = (c, c)

X(e) = 1 si e = (c, s) o (s, c) .


0 si e = (s, s)

Notemos que la variable aleatoria X toma los valores de 0, 1 y 2, por lo tanto X es una
variable aleatoria discreta. A esta variable aleatoria la podemos expresar mediante:
X := número de caras que figuran en los elementos de S
y
X = 0, 1, 2.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.1. VARIABLES ALEATORIAS DISCRETAS 75

Ejemplo 3.1.4. En el experimento de lanzar dos dados (distinguidos) y anotar el par de


números que salen, el espacio muestral es S = {(x, y) : 1 ≤ x, y ≤ 6}. Ahora bien podemos
definir la variable aleatoria X : S → R por:

X(x, y) = x + y
para cada elemento (x, y) ∈ S. En otras palabras la variable aleatoria resulta ser

X := la suma de las caras que muestran los dados al caer,

y
X = 2, 3, 4, 5, 6, 7, 8, 9, 10, 11, 12.
Por lo tanto X es una variable aleatoria discreta. También podemos ver como actúa la variable
aleatoria X en el espacio muestral S mediante el diagrama de la Figura 3.1.

{(1,1) (1,2) (1,3) (1,4) (1,5) (1,6) {2 3 4 5 6 7


(2,1) (2,2) (2,3) (2,4) (2,5) (2,6) 3 4 5 6 7 8
(3,1) (3,2) (3,3) (3,4) (3,5) (3,6) 4 5 6 7 8 9

(4,1) (4,2) (4,3) (4,4) (4,5) (4,6) 5 6 7 8 9 10
(5,1) (5,2) (5,3) (5,4) (5,5) (5,6) 6 7 8 9 10 11
(6,1) (6,2) (6,3) (6,4) (6,5) (6,6)} 7 8 9 10 11 12}

Figura 3.1: Función suma de las caras de los dados

Si seguimos las diagonales secundarias iso-coloreadas notamos que podemos definir para cada
i = 2 . . . , 12, el evento
Bi := la suma del par sea i.
De este modo la variable aleatoria X toma valores constantes en cada evento Bi , mas precisam
ente para cada i = 2, 3, . . . , 12
X(Bi ) = i.
A la variable X la podemos presentar mediante la Tabla 3.1.

(x, y) ∈ B2 B3 B4 B5 B6 B7 8 B9 B10 B11 B12


X(x, y) 2 3 4 5 6 7 8 9 10 11 12

Tabla 3.1: Ilustramos a la variable aleatoria X según los eventos donde toma un valor cons-
tante.

Comentario 3.1.3. Abordamos a continuación un concepto análogo al de frecuencia relativa,


pero en el contexto de variables aleatorias discretas. Esto es, la función de densidad de
probabilidad discreta. Pero antes de presentar este concepto, es necesaria la siguiente data:
si X : S → R es una variable aleatoria definida en S entonces debemos recordar que X es
una función definida en el espacio muestral S y que llega a valores en los números reales R,

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

76 CAPÍTULO 3. VARIABLES ALEATORIAS.

es decir, X toma cada valor e ∈ S y devuelve un único valor X(e) = x que pertenece a R.
Ahora bien, en adelante cuando escribimos X = x nos referimos precisamente al conjunto
{e ∈ S : X(e) = x}.
Es decir, este conjunto X = x está formado por los elementos e del espacio muestral S para
los cuales la variable aleatoria X vale x. Es decir X = x representa un evento en el espacio
muestral S y
P [X = x] = P [{e ∈ S : X(e) = x}]. (3.1)
Con esta notación presentamos la siguiente definición.
Definición 3.1.3. Dado un experimento con espacio muestral S y una variable aleatoria
discreta X definida en S, entonces la función f : R → R es llamada la función de densidad
de probabilidad discreta de la variable aleatoria X si para cada x ∈ R vale:
f (x) = P [X = x]. (3.2)
.
Comentario 3.1.4. Para que podamos entender la ecuación (3.2) es necesario que compren-
damos el significado de la expresión P [X = x]. Ası́ pues, es necesario el entendimiento previo
de la ecuación (3.1), en la cual exponemos de forma concisa su contexto.
Ejemplo 3.1.5. Recordemos que en el experimento de lanzar dos monedas distinguidas el
espacio muestral es: S = {(c, c), (c, s), (s, c), (s, s)}. Si consideramos la variable aleatoria
X := el número de caras que aparecen después del lanzamiento,
entonces para calcular la función de densidad de probabilidad discreta f : R → R de la
variable aleatoria discreta X procedemos como sigue:
1. El evento correspondiente a la igualdad X = 0, corresponde al evento formado por el
conjunto {(s, s)}, que son los elementos de S que no poseen caras. Y si x = 0, entonces

f (0) = P [X = 0] Por definición de f en (3.2)

= P [{(s, s)}] Por definición de X = 0

1
= 4
Calculando la probabilidad

= 0.25 Simplificando
2. El evento correspondiente a la igualdad X = 1, corresponde al evento formado por
el conjunto {(s, c), (c, s)}, que son los elementos de S que poseen una sola cara. Y si
x = 1, entonces

f (1) = P [X = 1] Por definición de f en (3.2)

= P [{(c, s), (s, c)}] Por definición de X = 1

2
= 4
Calculando la probabilidad

= 0.5 Simplificando

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.1. VARIABLES ALEATORIAS DISCRETAS 77

3. El evento correspondiente a la igualdad X = 2, corresponde al evento formado por el


conjunto {(c, c)} que son los elementos de S que poseen dos caras. Y si x = 2 entonces

f (2) = P [X = 2] Por definición de f en (3.2)

= P [{(c, c)}] Por definición de X = 2.

1
= 4
Calculando la probabilidad

= 0.25 Simplificando

4. Notemos que cuando el valor de x es diferente de 0, 1 o 2, el evento X = x es vacı́o.


Por lo tanto, si x 6= 0, 1, 2

f (x) = P [X = x] Por definición de f en (3.2)

= P [∅] Ya que X = x es vacı́o.

= 0 Por el Teorema 2.4.1

En resumen la función de densidad de probabilidad discreta f de la variable aleatoria discreta


Y viene dada por

1
 4 Si x = 0, 2

f (x) = 12 Si x = 1 .


0 En otro caso.

Alternativamente podemos presentar a la función f mediante la Tabla 3.3, indicando en la


primera fila los valores de la variable aleatoria X y en la segunda fila los valores de su función
de densidad de probabilidad discreta.

x 0 1 2 otro caso
f (x) = P [X = x] 0.25 0.5 0.25 0

Tabla 3.2: La función de densidad de probabilidad expresada mediante una tabla

Podemos observar detalladamente el gráfico de la función de densidad de probabilidad


discreta f : R → R de la variable aleatoria X en la figura 3.2.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

78 CAPÍTULO 3. VARIABLES ALEATORIAS.

0.5 y

0.25

x
−2 −1 1 2 3 4 5

−0.25

Figura 3.2: Gráfico de f (x)

Ejemplo 3.1.6. Consideremos el experimento de lanzar un dado y ver que cara cae. El espa-
cio muestral para este experimento es S = {1, 2, 3, 4, 5, 6}. Tomamos las variable aleatoria
discreta X := el número que muestra la cara del dado. Para calcular la función de densidad
de probabilidad discreta f de la variable aleatoria discreta X podemos notar facilmente que
la probabilidad de sacar cualquier un número fijo es precisamente 61 , por lo cual
(
1
si x = 1, 2, 3, 4, 5, 6
f (x) = 6
0 en otro caso
El gráfico de la función f lo podemos ver en la Figura 3.3

y
0.34

0.17

x
−1 1 2 3 4 5 6 7 8

Figura 3.3: Gráfico de f (x)

Comentario 3.1.5. En términos generales como las variables aleatorias son funciones de que
llegan a R entonces uno las puede sumar, restar multiplicar y dividir dos variables aleatorias.
Podemos ver el siguiente ejemplo para notar esto en el caso de la suma.
Ejemplo 3.1.7. En el lanzamiento de lanzar dos dados distinguidos, podemos tomar la
variable aleatoria X : S → {2, 3, . . . , 12}, dada por X(x, y) = x + y, es decir, X la suma
de las caras de los dados. Ahora bien, esta variable aleatoria posee función de densidad de
probabilidad discreta,

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.1. VARIABLES ALEATORIAS DISCRETAS 79

x= 2 3 4 5 6 7 8 9 10 11 12 otro caso
1 2 3 4 5 6 5 4 3 2 1
f (x) 36 36 36 36 36 36 36 36 36 36 36
0

Tabla 3.3: La función de densidad de probabilidad expresada mediante una tabla

Para entender esto basta recordar que para cada x = 2, 3, . . . , 12

f (x) = P [X = x]

= P [{(s, t) ∈ S : X(s, t) = x}]

= P [Bx ],

f (4) = P [X = 4] Por definición de f en (3.2)

= P [B4 ],

3
= 36
Por la Figura
De igual forma podemos proceder para conocer los valores de la función de densidad de
probabilidad discreta para este experimento. Para mayor ilustración

0.19 y
0.17
0.14
0.11
8.34 · 10−2
5.56 · 10−2
2.78 · 10−2
x
−2−1 1 2 3 4 5 6 7 8 9 10 11 12 13

Figura 3.4: Gráfico de f (x)

Teorema 3.1.1. Dado un experimento con espacio muestral S y variable aleatoria X : S → R


con función de densidad de probabilidad f : R → R, entonces

1. 0 ≤ f (x) ≤ 1 para todo x ∈ R, es decir Im(f ) ⊂ [0, 1].

2. lı́m f (x) = 0.
x→−∞

3. lı́m f (x) = 0.
x→∞

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

80 CAPÍTULO 3. VARIABLES ALEATORIAS.

4. Si además X es una variable aleatoria discreta entonces


X
f (xi ) = 1 (3.3)
xi ∈Im(X)

Comentario 3.1.6. De la misma manera que la función de densidad de probabilidad discre-


ta, atrapa a la idea de la frecuencia relativa, en el contexto de variables aleatorias, podemos
construir un concepto que haga lo mismo con la frecuencia relativa acumulada. Este concepto
es la función de densidad de probabilidad acumulada discreta. Para poder presentarlo, recor-
demos que si tenemos una variable aleatoria X, ella es una función definida en un espacio
muestral S y que devuelve valores en los números reales R, es decir, X toma valores e ∈ S
y devuelve valores X(e) = x que están en R. Ahora bien cuando escribimos X ≤ x nos
referimos al conjunto
{e ∈ S : X(e) ≤ x}.
Es decir, X ≤ x es un subconjunto del espacio muestral S el cual está formado por los
elementos e que satifacen la condición: X(e) ≤ x. Por lo tanto X ≤ x representa un evento
en el espacio muestral S. Ası́ pues tenemos que

P [X ≤ x] = P [{e ∈ S : X(e) ≤ x}] (3.4)


Definición 3.1.4. Dado un experimento, con una variable aleatoria X : S → R, se define la
función de densidad de probabilidad acumulada de X como la función F : R → R que para
cada x ∈ R cumple
F (x) = P [X ≤ x] (3.5)
Comentario 3.1.7. Para que podamos entender la ecuación (3.5) es necesario que compren-
damos el significado de la expresión P [X ≤ x], por lo cual debemos tener en mente la ecuación
(3.4). Por otro lado dado, supongamos que tenemos un experimento, con una variable aleato-
ria discreta X : S → R tal que: o Im(X) = {x1 , x2 , . . .}, o bien, Im(X) = {x1 , x2 , . . .}. Supon-
gamos además que conocemos a la función de densidad de probabilidad discreta f : R → R
de X. Con esta data tenemos que la función de densidad de probabilidad acumulada discreta
F : R → R, viene dada por la expresión
X
F (x) = f (xi ). (3.6)
xi ∈ Im(X)
xi ≤ x
Sin embargo este notación es bastante tediosa y la podemos usar de forma simplicada por
X
F (x) = f (xi ), (3.7)
xi ≤x

en donde es muy importante que tengamos muy presente que los xi son elementos de la
imagen de X, o en otras palabras, estos xi son precisamente los valores que toma la variable
aleatoria X.
Ejemplo 3.1.8. Consideremos el experimento de lanzar tres monedas de las cuales la segunda
moneda tiene dos caras. El espacio muestral de este experimento es
S = {(c, c, c), (c, c, s), (s, c, c), (s, c, s)}.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.1. VARIABLES ALEATORIAS DISCRETAS 81

Si tomamos la variable aleatoria discreta dada por:

X := el número de caras que figuran.

La función de densidad de probabilidad discreta f : R → R de la variable aleatoria discreta


X viene dada por

1

4 si x = 1, 3
f (x) = 12 si x = 2 .


0 en cualquier otro caso

Para encontrar la función de densidad de probabilidad acumulada de X procedemos como


sigue:

1. Si −∞ < x < 1

F (x) = P [X ≤ x] Por la ecuación (3.5)

= P [{e ∈ S : X(e) ≤ x}] Por la ecuación (3.4)

= P [∅] Por X no toma valores menores a 1

= 0 Por el Teorema 2.4.1

2. Si 1 ≤ x < 2

F (x) = P [X ≤ x] Por la ecuación (3.5)

= P [{e ∈ S : X(e) ≤ x}] Por la ecuación (3.4)


X
= f (xi ) Por la ecuación (3.7)
xi ≤x

= f (1) X toma el valor de 1 cuando 1 ≤ x < 2

1
= 4
Calculando f (1)

3. Si 2 ≤ x < 3

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

82 CAPÍTULO 3. VARIABLES ALEATORIAS.

F (x) = P [X ≤ x] Por la ecuación (3.5)

= P [{e ∈ S : X(e) ≤ x}] Por la ecuación (3.4)


X
= f (xi ) Por la ecuación (3.7)
xi ≤x

= f (1) + f (2) X toma los valores de 1 y 2 cuando 2 ≤ x < 3

1 1
= 4
+ 2
Calculando f (1) y f (2)

3
= 4
Simpificando

4. Si 3 ≤ x < ∞

F (x) = P [X ≤ x] Por la ecuación (3.5)

= P [{e ∈ S : X(e) ≤ x}] Por la ecuación (3.4)


X
= f (xi ) Por la ecuación (3.7)
xi ≤x

= f (1) + f (2) + f (3) X toma los valores de 1, 2 y 3 cuando 3 ≤ x < ∞

1
= 4
+ 21 + 1
4
Calculando f (1) y f (2)

= 1 Simpificando f (1) y f (2)

Resumiendo tenemos


 0 Si − ∞ < x1

1
4
Si 1≤x<2
F (x) = 3
 Si 2≤x<3
4


1 Si 3≤x<∞
Podemos observar bien detalladamente el gráfico de F en la figura 3.5.

Ejemplo 3.1.9. Consideremos nuevamente el experimento de lanzar dos dados y ver el par
que sale cuyo espacio muestral consta de 36 pares ordenados. Dada la variable aleatoria
X : S → {1, 2, 3, . . . , 12} dada por X(x, y) = x + y entonces función de densidad acumulada
para la variable aleatoria X es
x∈ (∞, 2) [2,3) [3,4) [4,5) [5,6) [6,7) [7,8) [8,9) [9, 10) [10,11) [11,12) [12,∞)
F (x) 0 1 3 6 10 15 21 26 30 33 35 1
36 36 36 36 36 36 36 36 36 36

También solemos escribir las funciones en la forma

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.2. VALOR ESPERADO Y VARIANZA DE UNA VARIABLE ALEATORIA 83

y
1

0.75

0.5

0.25
x
−2 −1 1 2 3 4 5 6
−0.25

Figura 3.5: Gráfico de f (x)



 0 x ∈ (∞, 2)
 1


 36
x ∈ [2,3)
 3


 36
x ∈[3,4)
 6


 36
x ∈[4,5)
 10

 x ∈[5,6)
 36
 15
36
x ∈[6,7)
F (x) = 21

 36
x ∈[7,8)
 26


 36
x ∈[8,9)
 30


 36
x ∈[9, 10)
 33


 36
x ∈[10,11)
 35


 36
x ∈[11,12)

1 x ∈[12,∞)
Teorema 3.1.2. Dado un experimento con espacio muestral S y variable aleatoria X : S → R
con función de densidad de probabilidad acumulada F : R → R, entonces
1. F es un función monótona creciente.
2. 0 ≤ F (x) ≤ 1 para todo x ∈ R, es decir Im(F ) ⊂ [0, 1].
3. lı́m F (x) = 0.
x→−∞

4. lı́m F (x) = 1.
x→∞

3.2. Valor esperado y varianza de una variable aleatoria


Definición 3.2.1. Dada una variable aleatoria discreta X con función de densidad de pro-
babilidad f , se define el valor esperado de X mediante
X
µ = E(X) = xi f (xi ) (3.8)
xi ∈Im(X)

Ejemplo 3.2.1.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

84 CAPÍTULO 3. VARIABLES ALEATORIAS.

Ejemplo 3.2.2.
Ejemplo 3.2.3.
Definición 3.2.2. Dada una variable aleatoria discreta X con función de densidad de pro-
babilidad f , se define el valor esperado de X mediante
X
σ 2 = E((X − µ)2 ) = (x − µ)2 f (x) (3.9)
x

Ejemplo 3.2.4.
Ejemplo 3.2.5.
Ejemplo 3.2.6.
Comentario 3.2.1. Cerramos esta sección notando que: dados los números reales a y b, si
ellos son distintos entonces los eventos X = a y X = b resultan mutuamente excluyente. Esta
propiedad proviene fuertemente del hecho que X es uan función, por lo tanto no puede vale a
y b al mismo tiempo. Presentamos el sigiente teorema que será de mucha ayuda en adelante
para la realización de variso cálculos.
Teorema 3.2.1. Si X es una variable aleatoria aleatoria discreta con función de densidad
de probabilidad discreta f , entonces para cualquier par de valores reales a 6= b vale que:
P [X = a o X = b] = f (a) + f (b). (3.10)
Mas generalmente para cualesquier colección de valores a1 , a2 , . . . , ak distintos todos entre
sı́, vale que:
Xk
P [X = a1 o X = a2 o . . . o X = ak ] = f (ai ). (3.11)
i=1

3.3. Variable aleatoria Hipergeométrica


Definición 3.3.1. Sean N, k, n ∈ N tales que n ≤ N . Consideremos el siguiente experimento
1. Tenemos un conjunto con N elementos a los cuales clasificamos en dos tipos (I y II)
distintos tal y como sigue: k son del tipo I y N − k son del tipo II. Mostramos en la
Figura 3.6 una representación de esta situación.

Tipo I Tipo II

x1 , x 2 , . . . , x k y1 , y2 , . . . , yN −k

N elementos en total

Figura 3.6: Ilustramos la distribución de los k elementos Tipo I y de los N − k elementos


tipo II

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.3. VARIABLE ALEATORIA HIPERGEOMÉTRICA 85

2. Elegimos sin reposición n elementos del conjunto de los N elementos.

Sobre este experimento podemos definir la variable aleatoria

X:=número de elementos del tipo I elegidos en la muestra.

Los posibles valores de esta variable aleatoria son

X = 0, 1, . . . , M in{n, k}.

La variable aleatoria definida anteriormente recibe el nombre de variable aleatoria Hiper-


geométrica con parámetros N , k y n. Por simplicidad escribimos X ∼ Hyp(N, k, n)

Teorema 3.3.1. Si X ∼ Hyp(N, k, n) entonces la función de densidad de probabilidad de


X viene dada por  
k N −k
x n−x
f (x) = P [X = x] = N
 (3.12)
n

Ejemplo 3.3.1. Supongamos que X tiene una distribución hipergeométrica con parámetros
N = 10, n = 2, k = 3. Encontremos

1. La función de densidad de probabilidad discreta de X.

2. La función de densidad de probabilidad acumulada discreta de X.

Ejemplo 3.3.2. Entre un total de 20 analistas es necesario seleccionar a 10 de ellos. Si la


selección se efectuara en forma totalmente aleatoria, calculemos la probabilidad de que entre
los diez elegidos se encuentran los cinco mejores del grupo.
Comenzamos notando que

a La cantidad de analistas es 20, por lo tanto N = 20.

b Vamos a elegir 10 analistas, por lo tanto n = 10.

c El tipo I está compuesto por los 5 mejores analistas, por lo tanto k = 5.

d El tipo II está compuesto por los 15 analistas restantes, por lo tanto N − k = 15. Tal y
como vemos en la figura 3.7

Mejores El resto

5 15

20 analistas

Figura 3.7: Resumimos la situación de los 20 analistas distinguiendo los dos grupos de interés

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

86 CAPÍTULO 3. VARIABLES ALEATORIAS.

e Variable aleatoria

X := número de analistas elegidos entre los cinco mejores.

X = 0, 1, . . . , 5.

f Función de densidad de probabilidad.


5
 15

x 10−x
f (x) = P [X = x] = 20
 (3.13)
10

Ya que estamos interesados en conocer la probabilidad de que entre los diez elegidos se
encuentran los cinco mejores del grupo, esto lo podemos traducir en que

X = 5.

Ası́ pues debemos calcular el valor de

f (5) = P [X = 5].

Por lo tanto procedemos como sigue:

f (5) = P [X = 5]

(55)(10−5
15
)
= 20
(10)

= 0.0162

Ejemplo 3.3.3. Un determinado producto industrial se embarca en lotes de 20 unidades.


Con el objetivo de minimizar el número de articulos defectuosos enviados a los clientes se
instituyó un programa de inspección que consiste en tomar una muestra de cinco unidades de
cada uno de los lotes y rechazar el lote en el caso de encontrar más de un artı́culo defectuoso.
En el caso de que el lote contiene cuatro defectuosos, calculemos la probabilidad de que sea
aceptado.
Comenzamos notando que

a El lote posee 20 unidades, por lo tanto N = 20.

b Vamos a elegir 5 unidades , por lo tanto n = 5.

c El tipo I está compuesto por los cuatro defectuosos, por lo tanto k = 4.

d El tipo II está compuesto por los 16 buenos, por lo tanto N − k = 16. Tal y como vemos
en la figura 3.8

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.3. VARIABLE ALEATORIA HIPERGEOMÉTRICA 87

Defectuosos Buenos

4 16

20 artı́culos

Figura 3.8: Resumimos la situación de los 20 artı́culos distinguiendo los dos grupos de interés

e Variable aleatoria

X := número de artı́culos defectuosos elegidos en la muestra de cinco artı́culos.

X = 0, 1, 2, 3, 4
f Función de densidad de probabilidad.
4
 16

x 5−x
f (x) = P [X = x] = 20
 (3.14)
5

Como estamos interesados en conocer la probabilidad de que l lote sea aceptado, debemos
tener en cuenta que el lote es rechado en el caso de encontrar más de un artı́culo defectuoso,
es decir, si la variable aleatoria cumple la propiedad
X > 1,
lo cual nos permite inferir que es aceptado si
X ≤ 1.
Ası́ pues debemos calcular el valor de
P [X ≤ 1].
Por lo tanto procedemos como sigue:

P [X ≤ 1] = f (0) + f (1)

(40)(164) (41)(163)
= + 20
(205) (5)

= 0.7513
Ejemplo 3.3.4. Un almacén ha recibido 100 aparatos de televisión de su proveedor, de los
cuales les es desconocida que en el lote se encuentran 10 aparatos defectuosos. Si se seleccionan
al azar dos aparatos para ser sometidos a inspección. Encontremos la probabilidad de que
ambos estén defectuosos
Comenzamos notando que

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

88 CAPÍTULO 3. VARIABLES ALEATORIAS.

a El almacén posee 100 unidades, por lo tanto N = 100.

b Vamos a elegir 2 televisores, por lo tanto n = 2.

c El tipo I está compuesto por 10 televisores defectuosos, por lo tanto k = 10.

d El tipo II está compuesto por los 90 televisores buenos, por lo tanto N − k = 90. Tal y
como vemos en la figura 3.9

Defectuosos Buenos

10 90

100 Televisores

Figura 3.9: Resumimos la situación de los 100 televisores artı́culos distinguiendo los dos
grupos de interés

e Variable aleatoria

X := número de artı́culos defectuosos elegidos en la muestra de cinco artı́culos.

X = 0, 1, 2.

f Función de densidad de probabilidad.


10
 90

x 2−x
f (x) = P [X = x] = 100
 (3.15)
2

Ahora bien, deseamos conocer la probabilidad de que ambos estén defectuosos, es decir,
si la variable aleatoria cumple la propiedad

X = 2.

Ası́ pues debemos calcular el valor de

f (2) = P [X = 2].

Por lo tanto procedemos como sigue:

(102)(900)
f (2) =
(1002 )

= 0.0091

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.4. DISTRIBUCIÓN BINOMIAL. 89

3.4. Distribución binomial.


Definición 3.4.1. Un ensayo de Bernoulli es un experimento aleatorio en el que sólo es
posible obtener dos resultados complementarios habitualmente etiquetados como Éxito (que
denotamos por E) y Fracaso (que denotamos por F ).
Ejemplo 3.4.1. Si lanzamos una moneda al aire podemos definir
Éxito: que caiga cara.
Ası́ pues, estamos ante un ensayo de Bernoulli, en cual tenemos
Fracaso: que caiga seca.
Ejemplo 3.4.2. Si Lanzamos un dado al aire y definimos:
Éxito: que caiga 3 o 4,
entonces estaremos ante un ensayo de Bernoulli, en cual tenemos
Fracaso: que caiga 1, 2, 5 o 6.
Ejemplo 3.4.3. Supongamos que tenemos un ensayo de Bernoulli con éxito E y fracaso F .
Si repetimos el ensayo de Bernoulli de forma idéntica e independiente dos veces, el espacio
muestral resulta ser
{(F, F ), (F, E), (E, F ), (E, E)}.
Ahora bien, podemos definir la variable aleatoria discreta
X :=número de éxitos.
La variable aleatoria X toma los siguientes valores

X(F, F ) = 0,
X(F, E) = 1,
X(E, F ) = 1,
X(E, E) = 2.

Comentario 3.4.1. Podemos reproducir el ejemplo anterior para cualquier cantidad de re-
peticiones. También podemos imponer que las probabilidades de obtener Éxitos o Fracasos no
sean la mismas. Esta idea nos permite introducir una familia de variables aleatorias paramétri-
zadas por la cantidad de repeticiones n y por la la probabilidad de Éxito p. Introducimos a
continuación la formalización de esta idea.
Definición 3.4.2. Sean p ∈ (0, 1) y n ∈ N. Tomemos el siguiente experimento
1. Comenzamos con un ensayo de Bernuolli con éxito E y fracaso F , tal que

P [E] = p, y P [F ] = 1 − p = q.

2. Repetimos n veces el ensayo de Bernoulli de forma idéntica e independiente. Esto es,


que p permanece constante en todas las repeticiones y que el resultado de una repetición
no afecta a las demás repeticiones.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

90 CAPÍTULO 3. VARIABLES ALEATORIAS.

Definimos la variable aleatoria

X := número de éxitos obtenidos.

X recibe el nombre de variable aleatoria Binomial con parámetros n y p. Por simplicidad


escribimos X ∼ Bin(n, p)

Teorema 3.4.1. Sean p ∈ (0, 1) y n ∈ N. Supongamos que X es una variable aleatoria bino-
mial con parámetros n y p ( X ∼ Bin(n, p)). Entonces la función de densidad de probabilidad
discreta de X viene dada por
 
n x n−x
f (x) = P [X = x] = p q , (3.16)
x

donde x = 0, 1, . . . , n, nx es el número combinatorio n combinados de x.

Comentario
 3.4.2. Debemos tener en cuenta que para calcular los números combinatorios
n
x
, debemos ubicar en la calculadora una tecla que viene usualmente marcada como nCr. Ası́
pues para calcular nCx en la calculadora. En caso no encontrar esta tecla, lo recomendable es
buscar en el manual de la calucladora como calcular números combinatorios. Por otro lado,
para ingresar correctamente la expresión de la ecuación (3.16) deberemos teclear

(nCx)(p∧ x)(q ∧ n − x),

donde n − x es el número simplificado.

Ejemplo 3.4.4. Si X es una variable aleatoria binomial con parámetros n = 3 y p = 0.4, en-
tonces podemos aplicar el Teorema 3.4.1 para conocer la función de densidad de probabilidad
discreta de X. Esta viene dada mediante la ecuación (3.16), donde debemos usar

n = 3, p = 0.4 y q = 1 − p = 0.6.

De este modo obtenemos que


 
3
f (x) = P [X = x] = 0.4x 0.63−x , (3.17)
x

donde x = 0, 1, 2, 3.
Vamos ahora a graficar a f (x). Ası́ que necesitamos calcular a f (0), f (1), f (2) y f (3), ya
que f (x) = 0 en cualquier otro caso. Dicho lo anterior tenemos entonces:

1. Si x = 0,
3

f (0) = 0
(0.4)0 (6)3−0 Haciendo x = 0 en la ecuación (3.17) con

3

= 0
(0.4)0 (0.6)3 Simplificando exponentes

= 0.216 Calculando.

E inferimos que
f (0) = P [X = 0] = 0.216.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.4. DISTRIBUCIÓN BINOMIAL. 91

2. Si x = 1,

3

f (1) = 1
(0.4)1 (6)3−1 Haciendo x = 1 en la ecuación (3.17) con

3

= 1
(0.4)1 (0.6)2 Simplificando exponentes

= 0.432 Calculando.

E inferimos que
f (1) = P [X = 1] = 0.432

3. Si x = 2,

3

f (2) = 2
(0.4)2 (6)3−2 Haciendo x = 2 en la ecuación (3.17) con

3

= 2
(0.4)2 (0.6)1 Simplificando exponentes

= 0.288 Calculando.

E inferimos que
f (2) = P [X = 2] = 0.288

4. Si x = 3,

3

f (3) = 3
(0.4)3 (6)3−3 Haciendo x = 3 en la ecuación (3.17) con

3

= 3
(0.4)3 (0.6)0 Simplificando exponentes

= 0.064 Calculando.

E inferimos que
f (3) = P [X = 3] = 0.064

En resumen podemos presentar a la función f (x) en la Tabla 3.4.

x 0 1 2 3 otro caso
f (x) 0.216 0.432 0.288 0.064 0

Tabla 3.4: Representamos a la función de densidad de probabilidad discreta de una variable


aleatoria binomial con n = 3 y p = 0.4

Como es natural la función f también posee un gráfico y a este lo presentamos en la


Figura 3.10

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

92 CAPÍTULO 3. VARIABLES ALEATORIAS.

0.5 f (x)
p = 0.4
0.4

0.3

0.2

0.1
X
1 2 3 4
−0.1

Figura 3.10: Representamos el gráfico de función de densidad de probabilidad discreta de una


variable aleatoria binomial con n = 3 y p = 0.4

Ejemplo 3.4.5. Si X ∼ Bin(4, 0.25), entonces la función de densidad de probabilidad dis-


creta de X viene dada mediante la ecuación (3.16), donde debemos usar n = 4, p = 0.25 y
q = 1 − p = 0.75. De este modo obtenemos que

 
4
f (x) = P [X = x] = 0.25x 0.754−x , (3.18)
x

donde x = 0, 1, 2, 3, 4. Ahora bien, si reemplazamos a x = 0, 1, 2, 3, 4 podemos presentar


a la función 3.18 en mediante la Tabla 3.5

x 0 1 2 3 4 otro caso
f (x) 0.3164 0.4219 0.2109 0.0469 0.0039 0

Tabla 3.5: Representamos a la función de densidad de probabilidad discreta de una variable


aleatoria binomial con n = 4 y p = 0.25

Y el gráfico de f (x) lo representamos en la Figura 3.11.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.4. DISTRIBUCIÓN BINOMIAL. 93

0.5 f (x)
p = 0.25
0.4

0.3

0.2

0.1
X
1 2 3 4
−0.1

Figura 3.11: Representamos el gráfico de función de densidad de probabilidad discreta de una


variable aleatoria binomial con n = 4 y p = 0.25

Ejemplo 3.4.6. Si X ∼ Bin(5, 0.1), entonces la función de densidad de probabilidad discreta


de X viene dada mediante la ecuación (3.16), donde debemos usar n = 5, p = 0.7 y q =
1 − 0.1 = 0.3. De este modo obtenemos que
 
5
f (x) = P [X = x] = 0.7x 0.35−x ,
x

donde x = 0, 1, 2, 3, 4, 5. Los valores de f (x) los presentamos en la Tabla 3.6

x 0 1 2 3 4 5 otro caso
f (x) 0.0024 0.0284 0.1323 0.3087 0.3601 0.1681 0

Tabla 3.6: Representamos a la función de densidad de probabilidad discreta de una variable


aleatoria binomial con n = 5 y p = 0.7

Calculemos seguidamente la función de densidad de probabilidad acumulada discreta


F : R → R de la variable aleatoria X.

1. Si −∞ < x < 0

F (x) = P [X ≤ x] Por la ecuación (3.5)

= P [∅] X no toma valores menores a 0

= 0 Por el Teorema 2.4.1

2. Si 0 ≤ x < 1

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

94 CAPÍTULO 3. VARIABLES ALEATORIAS.

F (x) = P [X ≤ x] Por la ecuación (3.5)

= f (0) X acumula el valor 0 cuando 0 ≤ x < 1

= 0.0024 Por la Tabla 3.6


3. Si 1 ≤ x < 2

F (x) = P [X ≤ x] Por la ecuación (3.5)

= f (0) + f (1) X acumula los valores de 0 y 1 cuando 1 ≤ x < 2

= 0.0024 + 0.0284 Por la Tabla 3.6

= 0.0308 Simplificando

4. Si 2 ≤ x < 3

F (x) = P [X ≤ x] Por la ecuación (3.5)

= f (0) + f (1) + f (2) X acumula los valores de 0, 1 y 2 cuando 1 ≤ x < 2

= 0.0024 + 0.0284 + 0.1323 Por la Tabla 3.6

= 0.1631 Simplificando

5. Si 3 ≤ x < 4

F (x) = P [X ≤ x] Por la ecuación (3.5)

= f (0) + f (1) + f (2) + f (3) X acumula a 0, 1, 2 y 3 cuando 3 ≤ x < 4

= 0.0024 + 0.0284 + 0.1323 + 0.3087 Por la Tabla 3.6

= 0.4718 Simplificando

6. Si 4 ≤ x < 5

F (x) = P [X ≤ x] Por la ecuación (3.5)

= f (0) + f (1) + f (2) + f (3) + f (4) X acumula a 0, 1, 2, 3 y 4 si 4 ≤ x < 5

= 0.0024 + 0.0284 + 0.1323 + 0.3087 + 0.3601 Por la Tabla 3.6

= 0.8319 Simplificando

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.4. DISTRIBUCIÓN BINOMIAL. 95

7. Si 5 ≤ x entonces

F (x) = 1
ya que X habrá tomado sus valores.

1 y 1

0.8

0.6

0.4

0.2
x
−2 −1 1 2 3 4 5 6

Figura 3.12: Gráfico de la función de densidad de probabilidad acumulada discreta F : R → R


de una variable aleatoria binimial con parámetros n = 5 y p = 0.7

Teorema 3.4.2. Supongamos que X ∼ Bin(n, p) entonces

1. El valor esperado de X viene dado por:

µ = E(X) = np (3.19)

2. La varianza de X viene dado por:

σ 2 = V ar(X) = np(1 − p) (3.20)

3. El desvı́o estándard de X viene dado por:


p p
σ = V ar(X) = np(1 − p) (3.21)

Comentario 3.4.3. A continuación presentaremos situaciones que resultan ser aplicaciones


de alguna variable aleatoria binomial. En este contexto de aplicaciones, es necesario identificar
siempre: el Éxito, el Fracaso, el valor p, el valor q, el valor n, la variable aleatoria X en
función del contexto del Éxito y la función de densidad de probabilidad discreta de la variable
aleatoria X. Ası́ pues una vez identificados los elementos anteriores, debemos traducir las
preguntas de la situación, por lo general, al lenguaje de probabilidades en función de X.

Ejemplo 3.4.7. Uno de cada diez libros de texto representa un éxito financiero y una casa
editora ha decidido publicar diez nuevos textos, determinemos:

1. La probabilidad de que 2 sean un éxito.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

96 CAPÍTULO 3. VARIABLES ALEATORIAS.

2. Al menos 3 sean un éxito.


3. A lo sumo 1 sea un éxito.
Abordaremos este ejemplo notando que tenemos la siguiente data:

a Ensayo de Bernoulli: La casa editora lanza un libro de texto al mercado.


b Éxito E: Que el libro sea un éxito financiero.
c Probabilidad de éxito: como 10 % de los libros resultan ser un éxito financiero tenemos

p = P [E] = 0.1

d Probabilidad de Fracaso, como p = 0.1 entonces

q = 1 − p = 0.9.

e Repeticiones del ensayo de Bernuolli: como la casa está lanzado 10 libros, entonces

n = 10.

f Variable aleatoria: Nos interesa contar los libros son un éxito financiero, ası́

X = número de libros de texto que son un éxito financiero.

g La función de densidad de probabilidad discreta de X: con n = 10, p = 0.1, q = 0.9


tenemos  
10
f (x) = P [X = x] = 0.1x 0.910−x ,
x
donde x = 0, 1, . . . , 10.

Para resolver el primer numeral basta darnos cuenta que el evento


2 sean un éxito,
lo traducimos a nivel de la variable aleatoria X como:

X = 2.

Por lo tanto nos están pidiendo que calculemos

f (2) = P [X = 2].

Ası́ procedemos como sigue

f (2) = P [X = 2]

10

= 2
(0.1)2 (0.9)8

= 0.1937
Para resolver el segundo numeral basta darnos cuenta que el evento

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.4. DISTRIBUCIÓN BINOMIAL. 97

Al menos 3 sean un éxito,

lo traducimos a nivel de la variable aleatoria como:

X ≥ 3.

Por lo tanto nos están pidiendo a P [X ≥ 3]. Notemos que el complemento del evento X ≤ 3
resulta ser el evento X ≤ 2, ası́ procedemos como sigue

P [X ≥ 3] = 1 − P [X ≤ 2]

= 1 − [f (0) + f (1) + f (2)]

10
 10
 10

= 1−[ 0
0.10 0.910 + 1
0.11 0.99 + 2
0.12 0.98 ]

= 1 − [0.3487 + 0.3874 + 0.1937]

= 0.0702.
Para resolver el tercer numeral basta darnos cuenta que el evento

A lo sumo uno sea un éxito,

lo podemos traducir a nivel de la variable aleatoria como:

X ≤ 1.

Por lo tanto nos están pidiendo a


P [X ≤ 1].
Ası́ procedemos como sigue

P [X ≤ 1] = P [X = 0 o X = 1]

= f (0) + f (1)

10
 10

= 0
0.10 0.910 + 1
0.11 0.99

= 0.3487 + 0.3874

= 0.7361.

Ejemplo 3.4.8. Debido a las altas tasas de interés, en una empresa reporta que el 30 % de
sus cuentas por cobrar de están vencidas. Si un contador toma una muestra aleatoria de cinco
de esas cuentas determine la probabilidad de que

1. Ninguna de las cuentas esté vencida

2. Exactamente dos estén vencidas,

3. Exactamente el 20 % de las cuentas estén vencidos

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

98 CAPÍTULO 3. VARIABLES ALEATORIAS.

Abordaremos este ejemplo notando que tenemos la siguiente data:


a Ensayo de Bernoulli: Extraer una cuenta .

b Éxito E: Cuenta esté vencida.

c Probabilidad de Éxito: p = P [E] = 0.3,

d Probabilidad de Fracaso : q = 1 − p = 0.7.

e Repeticiones del ensayo de Bernuolli: n = 5.

f Variable aleatoria: X := número de cuentas vencidas en la muestra.

g La función de densidad de probabilidad discreta de X:


 
5
f (x) = P [X = x] = (0.3)x (0.7)5−x
x
donde x = 0, 1, . . . , 5

1. Para resolver el primer numeral basta darnos cuenta que el evento:

Ninguna de las cuentas esté vencida,

se traduce a nivel de la variable aleatoria como:

X = 0.

Por lo tanto nos están pidiendo a

f (0) = P [X = 0].

Ası́ procedemos como sigue

f (0) = P [X = 0]

5

= 0
(0.3)0 (0.7)5

= 0.1681

2. Para resolver el segundo numeral basta darnos cuenta que el evento

Exactamente dos estén vencidas,

a nivel de la variable aleatoria significa que:

X = 2.

Por lo tanto nos están pidiendo a

f (2) = P [X = 2].

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.4. DISTRIBUCIÓN BINOMIAL. 99

Ası́ procedemos como sigue

f (2) = P [X = 2]

5

= 2
(0.3)2 (0.7)3

= 0.3087

3. En cuanto al tercer numeral basta darnos cuenta que el evento:

Exactamente el 20 % de las cuentas estén vencidos.

es equivalente a decir que una cuenta (porque 1 es el 20 % de 5) de las 5 esté vencida.


Esto es a nivel de la variable aleatoria que:

X = 1.

Por lo tanto nos están pidiendo a

f (1) = P [X = 1].

Ası́ procedemos como sigue

f (1) = P [X = 1]

5

= 1
(0.3)1 (0.7)4

= 0.3602

Ejemplo 3.4.9. El porcentaje de agencias de publicidad que contratan para su plantel


personal especializado en publicidad es del 40 %. Si se realiza una encuesta a diez agencias
de publicidad determine la probabilidad de que:

1. Alguna de las agencias tenga contratado personal especializado en publicidad.

2. Cuatro del total de agencias tenga personal especializado en publicidad.

3. Que en por lo menos tres agencias se tenga personal especializado en publicidad

4. Que ninguna de las agencias tenga personal especializado en publicidad en su plantel

Abordaremos este ejemplo notando que tenemos la siguiente data:

a Ensayo de Bernoulli: Elegir una empresa de publicidad,

b Éxito E: La agencia contrató personal espacializado en publicidad.

c Probabilidad de Éxito: p = P [E] = 0.4,

d Probabilidad de Fracaso : q = 1 − p = 0.6.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

100 CAPÍTULO 3. VARIABLES ALEATORIAS.

e Repeticiones del ensayo de Bernuolli: n = 10.

f Variable aleatoria: X := número de agencia contrató personal espacializado en publicidad.

g La función de densidad de probabilidad discreta de X:


 
10
f (x) = P [X = x] = (0.4)x (0.6)10−x
x
donde x = 0, 1, . . . , 10

1.
P [X ≥ 1] = 1 − P [X = 0]

10

=1− 0
(0.4)0 (0.6)10

= 0.994

2.
f (4) = P [X = 4]

10

= 4
(0.4)4 (0.6)6

= 0.2508

3.
P [X ≥ 3] = 1 − P [X ≤ 2]

= 1 − [f (0) + f (1) + f (2)]

10
 10
 10

=1− 0
(0.4)0 (0.6)10 − 1
(0.4)1 (0.6)9 − 2
(0.4)2 (0.6)8

= 0.8528

4.
f (0) = P [X = 0]

10

= 0
(0.4)0 (0.6)10

= 0.0060

Ejemplo 3.4.10. Una empresa de ventas afirma que cada entrevista produce una venta
con una probabilidad de 1/5. En un determinado dia uno de sus vendedores entrevista a 5
clientes, determine
o) La probabilidad de realizar una venta dos ventanas, tres ventas, cuatro ventas y cinco
ventas, 
f (0) = P [X = 0] = 50( 51 )0 ( 45 )5 = 0.3277
f (1) = P [X = 1] = 51( 51 )1 ( 45 )4 = 0.4096
f (2) = P [X = 2] = 52( 51 )2 ( 45 )3 = 0.2048
f (3) = P [X = 3] = 53 ( 51 )3 ( 45 )2 = 0.0512

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.4. DISTRIBUCIÓN BINOMIAL. 101



f (4) = P [X = 4] = 54 ( 51 )4 ( 54 )1 = 0.0064

f (5) = P [X = 5] = 55 ( 51 )5 ( 54 )0 = 0.0003
b) Confeccione el diagrama de distribuciones de probabilidades
0.5 Eje Y
p = 0.2
0.4

0.3

0.2

0.1
Eje X
−1 1 2 3 4 5
−0.1

Ejemplo 3.4.11. Los propietarios de una empresa de publicidad han decidido emitir acciones
y ponerlas en venta. Se sabe que el 90 % de las casas de bolsas están recomendando estas
acciones a sus clientes, determine la probabilidad de que
a) De dos casas de bolsa entrevistadas, ninguna recomienda la compra de esas acciones.
b) De cuatro casas de bolsa euro casas de bolsa entrevistadas, no más de dos recomienden
la compra de esas acciones.

f (0) = P [X = 0] = 20 (0.9)0 (0.1)2 = 0.01
P [Y ≤ 2] = P [Y = 0, 1, 2]

= g(0) + g(1) + g(2)

4
 4
 4

= 0
(0.9)0 0.12 + 1
0.91 0.13 + 2
0.92 0.12

Ejemplo 3.4.12. En el siguiente gráfico tenemos tres funciones de densidad de probabilidad


de tres variables aleatorias binomiales para n = 40
p = 0.2
0.2
p = 0.5
p = 0.8
0.1

0.1

0.0
0 10 20 30 40

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

102 CAPÍTULO 3. VARIABLES ALEATORIAS.

3.5. Variable aleatoria Poisson


Definición 3.5.1. Consideremos un fenómeno aleatorio que cumple
1. Las ocurrencias del fenómeno son independientes unas de otras. Es decir la ocurrencia
del fenómeno no afecta la probabilidad de una nueva ocurrencia del fenómeno.
2. La tasa de ocurrencia del fenómeno es λ por unidad de medida (tiempo, longitud, área,
volumen,...), y es constante.
3. El fenómeno no ocurre dos veces de forma simultánea.
Consideremos el experimento de observar el fenómeno anterior durante la unidad de medida
en la cual [Link] la variable aleatoria
X := cuantas veces ocurre el fenómeno.
La variable aleatoria X definida anteriormente se denomina variable aleatoria discreta
Poisson con parámetro λ. Por simplidad escribiremos X ∼ Poi(λ)
Teorema 3.5.1. Si X ∼ Poi(λ) entonces la función de densidad de probabilidad de X viene
dado por

λx e−λ
f (x) = (3.22)
x!
donde x = 0, 1, 2, . . ..
Ejemplo 3.5.1. Si X ∼ Poi(3), entonces podemos calcular P [X = 1] mediante
31 e−3
f (1) = 1!
Por (3.22) con λ = 3

3e−3
= 1
Simplificando

= 0.1494 Simplificando
Ejemplo 3.5.2. Si X ∼ Poi(2), entonces podemos calcular P [X = 3] mediante
23 e−2
f (3) = 3!
Por (3.22) con λ = 2

8e−2
= 6
Simplificando

= 0.1804 Simplificando
Ejemplo 3.5.3. Si X ∼ Poi(5), entonces podemos calcular P [X ≤ 1] mediante

Ya que Im(X) =
P [X ≤ 1] = P [X = 0, 1]
{0, 1, . . . , }

Ya que P [X = 0], P [X = 1],


= P [X = 0] + P [X = 1]
Son mutuamente excluyentes

= f (0) + f (1) Ya que P [X = x] = f (x)

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.5. VARIABLE ALEATORIA POISSON 103

Ahora bien, de otro lado uno tiene que


50 e−5
f (0) = 0!
Por (3.22) con λ = 5

1e−5
= 1
Simplificando

= e−5 Simplificando
= 0.0067 Simplificando
51 e−5
f (1) = 1!
Por (3.22) con λ = 5

5e−5
= 1
Simplificando

= 5e−5 Simplificando
= 0.0337 Simplificando
Ahora bien

P [X ≤ 1] = 0.0404
Ejemplo 3.5.4. Un conmutador telefónico de consultorios médicos puede manejar un máxi-
mo de 5 llamadas por minuto. Si la experiencia indica que se reciben 120 llamadas por hora.
Encuentre la probabilidad de que durante un determinado minuto el conmutador se encuentre
saturado
Antes que nada debemos notar que 120 llamadas por hora es lo mismo que 2 llamadas
por minuto
Fenómeno: El conmutador recibe llamadas durante una minuto determinado
Tasa de ocurrencia λ: 2 llamadas por minuto
Variable aleatoria: X :=

P [X > 5] = 1 − P [X ≤ 5]

= 1 − [f (0) + f (1) + f (2) + f (3) + f (4) + f (5)]


0 −2 21 e−2 22 e−2 23 e−2 24 e−2 25 e−2
= 1 − [ 2 0!
e
+ 1!
+ 2!
+ 3!
+ 4!
+ 5!
]
0 21 22 23 24 25 −2
= 1 − [ 20! + 1!
+ 2!
+ 3!
+ 4!
+ 5!
]e

109 −2
= 1− 15
e

= 1 − 0.9834
= 0.0166
Ejemplo 3.5.5. Una compañı́a de seguros asegura a 1000 hombres de una edad comprendida
entre los 40 y los 44 años. Se sabe que los estudios indican que la probabilidad de que un
hombre con una edad comprendida entre los 40 y 44 años tenga un siniestro en un determinado
año es de 0.001. Determine la probabilidad de la compañı́a tenga que

1. abonar durante un año por lo menos dos siniestros en un año.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

104 CAPÍTULO 3. VARIABLES ALEATORIAS.

2. abonar durante un año exactamente tres siniestrosen el año.


3. no tenga que abonar durante un año ningun siniestro en el año.

Fenómeno: siniestros de hombres entre los 40 y los 44 años en un año determinado.


Tasa de ocurrencia λ: 0.001 muertes/por año
Variable aleatoria: X := número siniestros de hombres entre los 40 y los 44 años en un
año determinado

P [X ≥ 2] = 1 − P [X ≤ 1]

= 1 − (P [X = 0] + P [X = 1]
h 
0.0010 e0.001 0.0011 e0.001
=1− 0!
+ 1!

= 1 − (1 + 0.001)e−0.001

= 4.99 × 10−7

3 −0.001
P [X = 3] = 0.001 3!e
= 1.67 × 10−10
0.0013 e−0.001
P [X = 0] = = 0.9990
3!
Ejemplo 3.5.6. El numero promedio de quejas de pasajeros recibidas por la Secretaria de
Transporte respecto de una empresa de transporte aéreo, por 100.000 pasajeros transporta-
dos, fue de 35. En igual cantidad de pasajeros deseamos saber la probabilidad de que:
1. dos o más pasajeros se quejen
2. menos de 3 pasajeros se quejen
3. más de dos pero menos de 4 pasajeros se quejen
4. haya 20 pasajeros que se quejen

P [X = 3, 4]
Ejemplo 3.5.7. Una empresa de transporte compra neumáticos en lotes de 500. Por expe-
riencias anteriores sabe que el ik de los neumáticos adquiridos suelen defectuosos y deben ser
reemplazados durante la primera semana de uso Indique cuál es la probabilidad de que en
un envio de 500 neumáticos se encuentre
1. Un solo defectuoso,
2. Ningún neumático defectuoso,
3. No más de tres defectuosos

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.6. VARIABLES ALEATORIAS CONTINUAS 105

3.6. Variables aleatorias continuas


Estamos interesados en variables aleatorias que contienen en su imagen un intervalo de
los números reales.

Definición 3.6.1. Considere un experimento con espacio muestral S, una variable aleatoria
X : S → R se dice que es una variable aleatoria continua si existe una función

f :R→R

tal que la función de densidad de probabilidad acumulada F : R → R de la variable aleatoria


X es de la forma Z x
F (x) = f (t)dt (3.23)
−∞

Notar que f (x) no es una función de densidad de probabilidad en el sentido estricto de


(3.2). Sin embargo le seguiremos llamando de esta forma abusando un poco de lenguaje,
porque como veremos en algunos ejemplos, f (x) puede tomar valores superiores a 1.

Ejemplo 3.6.1. Dado un intervalo (a, b) ⊂ R consideramos el experimento de elegir un


número al azar en el cual todos los x ∈ (a, b) tienen las misma probabilidad de ser elegidos.
La función de densidad de probabilidad de este experimento es
(
1
b−a
Si x ∈ (a, b)
f (x) =
0 En otro caso

Ahora bien, la función de densidad de probabilidad acumulada viene dada por



0
 Si x < a
x−a
F (x) = Si x ∈ [a, b]
 b−a

1 Si x > b

Teorema 3.6.1. Sean a, b ∈ R y X variable aleatoria continua, entonces

P [X = a] = 0 (3.24)

Z b
P [a < X < b] = f (t)dt (3.25)
a

P [a < X < b] = F (b) − F (a) (3.26)

Z ∞
f (t)dt = 1 (3.27)
−∞

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

106 CAPÍTULO 3. VARIABLES ALEATORIAS.

3.7. Ejercicios
1. En una concesionaria, la probabilidad de realizar una venta exitosa a un cliente es de
0.1. En cierto momento ingresan 5 clientes. Hallar la probabilidad de:

a) no realizar ventas exitosas


b) realizar exactamente una venta exitosa
c) realizar a lo sumo 1 venta exitosa ‘item realizar al menos 2 ventas exitosas

3.8. Distribución normal.


Definición 3.8.1. Una variable aleatoria continua X se dice que se distribuye normal con
parámetros µ y σ 2 6= 0 si su función de densidad de probabilidad acumulada es

Z x (t−µ)2
1 −
F (x) = √ e 2σ2 dt (3.28)
σ 2π −∞
Por simplicidad lo denotaremos como X ∼ N(µ, σ 2 )

Teorema 3.8.1. Si X ∼ N(µ, σ 2 ) entonces

1. f (t) es simétrica respecto µ.

2. La mediana de X es µ.

3. E(X) = µ.

4. Var(X) = σ 2 .

5. Los puntos de inflexión de la curva de f (t) se dan para

x = µ − σ, µ + σ.

6. P [µ − σ < X < µ + σ] = 0.6826

7. P [µ − 2σ < X < µ + 2σ] = 0.9544

8. P [µ − 3σ < X < µ + 3σ] = 0.9974

Ejemplo 3.8.1. Suponga que X ∼ N(10, 4) hallar un intervalo (a, b) con centro en 10 tal
que P [a < X < b] = 0.9974

Ejemplo 3.8.2. Suponga que X ∼ N(5, 2) hallar un intervalo (a, b) con centro en 5 tal que
P [a < X < b] = 0.9544

Ejemplo 3.8.3. Suponga que X ∼ N(0, 1) hallar un intervalo (a, b) con centro en 0 tal que
P [a < X < b] = 0.6826

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

3.8. DISTRIBUCIÓN NORMAL. 107

3.8.1. Distribución normal estándar.


Definición 3.8.2. Una variable aleatoria Z se dice que se distribuye normal estándard si
Z ∼ N(0, 1)

Teorema 3.8.2. (Estandarización.) Si X ∼ N(µ, σ 2 ) entonces la nueva variable Z definida


mediante la expresión
X −µ
Z=
σ
cumple

Z ∼ N(0, 1)

Definición 3.8.3. Supongamos que tenemosZ ∼ N(0, 1), definimos la función Φ : [0, ∞) →
[0, 1] mediante

Φ(z) = P [0 ≤ X ≤ z] (3.29)
y los valores de esta función se encuentran en el Apéndice 4.1.

Dado que casi totalidad de la distribución se halla a tres desviaciones tı́picas de la media
justifica el hecho de que los lı́mites de las tablas empleadas habitualmente en la normal
estándar figuren entre -3 y 3 o entre 0 y 3.

Ejemplo 3.8.4. Supongamos que Z ∼ N(0, 1), si deseamos encontrar P [0 ≤ Z ≤ 2.25]


debemos proceder como sigue:
Al necesitar a P [0 ≤ Z ≤ 2.25] basta comprender que

Φ(2.25) = P [0 ≤ Z ≤ 2.25],

por lo cual nos vamos a la tabla del apéndice en 4.1 y teniendo en cuenta que

2.25 = 2.2 + 0.05

y ubicamos el número 2.2 en la columna izquierda y el 0.01 el la fila superior y obtener


Z 0.00 0.01 0.02 0.03 0.04 0.05 0.06 0.07 0.08 0.09
de don-
2.2 .4861 .4864 .4868 .4871 .4875 .4878 .4881 .4884 .4887 .4890
de se deduce que

Φ(2.25) = P [0 ≤ Z ≤ 2.25] = 0.4878

Ejemplo 3.8.5. Supongamos que Z ∼ N(0, 1), si deseamos encontrar P [−1.5 ≤ Z ≤ 0]


debemos proceder como sigue:
Nos vamos a la tabla del apendice 4.1

Ejemplo 3.8.6. Supongamos que Z ∼ N(0, 1), si deseamos encontrar P [0.5 ≤ Z ≤ 1.2]
debemos proceder como sigue:

Ejemplo 3.8.7. Supongamos que Z ∼ N(0, 1), si deseamos encontrar P [−1.5 ≤ Z ≤ −1.2]
debemos proceder como sigue:

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

108 CAPÍTULO 3. VARIABLES ALEATORIAS.

3.9. intervalos de cofianza


Ejemplo 3.9.1. La maestra de castellano detectó el número de palabras con faltas de orto-
grafı́a en un grupo de pruebas de sus alumnos. Detectó que la distribución de palabras con
faltas de ortografı́a por prueba se manejaba por una distribución normal con una desviación
estándar de 2.44 palabras por prueba. En su clase de 20 alumnos de las 8 de la mañana,
el número medio de las palabras con faltas de ortografı́a fue de 6.05. Hallar intervalos de
confanza para la media al 99 % al 95 % y al 90 %

3.9.1. Resolución de una distribución binomial por aproximación


con la normal.
3.9.2. Resolución de una distribución de Poisson por aproxima-
ción con la normal.

Descargado por Martu Menendez (martinamenendezgarro@[Link])


lOMoARcPSD|4133870

Capı́tulo 4

Apendices

4.1. Tabla de la normal


Z 0.00 0.01 0.02 0.03 0.04 0.05 0.06 0.07 0.08 0.09
0.0 .0000 .0040 .0080 .0120 .0160 .0199 .0239 .0279 .0319 .0359
0.2 .0793 .0832 .0871 .0910 .0948 .0987 .1026 .1064 .1103 .1141
0.3 .1179 .1217 .1255 .1293 .1331 .1368 .1406 .1443 .1480 .1517
0.4 .1554 .1591 .1628 .1664 .1700 .1736 .1772 .1808 .1844 .1879
0.5 .1915 .1950 .1985 .2019 .2054 .2088 .2123 .2157 .2190 .2224
0.6 .2257 .2291 .2324 .2357 .2389 .2422 .2454 .2486 .2517 .2549
0.7 .2580 .2611 .2642 .2673 .2704 .2734 .2764 .2794 .2823 .2852
0.8 .2881 .2910 .2939 .2967 .2995 .3023 .3051 .3078 .3106 .3133
0.9 .3159 .3186 .3212 .3238 .3264 .3289 .3315 .3340 .3365 .3389
1.0 .3413 .3438 .3461 .3485 .3508 .3531 .3554 .3577 .3599 .3621
1.1 .3643 .3665 .3686 .3708 .3729 .3749 .3770 .3790 .3810 .3830
1.2 .3849 .3869 .3888 .3907 .3925 .3944 .3962 .3980 .3997 .4015
1.3 .4032 .4049 .4066 .4082 .4099 .4115 .4131 .4147 .4162 .4177
1.4 .4192 .4207 .4222 .4236 .4251 .4265 .4279 .4292 .4306 .4319
1.5 .4332 .4345 .4357 .4370 .4382 .4394 .4406 .4418 .4429 .4441
1.6 .4452 .4463 .4474 .4484 .4495 .4505 .4515 .4525 .4535 .4545
1.7 .4554 .4564 .4573 .4582 .4591 .4599 .4608 .4616 .4625 .4633
1.8 .4641 .4649 .4656 .4664 .4671 .4678 .4686 .4693 .4699 .4706
1.9 .4713 .4719 .4726 .4732 .4738 .4744 .4750 .4756 .4761 .4767
2.0 .4772 .4778 .4783 .4788 .4793 .4798 .4803 .4808 .4812 .4817
2.1 .4821 .4826 .4830 .4834 .4838 .4842 .4846 .4850 .4854 .4857
2.2 .4861 .4864 .4868 .4871 .4875 .4878 .4881 .4884 .4887 .4890
2.3 .4893 .4896 .4898 .4901 .4904 .4906 .4909 .4911 .4913 .4916
2.4 .4918 .4920 .4922 .4925 .4927 .4929 .4931 .4932 .4934 .4936
2.5 .4938 .4940 .4941 .4943 .4945 .4946 .4948 .4949 .4951 .4952
2.6 .4953 .4955 .4956 .4957 .4959 .4960 .4961 .4962 .4963 .4964
2.7 .4965 .4966 .4967 .4968 .4969 .4970 .4971 .4972 .4973 .4974
2.8 .4974 .4975 .4976 .4977 .4977 .4978 .4979 .4979 .4980 .4981
2.9 .4981 .4982 .4982 .4983 .4984 .4984 .4985 .4985 .4986 .4986
3.0 .4987 .4987 .4987 .4988 .4988 .4989 .4989 .4989 .4990 .4990

109
Descargado por Martu Menendez (martinamenendezgarro@[Link])

También podría gustarte