0% encontró este documento útil (0 votos)
6 vistas40 páginas

Introducción a la Estadística Descriptiva

Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
6 vistas40 páginas

Introducción a la Estadística Descriptiva

Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Estadística Descriptiva

Prof. Josette Zúñiga Morales


Matemáticas Pre BI
Repaso de conocimientos
previos sobre Estadística
Actividad de inicio
* Realice de manera individual y lo más honesta posible la actividad del
libro: “Antes de comenzar”, de la página 42 del Folleto Adicional que
encontrará en la carpeta compartida de Drive.

* Resuelva la actividad de manera individual, a mano, de manera clara y


ordenada, utilizando colores, regla y papel milimetrado preferiblemente.

* Cuando se le indique: DISCUSIÓN GRUPAL.


Actividad de inicio

Discusión grupal
*¿Qué es la estadística y para qué sirve?

*¿De qué maneras se puede representar la información? ¿Considera que


alguna es mejor que otra?

*¿Sabe qué es un pictograma, gráfico de barras, gráfico circular o de pastel?


¿Hay casos donde es conveniente utilizar cada uno o da igual?

*¿Sabe qué es la media, moda, mediana y rango de los datos? ¿Para qué
sirven en la estadística y en la vida cotidiana?
En resumen…
La estadística es una ciencia que utiliza conjuntos de datos numéricos
para obtener, a partir de ellos, inferencias basadas en el cálculo de
probabilidades.

Reúne, clasifica y recuenta todos los hechos que tienen una determinada
característica o características en común, para poder llegar a conclusiones a
partir de los datos numéricos extraídos.

La estadística que se aplica en cualquier otra rama externa a ella, como


psicología, medicina, sociología, historia, biología, mercadotecnia, etc.
En resumen…
La estadística se divide en dos ramas fundamentales:

Estadística Descriptiva y Estadística Inferencial. (¿En qué crees que


consiste cada una?)
En resumen…
La estadística descriptiva La estadística inferencial
se encarga de recolectar, es la rama encargada de hacer
analizar y caracterizar los deducciones, es decir, inferir
datos mediante estadísticos, propiedades, conclusiones y
tablas o gráficos. tendencias, a partir de una
muestra del conjunto. Es
Mostrar la información tal decir, ver más allá de los
y como realmente es, con datos, analizar la información
diferentes métodos tal cuál es. e interpretarla, para así
(La que estudiaremos analizar comportamientos,
inicialmente) predecir situaciones,
caracterizar información, etc.
Conceptos para el estudio
adecuado de estadística
Población: Es el conjunto sobre el que se realizará el estudio
estadístico.

Individuo o Unidad Estadística: Cada uno de los elementos que


componen la población.

Muestra: Conjunto representativo de la población pero más


pequeño que esta.

Muestreo: Es la reunión de los datos sobre una muestra que serán


el objeto de nuestro estudio estadístico.
Muestra aleatoria: Es aquella en la que cada elemento tiene la
misma probabilidad de ser incluido. (Se escogen al azar)

Muestra sesgada: Es una muestra no aleatoria, por ejemplo


escogerlos dada una característica en común.

***Una muestra debe ser siempre aleatoria y no sesgada, pues para


ser una muestra representativa (válida, con el menor margen de
error posible, que no determine a la investigación, etc.). Para
asegurar la aleatoriedad se pueden colocar en una tómbola y
sacarlos al azar, numerarlos y escoger números al azar, etc.***
Ejemplo A
Ejemplo B
Espacio muestral: Son todos los resultados que podemos obtener.
En el caso de una moneda serían cara y cruz.

Dato: Los datos estadísticos son los valores que se obtienen al


llevar a cabo un estudio de tipo estadístico. Se trata del producto
de la observación de aquel fenómeno que se pretende analizar.
Los distintos valores que obtenemos para cada individuo. Si
lanzamos la moneda al aire tres veces obtendríamos 3 datos; por
ejemplo: cruz, cara, cruz. Los datos se pueden clasificar como
cualitativos o cuantitativos. Además pueden ser univariados o
multivariados.
Datos univariables: Consiste en el análisis de cada una de las
variables estudiadas por separado, es decir, el análisis esta basado
en una sola variable.

Datos invariables y multivariables: Con el análisis bivariable


describimos y evaluamos la relación entre dos variables o el
comportamiento de una variable en función de otra, con el
multivariable estudiamos tres o más varias variables de modo
simultáneo y tratamos de determinar la relación entre ellas.
Datos cualitativos: Son propiedades no medibles (género,
profesión, grado académico, color de ojos, deporte favorito, etc.).

Datos cuantitativos: Son todas aquellas propiedades medibles o


cuantificables (estatura, edad, número de hermanos, peso, duración
en horas del funcionamiento de una bombilla, temperatura, etc.).
Estos datos a su vez se clasifican en datos continuos o discretos.

Datos discretos: Datos cuantitativos, cuyos atributos pueden ser


contados, son números exactos (enteros). (Ej: días, años, número de
cajas, número de bombillas en mal estado en una fábrica, número de
hijos, etc.)

Datos contínuos: Datos cuantitativos, cuyos atributos pueden ser


medidos (números reales). (Ej: peso, estatura, altura de un grupo de
árboles, peso de una bolsa de arroz, distancias, etc.)
Ejercitación

•Folleto Adicional Estadística pág.


46 a la 47: Ejercitación 2A
Recolectando y organizando
datos univariables
Actividad inicial
Rosa trabaja en un restaurante. Las propinas que los clientes dan a los
camareros y camareras se colocan en un frasco grande. Es trabajo de Rosa
contar las propinas cada semana, registrar la cantidad en una libreta y
colocar las propinas y la libreta en la caja fuerte. Al final de cada mes, las
propinas se dividen en partes iguales entre el personal.

El gerente está interesado en ver cómo las propinas varían de una semana a
otra, y también cuántos de cada tipo de billete o moneda hay (5¢, 10¢, 20¢,
50¢, €1, €5, €10, €20). Le pide a Rosa que haga una presentación para el
personal.

¿Cómo puede ella hacer esta presentación mejor? ¿Qué diagramas puede usar
ella? ¿Cómo puede el personal usar esta información para mejorar el servicio?
¿Cómo puede el gerente usar la información para mejorar el restaurante?
Datos discretos simples
Cuando recolectamos una gran cantidad de datos, es
más simple visualizar y comprender la información si
la presentamos en una tabla de frecuencias (el dato, y
el número de veces que se repite este dato).
Ejemplo A
Ejercitación

•Folleto Estadística pág.47 a la 48:


Ejercitación 2B: 2, 4 y 6
Datos discretos o contínuos agrupados
Cuando hay una gran cantidad de datos dispersos en un amplio rango es
útil AGRUPARLOS. Dependiendo de la cantidad de datos, debe haber
entre 5 y 15 grupos, o intervalos de clases, de la misma amplitud. Las
clases deben cubrir el rango de datos sin que se repita ninguno, cada
dato pertenece a una sola clase.

Podemos organizar tanto los datos discretos con rango muy grande,
como los continuos (principalmente) en tablas de frecuencias de datos
agrupados
Limite superior e inferior de
clase
Son los valores extremos que tiene el intervalo de clase, inferior
y superior, entre los cuales van a estar los valores de los datos
agrupados en ese intervalo de clase. La distancia (diferencia)
entre los límites se llama Amplitud de la clase (es la misma
para todas las clases).
Ejemplo B
Tablas de frecuencias acumuladas
Para determinar el número de clases o intervalos que debe tener una tabla de
frecuencias acumuladas se utilizan diferentes métodos, se puede elegir “a dedo”,
en las instrucciones del ejercicio nos pueden indicar el número exacto de clases
a utilizar, o seguir la regla de Sturges.

Regla de Sturges: k = 1 + 3,322 ⋅ log(n),

con k = numero de clases, n = total de datos

El número de casillas de una tabla, es un número entero, por lo que se


recomienda redondear al entero menor más cercano el valor de k, recordando
que el número de clases debe ser entre 5 y 15 para efectos de nuestro curso.
Tablas de frecuencias acumuladas
Anteriormente mencionamos que la Amplitud (A) de una clase
corresponde a la distancia entre los límites inferior y superior de cada
clase, es decir, el tamaño de cada una de las clases que tenemos.

Para calcular la amplitud utilizamos la fórmula:


R
A = , donde A = amplitud de clase, k = número de clases, R = rango
k
de los datos (dato mayor − dato menor: xmax − xmin)

***Para la primera clase iniciamos con el dato menor, luego a este valor inicial le sumamos la amplitud
A para obtener el límite superior de clase, para la siguiente clase el límite inferior coincide con el
superior de la anterior, para el superior le sumamos A y así sucesivamente con todas las clases. El límite
superior de la última clase debería ser el dato máximo (o al menos un valor muy cercano)***
Tablas de frecuencias acumuladas
Las tablas de frecuencias acumuladas cuentan con “columnas”
adicionales que permiten analizar más información a partir de los
datos. Las columnas que nos interesa estudiar por ahora son la
formadas por:

xi (marca de clase: promedio entre los límites de la clase)

fi (frecuencia absoluta: el número total de datos que se


encuentran en una clase. La suma de esta columna da como
resultado el número de datos.)
Tablas de frecuencias acumuladas
fr (frecuencia relativa: nos informa acerca de la proporción o el peso
que tiene algún valor u observación en la muestra. La suma de la
columna debe dar uno.)

F (frecuencia absoluta acumulada: es la frecuencia obtenida al


sumar el número de datos de la clase en cuestión, más la frecuencia
absoluta de las clases anteriores a esta. Para la última clase, la suma
debe dar como resultado el número total de datos)

***Para ampliar estos todos estos conceptos observe el ejemplo del video:
[Link]
Ejercitación

•Folleto Estadística pág.49:


Ejercitación 2C
Medidas de tendencia central
Las medidas de tendencia central más comunes son la media o
promedio, la moda y la mediana.

En resumen, el propósito de la medidas de tendencia central son:

1. Mostrar en qué lugar se ubica un dato promedio o típica del


grupo.

2. Sirve como un método para comparar o interpretar cualquier


dato en relación con el dato central o típico.
Medidas de tendencia central

3. Sirve como un método para comparar los datos obtenido por


un mismo sujeto en dos diferentes ocasiones.

4. Sirve como un método para comparar los resultados medios


obtenidos por dos o más grupos
La Moda
En un conjunto de datos, corresponde al dato que se repite con
mayor frecuencia de todo el conjunto.

La Mediana
En un conjunto de datos ordenados, corresponde al dato que se
encuentra justo a la mitad de todo el grupo de datos (en caso
de una cantidad impar de datos). En caso que haya una
cantidad par de datos, al medio de la lista habrán dos datos,
por lo que la mediana corresponde al promedio de estos datos.
La Media o Promedio
En un conjunto de datos, la suma de todos ellos y al dividirlos
por el número de datos, se obtiene como resultado el valor de la
media.

De estas las medidas de tendencia central, la media es reconocida


como la mejor y más útil de las medidas de tendencia central. Sin
embargo, cuando en una distribución se presentan casos cuyos
puntajes son muy bajos o muy altos respecto al resto del grupo,
es recomendable utilizar la mediana o la moda. (Porque dada la
características de la media, esta es afectada por los valores
extremos.)
La Media o Promedio
Visto desde un punto de vista más conceptual, la media es el
“centro” de los datos en el sentido numérico, ya que intenta
equilibrarlos por exceso y por defecto.
La Media o Promedio
Para calcular el promedio de datos simples utilizamos la fórmula:

1 n 1 x1 + x2 + . . . + xn
xi = (x1 + x2 + . . . + xn) = , n el número
n∑i=1
n n

total de datos, xi cada uno de los datos medidos.


La Media o Promedio
Para calcular el promedio de datos con frecuencias acumuladas
utilizamos:

n
1 1 f1x1 + f2 x2 + . . . + fn xn
fi ⋅ xi = (f1x1 + f2 x2 + . . . + fn xn) = ,
n∑i=1
n n

con n = total de datos, xi = cada una de las marcas de clase


para datos agrupados, o el valor cada grupo, fi = frecuencia
absoluta de cada dato.
Ejemplo C
Ejemplo D
Ejemplo E

NOTA: Para datos agrupados, la moda corresponde a la clase que posee


mayor frecuencia y su nombre correcto es clase modal
Ejercitación
Libro texto: 3A, 3B, 3C (Págs. 99 a la 105)

•Folleto Estadística pág.55 a la 56:


Ejercitación 2F: solo 4, 5, 6.

•Folleto Estadística pág.57 a la 58:


Ejercitación 2G: solo 2, 3, 4.

•Folleto Estadística pág.60:


Ejercitación 2H

También podría gustarte