ACTIVIDADES
¡Bienvenidos! A la Plataforma Virtual UGMEX, pero, sobre todo, a la materia de Probabilidad y
Estadística. En esta sesión aprenderemos cómo se realiza la recolección de datos y a transformar
estos datos en información para la toma de decisiones mediante el uso de técnicas estadísticas
descriptivas.
Objetivos:
• Comprender los conceptos básicos de Estadística.
• Establecer los métodos de recolección de datos.
• Realizar tablas y gráficas con los datos recolectados.
• Usar medidas de posición y dispersión para la descripción de datos.
CONCEPTOS BÁSICOS
Estadística
Diariamente oímos o leemos frases como:
“Actividad económica en México cae el 18.9% en el segundo trimestre del 2020”
“En junio el INEGI anunció que la actividad industrial se contrajo 25% en abril en comparación con
marzo, la caída más pronunciada desde que se comenzaron a recopilar esas cifras en 1993.”
“México ocupa el primer lugar en cuanto a horas realmente trabajadas por trabajador al año,
acumulando 2250 horas anuales.
“México es el mayor consumidor per cápita de refrescos de cola en el mundo. Y también el país con
mayor obesidad en el mundo. Un informe de la ONU indica que casi una tercera parte de los adultos
mexicanos son obesos.”
En la actualidad, a todos nosotros se nos bombardea con encuestas y resultados de encuestas.
Algunas reúnen datos de muestras que son útiles porque describen de manera exacta características
importantes de poblaciones. Otras encuestas usan datos muestrales recolectados de tal forma que
condenan los resultados a la creciente pila de basura de la mala información.
Fuente: [Link]
Esto que se ha visto son las Estadísticas, es decir, el conjunto de gráficos, tablas, inferencias y datos
obtenidos y analizados por la estadística.
La Estadística es un conjunto de métodos para planear estudios y experimentos, obtener datos y
luego organizar, resumir, presentar, analizar, interpretar y llegar a conclusiones basadas en los
datos.
Se reconocen dos tipos de estadística: la estadística descriptiva, tiene que ver con los métodos de
la codificación, tabulación, representación gráfica y la síntesis numérica de datos que presentan
variabilidad. Las técnicas que se estudian sirven para organizar y presentar los datos antes de
pretender cualquier interpretación. Sin embargo, a la extensión de las propiedades a toda la
población cae en el dominio de la estadística inferencial.
La estadística utiliza técnicas de análisis, es decir, mecanismos mediante los cuales se convierten
los datos en información útil. (Mata, 2003)
Los datos son las observaciones recolectadas (como mediciones, géneros, respuestas de encuestas,
etc.)
Por lo tanto, los datos representan la materia prima de la estadística para posteriormente ser
transformados en información útil para la toma de decisiones.
Una de las aplicaciones más comunes de la estadística es la elaboración de tablas y gráficas que
sirven para recopilar, organizar y presentar datos.
La principal ventaja de las tablas es que permiten presentar conjuntos grandes de datos en forma
compacta. En cuanto a las gráficas, es bien conocida su virtud de ofrecer información fácilmente
asimilable.
Sin embargo, es evidente que estas herramientas ofrecen sus ventajas sólo cuando se les elabora
en forma adecuada. Es precisamente aquí en donde intervienen las técnicas estadísticas para la
elaboración de tablas y gráficas.
Otra de las aplicaciones importantes y frecuentes de la estadística es la utilización de números
simples para resumir características importantes de conjuntos de datos. Estos números simples que
representan características propias de conjuntos de datos son denominados medidas.
- Promedio
- Proporción
- Moda
- El mayor, el menor, …
- Etc.
Un área muy importante del análisis estadístico es el muestreo: se escoge una cantidad
relativamente reducida de elementos representativos de una población numerosa para inferir
conclusiones acerca de la totalidad de la población; a esta parte de la estadística se le conoce como
estadística inferencial. La cual se verá más adelante.
Poblaciones y muestras, parámetros y estadísticos.
Una población es el conjunto de todos los elementos o unidades de interés para un estudio
determinado. Por otra parte, una muestra es un subconjunto de los elementos de una población.
La principal característica que debe tener una muestra estadística útil es: ser representativa de la
población de donde se extrae, porque el principal propósito de la obtención de muestras consiste
en hacer inferencias sobre la población correspondiente.
Es importante distinguir las medidas tanto para poblaciones como para muestras:
• Estadístico muestral o estadístico. Es una medida de una muestra, por ejemplo, el promedio
del ingreso por hogar en la muestra.
• Parámetro. Es una medida de una población, por ejemplo, el promedio del ingreso por hogar
en la población. Esta diferenciación es muy importante porque no es lo mismo.
Método para análisis de datos
La aplicación de las técnicas estadísticas para el análisis de datos puede resumirse en un método
que consta de 5 etapas:
1. Recopilación de datos.
2. Organización de datos.
3. Presentación de datos.
4. Análisis de datos.
5. Conclusiones.
En la recopilación de datos es importante tener presente la fuente de los datos con los que se
trabaja. Es posible tener datos de fuentes internas, que son aquellos generados al interior de la
organización, como pueden ser datos contables, registros de ventas, de personal, etc. O también los
datos de fuentes externas que pueden obtenerse de otras personas u organizaciones.
Para la organización de datos estadísticos, se refiere, entre otros aspectos, a la verificación de la
veracidad de los datos y a su ordenación de acuerdo con las necesidades del estudio en cuestión.
La presentación de datos estadísticos se hace principalmente a través de 2 medios: tablas y gráficas.
Y el análisis de datos estadísticos se lleva a cabo utilizando las técnicas de pruebas de hipótesis,
correlación, regresión, etc.
Y finalmente las conclusiones de cualquier estudio debe culminar con ellas porque, por supuesto,
no se inicia un estudio con la intención de no terminarlo. Para llegar a las conclusiones deben
tenerse en cuenta tanto la clase y la fuente de los datos utilizados como las técnicas aplicadas en el
análisis. Es también importante cuidar la forma (y no sólo el fondo) en la presentación de las
conclusiones, ya que el propósito principal de estas actividades consiste en obtener información útil
para la toma de decisiones.
Para recopilar los datos, hay que entender la clasificación de los mismos para saber cómo los vamos
a manejar.
Datos estadísticos: variables y su clasificación
Un variable puede definirse como la característica que se mide al hacer determinadas
observaciones. Es fácil ver que la denominación de variable refleja los diversos valores que pueden
obtenerse al hacer la medición. Así, al estudiar la aceptación que un producto tiene entre los
consumidores, alguna de las variables de interés sería qué tan agradable les resulta a aquéllos el
sabor del producto. En este caso se tendría una variable de posibles valores como: “mucho”, “poco”
o “nada”. Otro ejemplo, al estudiar las remesas que envían los mexicanos en el extranjero en su
país, se puede dividir en diferentes cantidades monetarias.
En las variables se distinguen dos tipos: cuantitativas y cualitativas. Las primeras se indican a través
de valores o cantidades, y las segundas, con una característica o categoría. Las variables
cuantitativas a su vez pueden ser discretas o continuas. Las variables discretas son aquellas que se
pueden contar 1,2,3,4… o las que van cambiando en intervalos de valor específico 0.5, 1.0, 1.5, 2.0,
… Y las variables continuas, como su nombre lo indica, pueden tomar una infinidad de valores en un
intervalo. Por ejemplo, el crecimiento de las bacterias en un alimento durante un día.
El establecimiento de una variable es una de las etapas más importantes de toda tarea estadística.
Con este proceso se relaciona el mundo real con la matemática.
Escalas de medida
El establecimiento de una variable, es decir, la asignación de números a los elementos de una
población se hace siguiendo determinadas reglas. En general, cuando se asigna un número se dice
que se ha establecido una escala de medida, que se ha realizado una medición. La medición es una
versión formalizada de una observación, es la descripción del mundo. Generalmente, se consideran
cuatro tipos de escalas de medida:
1. Nominales
2. Ordinales
3. De intervalo
4. De razón o cociente
Es importante conocerlos, pues permiten una mejor aplicación de los métodos estadísticos. Pueden
resumirse en el siguiente cuadro:
Tipos de variables Escalas de medición
Cualitativas Nominal
Ordinal
Cuantitativas De intervalo
De razón o cociente
1. El nivel de medición nominal se caracteriza por datos que consisten exclusivamente en
nombres, etiquetas o categorías. Los datos no se pueden acomodar en un esquema de
orden (como del más bajo al más alto).
Ejemplos:
• Sí/no/indeciso: Respuestas de sí, no e indeciso en una encuesta.
• Colores: Los colores de los automóviles conducidos por estudiantes universitarios
(rojo, negro, azul, blanco, magenta, púrpura, etcétera).
Puesto que los datos nominales carecen de orden y no tienen un significado numérico, no
se deben utilizar para hacer cálculos. En ocasiones se asignan números a las distintas
categorías (especialmente cuando los datos se codifican para utilizarse en computadoras),
pero estos números no tienen un significado.
2. Los datos están en el nivel de medición ordinal cuando pueden acomodarse en algún orden,
aunque no es posible determinar diferencias entre los valores de los datos o tales
diferencias carecen de significado.
Ejemplos:
• Las calificaciones de un curso: Un profesor universitario asigna calificaciones de A,
B, C, D, E o F. Tales calificaciones se pueden ordenar.
• Rango militar: General, teniente, cabo, etc.
3. El nivel de medición de intervalo se parece al nivel ordinal, pero con la propiedad adicional
de que la diferencia entre dos valores de datos cualesquiera tiene un significado. Sin
embargo, los datos en este nivel no tienen punto de partida cero natural inherente (donde
nada de la cantidad está presente).
Ejemplos:
• Temperaturas: Las temperaturas corporales de 98.2°F y 98.6°F son ejemplos de
datos a nivel de medición de intervalo. Dichos valores están ordenados, y podemos
determinar su diferencia de 0.4°F. Sin embargo, no existe un punto de inicio natural.
Pareciera que el valor de 0°F es un punto de inicio; son embargo, éste es arbitrario
y no representa la ausencia total de calor. Puesto que 0°F no es un punto de partida
cero natural, sería incorrecto decir que 50°F es dos veces más caliente que 25°F.
• Años: Los años 1000, 2008, 1776 y 1492. (El tiempo no inició en el año 0, por lo que
el año 0 es arbitrario y no constituye un punto de partida cero natural que
represente “la ausencia de tiempo”).
4. El nivel de medición de razón es similar a nivel de intervalo, pero con la propiedad adicional
de que sí tiene un punto de partida cero natural (donde el cero indica que nada de la
cantidad está presente). Para valores a este nivel, tanto las diferencias como las
proporciones tienen significado.
Ejemplos:
• Pesos: Los pesos (en quilates) de anillos de compromiso de diamante (el 0
realmente representa la ausencia de peso y 4 quilates es dos veces el peso de 2
quilates).
• Precios: Los precios de libros de texto universitarios ($0 realmente representa
ningún costo y un libro de $90 es tres veces más caro que un libro de $30)