INVESTIGACIÓN DE CONCEPTOS.
MATERIA: ESTADISTICA GENERAL.
CATEDRÁTICO: ADRIANA MAYA RIVERA.
LICENCIATURA EN PEDAGOGÍA.
NOMBRE COMPLETO: ZURY SADAI CHÁVEZ SUÁREZ.
FECHA DE ENTREGA: 24 DE OCTUBRE DEL 2024.
INTRODUCCIÓN
La estadística es una herramienta muy útil que nos ayuda a entender y analizar datos
en diversas áreas, desde la educación hasta la salud y los negocios. Uno de los
principales desafíos en este campo es la necesidad de estudiar grandes grupos de
personas o elementos, conocidos como poblaciones. Sin embargo, examinar a todos
los miembros de una población puede ser complicado, costoso y, en muchos casos,
prácticamente imposible. Por esta razón, se recurre al concepto de muestreo.
El muestreo es el proceso de seleccionar un pequeño grupo de individuos o
elementos de una población más grande. Este grupo, llamado muestra, debe ser
representativo de la población total para que los resultados obtenidos puedan
generalizarse. Existen diferentes métodos de muestreo. Por ejemplo, el muestreo
aleatorio es un método donde cada persona tiene la misma oportunidad de ser
seleccionada, mientras que, en el muestreo por conveniencia, se eligen a los que son
más fáciles de alcanzar. Elegir el método adecuado es fundamental para asegurar
que los resultados sean válidos y aplicables.
Una vez que tenemos nuestra muestra, podemos comenzar a realizar inferencias
estadísticas. Esto significa que utilizamos la información obtenida de la muestra para
hacer suposiciones o generalizaciones sobre la población completa. Un concepto
clave en este proceso es el intervalo de confianza. Este intervalo nos proporciona un
rango de valores donde es probable que se encuentre el verdadero parámetro de la
población, como la media o la proporción. Por ejemplo, si calculamos un intervalo de
confianza del 95% para la media de una población, estamos diciendo que estamos
un 95% seguros de que el verdadero valor está dentro de ese rango. Esta información
es muy valiosa porque nos da una idea de la precisión de nuestras estimaciones.
Además, las pruebas de hipótesis son otra herramienta importante en la estadística.
Estas pruebas nos ayudan a evaluar afirmaciones específicas sobre la población. Por
ejemplo, podemos tener una hipótesis que dice que la media de una población es
igual a un cierto valor. A través de una prueba de hipótesis, analizamos si los datos
de nuestra muestra respaldan o refutan esta afirmación. Si encontramos suficiente
evidencia en los datos, podemos rechazar la hipótesis nula y aceptar la hipótesis
alternativa, que plantea una afirmación diferente.
El uso de técnicas de muestreo, inferencia estadística, intervalos de confianza y
pruebas de hipótesis permite a los investigadores y profesionales tomar decisiones
más informadas. Por ejemplo, en el ámbito de la salud pública, estas herramientas se
utilizan para evaluar la efectividad de tratamientos o para entender la prevalencia de
enfermedades en diferentes poblaciones. En el mundo empresarial, ayudan a las
empresas a conocer mejor a sus clientes y a tomar decisiones estratégicas basadas
en datos.
En resumen, la estadística es una disciplina poderosa que nos proporciona métodos
para analizar datos y hacer inferencias sobre poblaciones basadas en muestras. A
través del muestreo, podemos obtener información valiosa de grupos más pequeños
y, mediante intervalos de confianza y pruebas de hipótesis, podemos validar nuestras
suposiciones. Estas herramientas son esenciales en muchas áreas de la vida
cotidiana, permitiendo a las personas y organizaciones tomar decisiones más
informadas y efectivas.
CONCEPTO DE MUESTREO.
Es una herramienta de la investigación científica. Su función básica es determinar
qué parte de una realidad en estudio (población o universo) debe examinarse con la
finalidad de hacer inferencias sobre dicha población.
Muestreo. Es el método utilizado para seleccionar a los componentes de la muestra
del total de la población. "Consiste en un conjunto de reglas, procedimientos y criterios
mediante los cuales se selecciona un conjunto de elementos de una población que
representan lo que sucede en toda esa población".(MATA et al, 1997:19) El realizar
el diseño muestral es importante porque: a) Permite que el estudio se realice en menor
tiempo. b) Se incurre en menos gastos. c) Posibilita profundizar en el análisis de las
variables. d) Permite tener mayor control de las variables a estudiar.
TIPOS
✓ PROBABILISTICO: Es requisito que todos y c/u de los elementos de la
población tengan la misma probabilidad de ser seleccionados (azar) Se debe
tener disponible un listado completo de todos los elementos de la población, a
esto se le llama MARCO DE MUESTREO.
✓ ALEATORIO SIMPLE (Muestreo Simple al Azar): Cada sujeto tiene una
probabilidad igual de ser seleccionado para el estudio. Se necesita una lista
numerada de las unidades de la población que se quiere muestrear.
Opciones:
◦ Fichas de lotería o bolitas numeradas
◦ Tabla de números aleatorios.
Pasos:
◦ Determinar el tamaño de la muestra.
◦ Numerar los individuos de 1 a n.
◦ Tirar unidades al azar (probabilidad igual).
Ejemplo: Cobertura de la vacuna anti- sarampión entre 1200 niños de una escuela X:
◦ Muestra = 60
◦ Hacer una lista de todos los niños
◦ Numerarlos de 1 a 1200
◦ Selección aleatoria de 60 números.
✓ Muestreo Aleatorio Sistemático: Se toman todos los individuos de la lista y
se selecciona c/3, c/7, o cualquier otro número. Para comenzar se utiliza un
número al azar.
Ejemplo: ◦ Población (N): 12,000
◦ Muestra requerida (n): 600
◦ Calcular el intervalo de muestreo (k) = 12,000 / 600 = 20
◦ Escoger el 1er número al azar [1 - 20] 1era unidad
◦ Añadir k para escoger la siguiente unidad y así sucesivamente hasta completar n.
✓ Muestreo Estratificado: Cuando la muestra incluye subgrupos
representativos (estratos) de los elementos de estudio con características
específicas: urbano, rural, nivel de instrucción, año académico, carrera, sexo,
grupo étnico, edad, paridad etc. En cada estrato para obtener el tamaño de la
muestra se puede utilizar el muestreo aleatorio o sistemático.
Ejemplo: Estudiantes de la Carrera de Medicina 2005 I año =20%, II año=18%, III año
=15%, IV año=30%.
✓ Muestreo por Racimos (Cluster o Conglomerado) Conglomerados: son
unidades geográficas (distritos, pueblos, organizaciones, clínicas) Facultad de
Ciencias Económicas Facultad de Ciencias Jurídicas y Sociales Facultad de
Química y Farmacia.
Limitantes: financieras, tiempo, geografía y otros obstáculos. Se reducen costos,
tiempo y energía al considerar que muchas veces las unidades de análisis se
encuentran encapsuladas o encerradas en determinados lugares físicos o
geográficos: Conglomerados.
Unidad de análisis: sujeto o sujetos Unidad Muestral en este caso: conglomerado a
través del cual se logra el acceso a la unidad de análisis. Selección en 2 etapas: ◦ Los
racimos o conglomerados ◦ En los racimos se seleccionan a los sujetos a ser medidos.
Población, Localidades, Viviendas. Croquis.
✓ Muestreo NO PROBABILISTICO: No se conoce la probabilidad que tienen los
diferentes elementos de la población de estudio de ser seleccionados.
A. Muestreo por conveniencia: Es la muestra que está disponible en el tiempo o
periodo de investigación. Ejemplo: Todos los pacientes que asistan a una clínica en
particular cierto día, semana, pueden ser requeridos para participar.
DESVENTAJA: la muestra puede ser poco representativa de la población que se
desea estudiar.
B. Muestreo por cuotas: Todos los elementos conocidos de la población tienen que
aparecer en la muestra. Se debe asegurar que estos aparezcan en la misma
proporción que en la población. El investigador entrevista a todas las personas de
cada categoría que pueda encontrar hasta que haya llenado la cuota.
C. Accidental o bola de nieve: Se aprovecha o utiliza personas disponibles en un
momento dado que se corresponda con el propósito del estudio. De los tres tipos de
muestreo no probabilístico resulta el más deficiente.
¿Cuál es el tamaño apropiado de la muestra?
Depende del paradigma o enfoque:
• Enfoque Cuantitativo o Cualitativo.
• Muestreo probabilístico o no probabilístico.
INFERENCIA ESTADÍSTICA
La inferencia estadística es el proceso mediante el cual se utiliza la información de
los datos de una muestra para extraer conclusiones acerca de la población de la que
se seleccionó dicha muestra. La teoría de inferencia estadística concatena la teoría
de probabilidad con la de estadística. En este curso se hará énfasis en que la
estadística incluye métodos para obtener inferencias para la población a partir de
datos muestreados en presencia de aleatoriedad, lo cual va más allá de la mera
obtención de datos y su representación en tablas, gráficas o medidas que resumen
información.
La inferencia estadística es el conjunto de métodos y técnicas que permiten inducir,
a partir de la información empírica proporcionada por una muestra, cual es el
comportamiento de una determinada población con un riesgo de error medible en
términos de probabilidad.
Los métodos paramétricos de la inferencia estadística se pueden dividir, básicamente,
en dos: métodos de estimación de parámetros y métodos de contraste de hipótesis.
Ambos métodos se basan en el conocimiento teórico de la distribución de probabilidad
del estadístico muestral que se utiliza como estimador de un parámetro.
La estimación de parámetros consiste en asignar un valor concreto al parámetro o
parámetros que caracterizan la distribución de probabilidad de la población. Cuando
se estima un parámetro poblacional, aunque el estimador que se utiliza posea todas
las propiedades deseables, se comete un error de estimación que es la diferencia
entre la estimación y el verdadero valor del parámetro. El error de estimación es
desconocido por lo cual es imposible saber en cada caso cual ha sido la magnitud o
el signo del error; para valorar el grado de precisión asociado con una estimación
puntual se parte de dicha estimación para construir un intervalo de confianza. En
síntesis, un intervalo de confianza está formado por un conjunto de valores numéricos
tal que la probabilidad de que éste contenga al verdadero valor del parámetro puede
fijarse tan grande como se quiera. Esta probabilidad se denomina grado de confianza
del intervalo, y la amplitud de este constituye una medida del grado de precisión con
el que se estima el parámetro.
Los métodos de contraste de hipótesis tienen como objetivo comprobar si
determinado supuesto referido a un parámetro poblacional, o a parámetros análogos
de dos o más poblaciones, es compatible con la evidencia empírica contenida en la
muestra. Los supuestos que se establecen respecto a los parámetros se llaman
hipótesis paramétricas. Para cualquier hipótesis paramétrica, el contraste se basa en
establecer un criterio de decisión, que depende en cada caso de la naturaleza de la
población, de la distribución de probabilidad del estimador de dicho parámetro y del
control que se desea fijar a priori sobre la probabilidad de rechazar la hipótesis
contrastada en el caso de ser ésta cierta.
INTERVALOS DE CONFIANZA PARA LA MEDIDA DE UNA POBLACIÓN.
Los intervalos de confianza son una herramienta estadística muy importante que nos
permite estimar el rango en el que probablemente se encuentra un parámetro de una
población, como la media. Cuando trabajamos con muestras de una población, rara
vez podemos conocer el valor exacto de la media o cualquier otro parámetro
poblacional, por lo que los intervalos de confianza nos proporcionan una manera de
hacer una estimación que incluya cierto margen de error.
¿Qué es un intervalo de confianza?
Un intervalo de confianza es un rango de valores que, basado en los datos de una
muestra, se estima que contiene el valor verdadero de un parámetro poblacional con
una determinada probabilidad. Este intervalo viene acompañado de un nivel de
confianza, que es el grado de certeza que tenemos de que el verdadero valor se
encuentra dentro del intervalo. Los niveles de confianza más comunes son el 95% y
el 99%. Por ejemplo, un intervalo de confianza del 95% significa que, si se repitiera el
muestreo muchas veces, el 95% de los intervalos de confianza resultantes
contendrían el verdadero valor de la media de la población.
¿Cómo se calcula un intervalo de confianza para la media?
Para calcular el intervalo de confianza para la media de una población, es necesario
contar con los siguientes elementos:
• Media muestral (X‾): La media de los datos de la muestra.
• Desviación estándar de la población (σ) o de la muestra si la población es
desconocida.
• Tamaño de la muestra (n).
• Nivel de confianza, que determina el valor del estadístico Z o t dependiendo
del tamaño de la muestra y de si la desviación estándar poblacional es
conocida o no.
La fórmula para el intervalo de confianza para la media cuando se conoce la
desviación estándar de la población es la siguiente:
¿Por qué son importantes los intervalos de confianza?
Los intervalos de confianza son esenciales porque nos dan una estimación más
precisa que un solo número, ya que incluyen un margen de error. En lugar de
simplemente decir que la media es 20 horas, podemos decir que estamos 95%
seguros de que la media está entre 19.02 y 20.98 horas. Esto proporciona una imagen
más completa y realista, considerando la variabilidad inherente a los datos
muestrales.
Los intervalos de confianza nos permiten hacer predicciones más seguras y precisas
sobre la media de una población basándonos en una muestra, y son una herramienta
fundamental para tomar decisiones informadas en la investigación y en la práctica
diaria.
PRUEBA DE HIPOTESIS SOBRE LA MEDIDA DE UNA POBLACIÓN.
La prueba de hipótesis sobre la media de una población es un proceso estadístico
que nos permite tomar decisiones sobre la media de una población basándonos en
datos de una muestra. Este tipo de prueba nos ayuda a verificar si una suposición o
afirmación sobre la media de una población es válida o no.
¿Qué es una prueba de hipótesis?
En una prueba de hipótesis, se empieza con una hipótesis nula (H₀), que es una
afirmación inicial sobre el parámetro de la población. Esta hipótesis se pone a prueba
para ver si los datos de la muestra proporcionan suficiente evidencia para rechazarla.
Si hay suficiente evidencia, se acepta una hipótesis alternativa (H₁), que es una
afirmación que difiere de la hipótesis nula.
Formular las hipótesis:
• Hipótesis nula (H₀): Es la afirmación que se desea probar. Generalmente,
sostiene que no hay diferencia o que un parámetro es igual a un valor
específico.
• Hipótesis alternativa (H₁): Es la afirmación contraria a la hipótesis nula, y se
acepta si hay suficiente evidencia para rechazar H0.
• Elegir el nivel de significancia (α): Este es el nivel de riesgo que estamos
dispuestos a aceptar de cometer un error al rechazar la hipótesis nula cuando
en realidad es verdadera. Los niveles de significancia más comunes son 0.05
(5%) y 0.01 (1%).
• Calcular el estadístico de prueba: El estadístico de prueba se usa para medir
cuán lejos están los datos muestrales del valor supuesto por la hipótesis nula.
• Determinar la región de rechazo: Una vez que tenemos el valor del
estadístico de prueba, lo comparamos con los valores críticos
correspondientes al nivel de significancia y el tipo de prueba (bilateral o
unilateral). Si el valor calculado cae en la región de rechazo, se rechaza la
hipótesis nula. Si no, se falla en rechazarla.
• Tomar una decisión: Con base en la comparación del valor del estadístico de
prueba y los valores críticos, se decide si se rechaza H0 en favor de HA, o si
no se rechaza H0 .
Tipos de pruebas de hipótesis sobre la media
Existen tres tipos básicos de pruebas de hipótesis sobre la media:
✓ Prueba bilateral: Se usa cuando queremos comprobar si la media de la
población es diferente de un valor específico.
✓ Prueba unilateral a la derecha: Se usa cuando queremos comprobar si la media
de la población es mayor que un valor específico.
✓ Prueba unilateral a la izquierda: Se usa cuando queremos comprobar si la
media de la población es menor que un valor específico.
Importancia de las pruebas de hipótesis.
Las pruebas de hipótesis son cruciales en la investigación científica y en la toma de
decisiones basadas en datos. Permiten validar afirmaciones o rechazar suposiciones
incorrectas, proporcionando una base sólida para inferencias sobre una población.
Esto es esencial en áreas como la medicina, la economía, la educación, y muchas
otras disciplinas, donde es fundamental basarse en datos confiables para tomar
decisiones informadas.
CONCLUSIÓN
Después de haber estudiado estos temas, comprendí que el muestreo es una técnica
esencial en estadística, ya que nos permite trabajar con una parte de la población
cuando no es posible o práctico estudiar a todos. Lo interesante es que hay varios
tipos de muestreo, y la elección depende del objetivo del estudio y la estructura de la
población. Por ejemplo, el muestreo aleatorio simple es útil cuando se busca que cada
individuo tenga la misma oportunidad de ser elegido, mientras que el estratificado es
ideal cuando queremos representar diferentes subgrupos.
La inferencia estadística me pareció muy útil porque, a partir de una muestra,
podemos hacer suposiciones y sacar conclusiones sobre toda la población. Esta es
la base para tomar decisiones basadas en datos sin tener que analizar a cada
individuo de una población.
Los intervalos de confianza también son importantes, ya que no nos dan un valor
exacto, pero nos ofrecen un rango dentro del cual es probable que esté el parámetro
de la población, como la media. Aprendí que el nivel de confianza refleja qué tan
seguros estamos de que ese intervalo contiene el valor real. Esto es clave porque nos
ayuda a entender la incertidumbre en nuestras estimaciones.
Finalmente, las pruebas de hipótesis me parecieron fundamentales en estadística.
Permiten comprobar si una suposición inicial (hipótesis nula) sobre una población es
verdadera o no. Al aprender sobre las pruebas de hipótesis, me di cuenta de que son
esenciales para tomar decisiones informadas, ya que nos dan un enfoque
estructurado para determinar si los resultados observados son producto del azar o
reflejan una realidad más significativa.
En resumen, estos temas están interconectados y son herramientas poderosas para
analizar datos de forma objetiva, lo que es clave en cualquier investigación o estudio.
BIBLIOGRAFÍA
[Link]
files/Muestreo_cuan.pdf
[Link]
[Link]
[Link]
a_Estadistica.pdf
[Link]
Montgomery, D. C., & Runger, G. C. (2014). Applied Statistics and Probability for
Engineers (6th ed.). Wiley.