UNIDAD 7
El proceso de muestreo y la obtención de datos.
1.- Introducción al muestreo.
El muestreo es una técnica utilizada en la investigación y la estadística que permite obtener
información sobre una población más amplia a partir del estudio de una muestra
representativa de la misma. En lugar de recopilar datos de todos los individuos o elementos
de interés, se selecciona una parte de la población para su estudio.
El objetivo del muestreo es inferir conclusiones precisas y confiables sobre una población
más grande utilizando una fracción o muestra más pequeña de esa población. Es
prácticamente imposible estudiar o recopilar datos de todos los individuos o elementos en
una población, ya que esto puede ser costoso, consumir mucho tiempo y, en algunos casos,
logísticamente inviable. Por lo tanto, el muestreo se convierte en una herramienta esencial
para los investigadores al permitirles obtener información útil y significativa de manera
eficiente.
Para que el muestreo sea efectivo, es fundamental que la muestra seleccionada sea
representativa de la población en estudio. Esto significa que la muestra debe reflejar las
características y propiedades clave de la población de interés de manera proporcional. Al
seleccionar una muestra representativa, se espera que los resultados obtenidos a partir de
esa muestra sean generalizables y aplicables a la población más amplia.
Existen diferentes métodos de muestreo, como el muestreo aleatorio simple, el muestreo
estratificado, el muestreo por conglomerados y el muestreo sistemático, entre otros. Cada
método tiene sus propias ventajas y desventajas, y la elección del método de muestreo
adecuado depende del objetivo de la investigación, las características de la población y los
recursos disponibles.
El muestreo es una herramienta poderosa en la investigación y la estadística, ya que
permite obtener conclusiones y tomar decisiones basadas en una fracción de la población
en estudio. Es esencial comprender los conceptos y métodos del muestreo para garantizar
la validez y confiabilidad de los resultados obtenidos.
La utilización de muestras para el estudio de una población está más que justificada, pues,
en la mayoría de los casos, el estudio exhaustivo de toda la población no será rentable ni en
términos económicos ni en términos de tiempo.
1.1.- Terminología básica del muestreo.
La población se refiere al conjunto completo de individuos, elementos o unidades que
comparten una característica común y son objeto de estudio. Por ejemplo, si estás
investigando sobre la estatura promedio de los estudiantes universitarios, la población sería
todos los estudiantes universitarios.
Universo: Es un término similar a la población y se utiliza a menudo como sinónimo. Se
refiere al conjunto completo de elementos que están sujetos a estudio o análisis.
Marco muestral: Es una lista o fuente que contiene los elementos o individuos de la
población en estudio. El marco muestral es utilizado como referencia para seleccionar una
muestra representativa de la población. Por ejemplo, si deseas seleccionar una muestra de
estudiantes universitarios, el marco muestral puede ser una lista de todos los estudiantes
matriculados en las universidades correspondientes.
Unidades muestrales: Son los elementos o unidades individuales que se seleccionan de la
población para formar parte de la muestra. Las unidades muestrales pueden ser personas,
objetos, empresas u otras entidades, dependiendo de la naturaleza de la población y el
objetivo del estudio.
Muestra: Es un subconjunto de la población o del marco muestral. La muestra es utilizada
para realizar conexiones y generalizaciones sobre la población en su conjunto. El tamaño
de la muestra se determina en base a consideraciones estadísticas y puede variar
dependiendo del nivel de precisión y confianza deseado.
La muestra se utiliza porque en muchos casos es poco viable estudiar o recopilar datos de
todos los individuos de la población debido a limitaciones de tiempo, recursos o logística.
Por lo tanto, la muestra actúa como una representación más manejable de la población y
proporciona una base para realizar estimaciones y generalizaciones sobre la misma.
Es importante que la muestra sea representativa de la población para evitar sesgos y
obtener resultados fiables.
1.2.- Parámetros de la población y estimadores.
Para poder profundizar en la materia hemos de conocer determinados conceptos:
Parámetros de la población:
✔ Los parámetros de la población son valores numéricos desconocidos que
describen características o propiedades de interés de la población en su
conjunto. Estos parámetros son los valores "verdaderos" que nos gustaría
conocer, pero debido a que estudiar toda la población es a menudo imposible, se
usan estimadores para obtener una aproximación de estos parámetros.
Estimadores:
✔ Los estimadores son estadísticas calculadas a partir de una muestra
seleccionada de la población. Estas estadísticas se utilizan para inferir o estimar
los valores de los parámetros desconocidos de la población. Los estimadores se
basan en los datos de la muestra y proporcionan una aproximación de los
parámetros poblacionales.
El objetivo principal del muestreo es utilizar la información de la muestra para extrapolar los
resultados a toda la población. Los estimadores pueden ser fórmulas matemáticas simples,
como la media muestral o la proporción muestral, o métodos más complejos, como los
estimadores de máxima verosimilitud.
Los estimadores están sujetos a cierto grado de incertidumbre. Por lo tanto, los estimadores
pueden variar de una muestra a otra, y es necesario tener en cuenta el margen de error o
intervalos de confianza al interpretar los resultados.
1.3.- La inferencia estadística
La inferencia estadística es el proceso por el cual se obtienen conclusiones o
generalizaciones sobre una población a partir de la información limitada y parcial
proporcionada por una muestra. La inferencia estadística se basa en principios y métodos
estadísticos para hacer estimaciones, tomar decisiones y evaluar la incertidumbre asociada
a los resultados obtenidos.
En resumen, la inferencia estadística permite extrapolar y hacer generalizaciones sobre una
población en función de los datos recopilados en una muestra. Es una herramienta
fundamental en los estudios de mercado, la toma de decisiones y en muchas otras áreas en
las que es impracticable o poco factible estudiar o recopilar datos de toda la población de
interés.
Para realizar inferencias estadísticas, se utilizan métodos y técnicas como la estimación de
parámetros poblacionales, la prueba de hipótesis, la construcción de intervalos de confianza
y el análisis de regresión, entre otros. Estos métodos se basan en modelos estadísticos y
principios probabilísticos para cuantificar la incertidumbre asociada a los resultados y
obtener conclusiones válidas y confiables.
La inferencia estadística está sujeta a ciertas limitaciones y supuestos, es necesario tener
en cuenta la calidad de los datos y la validez de los modelos utilizados. Además, la
interpretación adecuada de los resultados de la inferencia estadística requiere comprender
los conceptos de margen de error, nivel de confianza y significancia estadística.
En resumen, la inferencia estadística es el proceso mediante el cual se realizan
conclusiones y generalizaciones sobre una población a partir de una muestra, utilizando
métodos y técnicas estadísticas. La inferencia estadística es esencial para sacar
conclusiones válidas y confiables a partir de datos limitados y proporciona una base sólida
para la toma de decisiones y la generación de conocimiento en diversas áreas.
La inferencia estadística es un proceso de estimación de los resultados válidos para una
población a partir de los resultados obtenidos en una muestra representativa de esa
población
2.- Etapas del proceso de muestreo.
El proceso de muestreo consta de varias etapas que se deben seguir para obtener una
muestra representativa de la población:
1. Definición del objetivo: En esta etapa, se establece claramente el objetivo de la
investigación o el estudio. Se define la población de interés y se identifican las
características y variables relevantes que se desean estudiar.
2. Determinación del tamaño de la muestra: Se determina el tamaño necesario de la
muestra para obtener resultados precisos y confiables. El tamaño de la muestra se basa en
consideraciones estadísticas y puede depender del nivel de confianza deseado, la
variabilidad de los datos y el margen de error aceptable.
3. Selección del método de muestreo: Se elige el método de muestreo más apropiado para
el estudio. La elección del método depende de las características de la población y los
recursos disponibles.
4. Construcción del marco muestral: Se crea o se obtiene el marco muestral, que es una
lista o fuente que contiene los elementos o individuos de la población. El marco muestral
sirve como base para seleccionar la muestra y debe ser lo más completo y actualizado
posible.
5. Selección de la muestra: Se selecciona la muestra según el método de muestreo elegido.
Esto implica aplicar procedimientos para garantizar que cada elemento o individuo tenga la
oportunidad de ser seleccionado y que la muestra sea representativa de la población.
6. Recopilación de datos: Una vez seleccionada la muestra, se lleva a cabo la recopilación
de datos. Esto puede implicar encuestas, entrevistas, observaciones u otras técnicas de
recolección de información, dependiendo de la naturaleza del estudio.
7. Análisis de datos: Una vez que los datos se han recopilado, se realiza el análisis
estadístico para obtener conclusiones y resultados. Se utilizan técnicas y métodos
estadísticos apropiados para analizar los datos de la muestra y hacer inferencias sobre la
población.
8. Interpretación y generalización de los resultados: Los resultados obtenidos de la muestra
se interpretan y se hacen generalizaciones sobre la población en su conjunto. Se deben
tener en cuenta los límites y las suposiciones asociadas al proceso de muestreo para
realizar inferencias válidas y confiables.
9. Elaboración del informe de los resultados con las conclusiones
Estas etapas del proceso de muestreo son fundamentales para garantizar que la muestra
sea representativa de la población y que los resultados obtenidos sean válidos y aplicables.
2.1.- Errores que se pueden cometer en una investigación comercial.
En una investigación comercial, pueden producirse errores que afecten la calidad y la
precisión de los resultados. Los tipos de errores que se pueden dar son el error muestral y
el error no muestral.
1. Error muestral: se refiere a las discrepancias o desviaciones entre los resultados
obtenidos a partir de la muestra y los resultados que se habrían obtenido si se hubiera
estudiado la población completa. Este error se debe a la variabilidad natural que existe al
seleccionar una muestra en lugar de estudiar toda la población. El error muestral puede ser
minimizado mediante la utilización de un tamaño de muestra adecuado y técnicas de
muestreo representativas.
2. Error no muestral: se refiere a los errores que no están relacionados con el muestreo,
sino con otras fuentes de error en el diseño, la recolección y el análisis de los datos. Estos
errores pueden incluir errores en la medición, sesgos de respuesta, errores de codificación
o entrada de datos, errores en el análisis de los datos, entre otros. El error no muestral
puede introducir sesgos o inexactitudes en los resultados y debe ser identificado y
controlado tanto como sea posible. No se producen en los muestreos no probabilísticos.
Tanto el error muestral como el error no muestral son inevitables en cierta medida, en
cualquier investigación comercial. Sin embargo, podemos tomar medidas para minimizarlos
y controlarlos, como por ejemplo el uso de métodos de muestreo adecuados, que
garanticen la calidad en la obtención de datos, aplicar técnicas de validación y verificación
de datos, utilizar instrumentos de medición confiables y asegurar un análisis cuidadoso de
los datos.
Al tener en cuenta estos errores y tomar medidas para controlarlos, se puede aumentar la
confiabilidad y la validez de los resultados de la investigación comercial, lo que permitirá
tomar decisiones más fundamentadas y precisas.
El error de muestreo será tanto menor cuanto mayor sea el tamaño de la muestra, cuanto
mayor sea el nivel de confianza y cuanto menor sea la dispersión de la población de la cual
se ha obtenido la muestra.
2.2.- Métodos de muestreo.
Existen diferentes procedimientos para desarrollar un proceso de muestreo y seleccionar los
elementos que deben integrar la muestra. En una primera clasificación, los métodos de
muestreo pueden ser "probabilísticos o aleatorios” y “no probabilísticos".
Los más utilizados son los siguientes:
Muestreo Probabilístico
● Aleatorio Simple.
● Muestreo Aleatorio Sistemático.
● Muestreo Aleatorio Estratificado.
● Muestreo por Conglomerados y por Áreas.
● Polietápico.
● Muestreo Aleatorio
● Muestreo por Ruta Aleatoria.
Muestreo No Probabilístico
● Muestreo de Conveniencia.
● Muestreo de Juicios.
● Muestreo por Cuotas.
● Muestreo intencional.
● Muestreo de Bola de Nieve.
Estas categorías se diferencian en cómo se seleccionan los elementos de la muestra y en la
capacidad de generalizar los resultados a la población en general.
Muestreo probabilístico: En él, todos los elementos de la población tienen una
probabilidad conocida y no nula de ser seleccionados para formar parte de la muestra. Esto
significa que cada elemento tiene una oportunidad justa y aleatoria de ser seleccionado. Los
métodos de muestreo probabilístico incluyen:
1.- Muestreo aleatorio simple: Cada elemento de la población tiene la misma probabilidad
de ser seleccionado.
2.- Muestreo Aleatorio sistemático:Se selecciona un primer elemento al azar y luego se
seleccionan los elementos siguientes según un patrón sistemático.
3.- Muestreo estratificado: La población se divide en subgrupos o estratos, y luego se
selecciona una muestra aleatoria simple de cada estrato.
4.-Muestreo por conglomerados: La población se divide en grupos más grandes o
conglomerados, y se seleccionan algunos de estos conglomerados al azar para formar la
muestra.
5.- Muestreo polietápico: consiste en realizar selecciones en múltiples etapas niveles.
6.- Muestreo por ruta aleatoria: se seleccionan muestras a lo largo de una ruta predefinida
de manera aleatoria.
El muestreo probabilístico permite calcular estimaciones precisas de los parámetros de la
población y generalizar los resultados de la muestra a la población en general, siempre que
la muestra sea representativa y correctamente seleccionada.
Muestreo no probabilístico: En el muestreo no probabilístico, los elementos de la
población no se seleccionan mediante un proceso de selección aleatorio. En este caso, la
probabilidad de selección de cada elemento no se conoce y no puede calcularse de manera
precisa. Los métodos de muestreo no probabilístico incluyen:
1.- Muestreo por conveniencia: Se seleccionan los elementos que son convenientes o
fácilmente accesibles para el investigador.
2.- Muestreo de juicios: Los elementos se seleccionan según el juicio y la experiencia del
investigador.
3.- Muestreo de bola de nieve: Se seleccionan algunos elementos de la muestra
inicialmente y luego se solicita a esos elementos que ayuden a identificar y reclutar a otros
participantes.
4.- Muestreo intencional: Los elementos se seleccionan intencionalmente para representar
ciertas características o tipos específicos de la población.
5.- Muestreo por cuotas: se establecen cuotas predeterminadas para ciertas características
de interés en la población.
El muestreo no probabilístico no permite generalizar los resultados a la población en
general, ya que la muestra puede estar sesgada y no representar de manera precisa a la
población objetivo. Sin embargo, puede ser útil en situaciones en las que es difícil o costoso
aplicar métodos probabilísticos de muestreo.
3.- El muestreo aleatorio o probabilístico.
Los métodos de muestreo probabilístico son aquellos en los que la selección de la muestra
se realiza de forma "aleatoria". Se basan en que cada elemento del universo o población
objeto de estudio tiene una probabilidad conocida de formar parte de la muestra.
Es decir, los componentes de la muestra se seleccionan al azar y entran a formar parte de
ella con independencia de la voluntad del investigador, no existe subjetividad en la elección.
Aunque no por eso la muestra así obtenida tenga que ser siempre, y en todo caso, más
representativa que la obtenida en los muestreos no probabilísticos.
Las muestras probabilísticas son aleatorias y se caracterizan porque en ellas «cada
elemento de la población tiene una probabilidad conocida y no nula de ser seleccionado».
Aunque no existe garantía de que los resultados obtenidos con un muestreo probabilístico
sean más exactos que los derivados de otro no probabilístico, sí permiten calcular el "error
muestral" o grado en el que el estimador muestral difiere del valor real del parámetro
poblacional. Asimismo, permiten conocer el nivel de confianza y la precisión de las
estimaciones que se hagan.
Dado que la distribución de probabilidad de los estimadores muestrales suele ser conocida,
en este tipo de muestras es posible realizar la inferencia estadística, trasladando los
resultados muestrales a la población. Para ello es necesario hacer las correspondientes
estimaciones a partir de los datos muestrales, para proceder después al cálculo de su
variabilidad y del error estándar.
Para que las muestras sean probabilísticas y reúnan las características que se requieren, se
han de seguir ciertas normas en el proceso de extracción de la muestra, que garanticen la
aleatoriedad prevista en el cálculo de probabilidades. Estas normas dan origen a los
siguientes métodos básicos de muestreo probabilístico:
✔ Muestreo aleatorio simple
✔ Muestreo aleatorio sistemático
✔ Muestreo aleatorio estratificado
✔ Muestreo por grupos o conglomerados.
✔ Muestreo aleatorio por áreas
✔ Muestreo aleatorio polietápico
✔ Muestreo de ruta aleatoria.
Los tres primeros métodos suelen ser monoetápicos, lo que significa que los elementos de
la muestra se eligen directamente en una sola etapa. Los tres últimos suelen ser
polietápicos, ya que la selección de los elementos de la muestra definitiva se desarrolla en
varias fases.
4.- Muestreo aleatorio simple.
El muestreo aleatorio simple es una técnica en la cual cada elemento de la población tiene
la misma probabilidad de ser seleccionado para formar parte de la muestra.
El proceso de muestreo aleatorio simple se realiza en varias etapas:
1. Definir la población objetivo: Se establece claramente la población que se desea estudiar.
Por ejemplo, si se quiere investigar las preferencias de los consumidores de una ciudad, la
población podría ser todos los residentes de esa ciudad.
2. Asignar un número de identificación: A cada elemento de la población se le asigna un
número único que lo identifica de manera exclusiva. Por ejemplo, se pueden asignar
números a cada residente de la ciudad.
3. Determinar el tamaño de la muestra: Se decide el tamaño deseado de la muestra, es
decir, el número de elementos que se seleccionarán para formar parte de ella. El tamaño de
la muestra se basa en consideraciones estadísticas y prácticas.
4. Generar números aleatorios: Se utilizan tablas de números aleatorios o generadores de
números aleatorios para seleccionar los elementos de la muestra. Estos números aleatorios
se corresponden con los números de identificación asignados a los elementos de la
población.
5. Seleccionar la muestra: Se eligen los elementos correspondientes a los números
generados. Estos elementos seleccionados forman la muestra final.
El muestreo aleatorio simple tiene sus ventajas y sus inconvenientes.
Ventajas, garantiza que cada persona tenga la misma probabilidad de ser seleccionada, lo
que reduce el sesgo y permite realizar extrapolar los datos sobre la población en general.
Inconvenientes, la calidad de los resultados obtenidos mediante el muestreo aleatorio
simple depende de la representatividad de la muestra y de si se ha seguido correctamente
el proceso de selección aleatoria.
Supongamos que queremos realizar un estudio sobre la satisfacción de los empleados en
una empresa con 500 empleados. Para llevar a cabo el muestreo aleatorio simple,
seguimos los siguientes pasos:
1. Asignamos un número único a cada empleado de la empresa, desde el 1 hasta el 500.
2. Utilizamos un generador de números aleatorios para seleccionar al azar un número entre
1 y 500. Supongamos que obtenemos el número 275.
3. Seleccionamos al empleado número 275 de la lista y lo incluimos en nuestra muestra.
4. Repetimos los pasos 2 y 3 para seleccionar el resto de los empleados de la muestra. Por
ejemplo, si queremos una muestra de tamaño 50, repetimos los pasos hasta obtener 50
empleados seleccionados al azar.
Al finalizar estos pasos, tendremos una muestra de empleados seleccionados de manera
aleatoria y representativa de la población total de la empresa. Cada empleado tiene la
misma probabilidad de ser seleccionado, lo que nos permite generalizar los resultados
obtenidos en la muestra a toda la población de empleados.
El muestreo aleatorio simple presenta el inconveniente de que para su aplicación se
requiere disponer de un censo o lista exhaustiva de todas las unidades muestrales, para
poder seleccionar la muestra.
5.- Muestreo aleatorio sistemático.
El muestreo aleatorio sistemático o con "arranque sistemático", es similar al anterior, del
que difiere, fundamentalmente, por la forma de selección de los elementos muestrales.
Cada elemento de la población tiene una probabilidad igual y conocida de formar parte de la
muestra.
Al igual que en el muestreo aleatorio simple, también se necesita un listado completo de los
"N" elementos que componen la población, a los cuales se les asigna un número, y saber el
tamaño que ha de tener la muestra (n), para proceder a la selección.
Se calcula la proporción "N/n" o "coeficiente de elevación" y se procede a la selección
aleatoria del primer integrante de la muestra. A partir de aquí, los demás componentes se
van obteniendo sumando al anterior, el importe del coeficiente de elevación (N/n) y
repitiendo la operación hasta completar el tamaño total de la muestra. Se denomina
aleatorio sistemático porque el primer elemento de la muestra se selecciona al azar,
mientras que los (n-1) componentes restantes son seleccionados de forma sistemática.
Es decir, calculado el coeficiente de elevación (N/n), se elige al azar un número no superior
al mismo, que es el que indica el "punto de arranque" de la selección, que permite la
selección del primer elemento. A partir de aquí, al número elegido se le suma repetidamente
el coeficiente de elevación, dando lugar a los (n-1) números que pasan a formar parte de la
muestra.
Ejemplo: Suponemos una población de 160.000 médicos (N), de la que se desea extraer
una muestra de 1.280 elementos (n), el coeficiente de elevación será:
Suponiendo que el primer número obtenido al azar, no superior a 125, sea el 28. La
selección de los elementos de la muestra será: 28; 28+125=153; 153+125-278,
278+125=403; 403+125-528; y así sucesivamente, hasta completar los "n" elementos de la
muestra.
Este tipo de muestreo simplifica bastante la selección. Es un método sencillo y fácil de
aplicar y menos costoso que otros muestreos aleatorios, sólo se realiza la primera selección
al azar y a partir de aquí el proceso es automático. Además, este método de reparto de los
componentes de la muestra contribuye a evitar que esté compuesta únicamente por valores
extremos.
Sin embargo, esto no es siempre cierto y existe el riesgo de introducir sesgos en la muestra
al elegir los elementos de forma periódica y obtener una muestra que no sea representativa
de la heterogeneidad de la población. Esto ocurriría cuando el listado de los elementos de la
población está ordenado con algún criterio que suponga que se repitan ciertas
características con la misma periodicidad. Por ejemplo: la selección sistemática de una
muestra sobre un listado de individuos formado por grupos de 20 personas ordenadas,
siendo los 10 primeros varones y las 10 últimas mujeres: Si el coeficiente de elevación
fuese 20, se seleccionarán solo hombres o solo mujeres, no sería posible que en la muestra
estuvieran representados ambos sexos.
Para evitar este riesgo, habría que preparar la selección de los elementos de la muestra y,
si fuera necesario, desordenarlo. Una técnica utilizada con frecuencia, cuando se realizan
muestreos sistemáticos a partir de ficheros de individuos, podría ser romper el orden inicial
del fichero (alfabético, de antigüedad, etc.), utilizando un criterio como, por ejemplo, las 6
últimas cifras del DNI de los individuos que componen la población, ordenadas al revés. Así,
el número del DNI 71.160.823 se quedaría en 160.823 y el ordenado al revés sería 328.061.
A partir de aquí, se procedería a ordenar toda la población y a la aplicación del muestreo
sistemático.
6.- Muestreo aleatorio estratificado.
En el muestreo aleatorio simple todos los componentes de la población tienen la misma
probabilidad de pertenecer a la muestra, lo cual es muy conveniente en muchas ocasiones,
mientras que en otras no es lo mejor: Si se conoce la existencia de diversos grupos o
"estratos" de características distintas en la población objetivo, puede ser adecuado
mantener de forma estricta la representación de esos grupos en la muestra.
Es frecuente que una población esté compuesta por subconjuntos, grupos o estratos,
formados por elementos que tienen en común ciertas características. El muestreo aleatorio
estratificado se basa, precisamente, en contemplar esta diversidad en la selección de la
muestra, de modo que la muestra obtenida contenga elementos representativos de todos
los grupos o estratos que integran la población.
El muestreo estratificado se basa en la partición o fraccionamiento de la población objeto de
estudio en subgrupos o estratos mutuamente excluyentes y homogéneos en sí mismos, de
forma que, cada elemento o unidad de la población pertenece a un solo estrato, y el
conjunto de estratos o subgrupos constituyen la población total sobre la que opera el
proceso de muestreo.
La forma de operar para seleccionar la muestra en este tipo de muestreo es:
1. Se identifican las características o variables de la población que se consideran relevantes
para identificar los estratos, que permitan obtener subconjuntos homogéneos de la
población, que tengan interés para la investigación y que no impliquen un coste elevado del
proceso de estratificación. Por ejemplo, se puede dividir una población en grupos, por
edades, por sexos, por cifra de ingresos, por profesiones, o en consumidores y no
consumidores de un producto, en trabajadores y desempleados, según el voto emitido a
favor de un partido u otro, etc.
2. Se procede a la estratificación, con arreglo a esas variables de clasificación: Se divide la
población (N) en una serie de subconjuntos o estratos que han de ser mutuamente
excluyentes y colectivamente exhaustivos (N1, N2, N3, ...). Cualquier elemento debe
pertenecer a uno y sólo a uno de los estratos. El tamaño de los estratos debe ser suficiente
para que su estudio resulte interesante, y su número no debe ser muy elevado, porque
complica y encarece el proceso de muestreo y de recogida y análisis de los datos. En
cualquier caso, la suma de todos los estratos debe ser igual al tamaño total de la población
(N)
3. Selección aleatoria de la muestra en cada uno de los estratos, de forma similar al
muestreo aleatorio simple. Para ello, se necesita disponer de una relación de los
componentes de cada estrato, para extraer aleatoriamente los elementos que corresponden
a cada uno de ellos. Normalmente, se calcula el tamaño total de la muestra (n) según el
muestreo aleatorio simple y una vez determinado el valor de “n”, se procede a la distribución
de la muestra entre los distintos estratos identificados (n1, n2, n3, n4, ...). Este proceso
recibe el nombre de " afijación" de la muestra.
Finalmente, se seleccionan los n1 elementos para la muestra del estrato N1; los n2
elementos muestrales del estrato N2; los n3 elementos del estrato N3, y así sucesivamente,
hasta completar la muestra.
6.1.- Afijación de la muestra en el muestreo estratificado.
La afijación es el proceso de selección de las unidades de muestreo dentro de una
población para formar una muestra representativa. La selección de la muestra ha de reflejar
las características de la población.
En el muestreo estratificado, la población se divide en grupos homogéneos llamados
estratos, para posteriormente seleccionar una muestra en cada estrato (muestra
representativa).
El proceso de afijación de la muestra implica determinar el tamaño de la muestra que se
seleccionará en cada estrato, así como el método específico de selección de las unidades
de muestreo. La afijación puede basarse en diferentes criterios, como el tamaño relativo de
cada estrato en la población, la variabilidad dentro de cada estrato o la importancia relativa
de cada estrato en la estimación de los parámetros de interés.
Existen diferentes métodos para la afijación de la muestra en el muestreo estratificado,
algunos de los cuales incluyen la afijación proporcional y la afijación simple.
En la afijación proporcional, el tamaño de la muestra en cada estrato se determina en
proporción al tamaño relativo del estrato en la población.
En la afijación simple, se asigna el mismo tamaño de muestra tamaño de muestra a cada
estrato, independientemente de su tamaño relativo.
La afijación de la muestra en el muestreo estratificado es fundamental para garantizar que
la muestra obtenida sea representativa de la población objetivo y que los estimadores
basados en la muestra sean precisos y confiables.
Supongamos que queremos realizar un estudio sobre la calidad del servicio en un centro
comercial con tres departamentos: Moda, Electrónica y Alimentos. Queremos asegurarnos
de tener una muestra representativa de cada departamento. Para llevar a cabo el muestreo
estratificado con afijación proporcional, seguimos los siguientes pasos:
1. Identificamos los tres departamentos como nuestros estratos: Moda, Electrónica y
Alimentos.
2. Determinamos el tamaño de la muestra que queremos obtener para cada estrato en
proporción a su tamaño relativo en la población total. Por ejemplo, supongamos que la
población total del centro comercial es de 1000 clientes, de los cuales el 40% pertenece al
departamento de Moda, el 30% al departamento de Electrónica y el 30% al departamento
de Alimentos. Si queremos una muestra de tamaño 100, asignamos 40 clientes al estrato de
Moda, 30 clientes al estrato de Electrónica y 30 clientes al estrato de Alimentos.
3. Utilizamos un método de afijación proporcional dentro de cada estrato para seleccionar
los elementos de la muestra. Por ejemplo, si el departamento de Moda tiene 200 clientes en
la población total, asignamos una probabilidad de selección de 0.2 a cada cliente de Moda,
y seleccionamos al azar 40 clientes de acuerdo con estas probabilidades. Repetimos este
proceso para los otros dos estratos.
Al finalizar estos pasos, tendremos una muestra estratificada de clientes seleccionados de
manera aleatoria dentro de cada departamento, con un tamaño proporcional a su
importancia en la población total del centro comercial. Esto nos permitirá obtener una
muestra representativa de la calidad del servicio en cada departamento por separado.
6.2.- Ventajas e inconvenientes del muestreo estratificado.
El muestreo estratificado es una técnica utilizada en la investigación y en la recopilación de
datos, que implica la división de la población en subgrupos homogéneos llamados estratos.
Cada estrato se selecciona de forma independiente y se obtiene una muestra de cada uno
de ellos. Esta técnica tiene ventajas e inconvenientes que es importante tener en cuenta al
momento de diseñar un estudio de muestreo.
Ventajas del muestreo estratificado:
● Precisión: Al dividir la población en estratos y seleccionar muestras dentro de cada
estrato, se obtiene una muestra que representa de manera más precisa las
características de la población en comparación con otros métodos de muestreo. Esto
implica estimaciones más precisas...
● Eficiencia: El muestreo estratificado puede ser más eficiente que otros métodos de
muestreo al permitir una asignación óptima del tamaño de muestra a cada estrato. El
muestreo estratificado permite obtener estimaciones precisas con un tamaño de
muestra menor en comparación con un muestreo aleatorio simple.
● Representatividad: Al seleccionar muestras dentro de cada estrato, se asegura que
todas las características de la población estén representadas en la muestra.
Inconvenientes:
● Diseño complejo: El muestreo estratificado requiere un conocimiento previo de la
población y una clasificación adecuada en estratos. Esto implica un mayor esfuerzo
en la planificación y diseño del estudio, así como la necesidad de información
adicional para definir los estratos de manera adecuada.
● Sesgo de selección: Si los estratos no se definen correctamente o si la información
utilizada para clasificar en estratos es incorrecta o incompleta, pueden introducirse
sesgos en la muestra seleccionada y afectar la representatividad de los resultados.
● Coste y tiempo: En comparación con otros métodos de muestreo, el muestreo
estratificado puede requerir más tiempo, esfuerzo y recursos para llevar a cabo la
clasificación en estratos y seleccionar muestras dentro de cada estrato.
7.- Muestreo aleatorio por conglomerados y por áreas.
El muestreo aleatorio por conglomerados es un método en el que la población se divide en
grupos o conglomerados naturales que comparten características similares. Estos
conglomerados pueden ser, por ejemplo, escuelas, empresas, comunidades o regiones
geográficas. Luego, se seleccionan aleatoriamente algunos de estos conglomerados y se
recopila información de todos los individuos dentro de los conglomerados seleccionados.
Este método es útil cuando los conglomerados son heterogéneos internamente, pero son
similares entre sí.
Ejemplo de muestreo por conglomerados:
Queremos realizar un estudio sobre la satisfacción de los empleados en una ciudad
determinada. La población objetivo es el conjunto de todas las empresas ubicadas en esa
ciudad.
Para realizar el muestreo, podríamos seguir los siguientes pasos:
1. Identificación de conglomerados: Primero, identificamos los conglomerados naturales
dentro de la población, que en este caso serían las empresas. Supongamos que hay un
total de 500 empresas en la ciudad.
2. Selección de conglomerados: A continuación, seleccionamos aleatoriamente un número
determinado de conglomerados para formar nuestra muestra. Por ejemplo, podríamos
seleccionar al azar 50 empresas como conglomerados de nuestra muestra.
3. Recopilación de datos: Una vez seleccionados los conglomerados, recopilamos
información sobre la satisfacción de los empleados dentro de cada una de las empresas
seleccionadas (vía encuestas, entrevistas u otros métodos de obtención de datos).
4. Análisis de datos: Finalmente, analizamos los datos recopilados en los conglomerados
seleccionados para obtener medidas de satisfacción de los empleados.
Ventajas del muestreo aleatorio por conglomerados:
1. Eficiencia: Permite reducir el tamaño de la muestra al seleccionar solo a algunos
conglomerados en lugar de todos los individuos dentro de la población. Esto puede ahorrar
tiempo y recursos en comparación con un muestreo aleatorio simple.
2. En poblaciones grandes y dispersas geográficamente, puede ser más práctico y rentable
seleccionar conglomerados en lugar de intentar acceder a todos los individuos.
3. Representatividad: Si los conglomerados se seleccionan de manera adecuada y
representativa, el muestreo por conglomerados puede proporcionar estimaciones precisas
Inconvenientes del muestreo aleatorio por conglomerados:
1. Mayor variabilidad: Debido a la agrupación de los individuos dentro de los
conglomerados, puede haber una mayor variabilidad en las respuestas o mediciones
obtenidas de la muestra en comparación con un muestreo aleatorio simple.
2. Menor de precisión: En comparación con un muestreo aleatorio simple, puede requerir un
tamaño de muestra más grande para lograr la misma precisión en las estimaciones de la
población.
3. Sesgo de selección: Si los conglomerados no se seleccionan de manera adecuada o
representativa, puede haber un sesgo en las estimaciones obtenidas de la muestra, lo que
puede afectar la validez de las conclusiones.
El muestreo "por conglomerados" es un método de muestreo en el que la unidad muestral
no es un individuo o elemento de la población, sino un grupo o conjunto de individuos que,
en ciertos aspectos, se puede considerar que forman una unidad. Cada uno de estos
grupos se denomina "conglomerado".
El muestreo aleatorio por áreas también implica dividir la población en áreas más
pequeñas, pero en este caso, las áreas no necesariamente tienen que ser conglomerados
naturales. Las áreas pueden ser, por ejemplo, bloques de viviendas, cuadras o secciones
geográficas. Luego, se seleccionan aleatoriamente algunas de estas áreas y se recopila
información de todos los individuos dentro de las áreas seleccionadas. Este método es útil
cuando no hay una estructura de conglomerados claramente definida en la población o
cuando los conglomerados son muy grandes.
Tanto el muestreo aleatorio por conglomerados como el muestreo aleatorio por áreas son
métodos eficientes para reducir el tamaño de la muestra y facilitar la recopilación de datos
en estudios de investigación o encuestas. Al seleccionar aleatoriamente los conglomerados
o áreas, se busca obtener una muestra representativa de la población en estudio, lo que
permite hacer inferencias válidas sobre la población más amplia a partir de los datos
recopilados en la muestra.
Ventajas del muestreo aleatorio por áreas:
1. Eficiencia y factibilidad: Al seleccionar áreas en lugar de individuos, se puede reducir el
esfuerzo y los recursos necesarios para acceder a la población y recopilar los datos.
2. Muestreo geográfico: Si se desea hacer inferencias sobre características geográficas, el
muestreo por áreas permite una representación más precisa de esas características al
seleccionar áreas geográficas específicas.
Inconvenientes del muestreo aleatorio por áreas:
1. Mayor variabilidad: Al agrupar individuos dentro de áreas, puede haber una mayor
variabilidad en las respuestas o mediciones obtenidas de la muestra en comparación con un
muestreo aleatorio simple.
2. Sesgo de selección: Si las áreas no se seleccionan de manera adecuada o
representativa, puede haber un sesgo en las estimaciones obtenidas de la muestra, lo que
puede afectar la validez de las conclusiones.
3. Pérdida de precisión: En comparación con un muestreo aleatorio simple, puede requerir
un tamaño de muestra más grande para lograr la misma precisión en las estimaciones de la
población.
Ejemplo de muestreo aleatorio por áreas:
Supongamos que deseamos investigar la satisfacción de los clientes en una cadena de
tiendas minoristas que opera en diferentes ciudades. Para realizar el muestreo aleatorio por
áreas, seguiríamos los siguientes pasos:
1. Definir las áreas: Identificamos las diferentes áreas geográficas relevantes para nuestro
estudio. En este caso, podríamos considerar las ciudades donde se encuentran las tiendas
minoristas.
2. Determinar el tamaño de la muestra: Establecemos el tamaño de muestra deseado, es
decir, la cantidad de tiendas que queremos incluir en nuestro estudio. Por ejemplo,
podríamos decidir seleccionar 10 tiendas.
3. Asignar la muestra a cada área: Calculamos el número de tiendas que debemos
seleccionar en cada área proporcionalmente al tamaño de la población de cada ciudad. Esto
se puede hacer utilizando una fórmula de proporción. Por ejemplo, si hay un total de 100
tiendas y una ciudad tiene 20 tiendas, el 20% de la muestra debería provenir de esa ciudad,
lo que implicaría seleccionar 2 tiendas de esa área.
4. Seleccionar las unidades de muestreo: Utilizando algún método aleatorio, como por
ejemplo un generador de números aleatorios, seleccionamos las tiendas específicas dentro
de cada área. Podemos asignar un número a cada tienda y luego seleccionar al azar los
números correspondientes al tamaño de muestra deseado en cada área.
5. Realizar el estudio: Una vez que se han seleccionado las tiendas de cada área, podemos
llevar a cabo nuestro estudio de satisfacción del cliente, por ejemplo, aplicando encuestas a
los clientes de las tiendas seleccionadas.
Este es solo un ejemplo simplificado de cómo se podría realizar el muestreo aleatorio por
áreas. En la práctica, pueden existir consideraciones adicionales, como la estratificación de
las áreas según ciertas características relevantes para el estudio. Además, es importante
asegurarse de que el proceso de selección sea verdaderamente aleatorio para obtener una
muestra representativa de la población objetivo.
8.- Muestreo polietápico.
El muestreo polietápico es un método de selección de muestras que implica varias etapas o
niveles de selección. En el muestreo polietápico se seleccionan primero, grupos o
conglomerados grandes y luego se seleccionan subgrupos o unidades más pequeñas
dentro de esos conglomerados.
Un diseño de muestreo polietápico tendría estas fases:
1. División en conglomerados: Primero, se divide la población en conglomerados más
grandes. Por ejemplo, si estamos realizando un estudio de salud en un país, los
conglomerados podrían ser provincias o estados.
2. Selección de conglomerados: A continuación, se seleccionan aleatoriamente algunos
conglomerados de la población total. Por ejemplo, podríamos seleccionar 5 provincias al
azar.
3. División en subgrupos: Dentro de cada conglomerado seleccionado, se divide en
subgrupos más pequeños. Por ejemplo, las provincias seleccionadas se dividen en distritos.
4. Selección de subgrupos: Luego, se seleccionan aleatoriamente algunos subgrupos dentro
de cada conglomerado seleccionado. Por ejemplo, podríamos seleccionar 3 distritos al azar
dentro de cada provincia seleccionada.
5. Selección de unidades de muestreo: Finalmente, se seleccionan aleatoriamente unidades
de muestreo individuales dentro de cada subgrupo seleccionado. Por ejemplo, podríamos
seleccionar 20 hogares al azar dentro de cada distrito seleccionado.
El muestreo polietápico permite simplificar y reducir el coste de la selección de la muestra al
seleccionar grupos más grandes en las primeras etapas. Además, permite capturar la
variabilidad tanto entre los conglomerados como dentro de ellos.
Con el muestreo polietápico, podemos (sin desearlo) introducir un sesgo de selección si los
conglomerados o subgrupos no se seleccionan de manera representativa o si hay una
correlación fuerte entre las unidades de muestreo dentro de los conglomerados.
Ejemplo:
Supongamos que deseamos realizar un estudio sobre la calidad del agua en un país con
varias regiones geográficas. Queremos obtener una muestra representativa de la población
total de manera eficiente y precisa.
Primera etapa: selección de las regiones.
En esta etapa, seleccionamos al azar un número determinado de regiones geográficas para
incluir en nuestra muestra. Por ejemplo, si el país tiene 10 regiones, podemos seleccionar
aleatoriamente 3 de ellas.
Segunda etapa: selección de las áreas dentro de cada región.
Una vez seleccionadas las regiones, elegimos al azar un número de áreas o distritos dentro
de cada región. Por ejemplo, si cada región tiene 5 áreas, seleccionamos 2 áreas de cada
región para un total de 6 áreas.
Tercera etapa: selección de las unidades de muestreo dentro de cada área.
Finalmente, dentro de cada área seleccionada, elegimos al azar las unidades de muestreo,
que podrían ser hogares o pozos de agua, dependiendo del objetivo del estudio. Por
ejemplo, si en cada área hay 100 hogares, podemos seleccionar aleatoriamente 20 hogares
de cada área, lo que nos daría un total de 120 hogares seleccionados en toda la muestra.
El muestreo polietápico nos permite obtener una muestra representativa de la población, ya
que hemos tenido en cuenta las diferentes regiones geográficas y estratos dentro de cada
región. Además, este enfoque es más eficiente en términos de costos y tiempo, ya que no
tenemos que encuestar a todas las unidades de la población total.
9.- Muestreo por ruta aleatoria o "random route".
El muestreo por ruta aleatoria, "random route", es un método de selección de muestras
utilizado en investigaciones de campo o estudios de observación. En este método, se
selecciona una ruta aleatoria en un área geográfica determinada y se recopilan datos de
todos los individuos o puntos de interés que se encuentran en esa ruta.
El muestreo por ruta aleatoria tiene la ventaja de ser un método simple y eficiente para
recopilar datos de manera sistemática en áreas geográficas. Proporciona una cobertura
más representativa de la población objetivo que otros métodos de selección no aleatoria.
Sin embargo, es importante tener en cuenta que este método puede estar sujeto a sesgos
de selección, ya que solo se recopilan datos a lo largo de la ruta específica seleccionada y
pueden excluir áreas o individuos fuera de esa ruta.
Para poder llevar a cabo este método se usan determinados materiales:
● La Hoja de Ruta: indica dónde ha de situarse el entrevistador y de qué manera y
lugares ha de moverse.
● La tablilla de selección aleatoria: Es una tabla donde se indican el número de plantas
por edificios, viviendas por planta, etc.
● Las normas de sustitución: Entre estas normas está como actuar cuando el
entrevistado no se encuentra en el domicilio o no desea contestar.
Ventajas del muestreo por ruta aleatoria:
1. Eficiencia: Permite recopilar datos de manera sistemática y eficiente, ahorrando tiempo y
recursos.
2. Cobertura geográfica: Al seguir una ruta aleatoria, el muestreo por ruta aleatoria puede
proporcionar una cobertura más representativa de un área geográfica específica en
comparación con otros métodos de selección no aleatoria.
3. Menor sesgo de selección: En comparación con métodos de selección no aleatoria, el
muestreo por ruta aleatoria reduce el sesgo de selección, ya que se recopilan datos de
todos los individuos o puntos de interés encontrados a lo largo de la ruta.
Inconvenientes del muestreo por ruta aleatoria:
1. Sesgo de ruta: Existe la posibilidad de que la ruta aleatoria seleccionada no represente
adecuadamente la variabilidad de la población objetivo.
2. Sesgo de ubicación: Si la ruta aleatoria pasa por áreas específicas con características
particulares (por ejemplo, áreas más urbanas o rurales), puede haber un sesgo en los
resultados obtenidos debido a la selección de ubicaciones.
3. Limitación en la diversidad de la muestra: Dado que el muestreo por ruta aleatoria se
basa en una ruta específica, puede haber áreas o individuos que quedan excluidos de la
muestra si no están ubicados a lo largo de esa ruta.
10.- Muestreos no probabilísticos.
A diferencia de los muestreos probabilísticos, en los que cada elemento de la población
tiene una probabilidad conocida y no nula de ser seleccionado, en los muestreos no
probabilísticos la selección de las unidades de muestreo se realiza de manera subjetiva o
basada en criterios no aleatorios.
Existen diferentes tipos de muestreos no probabilísticos:
1. Muestreo por conveniencia: Se seleccionan unidades de muestreo que son
convenientes o fáciles de acceder. Esto puede implicar seleccionar individuos o
elementos disponibles en un momento o lugar determinado, lo que puede no
representar adecuadamente la población objetivo.
2. Muestreo en bola de nieve: En este método, los participantes iniciales de la
muestra son reclutados a través de contactos previos y luego se les pide que
identifiquen y recluten a otros participantes que cumplan con ciertos criterios de
interés para el estudio. Es un método de selección de muestras utilizado en
situaciones en las que es difícil acceder directamente a los miembros de una
población objetivo. Este tipo de muestreo puede introducir sesgos de selección, ya
que los participantes reclutados pueden tener características particulares que no
sean representativas de la población objetivo en general..
3. Muestreo por juicio: Las unidades de muestreo se seleccionan en función del juicio
o criterio del investigador. Esto implica que el investigador utiliza su conocimiento o
experiencia para seleccionar unidades de muestreo que considere representativas o
relevantes para el estudio.
4. Muestreo por cuotas: Las unidades de muestreo se seleccionan para cumplir con
ciertas cuotas preestablecidas en función de características específicas, como edad,
género o nivel educativo. Sin embargo, este método no garantiza la
representatividad de la muestra y puede estar sesgado si las cuotas no se
establecen adecuadamente.
Los muestreos no probabilísticos no permiten generalizar los resultados obtenidos de la
muestra a la población en general. Estos métodos se utilizan cuando es difícil o costoso
realizar un muestreo probabilístico. Sin embargo, los resultados de los estudios basados en
muestreos no probabilísticos deben interpretarse con cautela, ya que pueden estar
sesgados y no representar adecuadamente la realidad de la población.
10.1.- Muestreo por cuotas.
Con el muestreo por cuotas, se pretende construir un modelo de muestra a escala de la
población objeto de estudio, manteniendo las mismas proporciones que se observan en la
población que se intenta estudiar a partir del conocimiento previo que tiene de la misma el
investigador.
El muestreo por cuotas es utilizado cuando no es factible o práctico realizar un muestreo
probabilístico, como en estudios basados en entrevistas cara a cara o encuestas
telefónicas. Aunque este método puede garantizar una representación equitativa de ciertas
características en la muestra, es importante tener en cuenta que la selección de los
participantes no es aleatoria y, por lo tanto, puede introducir sesgos de selección. Además,
la generalización de los resultados obtenidos de una muestra por cuotas a la población en
general puede ser limitada, ya que la muestra no es probabilística.
El muestreo por cuotas es una técnica muy utilizada en estudios de mercado, opinión
pública y encuestas de opinión; Un muestreo por cuotas tendría los siguientes pasos:
1. Definición de las cuotas: Se establecen cuotas basadas en características o variables
específicas de interés en la población objetivo.
2. Selección de participantes: Seleccionar a los participantes que cumplan con las cuotas
establecidas.
3. Registro de información: Se registra la información relevante de los participantes
seleccionados, como edad, género, nivel educativo, etc.
4. Control de cuotas: A medida que se seleccionan participantes, se verifica que se cumplan
las cuotas establecidas para cada característica o variable de interés.
Veamos las ventajas y los inconvenientes
Ventajas del muestreo por cuotas:
1. Eficiencia en la recopilación de datos: El muestreo por cuotas permite recopilar datos de
manera rápida y relativamente económica, ya que no requiere de un marco muestral
completo ni de un proceso de selección aleatoria.
2. Representatividad de ciertas características: Al establecer cuotas en función de variables
relevantes (como la edad, el género, la ubicación geográfica, etc.), se busca garantizar que
la muestra refleje de manera proporcional las características demográficas de la población
objetivo.
3. Facilidad de realizar: Este método es relativamente sencillo de aplicar, ya que solo
implica establecer las cuotas requeridas y seleccionar a los participantes que cumplan con
esas características específicas.
Inconvenientes:
1. Sesgo en la selección: Existe el riesgo de que, al seleccionar a los participantes según
las cuotas establecidas, se introduzca un sesgo en la muestra.
2. Ausencia de aleatoriedad: A diferencia del muestreo aleatorio, el muestreo por cuotas no
permite calcular fácilmente los márgenes de error y los niveles de confianza estadística, ya
que no se basa en una selección aleatoria de la muestra.
3. Falta de generalización: Debido al sesgo y a la ausencia de aleatoriedad, los resultados
obtenidos a partir de una muestra por cuotas pueden no ser generalizables a la población
total.
El muestreo por cuotas es una técnica utilizada para obtener una muestra representativa de
una población, asegurando que ciertas características están representadas en proporciones
específicas en la muestra. Aquí tienes un ejemplo simplificado de cómo se podría realizar
un muestreo por cuotas:
Supongamos que deseas realizar un estudio sobre las preferencias de sabor de helado en
una ciudad. Quieres asegurarte de que la muestra refleja las proporciones de género y
grupos de edad en la población de la ciudad. Para ello, decides utilizar el muestreo por
cuotas de la siguiente manera:
1. Definir las cuotas: Con base en datos demográficos de la ciudad, determinar las
proporciones de género y grupos de edad que deseas representar en la muestra. Por
ejemplo, supongamos que quieres tener un 50% de hombres y un 50% de mujeres, y que
deseas que el 30% de la muestra sean jóvenes de 18 a 25 años, el 40% sean adultos de 26
a 40 años y el 30% sean adultos mayores de 41 años en adelante.
2. Selección de participantes: Utilizan diferentes métodos para seleccionar a los
participantes que cumplan con las cuotas establecidas. Puedes realizar entrevistas o
encuestas en lugares estratégicos de la ciudad, como parques o centros comerciales, y
seleccionar a las personas para la muestra en función de su género y edad.
3. Llenar las cuotas: Mientras recolectas datos, te aseguras de que se cumplan las cuotas
establecidas. Por ejemplo, si ya has alcanzado el número requerido de hombres jóvenes,
pero aún necesitas más mujeres jóvenes, te enfocas en seleccionar mujeres jóvenes para
llenar esa cuota.
4. Recopilación de datos: Una vez que hayas alcanzado las cuotas deseadas, puedes
realizar las entrevistas o encuestas para recopilar los datos sobre las preferencias de sabor
de helado. Puedes utilizar preguntas estructuradas o dar opciones de respuesta
predefinidas para facilitar el análisis posterior.
Este ejemplo muestra cómo el muestreo por cuotas puede ayudar a garantizar que ciertas
características están representadas en proporciones específicas en la muestra. Sin
embargo, es importante tener en cuenta que el muestreo por cuotas puede tener
limitaciones, como el sesgo de selección si no se logra reclutar participantes que cumplan
exactamente con las cuotas establecidas. Por tanto, es recomendable combinarlo con otros
métodos de muestreo y tener precaución al interpretar los resultados.
10.2.- Otros tipos de muestreo.
1. El muestreo de bola de nieve, es una técnica utilizada cuando se busca acceder a
una población o grupo de interés que es difícil de alcanzar o está poco
documentado.
Ventajas del muestreo de bola de nieve:
1. Acceso a poblaciones difíciles de alcanzar: Esta técnica es especialmente útil cuando se
investigan grupos o comunidades que son poco conocidos o tienen características
específicas que dificultan su identificación y acceso.
2. Ampliación de la muestra: Con el muestreo de bola de nieve, la muestra inicial puede
aumentar gradualmente a medida que se van incorporando nuevos participantes a través de
las referencias.
3. Obtención de información en profundidad: Al utilizar participantes que ya están
familiarizados con el tema de estudio, es más probable que se obtenga información rica y
en profundidad.
Inconvenientes del muestreo de bola de nieve:
1. Sesgo de selección: Existe un riesgo inherente de sesgo en el proceso de selección, ya
que los participantes iniciales pueden tener ciertas características o conexiones particulares
que pueden influir en las características de los participantes que se reclutan posteriormente.
2. Falta de control: El investigador tiene menos control sobre la composición final de la
muestra,.
3. Dificultad para calcular el margen de error: Dado que el muestreo de bola de nieve no
sigue un proceso de selección aleatoria, puede ser difícil calcular el margen de error y la
precisión de los resultados obtenidos. Esto limita la capacidad de hacer inferencias
estadísticas sólidas.
2. El muestreo por juicio es una técnica de muestreo no probabilístico en la que los
participantes son seleccionados por criterio subjetivo y conocimiento experto del
investigador. En lugar de utilizar un método de selección aleatoria, el investigador
elige deliberadamente a los participantes que considera representativos o relevantes
para el estudio.
Ventajas del muestreo por juicio:
1. Eficiencia en la selección: El muestreo por juicio permite una selección rápida y eficiente
de los participantes, ya que se basa en el conocimiento y criterio del investigador.
2. Acceso a información especializada: Al utilizar el juicio de expertos o individuos con
conocimientos profundos sobre el tema de investigación, es más probable obtener
información detallada y de alta calidad.
3. Flexibilidad en la selección: El muestreo por juicio permite adaptar la selección de
participantes a los objetivos y alcance específicos del estudio.
Inconvenientes del muestreo por juicio:
1. Sesgo de selección: La selección subjetiva realizada por el investigador puede introducir
sesgos en la muestra, ya que su criterio personal puede estar influenciado por prejuicios o
suposiciones.
2. Falta de aleatoriedad: Al no utilizar un método de selección aleatoria, no se puede
calcular el margen de error ni establecer conclusiones estadísticamente precisas sobre la
población objetivo. Esto puede limitar la validez y la confiabilidad de los resultados.
3. Subjetividad en la elección: La selección basada en el juicio del investigador puede
carecer de transparencia y objetividad.
3. El muestreo por conveniencia es un tipo de muestreo en el que los participantes
son seleccionados según su disponibilidad y accesibilidad para el investigador. En
lugar de seguir un proceso de selección aleatoria, se seleccionan aquellos
participantes que resulten más convenientes o fáciles de reclutar.
Ventajas del muestreo por conveniencia:
1. Facilidad y rapidez: El muestreo por conveniencia permite una selección rápida y sencilla
de los participantes, ya que se basa en la disponibilidad y accesibilidad. Esto puede ahorrar
tiempo y recursos.
2. Acceso a muestras diversas: Al seleccionar participantes según su disponibilidad, es
posible obtener una muestra con diversidad de características y perspectivas.
3. Exploración preliminar: permite obtener una visión general del tema antes de realizar un
muestreo más riguroso y representativo.
Inconvenientes del muestreo por conveniencia:
1. Sesgo de selección: La selección basada en la conveniencia puede introducir sesgos en
la muestra, ya que los participantes seleccionados pueden no representar adecuadamente a
la población objetivo.
2. Falta de aleatoriedad: Al no utilizar un proceso de selección aleatoria, no se puede
calcular el margen de error ni establecer conclusiones estadísticamente precisas sobre la
población. Esto limita la validez externa de los resultados y la capacidad de hacer
inferencias precisas.
3. Limitaciones en la generalización: Debido al sesgo y la falta de aleatoriedad, los
resultados obtenidos a partir de una muestra por conveniencia pueden no ser
generalizables a la población total.
11.- Determinación del tamaño de la muestra.
El tamaño de la muestra en una investigación o estudio puede estar influenciado por varios
factores, entre ellos:
1. Nivel de confianza deseado: Un nivel de confianza más alto, como el 95% o el 99%,
requerirá una muestra más grande para obtener estimaciones más precisas.
2. Margen de error deseado: Un menor margen de error requerirá una muestra más grande,
ya que se necesita una mayor precisión en la estimación de los parámetros de interés.
3. Variabilidad en los datos: Si los datos de la población objetivo son muy variables, se
necesitará una muestra más grande para obtener estimaciones precisas, ya que se requiere
una mayor representación de las diferentes variaciones presentes en la población.
4. Tamaño de la población: En poblaciones finitas, donde el tamaño total de la población es
pequeño en comparación con el tamaño de la muestra deseada, se requerirá un ajuste en el
cálculo del tamaño de la muestra para tener en cuenta esta limitación.
5. Objetivos del estudio: Dependiendo de los objetivos específicos del estudio, como la
detección de diferencias pequeñas o la exploración de subgrupos, puede ser necesario
aumentar el tamaño de la muestra para obtener resultados significativos y representativos.
6. Recursos disponibles: El tamaño de la muestra también puede estar limitado por los
recursos disponibles, como el tiempo, el presupuesto y el personal para llevar a cabo la
recopilación y el análisis de los datos.
Es importante considerar estos factores y realizar un cálculo adecuado del tamaño de la
muestra para garantizar que los resultados obtenidos sean confiables, representativos y
generalizables a la población objetivo.
Para calcular el tamaño de la muestra, el nivel de confianza y el error de muestra, se deben
seguir los siguientes pasos:
Paso 1: Determinar el tamaño de la población: Este paso es crucial, ya que afecta a la
fórmula a utilizar ya la precisión del cálculo. Debes determinar si la población es finita o
infinita.
Paso 2: Definir el nivel de confianza: El nivel de confianza representa la probabilidad de que
el resultado del estudio esté dentro de un intervalo de confianza determinado. Es común
utilizar un nivel de confianza del 95% o 99%.
Paso 3: Establecer el margen de error o error demostrado: El margen de error representa la
precisión que deseas tener en tus resultados. Es la distancia máxima permitida entre la
estimación de la muestra y el valor real de la población. Generalmente, se expresa como un
porcentaje o un valor absoluto.
Paso 4: Calcular el tamaño de la muestra:
Ejemplo: Supongamos que deseamos estimar la proporción de personas que prefieren un
determinado producto en una población muy grande. Deseas tener un nivel de confianza del
95% y un margen de error del 3%. No tienes información previa sobre la proporción
esperada en la población.
1. Nivel de confianza del 95%.
2. Margen de error (E) del 3% = 0.03.
3. Valor crítico para un nivel de confianza del 95%: Z≈ 1.96.
4. Estimación conservadora para la proporción esperada en la población (p) = 0.5.
5. Calculamos el tamaño de muestra necesario:
n = (1.96^2 * 0.5 * 0.5) / 0.03^2≈ 1067 (redondeado al entero más cercano)
Por lo tanto, para estimar la proporción deseada con un nivel de confianza del 95% y un
margen de error del 3% una población infinita, necesitarías una muestra de
aproximadamente 1067 personas.
Recuerda que estos son solo ejemplos y que los valores específicos pueden variar según
tus necesidades y la información disponible sobre la población.
Debes conocer
El nivel de confianza es una medida estadística que indica la probabilidad de que un
intervalo de confianza contenga el verdadero valor de un parámetro poblacional. En otras
palabras, es la probabilidad de que los resultados obtenidos a partir de una muestra sean
representativos de la población en general.
El nivel de confianza se expresa como un porcentaje y suele ser predeterminado antes de
realizar el estudio. El valor más comúnmente utilizado es el 95% o el 99%, lo que indica que
hay un 95% o 99% de confianza, respectivamente, de que el intervalo de confianza
calculado contiene el valor real del parámetro poblacional.
Por ejemplo, si se realiza un estudio con un nivel de confianza del 95% y se obtiene un
intervalo de confianza para la media de una variable, se puede afirmar con un 95% de
confianza que el verdadero valor de la media se encuentra dentro de ese intervalo.
Es importante tener en cuenta que el nivel de confianza está relacionado con el margen de
error y el tamaño de la muestra. A medida que se aumenta el nivel de confianza, se requiere
una muestra más grande para obtener una estimación más precisa con un intervalo de
confianza más estrecho. Sin embargo, un nivel de confianza más alto también implica un
mayor grado de certeza en los resultados.
En resumen, el nivel de confianza es una medida que cuantifica la fiabilidad de los
resultados obtenidos a partir de una muestra, proporcionando una estimación de la
precisión y validez de las conclusiones que se pueden obtener.
VALORES DE Z SEGÚN EL NIVEL DE CONFIANZA:
NIVEL CONFIANZA VALOR Z
90% 1.645
95% 1.96
99% 2.575
FÓRMULA INTERVALO DE CONFIANZA para la media:
FÓRMULA INTERVALO DE CONFIANZA para la proporción:
EJEMPLO CÁLCULO INTERVALO DE CONFIANZA:
La media de las estaturas de una muestra aleatoria de 400 personas de una ciudad es 1,75 m. Se
sabe que la estatura de las personas de esa ciudad es una variable aleatoria que sigue una
distribución normal con varianza σ2 = 0,16 m2.
Construye un intervalo, de un 95% de confianza, para la media de las estaturas de la población.
n = 400
x = 1.75 σ = 0.4
z = 1.96
(1.75 ± 1.96 · 0.4/20 )
(1.7108,1.7892)
Ejemplo 1:
En un estudio se pretende estimar la edad media a la que se diagnostica la Diabetes en la Comunitat
Valenciana. Para ello se dispone de una muestra de 21 pacientes a los que se les ha preguntado la
edad de diagnóstico de la enfermedad. A partir de estos 21 pacientes se ha obtenido una edad
media (muestral) de 48.78 años y una desviación típica muestral de 16.32. Calcula un intervalo de
confianza al 95% para la edad media de diagnóstico de esta enfermedad en la región de estudio.
[41.35 , 56.20]
Con un 95% de confianza, la edad media a la que se diagnostica la Diabetes en la Comunitat
Valenciana estará contenida en el intervalo [41.35, 56.20], es decir, entre 41 y 56 años
aproximadamente.
Ejemplo 2:
Un estudio pretende estimar el porcentaje de hipertensos que hay entre las personas mayores de 65
años en la Comunidad Valenciana. Además de una estimación puntual de este porcentaje, interesa
obtener un intervalo de confianza al 95% para este parámetro de la población (P). Para llevar a cabo
este estudio, han sido seleccionadas 350 personas mayores de 65 años en toda la Comunidad,
resultando tras realizar las pruebas correspondientes que 167 padecen de hipertensión.
Porcentaje: (167/350) x100=47.71%
Intervalo de confianza: [42.48, 52.94]
Con un 95% de confianza, el porcentaje de hipertensos entre las personas mayores de 65 años en la
Comunidad Valenciana estaría contenido en el intervalo [42.48, 52.94], es decir, aproximadamente
entre el 42.5% y 53% de la población.