0% encontró este documento útil (0 votos)
20 vistas25 páginas

Análisis Estadístico de Nicotina y Huitlacoche

Este documento presenta un proyecto final de bioestadística paramétrica y no paramétrica para la Universidad de Guanajuato. Contiene cuatro problemas que analizan datos relacionados con el contenido de nicotina en cigarros, el crecimiento de huitlacoche en maíz, la pureza determinada por técnicos y la correlación entre talla y peso de niños. Los problemas incluyen cálculos de intervalos de confianza, pruebas de hipótesis, análisis de varianza, correlación y recomendaciones basadas en los
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
20 vistas25 páginas

Análisis Estadístico de Nicotina y Huitlacoche

Este documento presenta un proyecto final de bioestadística paramétrica y no paramétrica para la Universidad de Guanajuato. Contiene cuatro problemas que analizan datos relacionados con el contenido de nicotina en cigarros, el crecimiento de huitlacoche en maíz, la pureza determinada por técnicos y la correlación entre talla y peso de niños. Los problemas incluyen cálculos de intervalos de confianza, pruebas de hipótesis, análisis de varianza, correlación y recomendaciones basadas en los
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

UNIVERSIDAD DE GUANAJUATO

DIVISIÓN DE CIENCIAS NATURALES Y EXACTAS

TERCER PARCIAL/PROYECTO FINAL DE BIOESTADÍSTICA (PARAMÉTRICA Y


NO PARAMÉTRICA)

INSTRUCCIONES. Resolver los siguientes problemas en equipo (2-3 personas).

Problema 1

Para evaluar el contenido de nicotina en cierto tipo de cigarros elaborados por un


proceso, se toma una muestra aleatoria de 40 cigarrillos y se obtiene que la media es
de 18.1 mg y la desviación estándar de 3 mg.

A. Estimar con los datos anteriores el intervalo de confianza al 95% de los datos.

𝜇 = 18.1, 𝑑𝑒𝑠𝑣𝑖𝑎𝑐𝑖ó𝑛 𝑒𝑠𝑡á𝑛𝑑𝑎𝑟 = 3, 𝑛 = 40, 𝑧 95% = 1.96

Entonces, con la siguiente formulación se calculará el intervalo de confianza al 95%


𝜇 ± 𝑧 𝜎⁄√𝑛, sustituyendo se obtiene un límite de confianza inferior (LCI) y un límite de
confianza superior (LCS).

𝜇 ± 𝑧 𝜎 ⁄ √𝑛 = (18.1) − (1.96) (3) ⁄ (√40) = 17.17

𝜇 ± 𝑧 𝜎 ⁄ √𝑛 = (18.1) + (1.96) (3) ⁄ (√40) = 19.02

Formulando el intervalo de confianza resulta [17.17,19.03]

B. ¿Qué puede decir sobre la cantidad mínima y máxima de nicotina por cigarro?
Es posible garantizar con suficiente confianza que los cigarros tienen menos
de 20 mg de nicotina.

De acuerdo con lo calculado en el inciso anterior, es posible garantizar con un 95%


de confianza que los cigarros contienen menos de 20 mg de nicotina

C. Antes del estudio se suponía que µ = 17.5 mg de nicotina. Dada la evidencia


de los datos, ¿se puede rechazar tal supuesto?

Para rechazar o aceptar tal supuesto, se formula las hipótesis dónde:

𝐻0: 𝜇1 = 𝜇2

𝐻𝐴: 𝜇1 ≠ 𝜇2, además 𝜇1 = 18.1 y 𝜇2=17.5.

Entonces se procede a realizar una diferencia de medias formulando una ecuación:


𝑡0 = (𝜇1 − 𝜇2 ) ( √𝑛 𝜎 )

𝑡0 = (18 − 17.5) ( √40 3 ) = 1.05

el valor obtenido se compara con un valor crítico, es decir, un valor de tablas de t de


Student, considera un 95% de confianza, y valor a buscar en las tablas se ve
representado por 𝑡𝛼,𝑛−1 = 𝑡0.05,39.

Se trata de una hipótesis bilateral, el valor consultado en las tablas correspondientes


es 𝑡0.05,39 = 2.02. Se formula un criterio, entonces si 𝑡𝑜 < 𝑡𝑡𝑎𝑏𝑙𝑎𝑠 [𝐻0(√) 𝐻𝐴 (×)], de
lo contrario 𝑡𝑜 ≥ 𝑡𝑡𝑎𝑏𝑙𝑎𝑠 [𝐻0 (×) 𝐻𝐴(√)], es apreciable que 𝑡𝑜 < 𝑡𝑡𝑎𝑏𝑙𝑎𝑠, 1.05 < 2.02,
por lo tanto, la hipótesis nula se acepta. En conclusión, no se rechaza el supuesto
planteado en este inciso, ya que no hay diferencia estadísticamente significativa.

Problema 2

Se infectan mazorcas de maíz con huitlacoche con la idea de obtener una mejor
producción de este hongo comestible. El estudio se realizó en dos localidades y una
vez infectada la mazorca, interesa medir el porcentaje final de la superficie de ésta
que fue cubierta por el hongo y el peso en gramos del huitlacoche. Los resultados
obtenidos en 15 mazorcas de Texcoco y en 15 mazorcas de Celaya se muestran en
la siguiente tabla:

A. ¿Se puede afirmar que el porcentaje de cobertura del hongo es mayor en


Celaya que en Texcoco?
Para afirmar que el porcentaje de cobertura del hongo es mayor en Celaya que en
Texcoco, se aplicará un análisis de comparación de dos medias, ya que es necesario
comparar ambas medias entre sí para determinar el supuesto. Se conoce la media
del porcentaje de cobertura de Celaya (𝜇1 = 62.66) y la media del porcentaje de
cobertura de Texcoco (𝜇2 = 38), 𝑙𝑎 𝑣𝑎𝑟𝑖𝑎𝑛𝑧𝑎 del porcentaje de cobertura de Celaya =
1281.66 y 𝑙𝑎 𝑣𝑎𝑟𝑖𝑎𝑛𝑧𝑎 del porcentaje de cobertura de Texcoco= 613.57, la desviación
estándar del porcentaje de cobertura de Celaya (𝜎1 = 35.80) y la desviación estándar
del porcentaje de cobertura de Texcoco (𝜎2 = 24.77). Se tiene que determinar el 𝑡0:

ahora se necesita obtener los grados de libertad para obtener el valor crítico de tablas:
B. Utilice un diagrama de dispersión (gráfica tipo X-Y) para ver si existe una
relación lineal entre el porcentaje de cobertura de la mazorca con los granos
de huitlacoche.

Al ser 𝑟 2 = 0.6639, se concluye que existe una correlación moderada.

Al ser 𝑟 2 = 0.5955, se concluye que existe una correlación moderada.


C. Ignore la cobertura y pruebe la igualdad de la producción promedio de
huitlacoche en las dos localidades.

Para probar la igualdad de producción promedio de huitlacoche en las dos localidades


se planteará una hipótesis de la siguiente manera 𝐻0: 𝜇1 = 𝜇2 y 𝐻𝐴: 𝜇1 ≠ 𝜇2, donde
la producción promedio de Celaya (𝜇1 = 143.11), la producción promedio de Texcoco
(𝜇2 = 93.46), la desviación estándar de la producción de Celaya (𝜎1 = 100.24), la
desviación estándar de la producción de Texcoco (𝜎2 = 58.50), la varianza de la
producción de Celaya y la varianza de la producción de Texcoco

Se tiene que determinar el:

Ahora se necesita obtener los grados de libertad para obtener el valor crítico de tablas:

Por lo tanto, el valor de Obtenidos 𝑡0 = 1.65 y 𝑡𝛼,𝐺.𝐿. = 2.07, se


puede formular el criterio 𝑡0 < 𝑡𝛼,𝐺𝐿 [𝐻0(√) 𝐻𝐴 (×)], de lo contrario 𝑡0 ≥ 𝑡𝛼,𝐺𝐿 [𝐻0 (×)
𝐻𝐴(√)], en este caso, 𝑡0 < 𝑡𝛼,𝐺𝐿 , 1.65 > 2.07, por lo tanto, la hipótesis nula se acepta,
entonces se puede comprobar con un 95% de confianza, que existe igualdad en la
producción promedio de huitlacoche en las dos localidades,

D. Es evidente que a mayor cobertura hay una mayor producción de huitlacoche,


¿habría forma de saber con estos datos si igual cobertura corresponde una
producción de huitlacoche semejante en ambas localidades? Argumente su
respuesta.

En realidad, no habría forma de saberlo, dado que no se sabe de qué tipo es la


expansión de esta producción, los datos anteriores no proporcionan la suficiente
información para sostener con firmeza y asegurar que con una igual cobertura se
tendrá una producción de huitlacoche semejante en ambas localidades.
Problema 3

Se realizó un experimento para ver si dos técnicos tienen una tendencia a obtener
diferentes resultados cuando determinan la pureza de cierto producto. Cada muestra
fue dividida en dos porciones y cada técnico determinó la pureza de una de las
porciones. Los resultados se muestran a continuación:

A. Estos datos deben analizarse en forma pareada, explique por qué.

Los datos se deben analizar de forma pareada ya que los datos no son independientes
y permiten una menor variabilidad debido a las muestras.

B. Formule la hipótesis correcta al problema.

Las hipótesis correspondientes son 𝐻0: 𝑑 = 0, 𝑡0 = 0 y 𝐻𝐴: 𝑑 > 0, 𝐻𝐴: 𝑑 > 0

C. Pruebe la hipótesis y obtenga conclusiones.

Se aplica la siguiente formulación para obtener , ahora


bien, para obtener .

Aplicando el criterio se tiene que 𝑡0 < 𝑡𝛼,𝐺𝐿 [𝐻0(√) 𝐻𝐴 (×)], de lo contrario 𝑡0 ≥ 𝑡𝛼,𝐺𝐿
[𝐻0 (×) 𝐻𝐴(√)], y en este caso se rechaza la hipótesis nula, ya que 𝑡0 ≥ 𝑡𝛼,𝐺𝐿, 3.30 ≥
2.36. Por lo tanto, se puede asegurar con un 95% que hay tendencia a obtener
resultados diferentes.
D. Si los técnicos son diferentes, ¿hay alguna evidencia sobre cuál de ellos hace
mal el trabajo?

Para comprobar si los técnicos hacen mal el trabajo se hará una comparación de
medias:

𝐻0: 𝜇1 = 𝜇2 y 𝐻𝐴: 𝜇1 ≠ 𝜇2, donde la media de la pureza de muestras del técnico 1 es


(𝜇1 = 73.18), la media de la pureza de muestras del técnico 2 (𝜇2 = 72.02), la
desviación estándar de la pureza de muestras del técnico 1 (𝜎1 = 0.9977), la
desviación estándar de la pureza de muestras del técnico 2 (𝜎2 = 1.1335), la varianza
de la pureza de muestras del técnico 1 y la varianza de la pureza de
muestras del técnico 2 . Se tiene que determinar el:

ahora se necesita obtener los grados de libertad para obtener el valor crítico de tablas,
𝐺. 𝐿. =

Por lo tanto, el valor de 𝑡𝛼,𝐺.𝐿. = 𝑡0.05,7 = 2.14 Aplicando el criterio se tiene que 𝑡0 <
𝑡𝛼, 𝐺𝐿 [𝐻0(√) 𝐻𝐴 (×)], de lo contrario 𝑡0 ≥ 𝑡𝛼,𝐺𝐿 [𝐻0 (×) 𝐻𝐴(√)], y en este caso se
rechaza la hipótesis nula, ya que 𝑡0 ≥ 𝑡𝛼,𝐺𝐿, 2.17 ≥ 2.14, ambas 𝑡 tienen valores muy
similares, con una seguridad del 95% de confianza se afirma que el trabajo de los
técnicos es diferente.

E. ¿Qué recomendaría para lograr mayor uniformidad en las determinaciones de


los dos técnicos?

Se recomendaría que ambos técnicos lleven a cabo la purificación por el mismo


método, que antes de empezar revisen si el material está graduado y que no esté
dañando, de caso contrario, solicitar su reemplazo.

Problema 4

Un investigador desea conocer preliminarmente qué correlación existe entre la talla y


los pesos corporales de los niños, con objeto de proponer un índice peso/talla. De
este estudio preliminar elige al azar a 20 niños cuyas edades están entre el nacimiento
y los seis años. Los datos se muestran a continuación:
A. Calcular el coeficiente de correlación momento producto e interpretarlo.

Para calcular el coeficiente de correlación momento producto, primero debemos


calcular la media y la desviación estándar de la talla y el peso corporal:

Media de la talla = (52.2 + 64.8 + 68.9 + 72.1 + 74.8 + 77.3 + 79.5 + 80 + 81.3 + 82.1
+ 83.1 + 87 + 95.1 + 98.6 + 101.5 + 103.1 + 104.5 + 106.7 + 110 + 112) / 20 = 84.855
cm

Desviación estándar de la talla = 16.64 cm

Media del peso corporal = (3.45 + 7.15 + 8.25 + 9.25 + 9.95 + 10.5 + 11.4 + 10.8 + 11
+ 11.4 + 11.6 + 12.5 + 14.5 + 15.5 + 16.5 + 16.95 + 17.5 + 19 + 19.5 + 20.1) / 20 =
11.3405 kg

Desviación estándar del peso corporal = 5.0592 kg

Luego, calculamos el coeficiente de correlación como:

r = Σ((xi - x̄) * (yi - ȳ)) / sqrt(Σ(xi - x̄)^2 * Σ(yi - ȳ)^2)

Donde xi y yi son las observaciones de la talla y el peso corporal, respectivamente; x̄


y ȳ son las medias de la talla y el peso corporal, respectivamente.

Aplicando la fórmula, obtenemos:

r = 0,9252
El coeficiente de correlación r es positivo y cercano a 1, lo que indica una correlación
fuerte y positiva entre la talla y el peso corporal de los niños.

B. Calcular el coeficiente de determinación e interpretarlo.

Para calcular el coeficiente de determinación, debemos elevar al cuadrado el


coeficiente de correlación: r^2 = 0,8552.

El coeficiente de determinación r^2 nos indica que el 85,52% de la variabilidad en el


peso corporal de los niños puede ser explicada por la talla.

C. Encontrar la ecuación de la recta que relaciona la talla (variable independiente)


con el peso corporal (variable dependiente).

Para encontrar la ecuación de la recta que relaciona la talla con el peso corporal,
podemos utilizar la fórmula de la recta de regresión:

ŷ = b1x + b0

Donde ŷ es el valor estimado del peso corporal, x es la talla, b1 es la pendiente de la


recta y b0 es el término independiente.
Para calcular la pendiente b1, podemos utilizar la fórmula:

b1 = r * (Sy / Sx)

Donde Sy es la desviación estándar del peso corporal y Sx es la desviación estándar


de la talla.

b1 = 0,9252 * (5.0592 / 16.64) = 0,281

Para calcular el término independiente b0, podemos utilizar la fórmula:

b0 = ȳ - b1x̄ b0 = 11.3405 - 0,281 * 84.855 = -9.171

Por lo tanto, la ecuación de la recta que relaciona la talla con el peso corporal es:

ŷ = 0,281x - 9.171

Por cada centímetro que aumenta la talla, se espera un aumento en el peso corporal
de 0,281 kg. El término independiente de la ecuación indica que un niño con talla cero
tendría un peso corporal de -9,171 kg, lo cual no tiene sentido en la práctica. Es
importante tener en cuenta que la ecuación de la recta debe utilizarse dentro del rango
de observaciones de la muestra y no se puede extrapolar a otras edades o tallas que
no se hayan incluido en el estudio preliminar.
Problema 5

Se conduce un experimento para determinar si el uso de un aditivo químico y un


fertilizante estándar acelera el crecimiento de las plantas. En cada una de 10
localidades se estudiaron dos plantas sembradas en condiciones similares. A una
planta de cada localidad se le aplicó el fertilizante puro y a la otra el fertilizante más
el aditivo. Después de cuatro semanas el crecimiento en centímetros fue el siguiente:

A. ¿Los datos obtenidos apoyan la afirmación de que el aditivo químico acelera


el crecimiento de las plantas?

H₀: El aditivo químico no acelera el crecimiento de las plantas.

H₁: El aditivo químico acelera el crecimiento de las plantas.

Utilizaremos una prueba t de Student emparejada, ya que se comparan las


mediciones de dos grupos emparejados (misma localidad). Para llevar a cabo la
prueba, calculamos la diferencia de crecimiento para cada par de plantas y realizamos
un análisis de los datos.

Diferencias de crecimiento: 3 3 -1 -1 3 -1 4 2 4 4

Calculando la media y la desviación estándar de las diferencias:

Media de diferencias (X̄): 2.2

Desviación estándar de diferencias (S): 2.387

Calculamos el estadístico de prueba t:


t = (X̄ - μ₀) / (S / √n)

Donde μ₀ es la diferencia media asumida bajo la hipótesis nula (en este caso, 0), S
es la desviación estándar de las diferencias y n es el número de pares de
observaciones.

En este caso:

t = (2.2 - 0) / (2.387 / √10) ≈ 2.63

Consultando la tabla de valores críticos de t para un nivel de significancia de α = 0.05


con 9 grados de libertad (n - 1), obtenemos un valor crítico de t de aproximadamente
2.262.

Como t (2.63) es mayor que el valor crítico (2.262), rechazamos la hipótesis nula.

Por lo tanto, los datos obtenidos apoyan la afirmación de que el aditivo químico
acelera el crecimiento de las plantas.

B. Obtenga un intervalo al 95% de confianza para la diferencia promedio.

Para obtener el intervalo de confianza, utilizaremos la fórmula:

Intervalo = (X̄ - t * (S / √n), X̄ + t * (S / √n))

Sustituyendo los valores:

Intervalo = (2.2 - 2.262 * (2.387 / √10), 2.2 + 2.262 * (2.387 / √10))

Intervalo ≈ (-0.63, 5.03)

Por lo tanto, el intervalo de confianza al 95% para la diferencia promedio está entre -
0.63 y 5.03. Esto indica que podemos estar razonablemente seguros de que la
diferencia promedio real entre los dos grupos se encuentra dentro de este intervalo.

Problema 6

Se obtuvieron los siguientes resultados al analizar un conjunto de soluciones patrón


de plata por espectrometría de absorción atómica.
A. Determinar el coeficiente de correlación de Pearson y coeficiente de
determinación.

Absorbancia
0.9
y = 0.0253x
0.8 R² = 0.9998
0.7

0.6
Absorbancia

0.5

0.4

0.3

0.2

0.1

0
0 5 10 15 20 25 30 35
Concentración ng/mL

Estos valores indican que hay una relación muy fuerte y positiva entre la
concentración de plata y la absorbancia medida.
B. Determinar la pendiente y ordenada al origen de la línea de calibrado.

Por lo tanto, la ecuación de la línea de calibrado es: y = 0.0251x + 0.0021, donde y


es la absorbancia medida y x es la concentración de plata en ng/ml.

C. Estime la concentración de plata en una muestra que proporciona una


absorbancia de 0.456.
Para estimar la concentración de plata en una muestra que proporciona una
absorbancia de 0.456, podemos utilizar la ecuación de la línea de calibrado:

0.456 = 0.0251x + 0.0021

Despejando x, obtenemos: x = (0.456 - 0.0021) / 0.0251 = 18.08 ng/ml Por lo tanto, la


concentración de plata en la muestra analizada es de 18.08 ng/ml.

Problema 7

Un grupo de investigación tiene interés en estimar la edad media a la que aparecen


determinados trastornos relacionados con la Diabetes Tipo II. Para ello se han
seleccionado las historias clínicas de algunos de estos pacientes diagnosticados con
este problema y ha obtenido sus edades de diagnóstico.

Plantea el contraste de hipótesis adecuado para contrastar si la edad media de


diagnóstico es significativamente diferente de 65 años, con una significatividad de α
=0.05. Comprueba los resultados obtenidos calculando el intervalo de confianza al
95% para la media poblacional correspondiente, se obtiene la misma conclusión que
has obtenido con el contraste de hipótesis. Los datos obtenidos son los siguientes:

58 62 64 67 69 70 72 73 73 75 80

1. Formulación de hipótesis:

H0: La edad media de diagnóstico de los trastornos relacionados con la diabetes tipo
II es igual a 65 años.

HA: La edad media de diagnóstico de los trastornos relacionados con la diabetes tipo
II es diferente de 65 años.

2. Elección del estadístico de contraste:

Teniendo en cuenta que los datos obtenidos son una muestra y que se desconoce la
varianza poblacional, se puede utilizar el estadístico t de Student con n-1 grados de
libertad.

3. Nivel de significación:

α = 0.05

4. Cálculo del estadístico de contraste:

Para calcular el valor del estadístico t de Student, es necesario primero calcular la


media y la desviación estándar muestrales:

Media muestral:
x̄ = (58+62+64+67+69+70+72+73+73+75+80)/11 = 69

Desviación estándar muestral:

s = √( Σ(xi - x̄)² / (n-1) )

s = √( ( (58-69)² + (62-69)² + ... + (80-69)² ) / (11-1) )

s = 6.306

A partir de estos valores, se puede calcular el valor del estadístico t de Student:

t = (x̄ - μ) / (s / √n)

t = (69 - 65) / (6.306 / √11)

t = 1.249

5. Decisión y conclusión:

Para determinar si se rechaza o no la hipótesis nula, es necesario comparar el valor


del estadístico t de Student con el valor crítico correspondiente a un nivel de
significación α=0.05 y n-1 grados de libertad. Como se trata de una prueba bilateral,
se utilizará una tabla de distribución t de Student con dos colas y 10 grados de libertad
(n-1):

El valor crítico correspondiente es de t(0.025, 10) = 2.228.

Como el valor del estadístico t de Student (t=1.249) es menor que el valor crítico
(2.228), no se rechaza la hipótesis nula. Por tanto, no se puede afirmar que la edad
media de diagnóstico de los trastornos relacionados con la diabetes tipo II sea
significativamente diferente de 65 años.

Calculando el intervalo de confianza al 95% para la media poblacional


correspondiente, se obtiene:

Intervalo de confianza = x̄ ± t(0.025, 10) * ( s / √n )

Intervalo de confianza = 69 ± 2.228 * ( 6.306 / √11 )

Intervalo de confianza = (63.6, 74.4)

Como el valor de 65 años no se encuentra dentro del intervalo de confianza, se puede


concluir que se obtiene la misma conclusión que en el contraste de hipótesis, es decir,
no se puede afirmar que la edad media de diagnóstico de los trastornos relacionados
con la diabetes tipo ii sea significativamente diferente de 65 años.
Problema 8

Un equipo de cardiólogos tiene interés en estudiar la presión arterial en personas con


diagnóstico Alzheimer que toman un fármaco en fase de pruebas. Estos enfermos
suelen tener una presión arterial media de 160 en condiciones normales, es decir, sin
el uso del nuevo fármaco de prueba. Con el objetivo de valorar si el nuevo fármaco
consigue disminuir la presión arterial de estos enfermos se toma la presión arterial de
15 personas con esta enfermedad que toman el nuevo fármaco y se obtiene en ellas
una presión arterial media de 148 y una desviación típica de 26. ¿Puede concluirse
a partir de estos datos que en enfermos con este síndrome que toman el nuevo
fármaco tienen una presión arterial media menor que 160?

Para responder a esta pregunta plantea el contraste de hipótesis correspondiente


tomando como nivel de significatividad α =0.05.

Para plantear el contraste de hipótesis correspondiente, se debe establecer primero


la hipótesis nula (H0) y la hipótesis alternativa (HA).

En este caso, la hipótesis nula sería que la presión arterial media en enfermos con
Alzheimer que toman el nuevo fármaco no es menor que 160 mmHg:

H0: µ ≥ 160

La hipótesis alternativa sería que la presión arterial media en enfermos con Alzheimer
que toman el nuevo fármaco es menor que 160 mmHg:

HA: µ < 160

Donde µ es la media poblacional de la presión arterial. Para comprobar estas hipótesis


se utilizará un contraste de hipótesis con una cola a la izquierda y un nivel de
significatividad α = 0.05.

El estadístico de contraste a utilizar en este caso es el estadístico t de Student, que


se calcula de la siguiente manera:

t = (x̄ - µ) / (s / √n)

Donde x̄ es la media muestral de la presión arterial, µ es la media poblacional, s es la


desviación típica muestral y n es el tamaño muestral (en este caso, 15).

Sustituyendo los valores conocidos:

t = (148 - 160) / (26 / √15) = -1.94

La región de rechazo se encuentra en la cola izquierda de la distribución t de Student.


Con un nivel de significatividad α = 0.05 y 14 grados de libertad (15 - 1), el valor crítico
es de -1.761.
Como el valor del estadístico de contraste t = -1.94 es menor que el valor crítico tα/2
= -1.761, se rechaza la hipótesis nula H0 y se concluye que hay suficiente evidencia
para afirmar que la presión arterial media en enfermos con Alzheimer que toman el
nuevo fármaco es menor que 160 mmHg a un nivel de significatividad α = 0.05. En
otras palabras, el nuevo fármaco parece tener un efecto significativo en la disminución
de la presión arterial en estos pacientes.

Problema 9

En un estudio sobre el efecto del maíz y sorgo en pollos de engorda en Apodaca


Nuevo León, se obtuvo el siguiente incremento promedio en gramos por días y por
pollo.

A. ¿Cuál sería el modelo estadístico?

El modelo estadístico sería: Y_ij = µ + α_i + ε_ij, donde Y_ij es el incremento de peso
del pollo j alimentado con el tratamiento i, µ es la media general, α_i es el efecto del
tratamiento i y ε_ij es el error aleatorio asociado al pollo j alimentado con el tratamiento
i.
B. Formular las hipótesis estadísticas adecuadas para este experimento.
- 𝐻0 : No hay diferencias significativas en el incremento de peso promedio entre los
tratamientos.
- 𝐻𝐴 : Existen diferencias significativas en el incremento de peso promedio entre al
menos dos tratamientos.
C. Realizar un diagrama de puntos de los datos.
Gráfico de puntos problema 9
60

50

40
Datos

30 Media
Media global

20 Lineal (Media global )

10

0
0 0.5 1 1.5 2 2.5 3 3.5

Se rechaza la hipótesis nula, y se acepta la hipótesis alternativa.

D. Comprobar las hipótesis con una significancia α = 0.05.


𝐹𝑡𝑎𝑏𝑙𝑎𝑠 = 𝐹𝛼, 𝐺𝐿𝑛𝑢𝑚𝑒𝑟𝑎𝑑𝑜𝑟 , 𝐺𝐿𝑑𝑒𝑛𝑜𝑚𝑖𝑛𝑎𝑑𝑜𝑟 = 𝐹0.005,2,24 = 3.493

Se rechaza la hipótesis nula y se acepta la hipótesis alternativa.


E. Realizar comparaciones múltiples utilizando el método de Tukey. En base a los
resultados, ¿existe un alimento que engorde más a los pollos (considerar un
α=0.05?
𝑘(𝑘 − 1) 3(3 − 1)
𝑐𝑜𝑚𝑝𝑎𝑟𝑎𝑐𝑖𝑜𝑛𝑒𝑠 = = =3
2 2
𝐶𝑀𝑒𝑟𝑟𝑜𝑟
𝑇𝛼 = 𝑞𝛼(𝑘,𝐺.𝐿 𝑒𝑟𝑟𝑜𝑟) √
𝑛𝑖

95.7
𝑇𝛼 = 𝑞0.005(3,24) √
12

95.7
𝑇𝛼 = 3.53√
12

𝑇𝛼 = 9.96

𝑯𝟎 𝑯𝑨 ∣ 𝒀𝒊 − 𝒀𝒋 ∣ 𝑻𝜶 𝑯𝟎

μ𝑀𝑂 = μ𝑂𝑁 μ𝑀𝑂 ≠ μ𝑂𝑁 ∣ 37.875 − > 9.96 X


29.666∣ = 8.209

μ𝑂𝑁 = μ𝑆 μ𝑂𝑁 ≠ μ𝑆 ∣ 29.666 − > 9.96 X


29.285∣ = 0.381

μ𝑆 = μ𝑀𝑂 μ𝑆 ≠ μ𝑀𝑂 ∣ 29.285 − > 9.96 X


37.875∣ = 8.59

Problema 10

Se obtuvieron los datos de longitud (mm) y peso (g) de 50 hojas de una especie de
planta. Estos datos se muestran en la carpeta de EXAMEN FINAL en el archivo de
Excel “EJERCICIO HOJAS”. Para los datos de longitud y peso, realizar lo siguiente:

Hoja Longitud (mm) Peso (g)

1 36.1 0.975

2 36.1 0.982

3 36.2 0.986

4 36.3 0.987

5 36.4 0.992
6 36.4 0.992

7 36.6 0.994

8 36.6 0.996

9 36.7 0.997

10 37 0.998

11 37.1 0.999

12 37.3 1

13 37.3 1

14 37.3 1

15 37.3 1.005

16 37.4 1.005

17 37.4 1.005

18 37.5 1.007

19 37.5 1.013

20 37.6 1.013

21 37.6 1.016

22 37.6 1.018

23 37.7 1.021

24 37.7 1.022

25 37.8 1.022
26 37.8 1.022

27 37.9 1.023

28 38 1.023

29 38 1.027

30 38.1 1.029

31 38.1 1.032

32 38.2 1.035

33 38.2 1.035

34 38.3 1.035

35 38.4 1.036

36 38.4 1.04

37 38.4 1.04

38 38.5 1.043

39 38.6 1.044

40 38.6 1.046

41 38.6 1.048

42 38.7 1.049

43 38.7 1.05

44 38.8 1.052

45 38.8 1.052
46 38.9 1.052

47 39 1.061

48 39.1 1.065

49 39.6 1.088

50 39.8 1.1

A. Histograma.
B. Diagrama de cajas y bigotes.
C. Diagrama de tallos y hojas.

3|667

3|6777

3|7778

3|888

4|001122333468

4|0013455667888

4|123444

4|588

5|68

D. En base a los gráficos, discutir los resultados en cuanto a sesgo, curtosis y si


existen datos anómalos o atípicos.

En base a los gráficos, se observa que tanto la longitud como el peso presentan una
distribución aproximadamente normal, sin sesgo evidente y con una ligera curtosis a
la derecha. No se observan datos anómalos en el diagrama de cajas y bigotes.

E. Hacer un gráfico de dispersión longitud (mm) Vs Peso (g) ¿Qué tipo de relación
existe entre las dos variables?
Se observa una correlación positiva entre la longitud y el peso de las hojas. A medida
que aumenta la longitud, también aumenta el peso. Sin embargo, la relación no es
perfecta y hay cierta dispersión de los puntos, lo que sugiere que hay otros factores
que influyen en el peso de las hojas además de su longitud.

También podría gustarte