0% encontró este documento útil (0 votos)
9 vistas19 páginas

Clase de Estadística: Inferencia y Aplicaciones

Hugo Rolando Sanchez Quispe introduce una clase de estadística enfocada en el contraste de hipótesis, destacando la importancia de la estadística inferencial y su aplicación en la investigación. Se discuten conceptos clave como la media aritmética, la varianza y las pruebas de hipótesis, así como el uso de software y programación para análisis estadísticos. La clase también enfatiza la necesidad de definir correctamente las pruebas estadísticas según el comportamiento de los datos.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
9 vistas19 páginas

Clase de Estadística: Inferencia y Aplicaciones

Hugo Rolando Sanchez Quispe introduce una clase de estadística enfocada en el contraste de hipótesis, destacando la importancia de la estadística inferencial y su aplicación en la investigación. Se discuten conceptos clave como la media aritmética, la varianza y las pruebas de hipótesis, así como el uso de software y programación para análisis estadísticos. La clase también enfatiza la necesidad de definir correctamente las pruebas estadísticas según el comportamiento de los datos.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd

00:00:46.750 --> 00:01:05.

190
Hugo Rolando Sanchez Quispe
Hola chicos, bienvenidos a la clase de estadística. Bueno, considerando que vamos
a tener 2 semanas. Bueno, esta semana bastante irregular, la semana que viene de
la misma manera, he decidido dejar.
00:01:05.870 --> 00:01:25.950
Hugo Rolando Sanchez Quispe
Una clase asíncrona grabada para no quedarnos, ya que iniciamos esa última
unidad y es muy importante lo que corresponde a la al contraste de hipótesis, ¿no?
En ese sentido, esta clase espero que la puedan revisar, nada más quiero.
00:01:27.950 --> 00:01:32.950
Hugo Rolando Sanchez Quispe
Comentar ciertas ciertas cuestiones, estoy teniendo problemas con.
00:01:34.670 --> 00:01:56.630
Hugo Rolando Sanchez Quispe
Con el OneDrive, así que deben ustedes descargarse la clase para que puedan
revisar. Es importante que lo hagan, ya que no es igual que yo suba un documento
y que ustedes revisen. No siempre es necesario la retroalimentación, así que de esa
manera, pues yo voy a iniciar para no hacer muy extensa.
00:01:57.070 --> 00:02:00.270
Hugo Rolando Sanchez Quispe
¿La clase de la estadística, no?
00:02:01.470 --> 00:02:01.870
Hugo Rolando Sanchez Quispe
Yeah.
00:02:04.110 --> 00:02:23.070
Hugo Rolando Sanchez Quispe
Vamos a hacer un repaso rapidísimo de lo que corresponde a la clase de estadística.
Hace rato nosotros hemos dejado ya de analizar la estadística descriptiva, no, pues
que la estadística descriptiva no es más que analizar.
00:02:23.150 --> 00:02:43.990
Hugo Rolando Sanchez Quispe
Tablas, analizar gráficas, prácticamente es eso, no la estadística descriptiva. Ahora
nosotros queremos analizar la estadística inferencial. De hecho, cuando ya estamos
viendo la distribución normal, la distribución binomial, la función.
00:02:44.190 --> 00:03:04.110
Hugo Rolando Sanchez Quispe
Probabilidad, estamos analizando ya lo que es ciertas hipótesis, ¿no? Por ejemplo, al
decir voy a lanzar una moneda. ¿Cuál será la probabilidad de que me salga cara o
de que me salga sello? ¿Si lanzo 3 veces, cuál será la probabilidad de yo tener
cierta combinación?
00:03:04.430 --> 00:03:27.710
Hugo Rolando Sanchez Quispe
En este caso, nosotros estamos ya utilizando o analizando lo que es la estadística
inferencial. Entonces, su nombre claramente lo dice, crea inferencias a través de
hipótesis que nosotros debemos demostrar si son verdaderas o si son falsas. Ahí
viene la importancia de la estadística, porque yo debo analizar cómo están mis
datos.
00:03:28.030 --> 00:03:52.710
Hugo Rolando Sanchez Quispe
y en base a eso de escribir no qué tipo de prueba estadística yo voy a a utilizar para
poder contrastar una hipótesis en en específico no entonces aquí ya eh el resto que
tengamos de de clases ya sea de esta manera así una eh virtual o en su defecto en
la forma presencial cuando volvamos el eh a el próximo año lo más
00:03:52.790 --> 00:04:13.270
Hugo Rolando Sanchez Quispe
seguro haremos la parte ya estadística y inferencia no utilizaremos el software del
spcs Seguiremos utilizando un poquito y también la idea es que podamos utilizar el
el python no Entonces para qué nosotros podemos utilizar bueno Esto está
enfocado
00:04:13.390 --> 00:04:25.590
Hugo Rolando Sanchez Quispe
Un poco a la parte ambiental, hacer monitoreo y control de suelo y aire. En realidad,
ustedes como ingenieros en tecnologías de la información son, digámosle.
00:04:26.390 --> 00:04:47.070
Hugo Rolando Sanchez Quispe
Tienen su campo muy amplio, ¿no? Entonces ustedes pueden hacer este tipo de
programación o crear algoritmos para hacer monitoreos y control del suelo.
Entonces ahí viene la parte estadística aplicada, no que yo obviamente con el
conocimiento que debería estudiar cómo es el comportamiento del control del suelo
o del aire.
00:04:47.150 --> 00:05:06.270
Hugo Rolando Sanchez Quispe
Ir creando algoritmos, ellos demostrando las hipótesis que me están solicitando, por
ejemplo, en un X trabajo, no de la misma manera, evaluar contaminación ambiental
o a través del aire, que sería crear modelos estadísticos. Y creo yo que ustedes, si
ven, por ejemplo, el machine learning, crean modelos.
00:05:06.430 --> 00:05:23.150
Hugo Rolando Sanchez Quispe
Utilizando inteligencia artificial y van analizando el famoso análisis de datos con el
Big Data, no y modelados, predicciones, etcétera. Entonces esto es netamente la
estadística aplicada correspondiente a la estadística inferenciada.
00:05:25.150 --> 00:05:44.590
Hugo Rolando Sanchez Quispe
Aquí tenemos un mapa mental, digámoslo así, que lo que hemos visto hasta el
momento, lo más enfático son tablas. Hemos visto histogramas a través del
software, hemos interpretado a través de ciertas bases de datos como es el
comportamiento, por ejemplo, de edades. de.
00:05:45.230 --> 00:05:54.430
Hugo Rolando Sanchez Quispe
De hobbies, etcétera, etcétera. Pero como les digo, ahora ya vamos a utilizar la
estadística inferencial, entonces igual acá.
00:05:55.630 --> 00:06:19.310
Hugo Rolando Sanchez Quispe
Si bien es cierto, al utilizar estadística descriptiva o al utilizar estadística inferencial,
es muy complejo trabajar con la población. Entonces siempre tengo que crear la
muestra para yo trabajar con una porción representativa de toda la población,
porque ya les había comentado, es muy complicado en realidad trabajar con toda la
muestra por cuestiones de tiempo, parte económica y la misma.
00:06:19.550 --> 00:06:22.550
Hugo Rolando Sanchez Quispe
A lo mejor de tomar datos a todo el universo.
00:06:24.590 --> 00:06:45.710
Hugo Rolando Sanchez Quispe
Bueno, esto de acá ya hemos visto que es una variable cuantitativa, cualitativa,
hemos hecho cierta clasificación de variables discretas continuas, nominales y
ordinales. No vamos a continuar, esto de acá no voy a redundar, ya vimos en la
primera en el medio ciclo, así que vamos a pasar rapidísimo.
00:06:46.030 --> 00:07:06.030
Hugo Rolando Sanchez Quispe
No, esto es importante, nosotros ahora ya vamos a definir qué es lo que pasa con la
media aritmética, qué es lo que pasa con la desviación estándar, con la varianza,
con esos valores vamos a trabajar. Entonces ya hemos visto esto, nos va a servir
ahora que vamos a interpretar, por ejemplo, la T de Student en esta clase, no.
00:07:06.230 --> 00:07:26.550
Hugo Rolando Sanchez Quispe
Entonces, para recordar un poco que la media aritmética no es más que la suma
total de todos los datos y la varianza no es más que sumar cada uno de los valores
restados, el valor de media aritmética al cuadrado dividido para n, pero en este
caso, como vamos a trabajar con poblacionales y muestrales.
00:07:26.710 --> 00:07:33.390
Hugo Rolando Sanchez Quispe
Sería dividido para toda la muestra menos 1 que ya vamos a explicar cuando
estemos en este en ese.
00:07:35.310 --> 00:07:54.830
Hugo Rolando Sanchez Quispe
en ese caso no las medidas de dispersión la que más vamos a utilizar sería la
desviación media Que obviamente para yo encontrar la Perdón la desviación
estándar que para yo encontrar la desviación estándar Necesito encontrar primero
la la varianza porque la desviación estándar o típica es la raíz cuadrada del la
00:07:55.710 --> 00:08:03.550
Hugo Rolando Sanchez Quispe
Varianza, no esto de acá, nosotros ya lo hemos visto, las distribuciones discretas
también empezamos ya con la.
00:08:05.230 --> 00:08:24.150
Hugo Rolando Sanchez Quispe
Con la estadística inferencial, hemos visto lo que es distribución binomial y
distribución hipergeométrica, distribución de Poison que nos faltaría ver todavía,
pero el resto ya hemos visto la distribución normal también que nos falta en este
cuadrito de acá. No hemos hecho ejercicios aplicando la distribución normal.
00:08:24.270 --> 00:08:49.150
Hugo Rolando Sanchez Quispe
Hemos hecho ejercicios aplicando distribución pregeométrica y prácticamente
hemos visto todas estas distribuciones, no la distribución normal que hicimos
últimamente en los ejercicios. Creería que también les envié a hacer una pequeña
consulta sobre la curtosis que tiene la campana de Gauss y esto era el valor que
había comentado y había dicho.
00:08:49.190 --> 00:09:08.390
Hugo Rolando Sanchez Quispe
En clases, no cuando yo hablo de una curtosis leptecurtica, mesocurtica o
platicurtica, va a depender mucho de los grados de libertad y cómo encuentro los
grados de libertad a través de esta fórmula. Y miren, sigo utilizando yo la media
aritmética y también la desviación típica, nada más que aquí como particularidad.
00:09:08.590 --> 00:09:16.110
Hugo Rolando Sanchez Quispe
¿Son elevadas a la cuarta, no? Y seguimos dividiendo para la n cantidad de datos,
¿no?
00:09:17.630 --> 00:09:37.350
Hugo Rolando Sanchez Quispe
Y empezamos con las pruebas de hipótesis, no, nosotros necesitamos ya ingresar a
esta unidad que son probar hipótesis, porque evidentemente que ahora ustedes
están haciendo la investigación formativa y en esta investigación formativa ustedes
se plantearon objetivos y esos objetivos tienen que estar contrastados.
00:09:37.470 --> 00:09:56.750
Hugo Rolando Sanchez Quispe
Frente a una hipótesis que también debe tener esa investigación formativa, porque
obvio que cuando yo estoy haciendo algo experimental que se pidió para las
investigaciones formativas, yo debo tener unas hipótesis, no para yo poder
contrastar esas hipótesis, si es verdad lo que yo estoy haciendo o no es verdad si lo
que estoy haciendo.
00:09:56.790 --> 00:10:15.710
Hugo Rolando Sanchez Quispe
¿O es factible? No es factible. Eso es lo que nosotros vamos a aprender en esta
unidad y obviamente, recordando un poco sobre qué es una hipótesis, pues no es
más que es una inferencia. Son inferencias que yo voy planteando ante una
investigación y pueden ser de 2 formas, ¿no?
00:10:15.990 --> 00:10:35.310
Hugo Rolando Sanchez Quispe
La alternativa, que es la que yo afirmo que evidentemente va a suceder lo que yo
estoy planteando, y la nula es algo que no va a suceder. Estoy negando totalmente
a un posible caso de estudio. Sí, esas son las 2:00 formas de escribir las hipótesis.
00:10:36.350 --> 00:10:54.230
Hugo Rolando Sanchez Quispe
Como yo analizo las hipótesis, vamos ahora sí a aplicar muchísimo esta campana de
gauss considerando las zonas de aceptación, las zonas de rechazo. Por ejemplo, acá
la zona de aceptación y habíamos dicho, por ejemplo, si yo trabajo con el 95% de
confianza, sería la parte celeste.
00:10:54.830 --> 00:11:16.030
Hugo Rolando Sanchez Quispe
Y la zona de rechazo, que sería el 5%, estaría distribuido en ambas colas, no una
cola izquierda y una cola derecha. Entonces aquí viene ya la cuestión de que tengo
que elegir dependiendo del caso de estudio, si trabajo con una cola, ya sea la cola
derecha o la cola izquierda, o si voy a trabajar con ambas colas, no, entonces esto.
00:11:16.350 --> 00:11:37.030
Hugo Rolando Sanchez Quispe
Ya es muy fundamental para yo poder probar estas hipótesis. Hay muchos, muchas
formas. En realidad, si se fija acá hay 5 pasos, pero tengo una presentación que
tiene 8 pasos un poco más detallado, ¿no? Por ejemplo, aquí voy a plantecar las
hipótesis alternativas y nulas.
00:11:37.150 --> 00:11:55.430
Hugo Rolando Sanchez Quispe
Selecciono el nivel de confianza, el nivel de significancia, identifico la prueba
estadística, en este caso el modelo, si es una T de Student, una Nova, si es T de
Student, si son muestras relacionadas, muestras independientes, si es una Nova, no
una vía, 2 vías, etcétera.
00:11:57.070 --> 00:12:15.870
Hugo Rolando Sanchez Quispe
Identificamos la forma o regla de decisión. Esto lo planteo yo en base a las hipótesis
que estoy planteando y finalmente hago yo la decisión sobre la muestra que he
tomado, ¿no? Entonces esas son los pasos que yo debo seguir. Entonces, una vez
que yo.
00:12:15.990 --> 00:12:35.670
Hugo Rolando Sanchez Quispe
He identificado esto, voy a proyectar y voy a proyectar la primera clase, que en esta
casa sería la T de Student. No, este sería la T de Student, que es lo que vamos a ver
ahora. Aquí hay algo fundamental que yo ya expliqué también.
00:12:35.950 --> 00:12:42.470
Hugo Rolando Sanchez Quispe
En el pizarrón sí voy a ponerle a cargar nada más mi computador, por favor, un
momentito.
00:12:47.110 --> 00:12:47.430
Hugo Rolando Sanchez Quispe
Yeah.
00:13:11.790 --> 00:13:28.230
Hugo Rolando Sanchez Quispe
Perfecto, ahí sí estamos ya con batería. Algo que yo ya expliqué, como les estaba
comentando en el pizarrón, el último día de clases que tuvimos, es que nosotros no
sé por qué no puedo.
00:13:29.390 --> 00:13:39.150
Hugo Rolando Sanchez Quispe
Voy a dejar de compartir y a compartir nuevamente para poder utilizar el lápiz que
necesito un poquito, no, entonces voy a.
00:13:44.030 --> 00:14:03.550
Hugo Rolando Sanchez Quispe
Ahí sí lo tenemos. Entonces, algo importante es que yo tengo que definir la prueba
estadística en base al comportamiento de mis datos, porque en realidad yo no
podría aplicar una T de Student siempre o una Nova siempre, o a lo mejor una U de
Mann Whitney siempre o Wilkinson siempre.
00:14:03.790 --> 00:14:26.110
Hugo Rolando Sanchez Quispe
Debo analizar cuál es el comportamiento de los datos y en base a eso decidir las
pruebas específicas que yo necesito. Entonces, antes de empezar esta T de
Student, tienen ustedes aquí 2 gráficas, no la gráfica uno y la gráfica número 2.
Entonces, si ustedes se fijan en la gráfica número uno.
00:14:26.590 --> 00:14:50.350
Hugo Rolando Sanchez Quispe
El comportamiento de los datos es más simétrico, es decir, el comportamiento es
normal, porque si yo analizo aquí voy a tener la media aritmética. Bueno, se movió
un poquito, voy a tener en el centro justamente la media aritmética que va a
coincidir con la , con la mediana y con la moda, y si analizamos las barras hacia la
izquierda y las barras hacia la derecha.
00:14:50.750 --> 00:15:10.950
Hugo Rolando Sanchez Quispe
Tienden a tener el la misma cantidad de valores, es decir, que la dispersión a la
izquierda y a la derecha es normal. Sí, no hay mucha dispersión, ya sea a la
izquierda o a la derecha, que justamente es lo que sucede acá en esta campana de
gaus, si ustedes se fijan.
00:15:11.070 --> 00:15:32.270
Hugo Rolando Sanchez Quispe
Esta campana de Gauss no es simétrica porque aquí se supone que yo debería
tener la media aritmética. Sí, pero miren, tengo más valores a la izquierda que a la
derecha porque tengo más valores pequeños acá. Entonces aquí esta distribución
no es normal. Entonces ahí yo tengo que utilizar otro tipo de pruebas. Entonces
cuando yo.
00:15:32.910 --> 00:15:52.510
Hugo Rolando Sanchez Quispe
Compruebe, a lo mejor no lo van a poder hacer directamente con las gráficas.
Cuesta un poquito graficar en los en los software, pero hay 2 métodos que puedo
utilizar yo para describir la normalidad de los datos, no que la una es Cosmogoro
Smirnop.
00:15:52.670 --> 00:16:11.950
Hugo Rolando Sanchez Quispe
Y la otra es de Shapiro Will. Sí, entonces cuando yo utilizo Shapiro Will, utilizo para
valores menores que 50 o 30. Hay muchas literaturas que dicen 50, muchos que
dicen 30, no, pero lo podríamos dejar en 50, no que sea así iguales o menores de 50
Shapiro Will.
00:16:12.270 --> 00:16:31.390
Hugo Rolando Sanchez Quispe
Y mayores que 50 Kolosmogorov Smirnoff, no, entonces en base a eso, yo planteo
hipótesis y digo que si el P valor es mayor a nivel de significancia, hay normalidad.
Si el P valor es menor que el nivel de significancia, entonces no hay normalidad.
00:16:31.430 --> 00:16:52.550
Hugo Rolando Sanchez Quispe
Entonces ahí yo voy viendo ya si son paramétricas o no son paramétricas. Entonces
dentro de las pruebas paramétricas o cuando hay normalidad, yo tengo algunas
pruebas como la T de Student, T de Student, tengo también el ANOVA. Ojo que aquí
estoy hablando de forma general porque la T de Student tiene 3 formas, ya vamos a
ver en esta presentación, tiene 3 formas.
00:16:52.670 --> 00:17:11.150
Hugo Rolando Sanchez Quispe
El ANOVA igual tiene algunas formas, si es que es simple, si es que estoy analizando
algún experimento un poco más complejo, va a cambiar también la forma de
analizar. Entonces no es que simplemente esté el student y ANOVA siempre, no. A lo
mejor en Python yo lo hago de una manera directa.
00:17:11.550 --> 00:17:31.590
Hugo Rolando Sanchez Quispe
Pero ya vamos a ver que en el mismo SPCS yo ya tengo dividido, por ejemplo, si
tengo una T de student para un caso, para 2 casos o para 3 casos, no. ¿Qué es lo
que vamos a ver en esta clase? No, entonces eso chicos, nada más cuando yo hablo
de normales o de datos paramétricos.
00:17:31.670 --> 00:17:39.030
Hugo Rolando Sanchez Quispe
Pues cuando no hay parametrización, sí, cuando los datos no son normales, tengo
algunas pruebas no paramétricas, como por.
00:17:40.110 --> 00:17:58.670
Hugo Rolando Sanchez Quispe
Ejemplo, la U de Man Whitney, la U de Man Whitney. Pueden buscar este en el
internet, no puedo escribir porque no tengo lápiz. La U de Man Whitney, Wilconson,
sí, Wilconson también Cruzcal Wallis y la de Cruzcal Wallis también. Y hay otra de
específicamente de Kolsmogorov Smirnov.
00:17:58.990 --> 00:18:17.030
Hugo Rolando Sanchez Quispe
Que utiliza un método específico, pero para analizar los datos en datos normales.
Entonces, ojo, no se confundan, no Kolmogorov Smirnoff también me sirve para
analizar normalidad, pero también es parte de una prueba no paramétrica.
Entonces el Kolmogorov Smirnoff.
00:18:17.830 --> 00:18:37.070
Hugo Rolando Sanchez Quispe
utilizamos tanto para la normalidad como para analizar los datos no paramétricos
Okay entonces en ese sentido vamos a empezar ya con la primera prueba
estadística cuando yo tengo normalidad en este caso estamos hablando del té de
student esta t de student su base
00:18:37.150 --> 00:18:59.070
Hugo Rolando Sanchez Quispe
Fundamental es que analiza las medias, no, entonces aquí yo tengo una gráfica y
estoy analizando 2 grupos, los grupos de color rojo va a decir que sea rojo y los
grupos de color amarillo. Entonces lo que hace es analizar las medias del grupo
uno, las medias del grupo 2 y entonces identifica qué tan distantes o qué tan
diferentes son.
00:18:59.190 --> 00:19:18.750
Hugo Rolando Sanchez Quispe
La media del grupo uno con la media del grupo 2 y puedo concluir cualquier tipo de
hipótesis que yo esté planteando. En este sentido, pues yo tengo algunos casos
para esta T de Student, como les estaba recalcando la T de Student, por ejemplo,
tengo para una sola muestra, es decir.
00:19:18.990 --> 00:19:38.110
Hugo Rolando Sanchez Quispe
Voy a analizar específicamente algo en el PAU 3, o sea, es decir, voy a analizar una
nueva metodología de estudio en estadística. Ya entonces para eso yo voy a hacer
una preprueba, es decir, voy a tomarles una prueba ahora sin esa metodología.
00:19:38.830 --> 00:19:58.790
Hugo Rolando Sanchez Quispe
Inyecto esta nueva metodología, yo que sé, una, 2 semanas o 3 semanas, un mes, y
nuevamente vuelvo a tomar la prueba. Entonces ahí estoy tomando o puedo aplicar
la T de Student, pero a una sola muestra que sería el pago 3 de ingeniería en
tecnologías de la información.
00:19:58.910 --> 00:20:22.190
Hugo Rolando Sanchez Quispe
Y voy a hacer la diferencia de medias cuando no tenía la metodología y cuando sí
tenía la metodología y voy a sacar una conclusión. Sí, ahora la otra es las famosas
pruebas independientes, es decir, yo voy a tener 2 grupos de estudios distintos y a
cada grupo yo voy a inyectar una metodología distinta, es decir, yo doy en
ambiental y también en.
00:20:22.350 --> 00:20:42.750
Hugo Rolando Sanchez Quispe
En tecnologías de la información, pues a lo mejor a ustedes voy a inyectar una
metodología virtual y en ambiental voy a utilizar una metodología más didáctica
práctica. Ya entonces obviamente son 2 cosas totalmente distintas y al final yo voy
a medir la media del rendimiento tanto de.
00:20:42.830 --> 00:21:02.270
Hugo Rolando Sanchez Quispe
Tecnologías de la información con un método virtual y en ambiental con el método
práctico. Y voy a sacar una diferencia. ¿Cuál fue la mejor? Sí, y finalmente tengo la
que es variada. Sí, las que son relacionadas, es decir, que al mismo curso yo voy a
irles tomando medidas.
00:21:02.310 --> 00:21:22.870
Hugo Rolando Sanchez Quispe
Pero en este caso en parejas, no, y luego voy a sacar una diferencia de esas parejas
y al final, obviamente esto termina convirtiéndose en una prueba de una muestra,
nada más que ya vamos a explicar cada una de estas, ¿no? Entonces la bueno, voy
a ponerles esto por acá.
00:21:23.710 --> 00:21:28.510
Hugo Rolando Sanchez Quispe
Ya estamos con 22 minutos, voy a tratar de avanzar un poco más rápido esto.
00:21:30.070 --> 00:21:48.670
Hugo Rolando Sanchez Quispe
¿Por qué no se mueve? Ahí está aquí de forma resumida, no tengo la prueba de una
muestra, tengo la prueba T para muestras independientes y tengo la muestra para
la prueba T para muestras relacionadas. no? Entonces ahí tienen un ejemplo, yo voy
a explicar rápidamente cada uno de ellos primero.
00:21:48.750 --> 00:22:10.350
Hugo Rolando Sanchez Quispe
La prueba para una sola muestra, no, entonces miren, acá tengo un ejemplo y
decimos que hay un fabricante de chocolate, entonces y el fabricante de chocolate
asevera, afirma que esas barras de chocolate que ha inyectado yo que sea a lo
mejor a un centro comercial pesa 50 g, pero yo quiero ver si es que es verdad.
00:22:10.390 --> 00:22:29.830
Hugo Rolando Sanchez Quispe
Entonces, para ver si es que es verdad, voy a tomar esas barras de chocolate, es
decir, un solo grupo. A lo mejor me voy al tía o al aquí a un solo supermercado y voy
a tomar aleatoriamente 30 valores y a y a propósito, no este tipo de pruebas Ted
Student, la mayoría de casos sugiere que se trabaje.
00:22:29.910 --> 00:22:54.750
Hugo Rolando Sanchez Quispe
Con 30 datos, porque si yo aumento los datos es como que ya se va convirtiendo en
un análisis de ANOVA más que una TV Student, pero sí lo puedo hacer, no sí lo
puedo hacer para más de 30 datos, pero lo aconsejable es para 30. Ahora bien,
entonces en el caso que estaba yo analizando es que me voy al supermercado, me
voy a la aquí y voy a tomar aleatoriamente 30 barras de chocolate y voy a sacar
una media.
00:22:54.830 --> 00:23:15.510
Hugo Rolando Sanchez Quispe
Y a lo mejor en mi caso me dio 48 y voy a sacar una conclusión, no, si yo digo que
aquí es 48 y el fabricante me dice que es 50, yo sacaré una conclusión si realmente
es aceptable o no es aceptable el que esté menos, el que esté de más los gramos,
no, ya tengo una idea.
00:23:15.630 --> 00:23:34.670
Hugo Rolando Sanchez Quispe
No, entonces esa es la prueba T para una muestra, no haciendo un ejemplo
bastante sencillo. Vamos con la prueba T para muestras independientes. Entonces
aquí yo les había comentado que tengo 2 grupos distintos, la muestra uno y la
muestra 2. Entonces un ejemplo muy didáctico es que yo voy a inyectar.
00:23:34.910 --> 00:23:55.270
Hugo Rolando Sanchez Quispe
un medicamento al grupo uno y otro tipo de medicamento al grupo dos. ¿Qué es lo
que voy a analizar? ¿Cuál es la eficacia del medicamento en el dolor? Entonces al
final lo que yo voy a hacer es encontrar la media aritmética de un grupo con el
medicamento A y la media aritmética.
00:23:55.390 --> 00:24:14.070
Hugo Rolando Sanchez Quispe
Del otro grupo con el medicamento by voy a ver cuáles son las diferencias que
existe entre 1 y otro, y yo decidí si hay diferencias significativas o a lo mejor da
igual que tome el medicamento A con el medicamento B. Entonces me sirve para yo
tomar una decisión y finalmente tengo.
00:24:14.430 --> 00:24:27.310
Hugo Rolando Sanchez Quispe
Las pruebas relacionadas. Entonces, como les había comentado, aquí se va
tomando de forma ordenada. Sí, los valores. Entonces, aquí como ejemplo, tengo
que voy a analizar una dieta.
00:24:28.270 --> 00:24:45.870
Hugo Rolando Sanchez Quispe
Ya entonces para hacer esta dieta yo tengo que hacer un pre testeo o sí una un pre
testeo y un post testeo, es decir, ahora mismo en el pavo 3 voy a voy a inyectar
una dieta. Sí, entonces antes de hacer la dieta yo voy a medirles.
00:24:47.310 --> 00:25:08.670
Hugo Rolando Sanchez Quispe
A pesarles, en parejas puede ser un hombre y una mujer, se me ocurre, no, eso no
es una camisa de fuerza, puede ser un hombre y una mujer, ya, pero ese hombre y
esa mujer que yo al inicio tomé como referencia o fui analizando a todo el curso
hombre, mujer, hombre, mujer, en ese mismo orden yo tengo que volver a medir
luego de haber implementado la dieta.
00:25:09.230 --> 00:25:28.950
Hugo Rolando Sanchez Quispe
Porque si es que a lo mejor yo al inicio tomé a no recuerdo sus apellidos, digamos a
Caixahuano y a lo mejor a Romo, creo que hay Caixahuano y Romo como primer
grupo, y luego cambio y le pongo a Caixahuano.
00:25:29.030 --> 00:25:48.520
Hugo Rolando Sanchez Quispe
con otra persona Entonces ya voy a tener un sesgo en la parte de análisis no
entonces no es factible eso Si yo ya tomé a caixahuano ya ya Romo como inicio
entonces hago la la dieta y vuelvo a tomar a caizahuano y
00:25:49.150 --> 00:26:08.670
Hugo Rolando Sanchez Quispe
Entonces, yo voy a tener una aceptación de cierta manera en el estudio. ¿Entonces,
cuál es el procedimiento? Entonces, como yo ya hice un pretesteo antes y un
pretesteo después, evidentemente que yo voy a tener una diferencia porque tengo
que restar los pesos, no cuánto tuvo antes, cuánto tuvo ahora.
00:26:09.070 --> 00:26:29.590
Hugo Rolando Sanchez Quispe
Y como obviamente todos los organismos son distintos, no voy a tener una medida
igual. Por ejemplo, en el primer grupo me dio menos 5, han bajado 5, en el otro
grupo tienen un más 2, en el otro grupo menos 1, en el otro grupo menos 3.
Entonces esto es lo que tengo que analizar yo y por eso les decía yo que una
prueba.
00:26:29.710 --> 00:26:49.150
Hugo Rolando Sanchez Quispe
De muestras relacionadas a la final termina siendo una prueba T de una sola
muestra, porque ya no voy a analizar los grupos, sino solamente las restas que
tienen al haber implementado una metodología, una dieta o lo que sea. Entonces
aquí ya simplemente me iría por el método de.
00:26:49.470 --> 00:27:08.150
Hugo Rolando Sanchez Quispe
¿Una sola muestra, no? Y justamente eso es lo que está explicándose acá, que una
vez que yo a lo mejor haga una muestra en parejas, sí, a lo mejor si hago una
muestra en parejas, a la final yo termino culminando que esa muestra en parejas
termina siendo.
00:27:08.270 --> 00:27:27.830
Hugo Rolando Sanchez Quispe
Una prueba D de una muestra, una prueba T de una muestra y que lo que uno lo
único que tendría que hacer es hacer un análisis de estas diferencias que tuve
antes de la dieta y después de la dieta con un valor referencial, el cero, no para ver
cuánto subió o cuánto bajó, nada más.
00:27:29.470 --> 00:27:52.390
Hugo Rolando Sanchez Quispe
Seguimos ahora con los supuestos para la prueba T. Como todo, pues siempre tiene
un pro y un contra. En realidad es muy factible, muy fácil este tipo de pruebas, pero
también tiene una contra, no que solamente utiliza es utilizada para variables
métricas o variables numéricas. Es decir, si yo quiero analizar, por ejemplo, color de
hoja.
00:27:53.550 --> 00:28:11.310
Hugo Rolando Sanchez Quispe
O una variable cualesquiera que sea cualitativa. Este tipo de pruebas no sirve a
menos que yo etiquete, a menos que yo vaya etiquetando, ahí sí lo puedo hacer.
Entonces siempre, por ejemplo, edad, peso o longitud, eso lo.
00:28:11.350 --> 00:28:30.790
Hugo Rolando Sanchez Quispe
¿Puedo hacer a través de la TD Student? No, algo muy esencial es que, por ejemplo,
cuando yo voy a trabajar con muestras independientes, es decir, tengo un grupo
uno, tengo un grupo 2, siempre tengo que analizar la varianza. Sí, tengo que
analizar la varianza uno y tengo que analizar también.
00:28:30.950 --> 00:28:53.590
Hugo Rolando Sanchez Quispe
La varianza 2, entonces depende de mucho que si las varianzas son iguales, si las
varianzas son iguales, entonces hay una ecuación o una fórmula específica para
encontrar la T de Stude, pero si son distintas, hay otra forma contar o hay otro otra
fórmula para yo encontrar.
00:28:54.510 --> 00:29:14.270
Hugo Rolando Sanchez Quispe
La T de Stude, no, entonces eso ténganlo muy en cuenta y cómo encuentro yo las
varianzas o cómo analizo la homogeneidad de varianzas a través de la prueba de
Leven. Así se llama la prueba de Leven. Eso me va a indicar si es que las varianzas
son iguales o no, es decir, hay homoselasticidad.
00:29:14.350 --> 00:29:22.510
Hugo Rolando Sanchez Quispe
Del grupo de estudio, no, eso significa la homoselasticidad, que las varianzas que
estoy analizando sean iguales, ¿no?
00:29:24.590 --> 00:29:44.230
Hugo Rolando Sanchez Quispe
Bien, esto también es muy fundamental que ustedes, cuando vayan a plantear las
hipótesis, tengan algo, una idea de cómo plantear. Por ejemplo, si estoy trabajando
con una sola muestra, tengo las hipótesis nulas y las alternativas. ¿Cómo debería yo
plantear? Me dice que la nula yo debería o podría plantear de las.
00:29:44.430 --> 00:30:06.350
Hugo Rolando Sanchez Quispe
Siguiente manera, esto no es una camisa de fuerza, no que la media de la muestra
es igual al valor de referencia. Ojo, que cuando yo voy a trabajar con una t Student
de una sola muestra, yo debo tener un valor referencial. Sí, es decir, yo estoy
analizando ahora mismo esto de la pandemia que está existiendo, ¿no?
00:30:06.590 --> 00:30:12.270
Hugo Rolando Sanchez Quispe
Entonces es algo preocupante, a lo mejor yo deme un momentito, por favor.
00:31:26.110 --> 00:31:44.990
Hugo Rolando Sanchez Quispe
Bien, chicos, vamos a continuar, ¿no? Entonces es una forma, como les dije, de
plantearse las hipótesis y lo que les estaba explicando es que cuando yo trabajo con
una hipótesis, perdón, con una te de student para una muestra, debo tener algo
global y estaba haciendo énfasis en el caso del COVID, ¿no?
00:31:45.310 --> 00:31:51.870
Hugo Rolando Sanchez Quispe
O de la nueva variante que está existiendo, entonces a lo mejor existe una
preocupación, ¿será que va a existir nuevamente?
00:31:53.190 --> 00:32:13.670
Hugo Rolando Sanchez Quispe
Todo vamos a tener que encerrarnos. ¿Entonces, qué debería hacer? Voy a lo mejor
a sacar una media, sí, una media de los casos que están ingresando a un hospital o
a un subcentro, y obviamente yo voy a tener un valor referencial del 2019 que
empezó la pandemia, ¿no?
00:32:14.270 --> 00:32:35.710
Hugo Rolando Sanchez Quispe
Entonces, si yo encuentro, por ejemplo, relación o que las diferencias son
significativas, es decir, no tienen nada que ver, entonces obviamente no tendría por
qué alarmarme, pero si no hay diferencias significativas, es decir, que casi que la
media que yo tuve en el dos mil diecinueve tiende a tener.
00:32:35.830 --> 00:32:56.190
Hugo Rolando Sanchez Quispe
La misma media en este momento, pues sería alarmante, ¿no? Porque estamos
entrando en un lapso de que evidentemente voy a tener un una nueva pandemia o
en su defecto, si la media que hoy estoy teniendo es mucho más alta, es decir, hay
una diferencia totalmente significativa mayor.
00:32:56.270 --> 00:33:15.590
Hugo Rolando Sanchez Quispe
Entonces estamos entrando en un en un problema, no porque nuevamente vamos a
tener problemas de de de ingresos al hospital y sería un caos nuevamente.
Entonces esa es una forma de trabajar con esta T de Student para una muestra, es
decir, yo debo tener un valor referencial.
00:33:15.710 --> 00:33:18.430
Hugo Rolando Sanchez Quispe
Es decir, la se llama esto.
00:33:19.710 --> 00:33:36.790
Hugo Rolando Sanchez Quispe
La media poblacional y vamos a comparar con una media muestral. Sí, esto es lo
importante para una Ed Student para una muestra. No tenemos acá las muestras
independientes y habíamos dicho que aquí lo esencial es que ambas.
00:33:37.870 --> 00:33:51.670
Hugo Rolando Sanchez Quispe
Deben ser medidas las varianzas para utilizar una u otra fórmula, no de como yo
planteo la hipótesis nula, me dice que las medias en los 2 grupos es la misma o la
otra, la media de los grupos es distinta.
00:33:52.910 --> 00:34:11.350
Hugo Rolando Sanchez Quispe
Muestras relacionadas hace referencia al cero. Recordemos mucho cuando hablo de
referencial o de relacionadas cuando yo hago la dieta, no, entonces la dieta va a
tener un valor estándar para ver si subió o bajo. Entonces la hipótesis nula me dice
la media de las diferencias entre los pesos o los pares de cero.
00:34:11.590 --> 00:34:18.030
Hugo Rolando Sanchez Quispe
¿O la media de las diferencias entre los pares no es cero, nada más o k cómo
encuentro yo la T de Student?
00:34:19.390 --> 00:34:39.150
Hugo Rolando Sanchez Quispe
Para cada caso hay una forma de encontrar la T de Student, no pues voy a vamos a
quedarnos aquí simplemente en la primera muestra para, perdón, la primera prueba
T de Student para una muestra y seguiré yo subiendo material la siguiente semana
para el resto de casos. No quiero avanzar también con el software.
00:34:40.190 --> 00:35:01.110
Hugo Rolando Sanchez Quispe
Bien, ¿cómo encuentro yo la prueba de T de Student para encontrar la prueba o
para yo tomar una decisión de la T de Student? Nosotros ya utilizamos los valores Z,
una tabla Z para hacer la distribución normal o encontrar valores probabilísticos a
través de la distribución normal. Entonces, de igual manera, yo aquí voy a tener.
00:35:01.310 --> 00:35:21.430
Hugo Rolando Sanchez Quispe
2 formas de encontrar ese valor o de tomar una decisión, ya sea el valor crítico T.
En este caso voy a utilizar otra tabla, ya no la tabla Z, sino el valor crítico T o en su
defecto el valor P que tiene cada una de las pruebas. Por ejemplo, voy a trabajar
con la T de Student, tengo un valor.
00:35:21.550 --> 00:35:32.110
Hugo Rolando Sanchez Quispe
¿De significancia de la prueba, entonces voy a comparar con el nivel de
significancia de la investigación, que generalmente es del 0,05, ya entonces tengo
2 formas de poder decidir esto, no?
00:35:33.550 --> 00:35:42.590
Hugo Rolando Sanchez Quispe
¿Bien, en dónde estamos aquí? Entonces, ¿cómo yo encuentro la T de Student?
Fácil, no encuentro la diferencia de los valores medios, es decir, si voy a trabajar.
00:35:43.670 --> 00:36:03.910
Hugo Rolando Sanchez Quispe
Con 1.1 sola muestra, yo voy a tener la media muestral que ya saben cómo se saca,
no se suma todos los valores, se divide para la cantidad de valores y una media
referencial, haciendo claro el ejemplo que acabé de hacer con la pandemia.
Entonces yo ya tengo una media de hace algunos años. En el 2019 tengo.
00:36:04.030 --> 00:36:10.030
Hugo Rolando Sanchez Quispe
Una media de atenciones en los hospitales, entonces eso sería la referencial ahora.
00:36:11.070 --> 00:36:30.230
Hugo Rolando Sanchez Quispe
Eso tengo que dividir para un error estándar de la media. ¿Y cómo encuentro yo?
Ese es el valor estándar de la media dividiendo la desviación típica para la raíz
cuadrada de n. Ustedes ya saben cómo encontrar la desviación típica. Entonces
aquí les voy a poner la formulita para encontrar la desviación típica que era.
00:36:30.350 --> 00:36:43.630
Hugo Rolando Sanchez Quispe
S o en su defecto, el famoso sigma, no, pero para encontrar sigma yo debería
primero encontrar la varianza que es sigma al cuadrado, no, entonces sigma al
cuadrado no es más que.
00:36:45.230 --> 00:36:50.710
Hugo Rolando Sanchez Quispe
La sumatoria, sí, la sumatoria de cada valor, es decir, xy.
00:36:51.870 --> 00:37:11.150
Hugo Rolando Sanchez Quispe
xy menos la media aritmética muestral no esto elevado al cuadrado sí Y esto lo
vamos a ir haciendo para cada valor entonces aquí voy a poner puntos suspensivos
porque va a ir para todos los valores y Esto va a ser dividido para n menos uno
00:37:11.230 --> 00:37:33.750
Hugo Rolando Sanchez Quispe
No, ojo con esto, n menos 1, porque voy a trabajar con los valores muestrales de
una población, n menos 1, listo. Entonces, como ya sé cómo sacar la varianza, la
desviación típica lo único que es sacar la raíz cuadrada de la varianza, nada más, y
dividimos para esta raíz de los datos y vamos a tener el valor t. Este valor t, como
les dije yo.
00:37:33.870 --> 00:37:57.710
Hugo Rolando Sanchez Quispe
Puedo comparar, ya sea con el valor crítico o en su defecto, analizar el nivel de
significancia de la prueba con respecto al nivel de la significancia de la
investigación. Okay, entonces eso prácticamente es eso. No voy a entrar mucho en
detalle a las muestras independientes porque no voy a hacer ningún ejercicio, pero
si ustedes se fijan ya.
00:37:57.870 --> 00:38:16.750
Hugo Rolando Sanchez Quispe
Va cambiando la fórmula, no es la misma. Y ojo, no que aquí esta es para cuando
las varianzas son iguales, es decir, varianza uno es igual a la varianza 2. Cuando
son, cuando no son iguales, hay otra fórmula, incluso para los grados de libertad
que necesito encontrar el valor crítico. no?
00:38:17.310 --> 00:38:37.550
Hugo Rolando Sanchez Quispe
Muestras relacionadas igual tienen otra fórmula, sí, y voy con el primer ejercicio,
chicos. Algo que es importante aquí de escribir antes de empezar con la parte
práctica es que lo único que hace la el T de Student es analizar la variabilidad que
tiene.
00:38:37.950 --> 00:38:38.790
Hugo Rolando Sanchez Quispe
Las.
00:38:39.790 --> 00:38:58.830
Hugo Rolando Sanchez Quispe
Medias, nada más, algo fundamental, mientras más dispersos que estén los valores
en análisis, más pequeña va a ser la el valor de TD Student. no? En cambio,
mientras más juntos estén, sí, como ustedes pueden ver, acá están más juntos, la
TD Student va a ser o tiende a ser un poco más grande. no?
00:38:59.150 --> 00:39:05.910
Hugo Rolando Sanchez Quispe
Eso nada más y seguimos entonces con el primer ejercicio. Estos son los pasos que
yo debo seguir para.
00:39:07.110 --> 00:39:29.990
Hugo Rolando Sanchez Quispe
Demostrar una hipótesis, hipótesis estadísticas, la nula, la alternativa, niveles de
significancia. Aquí están algunos niveles de significancia que yo puedo trabajar.
Generalmente yo trabajo con el 0,05, pero en este ejercicio creo que nos va a pedir
para el 0,01 los datos que necesito para trabajar, la media aritmética, la media
aritmética global.
00:39:30.070 --> 00:39:53.750
Hugo Rolando Sanchez Quispe
La desviación típica, la cantidad de datos y los grados de libertad para trabajar con
la tabla, no la parte estadística. Aquí yo tengo que marcar el modelo estadístico, ya
sea de una muestra, muestras independientes relacionadas, la distribución, si voy a
trabajar con 2 colas, con una cola superior o derecha, una cola inferior o izquierda.
Criterios de decisión depende mucho del trabajo.
00:39:54.590 --> 00:40:17.350
Hugo Rolando Sanchez Quispe
De investigación, los cálculos respectivos y la decisión. Finalmente, si acepto,
rechazo la hipótesis nula. Entonces tengo el primer ejercicio, menciona que en
Orellana el costo promedio para el trámite de una queja de una cooperativa es de
60 USD. Se tomaron medidas para reducir el costo. En ese sentido, se seleccionó
una muestra de 26 quejas con la siguiente tabulación.
00:40:17.430 --> 00:40:42.230
Hugo Rolando Sanchez Quispe
Entonces esto hice a los usuarios, no se hizo a los usuarios para ver efectivamente
si es que están cobrando de más o puedo hacer algo, ¿no? Entonces ya de entrada
yo tengo una media referencial, esa es la media global, este es el UU es igual a 60.
Miren, ya tengo una referencia y lo que tendría que hacer es encontrar la media
aritmética, la desviación estándar.
00:40:42.310 --> 00:40:59.030
Hugo Rolando Sanchez Quispe
Y luego aplicar la fórmula nada más. Y ojo que aquí me está dando ya el nivel de
significancia para trabajar este tipo de casos, no los datos o los pasos eran 8,
entonces planteo la hipótesis, la hipótesis va a ser mayor, igual que 60.
00:40:59.870 --> 00:41:17.990
Hugo Rolando Sanchez Quispe
Menor que 60 tengo el nivel de significación de 0,01 tengo los datos, esto ojo que
esto ustedes lo tienen que comprobar en casa, no encontrar la desviación típica, si
lo van a encontrar la desviación típica con esta fórmula que he recordado aquí para
que ustedes lo.
00:41:18.910 --> 00:41:37.390
Hugo Rolando Sanchez Quispe
Lo hagan en casa, en el cuaderno y practiquen, no, aquí ya lo tengo resuelto, así
que no me voy a demorar mucho. Ya tengo los grados de libertad es importantísimo,
los grados de libertad en este caso, no en todos los casos. En este caso, cuando voy
a trabajar con una sola muestra es n menos 1, es decir, tengo 26 datos que tomé.
00:41:37.470 --> 00:41:54.550
Hugo Rolando Sanchez Quispe
Menos 1 sería 25. ¿Cuál es el modelo estadístico? El modelo estadístico para una
muestra es esto, no la media muestral menos menos la media global sobre la
desviación típica dividido para la raíz cuadrada de n, que es la cantidad total de
datos. Esto es importante.
00:41:55.590 --> 00:42:05.110
Hugo Rolando Sanchez Quispe
¿Marcar el modelo de distribución, si voy a trabajar con una cola, 2 colas, entonces
cuando yo interpreto aquí me está diciendo, no?
00:42:06.870 --> 00:42:25.790
Hugo Rolando Sanchez Quispe
Es razonable concluir que el costo medio de atención de una queja es menor. Sí, es
menor. Yo esto yo ahí ya expliqué en lo que es distribución normal. Cuando yo tengo
en la campana de gauss, los valores que están a la izquierda son menores, los que
están a la derecha son mayores.
00:42:25.910 --> 00:42:47.030
Hugo Rolando Sanchez Quispe
Entonces, como me dice menor, pues es evidente que no voy a trabajar con las 2
colas, es decir, con la cola a izquierda en la cola derecha. Tengo que analizar
específicamente los valores menores al 60, es decir, voy a trabajar con la cola
izquierda, sí, con la cola izquierda. Entonces eso es importante y es lo que estoy
poniendo acá, ¿no?
00:42:48.950 --> 00:43:12.270
Hugo Rolando Sanchez Quispe
se analiza solamente la cola izquierda con un nivel de significación del cero coma
cero uno es decir voy a tener una zona de aceptación del noventa y nueve por
ciento no y lo que pasa acá pues será absolutamente factible dentro de la
investigación Okay entonces reemplazamos valores nada más Los criterios de
decisión No si te calculada Es mayor que te tabulada
00:43:12.350 --> 00:43:31.680
Hugo Rolando Sanchez Quispe
septo la hipótesis nula si te calculara es menor o igual que la tabulada entonces
rechazo la hipótesis nula hago los cálculos y he encontrado el valor de menos 1,818
decisión el menos 1,818 es mayor que el menos 2,4851
00:43:31.710 --> 00:43:50.710
Hugo Rolando Sanchez Quispe
Entonces, el costo medio de la atención de una queja es menor que 60 USD. ¿Por
qué? Porque aquí estoy aceptando la hipótesis nula. Ahora, ¿cómo encuentro este
valor? Ya este valor yo la encuentro con la tabla del test.
00:43:51.190 --> 00:43:54.670
Hugo Rolando Sanchez Quispe
No encuentro con la tablita T Student que está por acá.
00:43:56.870 --> 00:43:58.710
Hugo Rolando Sanchez Quispe
Aquí está la tabla T Student.
00:44:03.590 --> 00:44:22.750
Hugo Rolando Sanchez Quispe
Esperar que se abra ya, esta es la tabla Test Student, no lo pueden encontrar en
Internet, ponen valores críticos Test Student y les sale. Entonces, cómo interpreto
en la parte superior? Yo tengo los niveles de significancia cero 25 0,1 0,05, 0,025,
0,01 y 0,00.
00:44:22.910 --> 00:44:43.430
Hugo Rolando Sanchez Quispe
5 ya entonces yo estoy trabajando o el ejercicio me pide que analice con el cero
coma cero uno. Entonces este sería mi primer valor y los grados de libertad para
este caso, para cuando yo trabajo con una sola muestra, dijimos que era el número
total de datos menos 1, que era 26 menos 125.
00:44:43.750 --> 00:45:03.470
Hugo Rolando Sanchez Quispe
Entonces me voy acá, aquí están los grados de libertad, sería 25 y voy a hacer la
intersección y miren, aquí tengo 2,4851. Este es el valor con el que tengo que
comparar con el calculado, sí, con el calculado 2,4851.
00:45:04.070 --> 00:45:14.950
Hugo Rolando Sanchez Quispe
Sí, si nos vamos acá, efectivamente tengo el valor 2,4851, sí, 2,4851. ¿Ahora por
qué le puse yo negativo?
00:45:16.550 --> 00:45:32.870
Hugo Rolando Sanchez Quispe
Si yo estoy analizando la de Gauss, aquí yo tengo el cero. Como estoy hacia la
izquierda, evidentemente que debo poner el signo que corresponde, no porque del
cero a la izquierda son negativos y el cero a la derecha positivos. Por eso es que yo
acá lo puse negativo, aquí está.
00:45:33.830 --> 00:45:43.270
Hugo Rolando Sanchez Quispe
Negativos coma 4851 o KY chicos, eso ha sido todo con respecto a la parte algebra.
00:45:45.350 --> 00:45:47.710
Hugo Rolando Sanchez Quispe
A otra, acepto, si lo rapidito es.
00:45:48.950 --> 00:45:50.750
Hugo Rolando Sanchez Quispe
Con el SPCS.
00:45:51.990 --> 00:46:09.350
Hugo Rolando Sanchez Quispe
Sí, vamos a ver si es que nos habilita rápido y también voy a abrir Python, no,
también voy a abrir Python. En mi caso yo tengo el intérprete de Spyder para evitar
haciendo la programación. Voy a abrir ambos programas para que se pueda
evidenciar.
00:47:45.110 --> 00:47:49.830
Hugo Rolando Sanchez Quispe
Bueno, creo que se me fue un ratito, pero ya regresó, ¿no?
00:47:54.270 --> 00:47:54.710
Hugo Rolando Sanchez Quispe
Yeah.
00:47:58.550 --> 00:47:58.710
Hugo Rolando Sanchez Quispe
Y.
00:48:06.030 --> 00:48:14.270
Hugo Rolando Sanchez Quispe
Python necesito el numpay, el numpay me sirve para hacer cálculos matemáticos y
que creería que no va a haber.
00:48:27.190 --> 00:48:28.790
Hugo Rolando Sanchez Quispe
Dios mío, este internet.
00:48:35.270 --> 00:48:37.270
Hugo Rolando Sanchez Quispe
Estoy teniendo problemas con el Internet.
00:48:38.190 --> 00:48:39.750
Hugo Rolando Sanchez Quispe
Yes, pero...
00:48:40.790 --> 00:48:49.150
Hugo Rolando Sanchez Quispe
Entonces en un pay y también el paquete estadístico. Miren lo que estoy haciendo,
estoy creando un array con la muestra.
00:48:50.470 --> 00:48:51.830
Hugo Rolando Sanchez Quispe
It's a.
00:48:53.030 --> 00:48:58.190
Hugo Rolando Sanchez Quispe
Está y estoy poniendo todos los datos que tengo.
00:48:59.150 --> 00:49:06.230
Hugo Rolando Sanchez Quispe
Como pregunta del ejercicio, no los que poblacional, aquí está la media poblacional,
que era los 60 y.
00:49:08.230 --> 00:49:26.830
Hugo Rolando Sanchez Quispe
Lo voy a Python que efectivamente haga la t de student para una muestra es lo que
estoy diciendo, créame los valores tanto del test student, dame el y análisis el test,
el array que yo cree de la muestra junto con la media y compara.
00:49:27.350 --> 00:49:36.150
Hugo Rolando Sanchez Quispe
No hay compara con la media pueblo, este caso es 60. No siempre tienen que
declarar todas las variables que estoy pidiendo para que no haya error.
00:49:37.430 --> 00:49:49.110
Hugo Rolando Sanchez Quispe
Finalmente, lo que hago es imprimir tanto el estadio. Entonces, esto es algo. Yo aquí
estoy diciendo que me arroje directamente, si es que voy a aceptar o voy a.
00:49:50.630 --> 00:50:09.430
Hugo Rolando Sanchez Quispe
¿Sale hipótesis nula, pero lo ha puesto, no? Ojo que este software, perdón, este
algoritmo está en el Internet, no es que tampoco yo me inventé o hay cosas que se
va programando en ese momento. Creo que ustedes más bien van a aprender a
crear nuevos modelos que hagan.
00:50:09.550 --> 00:50:28.710
Hugo Rolando Sanchez Quispe
justamente lo que yo estoy haciendo en este momento no entonces solamente doy
eh correr el programa y ya tengo miren ya tengo el valor efectivamente tengo un p
valor del cero coma cero ocho y el valor t Student no menos uno coma ochenta y
uno o sea muy muy muy rápido no tuve que hacer ningún tipo de cálculo
00:50:28.990 --> 00:50:30.630
Hugo Rolando Sanchez Quispe
¿Y este valor debo comparar?
00:50:32.550 --> 00:50:34.190
Hugo Rolando Sanchez Quispe
Arco tabula.
00:50:36.830 --> 00:50:56.230
Hugo Rolando Sanchez Quispe
El valor de la prueba no el nivel de significancia de la prueba, que en este caso sería
el 0,05. Entonces sería mayor no el 0,08 es mayor que el 0,05 y ya puedo también
concluir no respecto al Python. Ojo que si no tienen instalado Python esto ustedes lo
pueden.
00:50:56.950 --> 00:51:15.350
Hugo Rolando Sanchez Quispe
Correr también en Google Colab. Entonces no lo voy a hacer porque ustedes están
viendo que tengo problemas de conectividad, así que quedaría para una próxima
ocasión. Ojalá tenga un mejor internet y pueda probar el mismo código, pero en
Google Colab. No, entonces yo voy a salirme de esta herramienta.
00:51:16.310 --> 00:51:35.150
Hugo Rolando Sanchez Quispe
Y quedaría pendiente el SPCS. Veamos si es que ayuda un poco el software, perdón,
el Internet. Voy a poner acá una variable que sea datos, es una variable escalar.
00:51:36.870 --> 00:51:40.590
Hugo Rolando Sanchez Quispe
No tiene ningún tipo de decimales y voy a copiar.
00:51:44.710 --> 00:52:03.110
Hugo Rolando Sanchez Quispe
Tenía por acá ella los datos, son los 26 datos, sí son los 26 datos, me voy a vista de
datos y voy a copiar los datos, no, ya está. Entonces hago lo mismo que hemos
venido haciendo en el SPSS y miren aquí cuando yo doy a analizar.
00:52:03.190 --> 00:52:22.790
Hugo Rolando Sanchez Quispe
¿Qué características tiene la TD Studen? Es que estoy comparando medias, así que
no voy acá a comparación de medias. Es decir, miren, tengo todas las pruebas que
he venido yo explicando en la parte teórica, no TD Student para una muestra, TD
Student para muestras independientes, para muestras relacionadas y la nueva que
veremos más adelante.
00:52:23.270 --> 00:52:46.110
Hugo Rolando Sanchez Quispe
Entonces voy a trabajar TD Student para una muestra porque solamente tengo una
muestra y arrojo o arrastro los valores numéricos acá. Aquí viene el valor de prueba,
en este caso es 60. Debo analizar el valor 60 en opciones debo verificar que
efectivamente tenga el nivel de confianza. Recuerden que no estoy trabajando ya
con el 95% me dijo que trabaje.
00:52:46.310 --> 00:53:01.350
Hugo Rolando Sanchez Quispe
Con un nivel de significación del 0,01, es decir, el nivel de confianza es 99. Cambio
eso y simplemente doy a aceptar y efectivamente voy a tener ya la prueba T de
Stude para.
00:53:02.470 --> 00:53:03.350
Hugo Rolando Sanchez Quispe
Este valor.
00:53:04.470 --> 00:53:23.390
Hugo Rolando Sanchez Quispe
Y aquí está, no, el valor es de 1,817, el mismo valor que me dio Python, el mismo
valor que me dio el cálculo algebraico y el mismo valor me acaba de dar SPCS. Bien,
chicos, espero que este video lo puedan revisar de mi parte, pues les agradezco que
revisen que.

También podría gustarte