Estadística
Los datos no útiles asi x si solos. Necesitan ser procesados para ser útlies a la hora de la toma de
decisiones. La estadística aporta las técnicas para poder analizar y procesar esos datos.
Es el arte y la ciencia de diseñar estudios y analizar datos resultantes de esos estudios, para
comprender el mundo q nos rodea. Los datos necesitan estar estructurados, organizados y
contextualizados para q sirvan.
Analizan, interpretación y presentarlos ese es la tarea de la estadística de esta materia.
Los datos numéricos son represantados en tablas, mapas, graficos, allí los datos pasan a ser info, y
están aptos para ser analizados e interpretados.
Contador: sirve para hacer auditoria usando técnicas de muestreo: en vez de ir a todas las pymes,
voy a las importantes.
Marketing: análisis de promociones y ventas
Finanzas: análisis técnico de acciones
Economía: hacer modelos para predecir comportaminetos.
Población son todos los individuos q son objeto de un estudi (x ej todas las pymes de bs as), en
cambio muestra son esos pocos q eligo para hacer el estudio, donde toda la población está
representada.
Estadística descriptiva: resume los datos para nuestro estudio q vienen de una muestra o de una
población y produce gráficos de tal info
Estadística inferencial: se concentra en deducir características de una población a través de una
muestra
Técnicas descriptivas:
Antes definir q es una variable: peso, altura, ingreso, cantidad empleados. Puede ser cuantitativas
(numéricas, son observaciones q son cantidades), y las cualitativas (son cateogoricas, si o no,
verdadero o falso, alto o baja)
Las cuanti pueden ser discretas (si los valores son finitos o numerables, cantidad de…) o continuas
(tiempo, peso, altura, ingreso). Interesa describir x donde andan todas las observaciones, cual es el
centro
Las cuali interesa el tamaño relativo de cada categoría
Para armar la longitud del intervalo: restar el dato máximo con el dato mínimo y dividirlo por la
reiz de la cantidad de datos
La frecuencia es la cantidad de datos en los intervalos
Un histograma es pasar a gráfico los intervalos y las frecuencias, el ancho de la columna, es decir,
el ancho alrededor de del eje de las x, es el intervalo
La superficie es proporcional a la frecuencia de cada barra
Si hago ese mismo histograma con la frecuencia relativa, va a seguir igual, lo único q va a cambiar
Polígono de frecuencia: unir el punto medio del intervalo de clase con una recta. Para terminar ese
polígono, se toma la mitad de las barras de las puntas, y se llega al eje x, tomando lo q mide la
mitad de cada una de las barras extremas, a ambas lados.
La superficie de ese polígono, es igual ala área del histograma.
En un histo vemos si los datos están todos juntos, o hay alguno separado. También si hay un solo
picp, o dos picos. También si hay simetría (un lado es espejo de otro), o si no la hay, es decir, si hay
sesgo a izquierda o a derecha.
Una de las maneras de ver dodne está el centro de los datos, se puede hacer un resumen
numérico. Cuando ese resumen refiere a una población se llama parámetro, si es sobre una
muestra es estadístico.
La media, la mediana, la moda, son las estádisticas q describen el centro
La dispersión, la variabilidad, la distancia entre las variables, se encuentra rango, desvoación
estándar, rango intercuartilico.
Media: pormedio. Sumar todo y dividirlo por el total de los datos
Mediana: es un valor, q as u izquierda se encuentra el 50. X raya
5 de los datos y a su derecha el 50% de los otros datos. Deja dos partes iguales, en cantidad, no
hacen fakta los valores. Hay q ordenar los datos de mayor, el q está en el medio, es la mediana. Si
ña cantidad es par, los dos del centro, se suman y se dividen por dos. X tilde
En distribuciones sesgadas la media es tirada hacia la cola más grande.
En distribuciones cesgadas, la mediana es la mejor representante.
Cuando hay simetría la media y la mmediana coinciden.
Moda: el valor más frecuente
Media ponderada: cada dato tiene asociado un peso.
Media geométrica: cuando se habla de crecimiento porcentual promedio. Para una cantidad n de
datos, se define como la raíz n del producto de todos los datos.
Medidas de variabilidad:
Rango: la dif entre el dato más grande y el más chcio
Desviación estándar: Sacar la distancia entre cada dato y la media, al cuadrado, dividido n-1
Coeficiente de variación: el desvío estadanr dividio el valor absoluto de la media.
Rango intercuartiílico: distancia entre el primer y tercer cuartil.
Rango: diferencia entre el valor más alto y el más chico
Percentil: hay q tener los datos ordenados, me dicenq porcentaje de datos quedan x debajo del
percentil q estamos hablando. La mediana es el 50 percentil, xq deja 50 de los datos a ambos
lados. El percentil 10, deja 10 el 10% de la distribución x debajo de ella.
Cuartiles: dividen en 4 partes iguales a la distribución. Los percentiles 25 (q1), 50 (q2) y 75 (q3) son
llamados cuartiles xq dejan ¼ de la distribución a derecha y a sus izquierdas.
El desvío estándar depende de la media q es sensible a los valores atípicos, pero el ric depende de
la mediana q no es sensible a valores atípicos.
Un valor atiíco son aquellos alejados del centro, de la mediana. Un valor atípico se puede
encontrar si está a una distancia 1,5 de más del primer o tercer quartil. Es decir hago: q1-1,5ric (el
ric es la dif entre el valor más alto y el más chico) o q3+1,5ric.
Construcción de la caja, cada extemo es un quartil, la línea del medio es la mediana. Los bigotes
q1-1,5 ric y el otro q3+1,5ric (si el ric es más chico, q el último dato, el bigote va ahasta el último
dato, no va hasta el numero pequeñísimo, lo mismo para un dato alto, inclusive, si hay un valor
muchísimo más alto, allí, ese valor alto, va a ser un valor atípico). Es decir, q los cálculos, q hice al
principio del párrafo funcionan como límites, es decir, el bigote no puede ir más allí de ese dato.
El centro de los datos esta cerca de la columna más alta, donde esta la moda
UNIDAD 2
Teoria de probabilidades se estudian procesos q no se sabe cual va a ser su resultado. Si yo digo
q hay 90 porciento de probabilidad de q apruebe el examen, significa, q si rindo el examen muchas
veces, el 9º % de esas veces aprobaría, y el 10% no lo haría. Es decir, la probabilid. Tiene q ver con
la frecuencia de veces con la q salga la cosa, el clima, la nota, etc.
Experiemetno aleatorio: procso por el cual, se obtiene un resultado. Se puede repetir en
condiciones idénticas, no se puede predecir el resultado, pero si sus probabilidades. X ejemplo
lanzar un dado
ESPACIO MUESTRAL: Conjunto de todos los resultados posibles. X EJ cualquiera de los 6 dados. Se
suele utilizar la letra omega para los distintos resultados.
Evento: un subconjunto del espacio muestral
Evento simple o elemental: tiene un solo resultado posible. Formado por un único elemento.
Complemento de a: todo lo q está en omega (espacio muestral), pero no está en a (evento)
Intersección: ocurren los dos elementos simultanaemnte. Donde se cruzan.
Unión: ocurre al menos uno de los dos. O en ambos
Diferencia: ocurre b pero no ocurre a. B intersección A complemento (lo q no está en A)
Eventos disjuntos: no comparten ningún resultado en común
Diferencia: A-B . el evento de los resultados q no pertenecen a B, pero si a A
Porbabilidad: A cada evento de un espacio muestral, le hace corresponder un valor, q se llama
p(A).
Porbabilidad está en el intervalo 0-1 (es un abuso decir q hay un 70% de prob de lluvia)
En un espacio finito o infinito numerable, la suma de las probab. De todos los eventos simples es 1.
Hasta las 8:45. Hata espacio muestral equiprobable.
CLASE DEL 15/03
La esta es una rama de la mate q x si sola no me dice nada. Separa lo q es dato de lo q es info
(procesar datos, y extraer conocimiento de ellos). Esa info me permite la toma de desiciones.
Es la ciencia y el arte de dar conocimiento del mundo q nos rodea a partir de los datos q podamos
recoger. También permite diseñar los estudios.
Reune datos, los analiza, los presenta, y l los interpreta. En la materia no vamos a reunir datos.
La estadític descpritiva muestra la foto. La infrenecial, saca conclusiones de la descriptiva.
Las variables son características q se observan de las cosas a las q se estudia.
Cuantitativas: son numéricas, corresponden a variables q se miden numéricamente. Hay dos clases
las de conteo, discretas, q son cantidad de… cantidad de pantalones q tengo en mi placar, cantidad
de fosforos en mi caja. Y x otra parte están las continuas, q son tales como el peso (una persona
pesa 64, otra 89, así sucesivamente tiene hasta grado infinito), el tiempo, la altura. Son infinas,
pero muchas veces se limitan las continuas.
Cualitativas: observaciones donde los resultados son categorías: hombre o mujer, asiste o no
asisitió.
Nombre de aglomerado, sexo, son cuaitativas. Edad es cuantitativa, es continua x convenencia.
Tabla de frecuencia: organizar la info en intervalos, q cubren todo slos rangos posibles de esa
variable cuantitativa, y dice cuantas diferencias encuentre en ese rango
La suma de las áreas, es proporcional a la cantidad de la muestra (grafico de geogebra)
Poligono de frecuencia: unir cada punto más alto de cada gráfico.
Una pregunta: cual será una observación representativa de los datos: es una preg q se responde
cuando puedo descrbir los datos con una medida de centro de la distribución: media, mediana,
moda.
Otra pregunta: tengo dos observaciones, cuán similares son: se responder en base en cuanto cuan
distantes están las variables.
La mediana es el dato q parte a la distribución en dos partes.
BIBLIO: ANDERSON Y NEWBOLD.