Para abordar estos temas en R, te proporcionaré las fórmulas clave y ejemplos
enfocados principalmente en regresión lineal múltiple y regresión logística
binomial, que son fundamentales en análisis de datos. También mencionaré
brevemente otros temas.
1. Independencia
No requiere fórmulas en R, pero es una suposición básica en muchos modelos
estadísticos, como la regresión lineal y logística.
2. Bondad de ajuste (Goodness of fit)
• Chi-cuadrado (multinomial):
Copiar código
[Link](tu_tabla)
Esto evalúa la bondad de ajuste de un modelo a través de la prueba de Chi-
cuadrado.
3. ANOVA (Análisis de Varianza)
• ANOVA un solo factor:
Copiar código
anova_model <- aov(variable_respuesta ~ factor_independiente, data=tu_data)
summary(anova_model)
• Prueba de Levene (para homogeneidad de varianzas):
Copiar código
library(car)
leveneTest(variable_respuesta ~ factor_independiente, data=tu_data)
• ANOVA tradicional:
Copiar código
anova([Link])
• Pruebas de comparación múltiple (Tukey):
Copiar código
TukeyHSD(anova_model)
4. Regresión Lineal Múltiple
• Ajustar un modelo de regresión lineal múltiple:
Copiar código
[Link] = lm(y ~ x1 + x2 + x3, data=tu_data)
summary([Link])
o Interpretación de variables cualitativas: Las variables categóricas
se manejan automáticamente en R como factores. Los coeficientes
de estas variables representan el cambio en la respuesta en relación
con el nivel de referencia.
• Prueba t (significancia individual de coeficientes): Los valores t y p se
obtienen directamente del summary() del modelo.
• Prueba F (significancia global del modelo): También aparece en el
summary() del modelo, donde el valor F y el p-valor asociado indican si el
modelo es significativamente mejor que un modelo sin variables
independientes.
• Multicolinealidad (VIF):
Copiar código
library(car)
vif([Link])
• Coeficiente de determinación (R-squared): También se obtiene del
summary() del modelo:
Copiar código
summary([Link])$[Link]
• Predicción:
Copiar código
new_data <- [Link](x1=10, x2=5, x3=3)
predict([Link], newdata = new_data)
5. Regresión Logística Binomial
• Ajustar el modelo de regresión logística:
Copiar código
logit_model <- glm(y ~ x1 + x2 + x3, data=tu_data, family=binomial)
summary(logit_model)
o Interpretación de odds ratio: Para obtener los odds ratio a partir de
los coeficientes del modelo:
Copiar código
exp(coef(logit_model))
o Evaluación de significancia: Se hace a través de las pruebas t y F,
mostradas en el summary() del modelo.
o Bondad de ajuste (Prueba de Hosmer-Lemeshow):
Copiar código
library(ResourceSelection)
[Link](tu_data$y, fitted(logit_model))
o Curva ROC y AUC (para evaluar el poder predictivo):
Copiar código
library(pROC)
roc_obj <- roc(tu_data$y, fitted(logit_model))
auc(roc_obj)
plot(roc_obj)
o Predicción y clasificación: Para predecir la probabilidad de que un
evento ocurra:
Copiar código
predict(logit_model, newdata=new_data, type="response")
Resumen Final:
1. Regresión Lineal Múltiple:
o lm(): Ajusta el modelo.
o summary(): Proporciona coeficientes, t, F, R-squared.
o vif(): Revisa la multicolinealidad.
o predict(): Predice nuevos valores.
2. Regresión Logística Binomial:
o glm(..., family=binomial): Ajusta el modelo.
o exp(coef()): Interpreta odds ratio.
o [Link](): Verifica la bondad de ajuste.
o roc(): Genera la curva ROC.
o predict(..., type="response"): Predice probabilidades.
Estas fórmulas cubren los principales aspectos de los temas que mencionaste,
con especial énfasis en la regresión logística y la regresión lineal múltiple.