0% encontró este documento útil (0 votos)
34 vistas4 páginas

Fórmulas R para Regresión y ANOVA

Cargado por

south.alecxs
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
34 vistas4 páginas

Fórmulas R para Regresión y ANOVA

Cargado por

south.alecxs
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Para abordar estos temas en R, te proporcionaré las fórmulas clave y ejemplos

enfocados principalmente en regresión lineal múltiple y regresión logística


binomial, que son fundamentales en análisis de datos. También mencionaré
brevemente otros temas.

1. Independencia

No requiere fórmulas en R, pero es una suposición básica en muchos modelos


estadísticos, como la regresión lineal y logística.

2. Bondad de ajuste (Goodness of fit)

• Chi-cuadrado (multinomial):

Copiar código

[Link](tu_tabla)

Esto evalúa la bondad de ajuste de un modelo a través de la prueba de Chi-


cuadrado.

3. ANOVA (Análisis de Varianza)

• ANOVA un solo factor:

Copiar código

anova_model <- aov(variable_respuesta ~ factor_independiente, data=tu_data)

summary(anova_model)

• Prueba de Levene (para homogeneidad de varianzas):

Copiar código

library(car)

leveneTest(variable_respuesta ~ factor_independiente, data=tu_data)

• ANOVA tradicional:

Copiar código

anova([Link])

• Pruebas de comparación múltiple (Tukey):

Copiar código

TukeyHSD(anova_model)

4. Regresión Lineal Múltiple

• Ajustar un modelo de regresión lineal múltiple:


Copiar código

[Link] = lm(y ~ x1 + x2 + x3, data=tu_data)

summary([Link])

o Interpretación de variables cualitativas: Las variables categóricas


se manejan automáticamente en R como factores. Los coeficientes
de estas variables representan el cambio en la respuesta en relación
con el nivel de referencia.

• Prueba t (significancia individual de coeficientes): Los valores t y p se


obtienen directamente del summary() del modelo.

• Prueba F (significancia global del modelo): También aparece en el


summary() del modelo, donde el valor F y el p-valor asociado indican si el
modelo es significativamente mejor que un modelo sin variables
independientes.

• Multicolinealidad (VIF):

Copiar código

library(car)

vif([Link])

• Coeficiente de determinación (R-squared): También se obtiene del


summary() del modelo:

Copiar código

summary([Link])$[Link]

• Predicción:

Copiar código

new_data <- [Link](x1=10, x2=5, x3=3)

predict([Link], newdata = new_data)

5. Regresión Logística Binomial

• Ajustar el modelo de regresión logística:

Copiar código

logit_model <- glm(y ~ x1 + x2 + x3, data=tu_data, family=binomial)

summary(logit_model)
o Interpretación de odds ratio: Para obtener los odds ratio a partir de
los coeficientes del modelo:

Copiar código

exp(coef(logit_model))

o Evaluación de significancia: Se hace a través de las pruebas t y F,


mostradas en el summary() del modelo.

o Bondad de ajuste (Prueba de Hosmer-Lemeshow):

Copiar código

library(ResourceSelection)

[Link](tu_data$y, fitted(logit_model))

o Curva ROC y AUC (para evaluar el poder predictivo):

Copiar código

library(pROC)

roc_obj <- roc(tu_data$y, fitted(logit_model))

auc(roc_obj)

plot(roc_obj)

o Predicción y clasificación: Para predecir la probabilidad de que un


evento ocurra:

Copiar código

predict(logit_model, newdata=new_data, type="response")

Resumen Final:

1. Regresión Lineal Múltiple:

o lm(): Ajusta el modelo.

o summary(): Proporciona coeficientes, t, F, R-squared.

o vif(): Revisa la multicolinealidad.

o predict(): Predice nuevos valores.

2. Regresión Logística Binomial:

o glm(..., family=binomial): Ajusta el modelo.


o exp(coef()): Interpreta odds ratio.

o [Link](): Verifica la bondad de ajuste.

o roc(): Genera la curva ROC.

o predict(..., type="response"): Predice probabilidades.

Estas fórmulas cubren los principales aspectos de los temas que mencionaste,
con especial énfasis en la regresión logística y la regresión lineal múltiple.

También podría gustarte