0% encontró este documento útil (0 votos)
5 vistas24 páginas

Regresión Lineal: Teoría y Práctica

El documento aborda la regresión lineal simple y múltiple en el contexto de la estadística inferencial, explicando sus fundamentos, pruebas de hipótesis, calidad del ajuste y uso de software estadístico. Se detallan los métodos de estimación, predicción y evaluación de modelos, así como las suposiciones necesarias para su validez. Además, se menciona la regresión no lineal como una alternativa cuando las relaciones no son lineales.

Cargado por

iind23.vcastrob
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
5 vistas24 páginas

Regresión Lineal: Teoría y Práctica

El documento aborda la regresión lineal simple y múltiple en el contexto de la estadística inferencial, explicando sus fundamentos, pruebas de hipótesis, calidad del ajuste y uso de software estadístico. Se detallan los métodos de estimación, predicción y evaluación de modelos, así como las suposiciones necesarias para su validez. Además, se menciona la regresión no lineal como una alternativa cuando las relaciones no son lineales.

Cargado por

iind23.vcastrob
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

INSTITUTO TECNOLÓGICO SUPERIOR DE COATZACOALCOS

CARRERA: INGENIERÍA INDUSTRIAL


Ciclo escolar: Enero – Junio 2025

Asignatura: Estadística Inferencial ll

Unidad 1: Regresión lineal simple y múltiple

Alumno: Parra Aguilar Guillermo Alejandro

Semestre: 4° Grupo: AI

Nombre del docente: M. I. A. Bricio Jiménez Ventura

Fecha: 05/02/2025

1
INDICE

INTRODUCCIÓN ........................................................................................... 3
1.1. Regresión Lineal simple ....................................................................... 4
1.1.1. Prueba de hipótesis en la regresión lineal
Simple ...........................................................................................................6
1.1.2. Calidad del ajuste en regresión lineal
Simple ...........................................................................................................8
1.1.3. Estimación y predicción por intervalo en regresión lineal simple
………………………………………………………………………………………..9
1.1.4. Uso de software estadístico ............................................................. 11
1.2. Regresión lineal múltiple ..................................................................... 12
1.2.1. Pruebas de hipótesis en regresión lineal
Múltiple ......................................................................................................... 14
1.2.2. Intervalos de confianza y predicción en regresión múltiple ............ 16
1.2.3. Uso de un software estadístico ......................................................... 18
1.3. Regresión no lineal ............................................................................... 20
CONCLUSIÓN............................................................................................... 21
GLOSARIO ................................................................................................... 22
REFERENCIAS ............................................................................................. 23

2
INTRODUCCIÓN

La regresión lineal simple es el modelo más básico y analiza la relación entre


una variable dependiente y una variable independiente a través de una
ecuación lineal. En este contexto, se realizan pruebas de hipótesis para evaluar
si los coeficientes del modelo son significativos, determinando si la variable
independiente tiene un efecto real sobre la dependiente. Además, se estudia
la calidad del ajuste del modelo mediante métricas como el coeficiente de
determinación R2, que mide qué proporción de la variabilidad de la variable
dependiente se explica por la independiente.

También se llevan a cabo estimaciones y predicciones utilizando intervalos de


confianza y predicción, los cuales proporcionan rangos de valores esperados
para nuevas observaciones. Para llevar a cabo estos análisis, es común el uso
de software estadístico como R, Python o SPSS, que facilitan tanto los cálculos
como la interpretación de los resultados.

La regresión lineal múltiple expande el modelo de regresión simple al


incorporar múltiples variables independientes. En este caso, se efectúan
pruebas de hipótesis para evaluar la importancia de cada variable en la
predicción de la variable dependiente. También se utilizan intervalos de
confianza y predicción para medir la incertidumbre de las estimaciones. Al igual
que en la regresión simple, el uso de herramientas estadísticas es crucial para
una correcta implementación y análisis del modelo.

Por último, la regresión no lineal se aplica cuando la relación entre las variables
no puede ser representada de forma adecuada por una línea recta. En estos
casos, se emplean modelos matemáticos más complejos que se ajustan mejor
a los datos. Estos modelos requieren técnicas de estimación avanzadas y
software especializado para su implementación y evaluación.

3
1.1. Regresión Lineal simple

La regresión lineal simple es un modelo estadístico utilizado para analizar la


relación entre una variable dependiente y una variable independiente mediante
una ecuación de la forma:

Para que el modelo de regresión lineal simple sea válido y los resultados sean
confiables, se deben cumplir ciertos supuestos:

1. Relación lineal: La relación entre la variable dependiente Y y la variable


independiente X debe ser aproximadamente lineal. Esto se puede verificar
mediante gráficos de dispersión.

2. Independencia de errores: Los errores (ε\varepsilonε) deben ser


independientes entre sí, lo que implica que las observaciones no deben
estar correlacionadas (por ejemplo, en datos de series temporales, este
supuesto puede no cumplirse).

3. Homocedasticidad: La varianza de los errores debe ser constante a lo


largo de todos los valores de X. Si los errores aumentan o disminuyen
sistemáticamente con X, se presenta heterocedasticidad.

4. Normalidad de los errores: Los errores deben seguir una distribución


normal, especialmente para que las pruebas de hipótesis sean válidas.
Este supuesto se puede evaluar mediante histogramas o pruebas
estadísticas como la prueba de Shapiro-Wilk.

5. Ausencia de valores atípicos: Puntos de datos extremos pueden influir


de manera desproporcionada en los coeficientes estimados y distorsionar
los resultados.

4
Estimación de Parámetros mediante Mínimos Cuadrados

El modelo de regresión lineal simple se ajusta utilizando el método de mínimos


cuadrados ordinarios (MCO), que busca minimizar la suma de los cuadrados de
los residuos (las diferencias entre los valores observados y los valores predichos
por el modelo).

Los coeficientes β0 (intercepto) y β1 (pendiente) se calculan con las siguientes


fórmulas

donde Xˉ y Yˉ representan las medias de X y Y, respectivamente.

Evaluación del Modelo

Después de ajustar el modelo, es importante evaluar qué tan bien se ajusta a los
datos. Para ello, se utilizan varias métricas:

1. Coeficiente de determinación R2R^2R2: Mide la proporción de la


variabilidad en Y explicada por X. Su valor varía entre 0 y 1, donde valores
cercanos a 1 indican un buen ajuste.

2. Error estándar de la estimación: Mide la dispersión de los datos alrededor


de la recta de regresión. Un valor menor indica un mejor ajuste.

3. Pruebas de hipótesis sobre los coeficientes: Se realizan pruebas de


hipótesis para verificar si la pendiente β1 es significativamente diferente de
cero, lo que indicaría que X tiene un efecto significativo sobre Y.

Predicción con la Regresión Lineal Simple

El modelo permite realizar predicciones para nuevos valores de X mediante la


ecuación estimada de la recta de regresión. Además, se pueden calcular
intervalos de confianza para los coeficientes y intervalos de predicción para
nuevas observaciones, lo que proporciona una estimación del rango probable en
el que caerán futuros valores de Y.

5
1.1.1. Prueba de hipótesis en la regresión lineal
Simple.

En la regresión lineal simple, la prueba de hipótesis es un procedimiento


estadístico que permite evaluar la significancia de los coeficientes del modelo, en
particular, la pendiente (β1). Esto ayuda a determinar si la variable independiente
X tiene un efecto significativo sobre la variable dependiente Y.

Hipótesis para la pendiente (β1)

La hipótesis nula (H_0) y la hipótesis alternativa (H_1) se plantean de la siguiente


manera:

• H0: β1 = 0 → No existe una relación lineal entre X y Y (la variable


independiente no tiene un efecto significativo).

• H1: β1 ≠ 0 → Existe una relación lineal significativa entre X y Y (la variable


independiente sí tiene un efecto en la variable dependiente).

Si se rechaza H_0se concluye que la variable independiente tiene un impacto


significativo en la variable dependiente.

Estadístico de Prueba

Para probar estas hipótesis, se utiliza la prueba t de Student, con el siguiente


estadístico de prueba:

donde:
• β^1 es el valor estimado de la pendiente.

• SE(β^1) es el error estándar de la pendiente, que mide la variabilidad de la


estimación.

Este estadístico sigue una distribución t de Studen-t con n−2n - 2n−2 grados de libertad,
donde n es el número de observaciones.

6
Criterio de Decisión

Se compara el valor absoluto del estadístico t con un valor crítico obtenido de la


tabla de distribución ttt para un nivel de significancia α (comúnmente 0.05 o 0.01):

• Si ∣t∣>tcrıˊtico|t| , se rechaza H_0 y se concluye que X tiene un efecto


significativo sobre Y.

• Si ∣t∣≤tcrıˊtico|t] , no se rechaza H_0, lo que sugiere que X no tiene un


efecto significativo sobre Y.

Otra forma de evaluar la significancia es usando el valor p:

• Si p<αp , se rechaza H_0 y se confirma que X influye en Y.

• Si p≥αp, no hay suficiente evidencia para rechazar H_0.

La prueba de hipótesis en la regresión lineal simple permite evaluar si la relación


entre las variables es estadísticamente significativa. Si la pendiente es
significativamente distinta de cero, se puede afirmar con cierto nivel de confianza
que existe una relación entre X y Y. En caso contrario, el modelo podría no ser
adecuado para describir la relación entre las variables.

7
1.1.2. Calidad del ajuste en regresión lineal Simple

La calidad del ajuste en un modelo de regresión lineal simple se refiere a qué


tan bien los valores predichos por el modelo coinciden con los valores observados
en los datos. Evaluar la calidad del ajuste es fundamental para determinar si el
modelo es adecuado para explicar la relación entre las variables.

Existen varias métricas y métodos que se utilizan para evaluar la calidad del ajuste
en regresión lineal simple.

Los residuos son las diferencias entre los valores observados y los valores
predichos por el modelo de regresión. El análisis de los residuos es crucial para
evaluar la calidad del ajuste y verificar que las suposiciones del modelo se
cumplan.

Algunos puntos clave en el análisis de los residuos son:

• Gráficos de Residuos: Un gráfico de residuos muestra si los residuos se


distribuyen de manera aleatoria alrededor de cero. Si los residuos muestran
algún patrón, indica que el modelo no está ajustando correctamente los
datos.
• Normalidad de los Residuos: Es importante que los residuos sigan una
distribución aproximadamente normal para que las inferencias estadísticas
sean válidas. Se pueden realizar pruebas de normalidad (como la prueba
de Shapiro-Wilk) o usar un gráfico de probabilidad normal (Q-Q plot) para
comprobarlo.
• Homocedasticidad: Los residuos deben tener una varianza constante en
todo el rango de los valores predichos. Si la varianza de los residuos
aumenta o disminuye a medida que los valores predichos aumentan, se
dice que hay heterocedasticidad, lo que puede indicar problemas en el
modelo.

Evaluar la calidad del ajuste en la regresión lineal simple es esencial para


determinar la validez del modelo. Las métricas clave incluyen el R2, el análisis de
residuos, el Error Estándar de la Regresión, y las pruebas de hipótesis sobre
los coeficientes. Además, el uso de intervalos de confianza y la visualización
de los resultados son herramientas importantes para asegurar que el modelo sea
adecuado y confiable.

8
1.1.3. Estimación y predicción por intervalo en regresión lineal simple

En la regresión lineal simple, la estimación y predicción por intervalo se


utilizan para cuantificar la incertidumbre asociada con los valores estimados de la
variable dependiente Y. Existen dos tipos principales de intervalos:

1. Intervalo de confianza para la media de Y: Estima el valor promedio de


Y para un valor dado de X.

2. Intervalo de predicción para una nueva observación de Y: Proporciona


un rango en el cual es probable que se encuentre un nuevo valor individual
de Y para un valor dado de X.

Intervalo de Confianza para la Media de Y

El intervalo de confianza (IC) se utiliza para estimar el valor medio esperado de


Y en una población dada un X específico. Se calcula con la fórmula:

donde:

• Y^=β0+β1X es el valor estimado de Y.

• 2,n−2 es el valor crítico de la distribución t de Student con n−2n - 2n−2

• Grados de libertad y un nivel de confianza 1−α1 - α.

• SEY^ es el error estándar de la estimación de Y, dado por:

donde se es el error estándar de la estimación, Xˉ es la media de X y n es el


número de observaciones.

Interpretación

Este intervalo nos indica un rango dentro del cual se espera que se encuentre el
valor promedio de Y para un valor específico de X, con un cierto nivel de confianza
(por ejemplo, 95%).

9
Intervalo de Predicción para una Nueva Observación de Y

El intervalo de predicción (IP) es más amplio que el intervalo de confianza


porque, además de la incertidumbre en la estimación de la media, también
considera la variabilidad natural de los valores individuales de Y.
Se calcula como:

donde el error estándar de predicción se calcula como:

Interpretación

Este intervalo nos proporciona un rango en el cual es probable que se encuentre


un nuevo valor individual de Y para un X dado, con una determinada confianza
(por ejemplo, 95%).

10
1.1.4. Uso de software estadístico

El uso de software estadístico facilita la estimación, interpretación y validación de


modelos de regresión lineal simple. Herramientas como Python, R, Excel,
SPSS y SAS permiten calcular coeficientes, generar gráficos de dispersión,
realizar pruebas de hipótesis y obtener intervalos de confianza y predicción.

Python (con statsmodels y scikit-learn)

Python es ampliamente utilizado para análisis estadístico y modelado de datos.


Se pueden utilizar las bibliotecas statsmodels y scikit-learn para realizar regresión
lineal.

R (con lm)

R es uno de los lenguajes más utilizados para el análisis estadístico.

Excel (Regresión con Herramienta de Análisis de Datos)

1. Ingresar los datos en dos columnas (X e Y).


2. Ir a Datos → Análisis de Datos → Regresión.
3. Seleccionar los rangos de X e Y y marcar la opción de Intervalos de
confianza.
4. Analizar los coeficientes y el valor de R2.

SPSS

1. Analizar → Regresión → Lineal.


2. Seleccionar la variable dependiente (Y) y la independiente (X).
3. Ejecutar el análisis y revisar los coeficientes, R2R^2R2 y p-valores.

El uso de software estadístico permite realizar análisis de regresión lineal


simple de manera eficiente, facilitando la interpretación de resultados y la
validación del modelo. Python y R son las opciones más flexibles, mientras que
Excel y SPSS son más accesibles para usuarios no programadores.

11
1.2. Regresión lineal múltiple

La regresión lineal múltiple es una extensión de la regresión lineal simple, en


la que se utilizan dos o más variables independientes (X1,X2,...,XpX_1, X_2,
..., X_pX1,X2,...,Xp) para predecir una variable dependiente (Y).

Este modelo es útil cuando el comportamiento de Y no puede ser explicado


únicamente por una sola variable.

Modelo Matemático

La ecuación de la regresión lineal múltiple es:

donde:

• Y es la variable dependiente.
• X1,X2,...,XpX_1, X_2, ..., X_pX1,X2,...,Xp son las variables
independientes.
• β0 es el intercepto.
• ,β2,...,βp son los coeficientes de regresión, que representan el impacto de
cada variable independiente en Y.
• ϵ es el término de error aleatorio.

El objetivo del modelo es encontrar los valores de los coeficientes que minimicen
la suma de los errores al cuadrado.

Suposiciones del Modelo

Para que la regresión lineal múltiple sea válida, deben cumplirse ciertas
suposiciones:

1. Linealidad: La relación entre Y y cada Xi debe ser aproximadamente lineal.


2. Independencia: Las observaciones deben ser independientes entre sí.
3. Homoscedasticidad: La varianza de los errores debe ser constante.
4. Normalidad de los errores: Los errores deben seguir una distribución
normal.
5. No colinealidad: Las variables independientes no deben estar altamente
correlacionadas entre

12
Evaluación del Modelo

Para analizar la calidad del ajuste del modelo, se utilizan las siguientes métricas:

• Coeficiente de determinación (R2): Indica qué porcentaje de la


variabilidad de YYY es explicado por el modelo.

• R2 ajustado: Se usa cuando hay múltiples variables, ya que penaliza la


inclusión de variables irrelevantes.

• Prueba F: Determina si al menos una variable tiene un efecto significativo


en Y.

• Prueba t: Evalúa la significancia individual de cada coeficiente βi.

• Factor de Inflación de la Varianza (VIF): Detecta problemas de


colinealidad entre las variables independientes.

13
1.2.1. Pruebas de hipótesis en regresión lineal
múltiple

En la regresión lineal múltiple, las pruebas de hipótesis se utilizan para evaluar


la significancia del modelo y de cada una de sus variables independientes. Existen
dos tipos principales de pruebas:

1. Prueba F: Evalúa si el modelo en su conjunto es significativo.

2. Pruebas t: Determinan la importancia individual de cada variable


independiente.

Prueba F: Significancia Global del Modelo

La prueba F verifica si al menos una de las variables independientes tiene un


efecto significativo sobre la variable dependiente.

Hipótesis:

• H0 (Hipótesis nula): Ninguna variable independiente influye en YYY, es


decir, β1=β2=...=βp=0.

• H1 (Hipótesis alternativa): Al menos una variable tiene un coeficiente


distinto de cero.

Estadístico F:

donde:

• SSR (Suma de cuadrados de regresión) mide la variabilidad explicada por


el modelo.
• SE (Suma de cuadrados del error) mide la variabilidad no explicada.
• p es el número de variables independientes.
• n es el número total de observaciones.

Si el p-valor de la prueba F es menor que 0.05, se rechaza H0, lo que indica que
al menos una variable tiene un efecto significativo sobre Y.

14
Pruebas t: Significancia Individual de los Coeficientes

Cada coeficiente βi representa el efecto de la variable Xi sobre Y, manteniendo


constantes las demás variables. La prueba t evalúa si cada βi es
significativamente diferente de cero.

Hipótesis:

• H0:βi=0 (La variable Xi no tiene efecto en Y).


• H1:βi=0 (La variable Xi sí influye en Y).

Estadístico t:

Donde:

• SE(βi^) es el error estándar del coeficiente.


• Si el p-valor asociado a ti es menor que 0.05, se rechaza H0, indicando
que la variable Xi es significativa en la predicción de Y.

15
1.2.2. Intervalos de confianza y predicción en regresión múltiple

En regresión lineal múltiple, los intervalos de confianza y los intervalos de


predicción son herramientas estadísticas importantes que permiten cuantificar la
incertidumbre asociada a las estimaciones de los coeficientes del modelo y a las
predicciones futuras.

Intervalos de Confianza para los Coeficientes

Un intervalo de confianza (IC) para un coeficiente βi nos da un rango dentro del


cual se espera que se encuentre el valor verdadero del coeficiente con un nivel de
confianza determinado (por ejemplo, 95%).

Cálculo del Intervalo de Confianza

El intervalo de confianza para un coeficiente βi se calcula como:

donde:
• βi^ es el valor estimado del coeficiente βi.
• }tα/2 es el valor crítico de la distribución t de Student con n−p−1grados de
libertad y un nivel de confianza α.
• SE(βi^) es el error estándar del coeficiente βi.

Interpretación:

Un intervalo de confianza de 95% para un coeficiente indica que, si repitiéramos


el estudio muchas veces, el 95% de esos intervalos contendrían el valor verdadero
de βi.

Intervalos de Predicción para Nuevas Observaciones

El intervalo de predicción proporciona un rango en el que se espera que una


nueva observación de Y caiga, dado un valor específico de las variables
independientes (X1,X2,...,XpX_1, X_2, ..., X_pX1,X2,...,Xp).

Cálculo del Intervalo de Predicción

El intervalo de predicción para una nueva observación Ynuevo se calcula como:

16
Intervalos de Predicción para Nuevas Observaciones

El intervalo de predicción proporciona un rango en el que se espera que una


nueva observación de Y caiga, dado un valor específico de las variables
independientes (X1,X2,...,XpX_1, X_2, ..., X_pX1,X2,...,Xp).

Cálculo del Intervalo de Predicción

El intervalo de predicción para una nueva observación Ynuevo se calcula como:

donde:

• Y^ es la predicción del valor de Y dada la combinación de las variables


X1,X2,...,XpX_1, X_2, ..., X_pX1,X2,...,Xp.

• MSE es el error cuadrático medio del modelo (también conocido como la


varianza de los residuos).

• X es el vector de las variables independientes para la nueva observación.

Los intervalos de confianza y los intervalos de predicción son herramientas


útiles para cuantificar la incertidumbre en las regresiones múltiples. Los intervalos
de confianza se aplican a los coeficientes del modelo, mientras que los intervalos
de predicción proporcionan un rango en el que esperamos que caigan nuevas
observaciones, dado el modelo ajustado.

17
1.2.3. Uso de un software estadístico

Excel es una herramienta comúnmente utilizada para realizar análisis estadísticos,


incluida la regresión lineal múltiple. Aunque no es tan avanzado como otros
programas como R o Python, Excel tiene funciones poderosas para realizar este
tipo de análisis de manera fácil y rápida, mediante el complemento

Análisis de Datos.

Pasos para realizar una regresión lineal múltiple en Excel

1. Preparar los datos:


o Asegúrate de que los datos estén organizados en una tabla con las
variables dependiente (Y) y las independientes (X) en columnas
separadas.
o La primera fila debe contener los nombres de las variables.

Ejemplo:

Y (Dependiente) X1 (Independiente) X2 (Independiente)


5 1 2
7 2 3
8 3 2
10 4 5
11 5 4

2. Activar el complemento "Análisis de Datos" (si no está activado):


o Haz clic en la pestaña "Archivo" → "Opciones".
o En el menú "Opciones de Excel", selecciona "Complementos".
o En la parte inferior de la ventana, selecciona "Complementos de
Excel" y haz clic en "Ir...".
o Marca "Análisis de Datos" y haz clic en "Aceptar".

3. Realizar la regresión lineal múltiple:


o Haz clic en la pestaña "Datos" y luego en "Análisis de Datos".
o Selecciona "Regresión" y haz clic en "Aceptar".
o En la ventana de regresión:

▪ Rango Y: Selecciona la columna de la variable dependiente


(Y).
▪ Rango X: Selecciona las columnas de las variables
independientes (X1, X2, etc.).
▪ Marca la casilla "Etiqueta" si has incluido los nombres de las
variables en la primera fila.
▪ Selecciona un rango de salida donde quieres que Excel
18
coloque los resultados (puede ser en una nueva hoja o en
un rango específico).
▪ Opcionalmente, puedes seleccionar otras opciones como el
intervalo de confianza del 95%.
o Haz clic en "Aceptar".

4. Interpretar los resultados:

Excel generará una tabla con los siguientes elementos clave:

• Coeficientes (β2): Los valores estimados de los coeficientes del modelo


de regresión.
• Errores estándar: La precisión de las estimaciones de los coeficientes.
• Estadístico t: Mide la relación entre el coeficiente estimado y su error
estándar, utilizado en la prueba t.
• p-valor: Indica si el coeficiente es estadísticamente significativo. Si es
menor a 0.05, se rechaza la hipótesis nula de que el coeficiente es igual a
cero.
• R cuadrado: El coeficiente de determinación, que indica qué porcentaje
de la variabilidad de la variable dependiente es explicado por las variables
independientes.
• Prueba F: Evalúa la validez global del modelo, es decir, si al menos una de
las variables independientes es significativa.

Excel es una herramienta accesible para realizar regresión lineal múltiple. A través
del complemento de Análisis de Datos, puedes calcular rápidamente los
coeficientes, realizar pruebas de hipótesis, y evaluar la calidad del ajuste del
modelo. Si bien Excel no es tan flexible o potente como otros programas
especializados en estadística, es una opción conveniente para análisis rápidos y
con un nivel moderado de complejidad.

19
1.3. Regresión no lineal

La regresión no lineal es un enfoque utilizado cuando la relación entre la variable


dependiente Y y las variables independientes X1,X2,...,XpX_1, X_2, ..., X_pX1,X2
,...,Xp no sigue una forma lineal. Mientras que la regresión lineal supone que la
relación entre las variables es una línea recta, en la regresión no lineal se puede
modelar cualquier tipo de relación, como curvas exponenciales, logarítmicas,
logísticas, polinómicas, etc.

Modelo Matemático de la Regresión No Lineal

El modelo de regresión no lineal tiene la forma general:

donde:
• (X1,X2,...,Xp) es una función no lineal que describe la relación entre las
variables dependientes e independientes.

• β1,β2,...,βp son los parámetros que se deben estimar.

• ϵϵ es el término de error aleatorio.

Las funciones f pueden ser exponenciales, logarítmicas, polinómicas de mayor


grado, entre otras.

20
Estimación de Parámetros

En la regresión no lineal, la estimación de los parámetros β1,β2,...,βp se realiza


generalmente utilizando el método de mínimos cuadrados no lineales. Este
método busca encontrar los parámetros que minimicen la suma de los cuadrados
de los residuos (las diferencias entre los valores observados y los valores
predichos por el modelo).

El proceso es iterativo, ya que no hay una fórmula directa para calcular los
coeficientes como en la regresión lineal. Algunos de los algoritmos utilizados para
estimar los parámetros incluyen:

• Método de Levenberg-Marquardt
• Algoritmo de Gauss-Newton
• Método de gradiente descendente

21
CONCLUSIÓN

La regresión lineal simple es el modelo básico para explorar la relación entre una
variable dependiente y una sola variable independiente. A través de ella, podemos
obtener estimaciones de cómo la variable dependiente cambia con respecto a un
cambio en la variable independiente. La prueba de hipótesis en regresión lineal
simple nos permite verificar si los coeficientes estimados son significativamente
diferentes de cero

La regresión lineal múltiple amplía el modelo de regresión simple para incluir


múltiples variables independientes. Esto permite modelar relaciones más
complejas donde varias variables influyen en la variable dependiente. En este
caso, las pruebas de hipótesis permiten evaluar la significancia de cada una de
las variables independientes en el modelo, mientras que los intervalos de
confianza y de predicción proporcionan una medida de la precisión de las
estimaciones y las predicciones. El uso de software estadístico, como Excel,
facilita la implementación de estos modelos, proporcionando herramientas como
la opción de Análisis de Datos que calcula automáticamente los coeficientes y
evalúa la calidad del modelo.

Cuando la relación entre las variables no sigue una forma lineal, la regresión no
lineal es el modelo adecuado. Este tipo de regresión incluye modelos como la
regresión polinómica, exponencial, logarítmica, logística y de potencia. Cada uno
de estos modelos tiene aplicaciones específicas para describir fenómenos con
diferentes patrones de cambio. La estimación de los parámetros en regresión no
lineal se realiza a través de métodos iterativos, como el algoritmo de mínimos
cuadrados no lineales, que ajusta el modelo para minimizar el error entre los
valores observados y los predichos.

La comprensión y aplicación adecuada de estos modelos de regresión son clave


para realizar análisis de datos efectivos. Mientras que la regresión lineal simple es
adecuada para relaciones simples entre dos variables, la regresión lineal múltiple
y la regresión no lineal ofrecen herramientas para capturar relaciones más
complejas y modelar fenómenos del mundo real. El uso de herramientas
estadísticas, como Excel, R y Python, facilita la implementación de estos modelos,
permitiendo a los analistas y científicos extraer conclusiones precisas a partir de
los datos.

22
GLOSARIO

Regresión Lineal: Un modelo estadístico que describe la relación lineal entre una
variable dependiente y una o más variables independientes.

Coeficiente: Un parámetro en un modelo de regresión que mide el impacto de


una variable independiente sobre la variable dependiente.

R2 (Coeficiente de Determinación): Una medida que indica la proporción de la


variabilidad de la variable dependiente que es explicada por el modelo.

Hipótesis Nula: Una declaración en pruebas estadísticas que indica que no hay
efecto o relación entre las variables. Se prueba mediante un valor p.

Valor p: Un valor en las pruebas estadísticas que ayuda a determinar si se


rechaza o no la hipótesis nula. Un valor p menor a 0.05 indica significancia
estadística.

Mínimos Cuadrados: Un método utilizado para estimar los parámetros de un


modelo de regresión, minimizando la suma de los cuadrados de los errores entre
las predicciones y los valores observados.

Regresión Polinómica: Un tipo de regresión que incluye términos de mayor


grado (como X2X^2X2, X3X^3X3, etc.) para modelar relaciones no lineales.

Regresión Logística: Un modelo de regresión utilizado cuando la variable


dependiente es binaria (sí/no), que modela la probabilidad de que ocurra un
evento.

Intervalo de Confianza: Un rango de valores dentro del cual se espera que se


encuentre el valor real de un parámetro con un cierto nivel de confianza
(generalmente 95%).

Errores Estándar: Las desviaciones típicas de los coeficientes estimados, que


indican cuán precisas son las estimaciones de los parámetros en un modelo de
regresión.

23
REFERENCIAS

Draper, N. R., & Smith, H. (2014). Applied regression analysis (3rd ed.). John Wiley &
Sons.

Montgomery, D. C., Peck, E. A., & Vining, G. G. (2012). Introduction to linear regression
analysis (5th ed.). John Wiley & Sons.

Field, A. (2013). Discovering statistics using IBM SPSS statistics (4th ed.). SAGE
Publications.

Weisberg, S. (2014). Applied linear regression (4th ed.). Wiley.

Kutner, M. H., Nachtsheim, C. J., & Neter, J. (2004). Applied linear statistical models (5th
ed.). McGraw-Hill.

Hastie, T., Tibshirani, R., & Friedman, J. (2009). The elements of statistical learning: Data
mining, inference, and prediction (2nd ed.). Springer.

Bishop, C. M. (2006). Pattern recognition and machine learning. Springer.

Greene, W. H. (2018). Econometric analysis (8th ed.). Pearson.

24

También podría gustarte