0% encontró este documento útil (0 votos)
11 vistas6 páginas

Modelo de Regresión Lineal Múltiple

Este documento presenta el tema 3 sobre el modelo de regresión lineal múltiple. Explica el planteamiento del modelo cuando la variable dependiente depende de más de una variable independiente, y cómo se puede generalizar el modelo de regresión lineal simple para incluir múltiples variables explicativas. También resume los métodos de estimación por mínimos cuadrados ordinarios, incluyendo la derivación de las ecuaciones normales, y revisa las propiedades de los estimadores resultantes.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
11 vistas6 páginas

Modelo de Regresión Lineal Múltiple

Este documento presenta el tema 3 sobre el modelo de regresión lineal múltiple. Explica el planteamiento del modelo cuando la variable dependiente depende de más de una variable independiente, y cómo se puede generalizar el modelo de regresión lineal simple para incluir múltiples variables explicativas. También resume los métodos de estimación por mínimos cuadrados ordinarios, incluyendo la derivación de las ecuaciones normales, y revisa las propiedades de los estimadores resultantes.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

1

Grado en Economía 2022-2023 2

Tema 3: Modelo de regresión lineal múltiple

eCONOMETRÍAI
3.1 Planteamiento del modelo de regresión lineal múltiple.
3.2 Estimación por Mínimos Cuadrados Ordinarios, MCO.
3.3 Propiedades descriptivas de los estimadores MCO.
3.4 Medidas de bondad de ajuste y selección de regresores.
Profesor:
Marko Petrovic
Correo electrónico: [Link]@[Link]
Despacho: 3C01
Tutorías: miércoles 10.30-12.00
miércoles 16.00-17.30
online

Tema 3: MRLM 3 Tema 3: MRLM 4

3.1. Planteamiento del modelo de RLM 3.1. Planteamiento del modelo de RLM
¿Qué ocurre si la variable endógena depende de más de una variable como
explicativa de su comportamiento? En ese caso, debemos incluir esos otros factores En el caso de tener N observaciones muestrales:
explicativos explícitamente en el modelo (si no lo hacemos, tendríamos un
problema de omisión de variables relevantes) Y1 = 1 +  2 X 21 +  3 X 31 + ... +  k X k1 + u1
Y2 = 1 +  2 X 22 +  3 X 32 + ... +  k X k 2 + u 2
Podemos generalizar el MRLS el caso general, considerando que tenemos K-1
variables explicativas y un término constante:   
YN = 1 +  2 X 2 N +  3 X 3 N + ... +  k X kN + u N
𝑌𝑖 = 𝛽1 + 𝛽2 𝑋2𝑖 + 𝛽3 𝑋3𝑖 +. . . +𝛽𝑘 𝑋𝑘𝑖 + 𝑢𝑖
Y en notación matricial: y = X +u
La explicativa X1 no aparece porque es el término constante, es decir, un vector
unitario:
 Y1  1 X 21  X
k1   1   u1 
Y  X   2   u2 
 2=
1 1 X 
1 22 k2   +  
X1 =              
      

1 YN  1 X 2 N  X
kN 
  k  u N 
Nx1 Nxk kx1 Nx1
Tema 3: MRLM 5 Tema 3: MRLM 6

3.1. Planteamiento del MRLM 3.2. Estimación por MCO


El modelo econométrico será: y = X +u
El modelo estimado será: 𝐲ො = 𝑿෠ y, por tanto, los residuos son 𝒖
ෝ = 𝒚 − 𝐲ො = 𝒚 − 𝑿෠
para aplicar el criterio de mínimos cuadrados en el modelo de regresión lineal
La interpretación de los parámetros del modelo, al igual que en el MRLS, en el caso de múltiple, calculamos la primera derivada de S con respecto a cada 𝛽𝑗
un modelo lineal general será en términos de efecto marginal: será la magnitud del
cambio en Y cuando la explicativa X2 aumenta una unidad adicional, mientras el resto de
factores (explicativas) permanece constante (ceteris paribus).

El criterio de ajuste a la nube de puntos (con k-1 dimensiones) sigue siendo el de


minimizar la suma de los residuos al cuadrado:

Min SCR = Min respecto a ෡

Tema 3: MRLM 7 Tema 3: MRLM 8

3.2. Estimación por MCO - notación matricial 3.2. Estimación por MCO - notación matricial
min 𝑢′ መ
ො 𝑢ො = (𝑦 − 𝑋𝛽)′(𝑦 መ = 𝑦 ′ 𝑦 − 𝑦′𝑋𝛽መ − 𝛽መ ′ 𝑋 ′ 𝑦 + 𝛽′𝑋′𝑋
− 𝑋𝛽) መ 𝛽መ = Para minimizar, la derivada primera se iguala a cero:
መ መ ′ ′ ′ መ ′ ′ መ ′
= ሼ𝑐𝑜𝑚𝑜 𝑦′𝑋𝛽 𝑒𝑠 𝑒𝑠𝑐𝑎𝑙𝑎𝑟 = 𝛽 𝑋 𝑦ൟ = 𝑦 𝑦 − 𝛽 𝑋 𝑦 − 𝛽 𝑋 𝑦 + 𝛽′𝑋′𝑋 ′ መ 𝛽መ =
𝜕𝑢′
ො 𝑢ො
′ መ ′ ′ መ
= 𝑦 𝑦 − 2𝛽 𝑋 𝑦 + 𝛽′𝑋′𝑋𝛽 መ = −2𝑋 ′ 𝑦 + 2𝑋′𝑋𝛽መ = 0
𝜕𝛽መ

𝜕(𝐴′ 𝑏) 𝜕(𝑏′ 𝐴) 𝜕(−2𝛽መ ′ 𝑋 ′ 𝑦)


• = =𝐴 = −2𝑋 ′ 𝑦
𝜕𝑏 𝜕𝑏 𝜕𝛽መ
𝜕β෠ ′ 𝑋′𝑋β෠ 𝜕β෠ ′ 𝐴β෠
• = = 𝐴 + 𝐴′ 𝛽መ = 2𝐴𝛽መ = 2β෠ ′ 𝐴
𝜕𝛽መ 𝜕 𝛽መ Sistema de ecuaciones
donde A es cualquier matriz simétrica. Tenga en cuenta que puede escribir la Normales del MRLG
derivada como 2𝐴𝛽መ o 2𝛽መ ′ 𝐴, cundo A es simétrica .

Derivada escalar Derivada vectorial

a) X′X/n es la matriz de momentos muestrales de segundo orden, con respecto al


b) origen, de los regresores.
c) X′y /n es el vector de momentos muestrales de segundo orden, con respecto al
origen, entre el regresando y los regresores.
Tema 3: MRLM 9 Tema 3: MRLM 10

3.2. Estimación por MCO 3.3. Propiedades descriptivas de los estimadores

𝑿′ 𝑿෠ = 𝑿′ 𝒚
1- La suma de los productos cruzados de los residuos con las variables
explicativas es cero,
(𝑿′ 𝑿)−𝟏 (𝑿′ 𝑿)෠ = (𝑿′ 𝑿)−𝟏 𝑿′ 𝒚
𝑿′ෝ
𝒖=𝟎 → ෡ = 𝑿′ 𝒚 − 𝑿′𝑿(𝑿′ 𝑿)−1 𝑿′ 𝒚 = 0
𝑿′(𝒚 − 𝑿𝜷)
Como (𝑿′ 𝑿)−𝟏 (𝑿′ 𝑿) = 𝑰 es una matriz identidad de orden kxk, obtenemos

෡ = (𝑿′ 𝑿)−1 𝑿′ 𝒚
𝜷

La condición de mínimo se alcanza siempre que la matriz de derivadas


segundas (Matriz Hessiana) sea definida positiva:
𝜕 2 𝑢′
ො 𝑢ො
= 2𝑋′𝑋 > 0 2- La suma de los productos cruzados de los residuos con la variable
𝜕 𝛽መ
2
dependiente es cero
𝑢′
ො 𝑢ො ′
෡ 𝒖 ෡ ′ 𝑿′ 𝒖 ෡ ′𝟎 = 𝟎
La estimación de la varianza de las perturbaciones es: 𝜎2 = ෝ′ 𝒖
𝒚 ෝ=𝟎 → 𝑿𝜷 ෝ=𝜷 ෝ=𝜷
𝑁−𝑘
Debido a la
prop. 1

Tema 3: MRLM 11 Tema 3: MRLM 12

3.3. Propiedades descriptivas de los estimadores 3.2. Estimación por MCO


Ejemplo: El siguiente modelo con k = 3 se estima utilizando 15 observaciones:
3- La suma de los residuos es cero, σ𝑁
𝑖=1 𝑢
ො𝑖 = 0
yi = 1 +  2 x2 i +  3 x3i + ui
Si regresión tiene el término constante, entonces la primera columna en
X (es decir, 𝑋1 ) será una columna de unos. Esto significa que para el y se obtienen los siguientes resultados a partir de los valores de las
primer elemento en el X′ෝ 𝒖 vector (es decir, 𝑋11 × 𝑢ො 1 + 𝑋12 × 𝑢ො 2 + . . . + observaciones de las explicativas:
𝑋1𝑛 × 𝑢ො 𝑛 ) para ser cero, debe darse el caso de que σ𝑁 𝑖=1 𝑢
ො 𝑖 = 0.  2.0 35 . 
. −10 −30 . 
( X ' X ) −1 =  35
.10 . ,( X ' y) = 2.2  , u' u = 10.96
. 65  
−10 . 4.3 
. 65  0.6 
4 - La media muestral de los residuos es cero.
Esto se sigue directamente de la propiedad anterior, es decir,
σ𝑁 𝑢ෝ Calcula los coeficientes estimados
𝑢തො = 𝑖=1 𝑖 = 0.
𝑁

Para calcular la varianza de las perturbaciones, o errores estándar, necesitamos


4- El hiperplano de regresión pasa por el punto 1, 𝑋ത2 , 𝑋ത3 , … , 𝑋ത𝑘
Esto se sigue del hecho de que 𝑢ത = 0.
una estimación de 2.
ෝ = 𝒚 − 𝑿𝜷
𝒖 ෡/n 𝑢തො = 𝑦ത − 𝒙
ഥ𝜷෡ ഥ𝜷
𝑦ത = 𝒙 ෡
𝑢′
ො 𝑢ො 10.96
𝜎2 = = 0.91
𝑁 − 𝑘 15 − 3
Tema 3: MRLM 13 Tema 3: MRLM 14

3.4. Medidas de bondad de ajuste 3.4. Medidas de bondad de ajuste

El coeficiente de determinación múltiple, al igual que en el caso del MRLS, indica el


porcentaje de la varianza total explicada por el modelo: El coeficiente de determinación parcial Y y Xk es la proporción de la
N N
variación residual del modelo con k-1 regresores que es explicada por la
 (Yˆ − Yˆ )
i
2
 (uˆ ) i
2
෡ ′ 𝒚 − 𝑁𝑌ሜ 2
𝜷′𝑿
introducción del regresor k-ésimo, y descontando el efecto de las otras k-1
R2 = i =1
=1− i =1
Matricialmente: 𝑅2 =
variables explicativas.
N N
𝒚′ 𝒚 − 𝑁𝑌ሜ 2
 (Y − Y )
i
2
 (Y − Y ) i
2

i =1 i =1 Rk2 − Rk2−1
El coeficiente de determinación corregido (R cuadrado ajustado) supera una de las rYX x , X 2 ,, X k −1 = También está acotado entre 0 y 1.
limitaciones del R2 por tener en cuenta el número de variables explicativas incluidas en el 1 − Rk2−1
modelo. De hecho, penaliza el añadir variables al modelo y sólo aumentaría si el nuevo regresor
efectivamente explicara parte de la varianza total.
A estas medidas del coeficiente de determinación R2 se pueden aplicar las
𝑆𝐶𝑅ൗ mismas condiciones que las explicadas en el Tema 2 punto 2.5.
𝑁−𝑘 𝑁−1
𝑅ത 2 = 1 − = 1 − (1 − 𝑅2 )
𝑆𝐶𝑇ൗ 𝑁−𝑘
𝑁−1 Al MRLG también se aplica el cálculo de otras medidas de la bondad del ajuste
como el AIC de Akaike.
La cota superior es 1, pero la inferior no es 0. Podría llegar a ser un valor negativo si la capacidad
explicativa del regresor es muy pobre.

1
15 Grado en Economía 2022-2023

Referencias

eCONOMETRÍAI
• Básicas
• Wooldridge, J (2016). Introducción a la econometría. 5
ed. Cengage Learning.
• Gujarati, D. y Porter D.C. (2010) Econometría (5ª Profesor:
Edición). McGraw-Hill. Marko Petrovic
• Uriel E. (2019) Introducción a la Econometria. Libro Correo electrónico: [Link]@[Link]
electrónico. Universitat de València. (Castellano, Despacho: 3C01
Valencià, english) [Link]
Tutorías: miércoles 10.30-12.00
miércoles 16.00-17.30

online
2
Ejercicio 1 3

Con la siguiente información muestral: Y X2 X3


10 1 0
25 3 -1
32 4 0
43 5 1
58 7 -1
62 8 0
67 10 -1
71 10 2

Prácticas 4 se desea estimar el modelo 𝑌𝑡 = 𝛽1 + 𝛽2 𝑋2𝑡 + 𝛽3 𝑋3𝑡 + 𝑢𝑡

a) Construya la matriz de regresores X.


- Tema 3- b) Obtenga X’X.
c) Obtenga (X’X)-1.
d) Construya el vector y.
e) Obtenga el vector de estimadores 𝜷෡
f) Escriba el modelo estimado.
g) Interprete los estimadores.
h) Obtenga el vector de valores ajustados 𝒚ෝ.
i) Obtenga el vector de residuos 𝒖ෝ.
j) Verifique las propiedades descriptivas.
k) Obtenga el coeficiente de determinación e interprete su valor.

Ejercicio 2 4
Ejercicio 3 5

Con los datos del archivo‘Caso303.wf1’ (Econometría Aplicada, E. Uriel y I. Gea, Con una muestra formada por 88 viviendas de una determinada zona se ha
Editorial AC) se han estimado los modelos A, B y C. Utilizando criterios de selección obtenido la siguiente estimación:
de modelos como el coeficiente de determinación, coeficiente de determinación P = 19,3 + 0,128·sqrft + 15,2·bdrms
ajustado y AIC: Donde: P: precio de la vivienda en miles de dólares USA
a) ¿Seleccionaría el modelo A o el B? Method: Least Squares MODELO B Sqrft: superficie de la vivienda en pies cuadrados
Included observations: 40
b) ¿Seleccionaría el modelo A o el C? Coefficient Std. Error t-Statistic Prob. Bdrms: número de dormitorios de la vivienda
C 4.359601 1.524739 2.859245 0.0070
c) ¿Seleccionaría el modelo A, el B o el C? RDISP 0.004659 0.001211 3.848195 0.0005
ESTMED 0.801355 1.300718 0.616087 0.5417
ESTSUP 1.409486 1.751588 0.804690 0.4263 a) Si se mantiene fija la superficie total de la vivienda, ¿cuál será el aumento
Dependent Variable: LACTEOS R-squared 0.468816 Mean dependent var 11.48525
Method: Least Squares MODELO A Adjusted R-squared
S.E. of regression
0.424550
3.295989
S.D. dependent var
Akaike info criterion
4.344923
5.317929
estimado del precio de una vivienda si se le dota de un dormitorio adicional?
Included observations: 40
Coefficient Std. Error t-Statistic Prob. Sum squared resid 391.0875 Schwarz criterion 5.486817 b) ¿Cuál será el aumento estimado del precio de una vivienda si se construye un
C 2.674608 1.539721 1.737073 0.0907 Log likelihood -102.3586 Hannan-Quinn criter. 5.378994
RDISP 0.005530 0.000911 6.067850 0.0000 F-statistic 10.59103 Durbin-Watson stat 1.578691 dormitorio adicional aumentando también la superficie de la vivienda en 100
URBANO 1.897885 1.002361 1.893415 0.0661 Prob(F-statistic) 0.000039
R-squared 0.506211 Mean dependent var 11.48525 pies cuadrados?
Adjusted R-squared 0.479520 S.D. dependent var 4.344923 MODELO B
S.E. of regression 3.134615 Akaike info criterion 5.194928 c) Una vivienda de 2.500 pies cuadrados y 4 dormitorios se pone a la venta por
Sum squared resid 363.5550 Schwarz criterion 5.321594
Log likelihood -100.8986 Hannan-Quinn criter. 5.240727 Dependent Variable: LOG(LACTEOS) 270.000 dólares. ¿Qué opina del precio?
F-statistic 18.96539 Durbin-Watson stat 1.629599 Method: Least Squares MODELO C
Prob(F-statistic) 0.000002 Included observations: 40 d) Exprese el modelo estimado utilizando como unidad de medida de superficie el
Coefficient Std. Error t-Statistic Prob.
MODELO A C 1.582545 0.129153 12.25329 0.0000 metro cuadrado (sqrmts) y expresando el precio en miles de euros (P€).
RDISP 0.000500 7.64E-05 6.539005 0.0000
URBANO 0.158035 0.084079 1.879611 0.0681
R-squared 0.541553 Mean dependent var 2.371872
Adjusted R-squared 0.516772 S.D. dependent var 0.378241 NOTAS: 1 pie cuadrado equivale aproximadamente a 0,1 metros cuadrados. Utilice
SI comparamos un modelo con Y, Modelo 1, y otro con ln(Y), S.E. of regression 0.262933 Akaike info criterion 0.238204
Modelo 2, como endógenas, el estadístico AIC corregido Sum squared resid 2.557952 Schwarz criterion 0.364870 como tipo de cambio 1 euro = 1,28 dólares USA.
Log likelihood -1.764088 Hannan-Quinn criter. 0.284003
para el modelo 2 se calcula como: F-statistic 21.85360 Durbin-Watson stat 1.837239
Prob(F-statistic) 0.000001

MODELO C
Ejercicio 4 6
Ejercicio 5 7

El archivo engel contiene las siguientes variables para una muestra de Con respecto al modelo,
235 familias:
foodexp: Gasto familiar anual en la comida. Se expresa en miles de
argumentar la verdad o falsedad delas siguientes afirmaciones y, si es necesario,
euros al año. proponga afirmaciones alternativas correctas:
income: Ingreso familiar anual disponible. Se expresa en miles de
euros al año. a) Cuando la variable 𝑋2 aumenta una unidad, la variable 𝑌 tiene una tasa de
crecimiento porcentual igual a 𝛽2.
b) Cuando la variable 𝑋3 aumenta una unidad, la variable 𝑌 aumenta 𝛽3
a) ¿Cuál es el aumento esperado de 𝐹𝑂𝑂𝐷 cuando 𝐼𝑁𝐶 aumenta en unidades.
mil euros? c) En un modelo de regresión, el coeficiente de determinación (𝑅2) es igual al
coeficiente ajustado de determinación (𝑅2 adj).
b) ¿Cuál es la tasa de crecimiento esperada en 𝐹𝑂𝑂𝐷 cuando 𝐼𝑁𝐶
aumenta en mil euros?
c) ¿Cuál es el incremento esperado en 𝐹𝑂𝑂𝐷 cuando 𝐼𝑁𝐶 aumenta
10%?
d) Estima la elasticidad de 𝐹𝑂𝑂𝐷 con respecto a 𝐼𝑁𝐶.

Ejercicio 6 8

Consideremos el siguiente modelo:

𝑌 is expressed in euros, 𝑋2 is expressed in kilograms, 𝑋3 is expressed in centimeters and


both 𝑋4 and 𝑋5 are expressed in euros. What change would you expect in 𝑌 when:

𝑋2 increases by one kilogram …………………………………..


𝑋2 increases by seven kilograms ……………………………..
𝑋2 decreases by 3,1 kilograms …………………………………
𝑋2 decreases by 600 grams ……………………………….……
𝑋3 increases by one centimeter ……………………………….
𝑋3 increases by two meters ……………………………………..
𝑋3 decreases by 14 centimeters ………………………………
𝑋4 increases by 2% …………………………………………………
𝑋4 decreases by 7% ……………………………………………...…
𝑋5 increases by 1 euros …………………………………………..
𝑋5 increases by 6 euros ……………………………………….…
𝑋5 is equal to 10 euros and increases by 1 euros ………
𝑋5 is equal to 100 euros and increases by 1 euro ….….
𝑋5 is equal to 100 euros and increases by 2 euros ……

También podría gustarte