Presentation STAT-MATH
BACHELOR 3
2023-10-16
Tableau des données sur le budget de publicité et les bénéfices
1. Calculons le coefficient de corrélation
budget benefices
15 48
8 43
36 77
41 89
16 50
8 40
21 56
21 62
53 100
10 47
32 71
17 58
58 102
6 35
20 60
## $ho = 0.989
2. Calculer les estimations \(a\hat{}\) et \(b\hat{}\):
Régression linéaire
regression <- lm(tab$benefices ~ tab$budget)
Coefficients a^ et b^
a_chap <- regression$coefficients[2]
b_chap <- regression$coefficients[1]
a_chap
## tab$budget
## 1.278709
b_chap
1
## (Intercept)
## 31.67382
3. Préciser l’équation d’analyse de la variance et calculer le coefficient de déter-
mination \(R^2\):
Analyse de la variance
anova_res <- anova(regression)
anova_res
## Analysis of Variance Table
##
## Response: tab$benefices
## Df Sum Sq Mean Sq F value Pr(>F)
## tab$budget 1 6137.7 6137.7 604.41 2.77e-12 ***
## Residuals 13 132.0 10.2
## ---
## Signif. codes: 0 '***' 0.001 '**' 0.01 '*' 0.05 '.' 0.1 ' ' 1
Coefficient de détermination R^2
R_squared <- summary(regression)$[Link]
cat("R^2 =",round(R_squared,3))
## R^2 = 0.979
4. 4. Estimation des variances de \(\hat{a}\) et \(\hat{b}\) sachant que
\(\hat{\sigma}^2_{\epsilon} = 10.155\):
Nombre d’observations
n <- length(tab$budget)
Estimation des variances de a^ et b^
var_a_chap <- (10.155 / sum((tab$budget - (n*mean(tab$budget))^2)))
var_b_chap <- (10.155* sum(tab$budget^2)) / (n * sum((tab$budget - mean(tab$budget))^2))
cat("a^ =",var_a_chap, "\n")
## a^ = -5.167155e-06
cat("b^ =",var_b_chap)
## b^ = 2.252619
5. Calculer les intervalles de confiance pour 𝑎, 𝑏 et 𝜎𝜖2 au seuil 𝛼 = 0.05:
Intervalle de confiance pour a
a_ci <- confint(regression)[2, ]
print(a_ci)
2
## 2.5 % 97.5 %
## 1.166343 1.391075
Intervalle de confiance pour b
b_ci <- confint(regression)[1, ]
print(b_ci)
## 2.5 % 97.5 %
## 28.43139 34.91625
Intervalle de confiance pour sigma^2_epsilon
sigma2_epsilon_ci <- c(10.155 / qchisq(1 - 0.025, df = n - 2), 10.155 / qchisq(0.025, df = n - 2))
print(sigma2_epsilon_ci)
## [1] 0.4105418 2.0274518
6. Tester si les coefficients 𝑎 et 𝑏 sont significativement différents de 0 (au niveau
de confiance de 95%):
Test de significativité pour a et b
p_value_a <- summary(regression)$coefficients[2, 4]
p_value_b <- summary(regression)$coefficients[1, 4]
alpha <- 0.05
if (p_value_a < alpha) { print("a est significativement différent de 0.") } else { print("a n'est pas si
## [1] "a est significativement différent de 0."
if (p_value_b < alpha) { print("b est significativement différent de 0.") } else { print("b n'est pas si
## [1] "b est significativement différent de 0."