0% ont trouvé ce document utile (0 vote)
5 vues8 pages

Régression linéaire avec modération âge-entrainement

Ce chapitre aborde la régression linéaire avec une variable modératrice, en se concentrant sur l'effet de l'entraînement sur le pourcentage musculaire des clients d'un médecin du sport, en tenant compte de l'âge. L'analyse révèle que l'âge est négativement lié au pourcentage musculaire, tandis que les heures d'entraînement sont positivement liées, avec une interaction indiquant que l'effet de l'entraînement diminue avec l'âge. Des groupes d'âge sont créés pour visualiser et tester cette interaction, montrant des résultats significatifs pour les groupes plus jeunes, mais pas pour les plus âgés.

Transféré par

naroto naroto
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
5 vues8 pages

Régression linéaire avec modération âge-entrainement

Ce chapitre aborde la régression linéaire avec une variable modératrice, en se concentrant sur l'effet de l'entraînement sur le pourcentage musculaire des clients d'un médecin du sport, en tenant compte de l'âge. L'analyse révèle que l'âge est négativement lié au pourcentage musculaire, tandis que les heures d'entraînement sont positivement liées, avec une interaction indiquant que l'effet de l'entraînement diminue avec l'âge. Des groupes d'âge sont créés pour visualiser et tester cette interaction, montrant des résultats significatifs pour les groupes plus jeunes, mais pas pour les plus âgés.

Transféré par

naroto naroto
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Chapitre II : la régression linéaire avec variable modératrice

Pr. BOULAHOUAL Adil


Un médecin du sport mesure régulièrement les pourcentages musculaires de ses clients. Il leur demande également combien
d’heures par semaine ils consacrent généralement à la formation. Notre médecin
soupçonne que les clients qui s’entraînent plus sont également plus musclés. En outre, il
pense que L’effet de l’entraînement sur la musculature diminue avec l’âge. Dans l’analyse
de régression multiple, c’est ce qu’on appelle un effet d’interaction de modération. La ENTRAINEMENT

figure l’illustre.

Alors, comment tester un tel effet de modération? Eh Le centrage moyen d’une variable consiste à soustraire sa moyenne
bien, nous le faisons généralement en 3 étapes: de chaque score individuel. Après cela, une variable aura une moyenne
d’exactement zéro mais n’est pas affectée, autrement : son écart-type,
son asymétrie et sa forme distributive et tout le reste restent les mêmes.
1. Si les deux prédicteurs sont quantitatifs, nous Après avoir centré nos prédicteurs moyens, nous les multiplions simplement pour

Chapitre II : la régression linéaire avec variable modératrice


voulons généralement dire les centrer en ajouter des prédicteurs d’interaction à nos données. Se recentrer avant de faire cela
a 2 avantages:
premier;
2. Nous multiplions ensuite les prédicteurs centrés  Elle tend à diminuer la multicolinéarité, en particulier entre l’effet d’interaction et
ses principaux effets constitutifs ;
en une variable prédictive d’interaction;
 Cela peut rendre nos coefficients b plus facilement interprétables.
3. Enfin, nous entrons à la fois les prédicteurs
moyens centrés et le prédicteur d’interaction
dans une analyse de régression.
Nous avons maintenant trois variable explicatives :
 Age ;
 Heure d’entrainement Statistiques
 Age*heure d’entrainement Age
Moyenne 31,938
Et une variable à expliquer.1

1
Fichier source pour application : l’interaction [Link].
1
Pour créer la nouvelle variable calculer-là depuis : transformer calculer variable comme ci-dessus.

Pr. BOULAHOUAL Adil


Puis faite de même pour le nombre d’heure et en fin calculer l’interaction en multipliant les deux centres comme ci-après.

Notre régression de modération n’est pas différente de toute autre analyse de


régression linéaire multiple : nous naviguons vers Analyse régression linéaire
et remplissons les boîtes de dialogue comme indiqué ci-dessous. (Qualité et
mesure de corrélation partielles.)
Puis dans tracé Y : ZRESID et dans X : ZRESID et cochez Histogramme.

Chapitre II : la régression linéaire avec variable modératrice


2
Pr. BOULAHOUAL Adil
Coefficientsa
Coefficients non Coefficients
standardisés standardisés Corrélations
Erreur Corrélation
Modèle B standard Bêta t Sig. simple Partielle Partielle
1 (Constante) 38,402 ,105 364,300 ,000
AGE_CENTRE -,072 ,014 -,363 -5,227 <,001 -,268 -,320 -,280
HEURE_CENTRE ,904 ,105 ,529 8,581 <,001 ,248 ,485 ,459
AGE*HEURE -,036 ,008 -,291 -4,468 <,001 -,302 -,278 -,239
a. Variable dépendante : Muscle Pourcentage

À p = 0,000, les 3 effets sont statistiquement très significatifs, puis :


L’âge est négativement lié au pourcentage musculaire. En moyenne, les clients perdent 0,072 point de pourcentage par an.

Chapitre II : la régression linéaire avec variable modératrice


Les heures d’entraînement sont positivement liées au pourcentage musculaire : les clients ont tendance à gagner 0,9 point de
pourcentage pour chaque heure qu’ils travaillent par semaine.
L’interaction Age*heures d’entrainement indique que l’effet d’entraînement devient plus négatif - ou moins positif - avec l’âge.
Maintenant, que l’impact est significatif il faudra évaluer la taille de cet effet.
Nous pourrions utiliser les corrélations semi-partielles (extrême droite) où :
 r = 0,10 indique un petit effet;
 r = 0,30 indique un effet moyen;
 r = 0,50 indique un effet important.
 L’effet d’entraînement est presque important, par contre l’effet de l’âge et l’âge par
interaction d’entraînement sont presque moyens.
En ce qui concerne les placettes résiduelles notons que :

L’histogramme résiduel ne semble pas entièrement distribué normalement mais plutôt


bimodal. Cela dépend un peu de la largeur de son bac et ne semble pas trop alarmant;

3
Le nuage de points résiduel ne montre aucun signe d’hétéroscédasticité ou de curvilinéarité. Dans l’ensemble, ces graphiques ne

Pr. BOULAHOUAL Adil


montrent pas de violations claires des hypothèses de régression.

Création de groupes d’âge

Notre analyse simple des pentes commence par la création de groupes d’âge. Optons pour les groupes tertiles : les plus jeunes, les
intermédiaires et les plus âgés (33,3%). C’est un choix arbitraire et la taille égale des groupes n’est pas obligatoire. Dans tous les cas, la
syntaxe ci-dessous crée les groupes de tertiles d’âge en tant que nouvelle variable dans nos données.
Vous pouvez scinder votre fichier en trois groupe depuis données comme vous pouvez exécuter la commande suivante :

*Créer des groupes de tertiles d’âge.


rank age
/ntiles(3) into agecat3.

Chapitre II : la régression linéaire avec variable modératrice


*Étiquetez une nouvelle variable et de nouvelles valeurs.
variable labels agecat3 'Age Tertile Group'.
value labels agecat3 1 ' Petit âge ' 2 ' Age moyen ' 3 ' Plus Agés '.

*Vérifiez les statistiques descriptives par âge par groupe d’âge. Rapport
means age by agecat3 Age at Visit
/cells count min max mean stddev.
Age Tertile Group N Minimum Maximum Moyenne Ecart type

Voici quelques conclusions fondamentales de ce tableau : Petit âge 81 20,2 26,6 23,796 1,9058

1. Nos groupes d’âge ont des tailles d’échantillon Age moyen 81 26,6 32,8 29,709 1,8806

exactement égales de n = 81; Plus Agés 81 32,9 62,9 42,310 8,5163

2. Les âges moyens des groupes sont inégalement répartis : Total 243 20,2 62,9 31,938 9,2844

la différence entre les jeunes et les intermédiaires - environ 6 ans - est beaucoup plus faible qu’entre les intermédiaires et les
plus élevés - environ 13 ans;
3. Le groupe d’âge le plus élevé à un écart-type beaucoup plus important que les 2 autres groupes.
Les points 2 et 3 sont causés par l’asymétrie de l’âge et plaident contre l’utilisation de groupes tertiles. 4
Pr. BOULAHOUAL Adil
Analyse des pentes simples I - Lignes d’ajustement
Visualisons maintenant l’interaction de modération entre l’âge et l’entraînement. Nous allons commencer par créer un nuage de
points comme indiqué ci-dessous.

Chapitre II : la régression linéaire avec variable modératrice


Nous pouvons créer le diagramme via la syntaxe suivante ; * Créer un pourcentage musculaire de nuage de
points par heures d’entraînement non centrées par groupe d’âge.
GRAPH
/SCATTERPLOT(BIVAR)=thours WITH mperc BY agecat3
/MISSING=LISTWISE
/TITLE='Muscle Percentage by Heures d’entraînement by Age Group'.
5
Pr. BOULAHOUAL Adil
Ajout de lignes d’ajustement distinctes au nuage de points
Après avoir créé notre nuage de points, modifiez-le en double-cliquant dessus. Dans la fenêtre Éditeur de graphique qui s’ouvre, nous
cliquons sur l’icône intitulée Ajouter une ligne d’ajustement aux sous-groupes ( image ci-dessous)

Chapitre II : la régression linéaire avec variable modératrice


Nos lignes d’ajustement expliquent bien la nature de notre âge par
l’effet d’interaction de l’entraînement:

 Les 2 groupes d’âge les plus jeunes montrent une augmentation


constante du pourcentage musculaire par heures d’entraînement;
 Pour les personnes les plus âgés, cependant, l’entraînement semble
affecter à peine le pourcentage musculaire. C’est ainsi que l’effet de l’entraînement sur le pourcentage musculaire est modéré par
l’âge;
 Dans l’ensemble, la ligne d’ajustement pour le groupe le plus âgé est inférieure à celle des 2 autres groupes.
 Encore une fois, la similitude entre les 2 groupes les plus jeunes peut être due à l’asymétrie des âges : les âges moyens de ces groupes
ne sont pas trop différents mais très différents du groupe d’âge le plus élevé.
6
Analyse des pentes simples II - Coefficients

Pr. BOULAHOUAL Adil


Après avoir visualisé notre effet d’interaction, testons-le: nous allons exécuter une régression linéaire simple de l’entraînement sur le
pourcentage musculaire pour nos 3 groupes d’âge séparément. Une bonne façon de le faire dans SPSS est d’utiliser SPLIT FILE.
La syntaxe REGRESSION a été créée à partir du menu comme précédemment, mais avec une formation (non centrée) comme seul
prédicteur.

Nous pouvons procéder par


syntaxe aussi :

1 *Diviser le fichier par


groupe d’âge.
sort cases by agecat3.

Chapitre II : la régression linéaire avec variable modératrice


split file layered by
agecat3.

2 * Exécutez une régression linéaire simple avec des heures


d’entraînement non centrées sur le pourcentage musculaire.
REGRESSION
/MISSING LISTWISE
/STATISTICS COEFF OUTS R ANOVA ZPP
/CRITERIA=PIN(.05) POUT(.10)
/NOORIGIN
/DEPENDENT mperc
/METHOD=ENTER thours
/SCATTERPLOT=(*ZRESID ,*ZPRED)
/RESIDUALS HISTOGRAM(ZRESID).

7
Pr. BOULAHOUAL Adil
Exécutez une régression linéaire basique pour obtenir :

Coefficientsa
Coefficients non standardisés Coefficients standardisés Corrélations

Age Tertile Group Modèle B Erreur standard Bêta t Sig. Corrélation simple Partielle Partielle

Petit âge 1 (Constante) 34,274 ,658 52,083 <,001

Heures d’entrainement 1,046 ,159 ,594 6,560 <,001 ,594 ,594 ,594
Age 1 (Constante) 33,705 ,973 34,641 <,001
moyen Heures d’entrainement 1,121 ,225 ,488 4,974 <,001 ,488 ,488 ,488
Plus Agés 1 (Constante) 37,148 ,893 41,581 <,001

Heures d’entrainement ,121 ,175 ,077 ,689 ,493 ,077 ,077 ,077

Chapitre II : la régression linéaire avec variable modératrice


a. Variable dépendante : Muscle Percentage

Pour le groupe d’âge le plus jeune, l’effet de l’entraînement est statistiquement significatif à p = 0,000. De plus, sa corrélation
partielle de r = 0,59 indique un effet important;
les résultats pour le groupe d’âge intermédiaire sont à peu près similaires à ceux du groupe le plus jeune;
Pour le groupe d’âge le plus élevé, la corrélation partielle de r = 0,077 n’est pas substantielle. Nous ne le prendrions pas au sérieux
même s’il avait été statistiquement significatif - ce qui n’est pas le cas à p = 0,49.

Enfin, les histogrammes résiduels (non montrés ici) ne montrent rien d’inhabituel. Le nuage de points résiduel pour le groupe d’âge le
plus âgé semble curviligne, à l’exception de certaines valeurs aberrantes. Nous devrions peut-être examiner cette analyse de plus
près, mais nous la laisserons pour un autre jour.

Vous aimerez peut-être aussi