0% ont trouvé ce document utile (0 vote)
65 vues168 pages

Data Analysis

Ce document présente un module de formation sur la modélisation par équations structurelles (SEM) et l'analyse des données, visant à doter les étudiants de compétences en structuration de questionnaires et en analyse de données multivariées. Il couvre des concepts fondamentaux tels que l'Analyse des Composantes Principales (ACP), la construction d'échelles de mesure, et les types de variables latentes. L'objectif est de garantir la validité, la fiabilité et la pertinence des données collectées dans le cadre de recherches académiques ou professionnelles.

Transféré par

souadbadr23
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
65 vues168 pages

Data Analysis

Ce document présente un module de formation sur la modélisation par équations structurelles (SEM) et l'analyse des données, visant à doter les étudiants de compétences en structuration de questionnaires et en analyse de données multivariées. Il couvre des concepts fondamentaux tels que l'Analyse des Composantes Principales (ACP), la construction d'échelles de mesure, et les types de variables latentes. L'objectif est de garantir la validité, la fiabilité et la pertinence des données collectées dans le cadre de recherches académiques ou professionnelles.

Transféré par

souadbadr23
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

T

Analyse des Données


Introduction à la modélisation par les équations structurelles à
variable latente

AF
(A partir des données d’enquêtes)

@Prof. Soussi Noufail Outmane

Université Mohammed V Rabat


DR
FSJES Salé

Octobre 2023
Objectifs du cours
Ce module vise à fournir aux étudiants les compétences et les
connaissances nécessaires pour utiliser la modélisation SEM dans

T
l’analyse des données. Il vise donc :
Structurer votre questionnaire.

AF
Comprendre les concepts fondamentaux de l’Analyse des
Composantes Principales (ACP).
Savoir comment effectuer une ACP sur des données.
Être en mesure d’interpréter les résultats de l’ACP.
Utiliser l’ACP comme outil de réduction de dimension et de
visualisation de données.
DR
Comprendre la signification de la modélisation par équation
structurelle (SEM) et sa relation avec l’analyse de données
multivariées.
Comprendre les concepts de base de la méthode des moindres
carrés partiels SEM (PLS-SEM).
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 2 / 168
Sommaire

T
1 Introduction

2 Questionnaire

AF
3 Construction d’une échelle de mesure pour une variable

4 Examen des instruments de mesure

5 Structuration factorielle et épuration des échelles


DR
6 Structural Equation Modeling

7 PLS-SEM

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 3 / 168


Sommaire

T
AF
1 Introduction
Mise à niveau
C’est quoi collecter des données
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 4 / 168
Sommaire

T
AF
1 Introduction
Mise à niveau
C’est quoi collecter des données
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 5 / 168
Mise à niveau

T
Rappel des notions fondamentales :
Statistiques descriptives

AF
Calcul Matriciel
Probabilités
Tests d’hypothèses
Introduction à l’économétrie
Corrélation et causalité
DR
Modèle de régression linéaire simple
Modèle de régression linéaire général

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 6 / 168


Sommaire

T
AF
1 Introduction
Mise à niveau
C’est quoi collecter des données
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 7 / 168
Collecte des données
Définitions

T
La collecte de données est une étape fondamentale dans la
réalisation de recherches, de projets académiques ou professionnels
Elle nécessite une méthodologie précise pour garantir la qualité et

AF
la pertinence des données recueillies.

Il faut :
1 Définir l’objectif de la collecte de données

2 Identifier un plan détaillé qui précise les méthodes, les sources de

données, les échantillons, les instruments de collecte


DR
(questionnaires, enquêtes, entretiens, etc.) et le calendrier
3 Sélectionner les méthodes de collecte de données

4 Sélectionner l’échantillon

5 Collecter les données en assurant une cohérence et une fiabilité des

données.
6 Traitements (Usage des logiciels) et présentation des résultats

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 8 / 168


Recueils des données

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 9 / 168
Sommaire

T
2 Questionnaire

AF
Définitions
Objectifs
Élaboration et organisation
Mesure et Échelles
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 10 / 168
Sommaire

T
2 Questionnaire

AF
Définitions
Objectifs
Élaboration et organisation
Mesure et Échelles
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 11 / 168
Le questionnaire

T
Définition
Un questionnaire est un outil de collecte de données structuré et
standardisé utilisé pour recueillir des informations auprès de

AF
personnes ou de groupes dans le cadre d’une étude de recherche,
d’une enquête ou d’une évaluation.
Les questionnaires sont couramment utilisés dans plusieurs
domaines :
en recherche sociale
en sciences comportementales
en marketing
DR
en sondages d’opinion
dans de nombreux domaines : Santé, éducation , etc.
Et ce pour obtenir des données quantitatives ou qualitatives sur
un sujet spécifique.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 12 / 168


Sommaire

T
2 Questionnaire

AF
Définitions
Objectifs
Élaboration et organisation
Mesure et Échelles
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 13 / 168
Objectif du questionnaire

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 14 / 168
Objectifs d’un questionnaire se référent aux études en
sciences de gestion

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 15 / 168
Sommaire

T
2 Questionnaire

AF
Définitions
Objectifs
Élaboration et organisation
Mesure et Échelles
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 16 / 168
Étapes pour l’élaboration d’un questionnaire

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 17 / 168
Organisation d’un questionnaire

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 18 / 168
Organisation d’un questionnaire

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 19 / 168
Sommaire

T
2 Questionnaire

AF
Définitions
Objectifs
Élaboration et organisation
Mesure et Échelles
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 20 / 168
Échelles de mesures

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 21 / 168
Échelles de mesures d’attitude

T
AF
DR
https ://[Link]/actualites/enquetes/enquete-de-satisfaction-clients/

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 22 / 168


Encoder le questionnaire

Il est recommandé de résumer les informations les plus importantes sur

T
les variables rassemblées dans un « tableau de codage ».
Exemple

AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 23 / 168
Encoder le questionnaire

T
Il existe une multitude de logiciels qui dépendent de vos besoins
spécifiques en termes de création de questionnaire, de collecte de
données et d’analyse. Certains sont gratuits, tandis que d’autres

AF
nécessitent un abonnement ou un achat.
Microsoft Excel
Google Forms (en ligne), Gratuit.
Qualtrics, SurveyMonkey, QuestionPro (en ligne)
LimeSurvey, (Open source)
DR
SurveyGizmo, Snap Survey Software, FluidSurveys,
RedCap
MAXQDA, NVivo (Pour l’analyse qualitative qui peut être
utilisé pour analyser les réponses textuelles des questionnaires)

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 24 / 168


Sommaire

T
AF
3 Construction d’une échelle de mesure pour une variable
Construction du Concept
Variable Latente
Stratégie et Démarche
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 25 / 168
Sommaire

T
AF
3 Construction d’une échelle de mesure pour une variable
Construction du Concept
Variable Latente
Stratégie et Démarche
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 26 / 168
Construction du concept, dimension, variable
Dans le cadre de la modélisation par équations structurelles il est
essentiel de comprendre la hiérarchie des concepts, des dimensions et

T
des variables.

AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 27 / 168
Construction du concept, dimension, variable

Définition : Concept

T
C’est un terme général qui représente une idée ou un phénomène
abstrait que vous souhaitez étudier.
Exemple : la satisfaction client, la qualité de vie, la performance

AF
organisationnelle, etc.

La construction du concept consiste à définir précisément ce que


vous entendez par ce concept abstrait. Il s’agit d’une étape de
conceptualisation où vous spécifiez les composants clés qui
décrivent le concept.
DR
Par exemple, si vous construisez le concept de "satisfaction client",
vous pourriez considérer des dimensions telles que la qualité du
produit, le service à la clientèle, le prix, etc.
Cette étape de construction du concept est cruciale car elle permet
de clarifier ce que vous mesurez et ce que vous ne mesurez pas.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 28 / 168
Construction du concept, dimension, variable

Définition : Dimension

T
C’est un sous-ensemble ou une composante du concept que vous
avez construit. Les dimensions sont généralement plus spécifiques
que le concept global et décrivent différentes facettes ou aspects du

AF
concept.
Dans un modèle SEM, chaque dimension est représentée par une
variable latente (non observée) qui est mesurée à l’aide
d’indicateurs observables (variables observées).
Les indicateurs sont des mesures spécifiques qui capturent les
caractéristiques de la dimension.
DR
Par exemple, si vous avez construit le concept de "satisfaction
client", vous pourriez avoir des dimensions telles que la "qualité du
produit", la "qualité du service" et la "satisfaction globale". Chaque
dimension serait mesurée par plusieurs indicateurs.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 29 / 168
Construction du concept, dimension, variable
Définition : Variable

T
Est une mesure spécifique que vous utilisez pour quantifier une
dimension.
Les variables peuvent être soit observables (mesurées directement)

AF
soit latentes (non observées).

Les variables observables (mesurées) sont des mesures concrètes


que vous avez collectées à partir de données empiriques. Exemple :
si vous mesurez la dimension "qualité du produit", vous pouvez
utiliser des variables observables telles que "note de satisfaction du
DR
produit" ou "nombre de retours de produits".
Les variables latentes (non observées) représentent des concepts
abstraits ou des dimensions construites à partir d’un ensemble
d’indicateurs observables. Exemple : la "satisfaction globale du
client" peut être construite à partir des réponses à plusieurs
questions sur la satisfaction client.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 30 / 168
Sommaire

T
AF
3 Construction d’une échelle de mesure pour une variable
Construction du Concept
Variable Latente
Stratégie et Démarche
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 31 / 168
Typologie des variables latentes

T
On distingue deux types de variables latentes dans le contexte SEM :
Les données informatives (Reflective Data)
Les données formatives (Formative Data)

AF
Il s’agit de connaitre la direction de la relation entre la variable latente
et les indicateurs observables.

F I
DR
X1 X2 X3 C1 C2 C3
Relations Formatives Relations Informatives

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 32 / 168


Reflective Data
Les données informatives sont souvent utilisées pour représenter

T
un concept (I) qui sont considérés comme une cause sous-jacente
de plusieurs indicateurs ou variables observables.
Dans ce modèle, les indicateurs sont considérés comme étant
influencés par la variable latente, ce qui signifie que les indicateurs

AF
sont des mesures ou des reflets du concept sous-jacent.
L’objectif est de représenter la variable latente de manière fidèle,
en réduisant au maximum l’erreur de mesure.
Exemple : Compétitivité sectorielle
Variable latente : Compétitivité du secteur
DR
Indicateurs observables : Croissance des ventes, part de marché,
nombre de brevets déposés
Modèle informatif : On suppose que la compétitivité du secteur est
une cause sous-jacente de la croissance des ventes, de la part de
marché et du nombre de brevets déposés.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 33 / 168
Formative Data
Les données formatives sont utilisées pour représenter un concept

T
(F) qui est considéré comme étant construit à partir des
indicateurs observables.
Autrement dit, les indicateurs contribuent à former ou à définir la
variable latente.

AF
Dans ce modèle, les indicateurs sont considérés comme des
éléments constitutifs de la variable latente. La variable latente
n’est pas supposée être la cause des indicateurs, mais plutôt une
combinaison des indicateurs.
L’objectif est de mesurer la variable latente de manière
satisfaisante, en utilisant un ensemble d’indicateurs pertinents.
DR
Exemple : Performance des employés
Indicateurs observables : Nombre de tâches accomplies, heures de
travail, feedback des clients
Modèle formatif : On suppose que la performance des employés est
construite en fonction du indicateurs sus-cités.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 34 / 168
Échelle de mesure pour une variable

T
Construction d’une échelle de mesure pour une variable
Est une étape essentielle pour garantir que les données collectées sont :
Valides,

AF
Fiables et
Pertinentes.
Généralement on peut citer ces orientations :
Définissez clairement ce que la variable représente et pourquoi
elle est importante dans le contexte de votre recherche.
DR
Choisissez le type d’échelle qui convient le mieux à votre
variable (nominales, ordinales, intervalles et de ratio).
Déterminez les items (questions) qui permettront de la mesurer.
Ces items doivent être clairs, précis et pertinents et les rédiger.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 35 / 168


Échelle de mesure pour une variable

Utilisez une échelle de réponse appropriée : Likert, binaire, etc.

T
Testez l’échelle sur un petit groupe de participants pour vous
assurer qu’elle est compréhensible et qu’elle fonctionne comme
prévu. Faire des ajustement si nécessaire.

AF
Recueillez des données (questionnaire final)
Analysez la validité et la fiabilité. (Affinez l’échelle si nécessaire)

Important
Churchill (1979) a développé une démarche d’ordre méthodologique
appelée "Paradigme de Churchill", pour construction des instruments
DR
de mesure de types questionnaires à échelles multiples.

Il distingue deux type d’analyse :


1 Analyse exploratoire
2 Analyse confirmatoire
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 36 / 168
Sommaire

T
AF
3 Construction d’une échelle de mesure pour une variable
Construction du Concept
Variable Latente
Stratégie et Démarche
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 37 / 168
Paradigme de Churchill : Analyse exploratoire

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 38 / 168
Sommaire

T
AF
4 Examen des instruments de mesure
Objectif et Protocole
Fiabilité des instruments de mesure
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 39 / 168
Sommaire

T
AF
4 Examen des instruments de mesure
Objectif et Protocole
Fiabilité des instruments de mesure
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 40 / 168
Analyse exploratoire

T
L’exploration consiste à :
Se focaliser sur la revue de littérature pour identifier et spécifier le
domaine du construit.

AF
Les entretiens et les exemples pratiques permettent au chercheur
de générer des indicateurs de mesure du concept.
La collecte des premières données sert à purifier l’instrument de
mesure pour pouvoir élaborer une deuxième version du
questionnaire.
DR
Son objectif
Valider une hypothèse ou aider à la prise de décision.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 41 / 168


Protocole de l’examen exploratoire des instruments

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 42 / 168
Sommaire

T
AF
4 Examen des instruments de mesure
Objectif et Protocole
Fiabilité des instruments de mesure
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 43 / 168
Fiabilité des instruments de mesure

T
Objectif
Évaluation de la cohérence interne (d’améliorer ses qualités globales
afin de pouvoir sélectionner les meilleurs items qui traduisent les

AF
construits étudiés
Elle est réalisée en appliquant les deux étapes :
1 Calculer le coefficient de l’alpha de Cronbach. Techniquement, la
valeur calculée de ce coefficient permettra de mesurer la
consistance interne d’un ensemble d’indicateurs de mesure. Ce qui
DR
permet d’estimer dans quelle mesure un item peut affaiblir la
cohérence interne d’une échelle multiple.
2 Supprimer les items qui affaiblissent la valeur de l’alpha de
Cronbach en adoptant une règle de décision spécifique.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 44 / 168


Calcul de l’alpha de Cronbach
L’alpha de Cronbach

T
Également connu sous le nom de coefficient alpha de Cronbach, est
une mesure de la fiabilité ou de la cohérence interne d’une échelle de
mesure, généralement utilisée en psychométrie.

AF
Pn !
N 2
i=1 σik
α= 1− (1)
N −1 σT2

α est le coefficient alpha de Cronbach


DR
N est le nombre d’éléments (ou d’observations) dans l’échelle
k est le nombre d’éléments dans l’échelle (c’est-à-dire le nombre de
questions ou d’items dans le questionnaire)
σi2 est la variance de chaque item individuel
σT2 est la variance totale de l’ensemble des scores des items
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 45 / 168
Calcul de l’alpha de Cronbach

T
L’alpha de Cronbach est souvent utilisée comme étape
préliminaire avant l’analyse factorielle.

AF
Bien qu’il ne soit pas littéralement correct, l’alpha est parfois
conceptualisé comme la corrélation moyenne entre toutes les
combinaisons possibles par paires d’un groupe d’items.
Une valeur alpha importante indique une intracorrélation élevée
entre un groupe d’items et est généralement utilisée comme critère
DR
pour déterminer qu’une analyse factorielle ultérieure est
appropriée.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 46 / 168


Calcul de l’alpha de Cronbach avec Excel

Exemple 1

T
Supposons que vous ayez un questionnaire a avec 11 questions (items
(i)) conçues pour mesurer la satisfaction des clients à l’égard d’un
produit, et que vous ayez recueilli des réponses de 12 clients.

AF
a. Voir la base de données : TP1

Q1 Q2 Q3 Q4 Q5 Q6 Q7 Q8 Q9 Q10 Q11 Score


1 1 1 1 1 1 1 1 1 1 1 1 11
2 1 1 1 1 1 1 1 1 0 1 0 9
3 1 0 1 1 1 1 1 1 1 0 0 8
4 1 1 1 0 1 1 0 1 1 0 0 7
DR
5 1 1 1 1 1 0 0 0 1 0 0 6
6 0 1 1 0 1 1 1 1 0 0 0 6
7 1 1 1 1 0 0 1 0 0 0 0 5
8 1 1 1 1 1 0 0 0 0 0 0 5
9 0 1 0 1 1 0 0 0 0 1 0 4
10 1 0 0 1 0 1 0 0 0 0 0 3
11 1 1 1 0 0 0 0 0 0 0 0 3
12
P 1 0 0 1 0 0 0 0 0 0 0 2
10 9 9 9 8 6 5 5 4 3 1 69

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 47 / 168


Calcul de l’alpha de Cronbach avec Excel
Ce tableau peut être schématisé comme suit :

T
 
x11 x12 ··· x1k
x
 21 x22 ··· x2k 

 . .. 
 . .
 . (2)

AF

..
 
.
 
 
xN 1 xN 2 ··· xN k
On est en présence d’une variable latente mesurée à travers plusieurs
questions (11 items) appelées une échelle de mesure de cette variable
latente, Donc :
DR
N = 12 est le nombre d’observations
k = 11 est le nombre d’items
2 est la variance de chaque item ; On dispose de k = 11
σik
variances qu’il faut calculer.
σT2 est la variance totale : C’est la variance des scores des items ;
On dispose d’une seule variance à calculer
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 48 / 168
Calcul de l’alpha de Cronbach avec Excel
1 Calcul des variances individuelles : (Sous Excel : =VAR.P(B5 :B16))

T
PN
2 i=1 (xik − x¯k )2
σik = (3)
N

AF
Pour k = 1 : P12
2 i=1 (xi1 − x¯1 )2
σi1 = = 0, 139
N
2
σi1 2
σi2 2
σi3 2
σi4 2
σi5 2
σi6 2
σi7 2
σi8 2
σi9 2
σi10 2
σi11
0,139 0,188 0,188 0,188 0,222 0,25 0,243 0,243 0,222 0,188 0,076
DR
2 Calcul de la somme des variances individuelles :
n
X
2
σik = 2.1458 ≈ 2.15
i=1

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 49 / 168


Calcul de l’alpha de Cronbach avec Excel

T
3 Calcul de la variance des scores
n

AF
1X
σT2 = (yi − ȳ)2 = 6.521 ≈ 6.52 (4)
n i=1

Avec yi est la somme des réponses de l’individu i


4 Calcul de l’alpha
Pn !
2
DR
N i=1 σik 11 2.15
 
α= 1− = 1− = 0.738 ≈ 0.74
N −1 σT2 11 − 1 6.52

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 50 / 168


Évaluation de l’alpha de Cronbach avec Excel
Pour évaluer la consistance interne de l’échelle de mesure de la variable
Latente. Ce paramètre est toujours 0 < α < 1. On retient la règle de

T
décision suivante :

Conclusion
AF
D’après les calculs, l’alpha de Cronbach est compris entre 0.6 et
DR
0.8 : On peut accepter le test et de confirmer de la fiabilité de
l’échelle de mesure de la dite variable latente.
en d’autre terme :

0.6 < α = 0.74 < 0.8 ⇒ Echelle de mesure acceptable


Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 51 / 168
Autres formulations

Le coefficient a se calcule en appliquant une autre formule :

T
N × r̄
α= (5)
1 + (N − 1) × r̄

AF
r̄ est corrélation moyenne entre tous les couples d’items.
P
rij
r̄ =
Card(s)

Card(s) est le nombre de coefficients de corrélation à calculer :


DR
C’est une Combinaison sans Répétition :
! !
p N N 2
Card(s) = CN = = = CN
p 2

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 52 / 168


Autres formulations

T
Le coefficient de corrélation de Pearson entre les variables X et
Y est donné par :

AF
Pn
i=1 (xi − x̄)(yi − ȳ)
rxy = pPn 2
pPn
2
i=1 (xi − x̄) i=1 (yi − ȳ)

Où :
n est le nombre d’observations.
DR
xi et yi sont les valeurs individuelles des variables X et Y .
x̄ et ȳ sont les moyennes des variables X et Y respectivement.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 53 / 168


Autres formulations

D’après les données de l’exemple précédent : (Voir TP1)

T
1 On dispose de 55 coefficients de corrélation distincts à calculer :
!
11 11 × 10

AF
= = 55
2 2

2 On calcul donc la matrice de corrélation et l’on s’intéresse qu’au


coefficients inter-items ( =[Link](Matrice1 ;Matrice2)) par
exemple : r12 = −0.26
10.94
3 On calcul la corrélation moyenne : r̄ = = 0.20
DR
55
4 Alpha est donné par :
11 × 0.20
α= = 0.733 ≈ 0.73
1 + (11 − 1) × 0.20

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 54 / 168


Exemple sous Stata

T
Données du TP 1
En utilisant Stata, On peut importer les données en suivant : File

AF
> import > Excel Spreadsheet
Après importation, On visualise les données : data Editor (Browse)
Dans le menu Statistics, Vous pouvez mener vos calcul

Pour calculer l’alpha de Cronbach, il faut préalablement procéder a


une analyse plus raffinée des données :
DR
Mener une analyse descriptive des données
Mener une analyse de corrélation
Calculer l’Alpha

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 55 / 168


Exemple sous Stata : Statistiques Descriptives

T
Chemin : Statistics > Summarises, tables and Tests > Symmary
and Statistique descriptives> Summary statistics
Commande : sumarize q1 q2 q3 q4 q6 q5 q7 q8 q9 q10 q11

AF
Sortie Stata
Variable Obs Mean Std. Dev. Min Max
q1 12 0,83 0,39 0 1
q2 12 0,75 0,45 0 1
q3 12 0,75 0,45 0 1
q4 12 0,75 0,45 0 1
q5 12 0,67 0,49 0 1
q6 12 0,50 0,52 0 1
DR
q7 12 0,42 0,51 0 1
q8 12 0,42 0,51 0 1
q9 12 0,33 0,49 0 1
q10 12 0,25 0,45 0 1
q11 12 0,083 0,289 0 1

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 56 / 168


Exemple sous Stata : Statistiques Descriptives

T
Chemin : Statistics>Summarises, Tables and Tests > Symmary
and Statistique descriptives> correlations and covariances
Commande : correlate q1 q2 q3 q4 q6 q5 q7 q8 q9 q10 q11

AF
Sortie Stata

q1 q2 q3 q4 q6 q5 q7 q8 q9 q10 q11
q1 1
q2 -0,26 1
q3 0,26 0,56 1
q4 0,26 -0,33 -0,33 1
q6 0,00 -0,19 0,19 -0,19 1
DR
q5 -0,32 0,41 0,41 0,00 0,35 1
q7 -0,08 0,10 0,49 0,10 0,51 0,24 1
q8 -0,08 0,10 0,49 -0,29 0,85 0,60 0,66 1
q9 0,32 0,00 0,41 0,00 0,35 0,50 0,12 0,48 1
q10 -0,26 0,33 -0,11 0,33 0,19 0,41 0,29 0,29 0,00 1
q11 0,13 0,17 0,17 0,17 0,30 0,21 0,36 0,36 0,43 0,52 1

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 57 / 168


Exemple sous Stata
Chemin : Statistics > Multivariate analysis > Cronbach’s alpha

T
Commande : alpha q1 q2 q3 q4 q5 q6 q7 q8 q9 q10 q11
Sortie Stata : Pour illustrer l’alpha, nous l’appliquons, d’abord
sans puis avec l’option item, à l’ensemble de données :

AF
Test scale = mean(unstandardized items)
Reversed items : q1 q4
Average interitem covariance : .050551
Number of items in the scale : 11
Scale reliability coefficient : 0.7741

Interprétations
DR
L’échelle dérivée de nos éléments (Items) choisis de manière
arbitraire semble raisonnable car la corrélation
√ estimée entre elles
et le facteur sous-jacent qu’elle mesure est 0.7741 ≈ 0, 8798 et la
corrélation estimée entre cette batterie de onze éléments et toutes
les autres éléments du même domaine est de 0.7741.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 58 / 168
Exemple sous Stata

T
Attention
Étant donné que les items "éléments" sont sur la même échelle
(Likert), On se contente de mener le test : mean(unstandardized items)

AF
⇒ Dans le cas contraire : les items ne sont pas sur la même échelle, il
est important que std soit spécifié de manière à ce que l’échelle et sa
fiabilité soient basées sur la somme de variables standardisées. Nous
pourrions obtenir l’échelle dans une nouvelle variable appelée sc avec
l’option gen(sc).
DR
Exemple : Utilisez cette base de données
http ://[Link]/data/r14/automiss (1978 Automobile Data)
. alpha price headroom rep78 trunk weight length turn displ

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 59 / 168


Exemple sous Stata

T
Test scale = mean(unstandardized items)
Reversed items : q1 q4

AF
Average interitem covariance : .050551
Number of items in the scale : 11
Scale reliability coefficient : 0.7741

Reversed items : q1 q4 : Signifie que les deux Items ont été inversé.
11 est le nombre d’items dans l’échelle de mesure de la variable.
DR
Stata prend en compte plusieurs options pour le calcul de l’alpha.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 60 / 168


Exemple sous Stata

Option : Avoir un tableau global

T
AF
DR
"Test scale" renseigne sur : r̄ = 0, 50551 ≈ 0.55 est la corrélation
moyenne entre les items et 0, 8984 est le coefficient alpha pour une
échelle de test basée sur tous les éléments.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 61 / 168


Exemple sous Stata
"Obs" indique le nombre de valeurs non manquantes des éléments ;

T
"Signe" indique la direction dans laquelle une variable d’élément
est entrée dans l’échelle ; "-" indique que l’élément a été inversé.
Les quatre colonnes restantes du tableau fournissent des

AF
informations sur l’effet d’un élément sur l’échelle.
En règle générale, les Item-test correlation doivent être à peu près
les mêmes pour tous les éléments : Ce test permet de détecter les
éléments mal ajustés qui peuvent fausser l’échelle.
Item-rest correlation est la corrélation entre un élément et l’échelle
formée par tous les autres éléments.
DR
average interitem covariance représente Les corrélations moyennes
inter-éléments (covariances si std est omis) de tous les éléments, à
l’exception d’un.
La septième colonne donne le α de Cronbach pour l’échelle de
test, qui comprend tous les éléments sauf un.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 62 / 168
Exemple sous Stata

T
AF
DR
Le α de cronbach vaut 0.77 ce qui signifie que le test est accepté
et par conséquent il reflète une fiabilité et une cohérence interne de
cet instrument de mesure.
On retient tous les items car les valeurs respectives de l’alpha pour
chaque items une fois supprimé ne permettront pas
individuellement d’augmenter la fiabilité de cet instrument.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 63 / 168
Exemple sous Stata

T
Exemple 2
Données qui correspondent à une Évaluation d’un produit à travers un

AF
questionnaire qui comporte 27 de questions. Cette évaluation concerne
243 répondants. (Lien Ici)

La base de données prends la forme suivante :


age prof income gender resi quali quality1 quality2 quality3 quality4 quality5
3 1 2 1 1 2 4 4 3 3 3
DR
2 2 2 1 1 4 4 4 3 3 5
1 2 2 1 1 2 1 1 1 1 1
2 2 2 1 1 2 1 1 1 1 2
3 1 1 1 1 4 4 4 4 4 4
1 4 1 1 1 1 2 1 3 1 1

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 64 / 168


Exemple sous Stata
On suppose que le modèle théorique se comporte ainsi :

T
Qualité du produit Fidélité au produit

Satisfaction

AF Interaction avec le produit

Qualité du produit (quality) : Variable mesurée par 6 items


DR
Fidélité au produit (loyalty) : Variable mesurée par 5 items
Comportement d’Interaction avec le produits (beh int) : Variable
mesurée par 6 items
Satisfaction (sta) : Variable mesurée par 4 items
L’objectif : Tester la fiabilité des instruments de mesure
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 65 / 168
Exemple sous Stata

T
Visualisation des données à partir de Stata

AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 66 / 168
Exemple sous Stata

1 Générer un tableau de statistiques descriptives (summarize *)

T
AF
Objectif : s’assurer des
variable de manquantes, des
Minima et des Maxima et voir
la dispersion des variables.
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 67 / 168
Exemple sous Stata

T
2 Générer un tableau de corrélation (corr *)

AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 68 / 168
Exemple sous Stata
3 Calcul de l’Alpha de Cronbach

T
La variable latente : Quality est mesurée à partir de 6 items

AF
DR
Décision
le alpha pour "Quality" étant supérieur à 0,6 et dépasse 0,8 : retenir
tous les items = fiabilité des instruments de mesure
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 69 / 168
Exemple sous Stata

3 Calcul de l’Alpha de Cronbach

T
La variable latente : Loyalty est mesurée à partir de 6 items

AF
DR
Décision
Le alpha pour Loyalty étant supérieur à 0,6 et dépasse 0,8 : retenir tous
les items = fiabilité des instruments de mesure

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 70 / 168


Exemple sous Stata
3 Calcul de l’Alpha de Cronbach

T
La variable latente : Fidelity est mesurée à partir de 6 items

AF
DR
Décision
Le alpha pour " beh int" étant supérieur à 0,6 et dépasse 0,8 : retenir
tous les items = fiabilité des instruments de mesure

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 71 / 168


Exemple sous Stata

3 Calcul de l’Alpha de Cronbach

T
La variable latente : Satisfaction est mesurée à partir de 4 items

AF
DR
Décision
Le alpha pour "Sat" étant supérieur à 0.6 et dépasse 0.8 : retenir tous
les items = fiabilité des instruments de mesure

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 72 / 168


Exemple sous Stata

T
Conclusion

AF
Ce tableau résume les résultats statistiques
Items
Variables Initiaux Éliminés Retenus Alpha Type d’échelle
Qualité 6 0 6 0,8943 5 pts
Fidélité 5 0 5 0,8429 5 pts
Interaction 6 0 6 0,8574 5 pts
Satisfaction 4 0 4 0,8506 5 pts
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 73 / 168
Sommaire

T
5 Structuration factorielle et épuration des échelles

AF
Principe et Méthodes
Procédure de l’analyse en composantes principales
Outils de diagnostique de la solution factorielle
Étude des distributions des nouvelles variables latentes
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 74 / 168
Sommaire

T
5 Structuration factorielle et épuration des échelles

AF
Principe et Méthodes
Procédure de l’analyse en composantes principales
Outils de diagnostique de la solution factorielle
Étude des distributions des nouvelles variables latentes
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 75 / 168
Purification factorielle

Afin de purifier l’instrument de mesure, il est impératif d’appliquer

T
une analyse factorielle.
Elle permettra de réduite la dimensionnalité des données en
identifiant les principales composantes qui capturent la majeure

AF
partie de la variance dans les données.
Elle permettra d éliminer la redondance, de distinguer les variables
importantes de celles qui ont peu d’impact sur la variance des
données.
L’analyse factorielle permettra la visualisation des relations entre
DR
variables dans un espace de composantes principales, ce qui peut
aider à comprendre la structure sous-jacente des données.
Il existe plusieurs techniques : les méthodes factorielles

Il faut appliquer une de ces techniques factorielles

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 76 / 168


Structuration factorielle
Définition

T
L’analyse factorielle est un moyen de condenser les données de
nombreuses variables en quelques variables seulement pour
simplifier la compréhension des résultats.

AF
Elle est aussi parfois appelée Méthode de réduction de dimension.
Elle permet de réduire les dimensions de vos données en une ou
plusieurs super-variables appelées aussi construits

La technique d’analyse factorielle la plus courante est connue sous


le nom d’ACP, Analyse en Composantes Principales (PCA en
DR
anglais pour Principal Component Analysis).
Mais la raison principale d’appliquer l’ACP et non une autre
analyse multidimensionnelle est qu’il s’agit des données
quantitatives (Questionnaire encodé) représentées sous forme d’un
tableau constitué de p colonnes et n lignes (n × p) (Individus ×
Variables).
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 77 / 168
Sommaire

T
5 Structuration factorielle et épuration des échelles

AF
Principe et Méthodes
Procédure de l’analyse en composantes principales
Outils de diagnostique de la solution factorielle
Étude des distributions des nouvelles variables latentes
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 78 / 168
Analyse en composantes principales

Principe et objectif général

T
L’analyse en composantes principales est une technique statistique
utilisée pour la réduction des données.

AF
l’ACP permet le calcul entre autres : Les vecteurs propres de la
corrélation ou la matrice de covariance des variables
Ces indicateurs décrivent une série de combinaisons linéaires non
corrélées des variables (réduction des données).
Ils contiennent la majeure partie de la variance.
En plus, les vecteurs propres d’une ACP sont souvent inspectés
DR
pour en savoir plus sur la structure sous-jacente des données.

Donc : l’ACP va nous permettre de construire un nouveau système de


représentation (combinaisons linéaires des variables originelles) qui
permet synthétiser l’information.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 79 / 168


ACP : Position du problème

Lors d’une ACP, Il est important en analysant un questionnaire de

T
s’interroger sur :
La proximité entre individus : Qui sont les individus qui ont donné
la (même) réponse aux questions afférentes à une variable, un

AF
concept ou à une dimension.
La ressemblance entre individus : Sur quelles réponses sont fondées
les ressemblances / dissemblances.
Quelles sont les relations entre les questions (items).
Donc sur la base des données issues du questionnaire l’objectif est de :
DR
1 Étudier la ressemblance : S’assurer que les réponses (liée au
concept) sont plutôt homogènes
2 Étudier la variabilité : Retrouver les items qui sont liés entre eux
(corrélés)

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 80 / 168


Principe de l’ACP

T
On peut dire que le principe général de l’ACP est de :
Construire un système de représentation de dimension réduite qui
préserve les (proximités) distances entre les individus. On peut la

AF
voir comme une compression avec perte (contrôlée) de
l’information.
C’est à dire :
Si l’on est par exemple un concept (ou une variable) mesuré (ée)
par un système de n items, l’ACP permettra de construire une
DR
représentation réduite de ce concept (ou une variable) constituée
(de p < n items). Ce nouveau système restera fidèle aux distances
(relations) existantes (cohérence interne) entre ces items.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 81 / 168


Les trois résultats d’une ACP
Lors de la mise en œuvre d’une ACP, le principal résultat est :

T
1. Construire un ensemble de composantes (C1 , C2 , . . ., Ck ,. . .Cp )
principales, définies comme des combinaisons linéaires des items
originelles (centrées et réduites) 1 , dont on peut apprécier la qualité
de restitution de l’information à travers l’inertie 2 reproduite (λk ) 3

AF


 C1 = a11 z1 + a21 z1 + · · · + ap1 zp (λ1 )

.
 ..




Ck = a1k z1 + a2k z2 + · · · + apk zk (λk )

 ..
.





Cp = a1p z1 + a2p z2 + · · · + app zp (λp )
DR

Avec : zk est la valeur de la variable (Xk après centrage et réduction)


propre à l’individu k.
1. ACP normée
2. Dispersion autour du barycentre, c’est une variance multidimensionnelle
(calculée sur p dimensions)
3. Valeurs propres
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 82 / 168
Les trois résultats d’une ACP

T
2. On observe la décomposition de l’information en composantes non
corrélées (orthogonales).

AF
3. Retenir la (les) composante(s) principale(s) qui maximise (ent) le
carré de sa (leur) corrélation avec les variables de la base de
données.
Étant donné que l’ACP fournit de différents résultats. Et en liaison
avec le contexte de l’analyse des données liées aux instruments de
DR
mesure des données du questionnaire, il est important de proposer une
démarche précise.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 83 / 168


Mise en œuvre de l’ACP : Étude du nuage des points

T
Étudier la ressemblance d’un tableau de données peut être réalisé
géométriquement en étudiant les distances a entre individus.

AF
a. Distance euclidienne entre 2 individus (i, i’) : d2 (i, i0 ) = (xij − xi0 j )2
P

Etape 1. Étude graphique : Étude de la forme du nuage de points.


Il faut donc :
Centrer les données : Pour que G (point d’inertie)
soit situé à l’origine.
DR
Réduire les données : Pour rendre comparables les
variables exprimées sur des échelles (unités)
différentes. 4

4. On parle d’une ACP normée


Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 84 / 168
Mise en œuvre de l’ACP : Étude du nuage des points
Exemple 1

T
Reprenons l’exemple (TP1) avec n = 12 et p = 11.
On calcul les moyennes respectives de chaque item
On calcul les écart types respectifs de chaque item

AF
xij −x̄j
On construit le nouveau tableau des valeur centrées : zij = σxj

Les zij ont des moyennes nulles et des variances unitaires

Q1 Q2 Q3 Q4 Q5 Q6 Q7 Q8 Q9 Q10 Q11
0,447 0,577 0,577 0,577 0,707 1,000 1,183 1,183 1,414 1,732 3,317
DR
0,447 0,577 0,577 0,577 0,707 1,000 1,183 1,183 -0,707 1,732 -0,302
0,447 -1,732 0,577 0,577 0,707 1,000 1,183 1,183 1,414 -0,577 -0,302
0,447 0,577 0,577 -1,732 0,707 1,000 -0,845 1,183 1,414 -0,577 -0,302
0,447 0,577 0,577 0,577 0,707 -1,000 -0,845 -0,845 1,414 -0,577 -0,302
-2,236 0,577 0,577 -1,732 0,707 1,000 1,183 1,183 -0,707 -0,577 -0,302
0,447 0,577 0,577 0,577 -1,414 -1,000 1,183 -0,845 -0,707 -0,577 -0,302
0,447 0,577 0,577 0,577 0,707 -1,000 -0,845 -0,845 -0,707 -0,577 -0,302
-2,236 0,577 -1,732 0,577 0,707 -1,000 -0,845 -0,845 -0,707 1,732 -0,302
0,447 -1,732 -1,732 0,577 -1,414 1,000 -0,845 -0,845 -0,707 -0,577 -0,302
0,447 0,577 0,577 -1,732 -1,414 -1,000 -0,845 -0,845 -0,707 -0,577 -0,302
0,447 -1,732 -1,732 0,577 -1,414 -1,000 -0,845 -0,845 -0,707 -0,577 -0,302

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 85 / 168


Mise en œuvre de l’ACP : Étude du nuage des points

Etape 2. Analyser le tableau centré-réduit : Il est impossible de

T
visualiser les données
Solution : Chercher une image (réduction) des données
(Meilleure projection). C-à-d chercher un sous-espace qui

AF
résume les données en appliquant l’ACP.
TAF est de mener une première projection du nuage (matrice) de
12 individus sur les deux premiers axes de l’inertie (Premier plan
factoriel)

C’est de cette matrice que l’on va trouver les axes factoriels


DR
Pour cela on calcule les valeurs propres (représentent la quantité
d’information récupérée dans l’axe) et les vecteurs propres
associés : Cet examen permettra de déterminer combien de
composantes principales doivent être prises en compte.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 86 / 168


Mise en œuvre de l’ACP : Calcul des valeurs propres

Etape 3. Pour y arriver, On calcul la matrice de variance

T
covariance.
Si les données présentent la même échelle de mesure
(binaire, Likert), pas la peine de centrer-réduire, il suffit

AF
de calculer la matrice de corrélation.
Dans notre cas, On calcul simplement la matrice de corrélation
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 87 / 168
Mise en œuvre de l’ACP : Calcul des valeurs propres

T
Définitions (rappel)
On appelle vecteur propre de f tout vecteur x, vérifiant f (x) = λx

AF
x1
 
 .. 
Si A est la matrice de l’application f et X =  .  la matrice du
xn
vecteur propre x, alors :
f (x) = λx ⇒ AX = λX ⇔ (A − Iλ)X = 0 (I est la matrice
unitaire).
DR
Les vecteurs propres associés aux valeurs propres forment une base
dans laquelle la matrice D est diagonale.
La matrice diagonale est donc formée des valeurs propres.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 88 / 168


Mise en œuvre de l’ACP : Calcul des valeurs propres

Etape 4.1 Il est temps de réorganiser les données (nouveau système

T
de données). Celle-ci s’appuie sur la diagonalisation de la
matrice de variances-covariances.
On calcul des Valeurs et des Vecteurs propres à partir de

AF
la matrice de corrélation (matrice de variance covariance
sur les valeurs centrées) (=eVECTORS(C18 :M28 ;100 ;FAUX))
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 89 / 168
Mise en œuvre de l’ACP : Calcul des valeurs propres
Etape 4.2 Calculer la proportion de la variation expliquée par chaque
valeur propre et le pourcentage cumulé expliqué. 33.92%

T
représente la contribution de C1 (présentation factorielle) dans
la variabilité totale. Une méthode alternative consiste à
construire le graphique suivant (Scree Plot) qui illustre les

AF
différences successives entre les valeurs propres.
DR
Remarque : Les 4 composantes : C1 , C2 , C3 et C4 expliquent 78.43% de la
variation. Il s’agit d’un pourcentage assez élevé.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 90 / 168
Mise en œuvre de l’ACP : Calcul des scores
Etape 5.1 Charger la Matrice de poids totale : Cette matrice va nous

T
renseigner des charges =VecteursP*RACINE(ABS(ValeursP)).
Par exemple, la première composante principale Ĉ1 peut être
calculée à l’aide des éléments du premier vecteur propre

AF
DR
Lire : 
 Ĉ1 = −0.06Q1 + 0.36Q2 + · · · + 0.57Q11
−0.55Q1 + 0.71Q2 . + · · · − 0.39Q11

 Ĉ2 =
.. ..
 . .


Ĉ11 = 0.00Q1 + 0.00Q2 . + · · · + 0.00Q11

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 91 / 168


Mise en œuvre de l’ACP : Structuration factorielle
Etape 5.2 Cette ACP est dite (Sans rotation). Elle consiste à Retenir les

T
p = 4 composantes principales qui capture 78.43% de la
variabilité totale.
Il est important maintenant de recalculer la Matrice des
vecteurs propres/scores uniquement pour les principaux p

AF
facteurs (composantes).
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 92 / 168
Mise en œuvre de l’ACP : Dimensionnalité
Etape 6.1 Mener une analyse avec rotation : Avoir une meilleure

T
représentation des contribution de chaque items par rapport au
facteur choisi. Ici on choisit une rotation orthogonale Varimax.
(=VARIMAX(matrice des Composantes ;100))
Il existe plusieurs Méthodes de rotation orthogonale :

AF
(Quartimax, Equamax, Parsimax . . .)
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 93 / 168
Interpréter l’ACP
Les combinaisons linéaires :

T


 Ĉ1 = −0.136Q1 − 0, 108Q2 + · · · + 0, 332Q11
Ĉ 2 = −0, 012Q1 − 0, 078Q2 + · · · − 0, 644Q11




 . ..
.. .

AF
− 2 + · · · − 0, 189Q11

 Ĉ
 4
 = 0, 205Q1 0, 945Q
 .. ..


. .

Chacune d’entre elles peut être considérée comme une régression linéaire,
prédisant Ci à partir de Q1 , Q2 , ... , Q11 .
DR
Il n’y a pas de constantes, et les coefficients ai1 , ai2 , . . ., aip peuvent être
considérés comme des coefficients de régression (standardisés).
Notez que Ci est fonction de nos données aléatoires, et est donc
également aléatoire. Il y a donc : une variance de population, une
covariance de population et un vecteur capturant les valeurs propre de de
système d’équations linéaires.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 94 / 168
Interpréter l’ACP
L’interprétation des composantes principales repose sur la recherche des

T
variables qui sont les plus fortement corrélées à chaque composante Ĉp .
Une corrélation supérieure à 0, 5 en valeur absolue est considérée comme
importante.

AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 95 / 168
Interpréter l’ACP : Première composante principale Ĉ1

T
Ĉ1 est la combinaison linéaire de la variable Q qui présente une variance
maximale (parmi toutes les combinaisons linéaires).
Plus précisément, les coefficients suivant a11 , a12 , . . . , a1p sont définis de
telle manière que la variance est maximisée, sous la contrainte que la

AF
p
somme des carrés des coefficients soit égale à un A01 A1 = A21j = 1.
P
j=1

Cette contrainte est nécessaire pour qu’une solution unique puisse être
obtenue.
7→ Ĉ1 est fortement corrélée à trois des variables initiales. Elle augmente avec
DR
l’augmentation des scores de Q6 , Q8 et Q7 . Cela suggère que ces trois (items)
critères varient ensemble. Si l’un d’entre eux augmente, les autres ont
tendance à augmenter également.
7→ De plus, Ĉ1 est la plus fortement corrélée aux Q8 (0.953) et Q6 (0.933).
On pourrait affirmer, sur la base de la corrélation, que cette composante
principale est avant tout une mesure (construit) de ces deux items.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 96 / 168


Interpréter l’ACP : Deuxième composante Ĉ2

T
La Ĉ2 est la combinaison linéaire de la variable Q qui représente autant
que possible la variation restante, avec la contrainte supplémentaire que
la corrélation entre la Ĉ1 et la Ĉ2 est de 0.

AF
C-à-d : On définit a21 , a22 , . . . , a2p qui maximise la variance de ce
nouveau composant sous la contrainte que les sommes des coefficients au
p
a22j = 1, avec la contrainte supplémentaire que ces composantes
P
carré
j=1
p P
p
a1k a2l σkl = A01 ΣA2 = 0
P
ne sont pas corrélées : cov(C1 , C2 ) =
k=1 l=1
DR
7→ Ĉ2 diminue avec l’augmentation des scores de Q4 , Q10 et Q11 . Cette
composante peut être considérée comme (construit) une mesure regroupant
ces trois items

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 97 / 168


Interpréter l’ACP : iéme Composante principale Ĉi

T
Pour le Ĉ i , On cherche ai1 , ai2 , . . . , aip qui maximise C i = A0i ΣAi sous
les contraintes :
p
1 A0 Ai = a2ij = 1
P

AF
i
j=1
2 Et que toutes les composantes principales ne sont pas corrélées les
unes aux autres.
p Pp
a1k ail σkl = A01 ΣAi = 0,
P
cov(C1 , Ci ) =
k=1 l=1
p P p
a2k ail σkl = A02 ΣAi = 0,
P
cov(C2 , Ci ) =
k=1 l=1
DR
..
.
p
p P
ai−1,k ail σkl = A0i−1 ΣAi = 0
P
cov(Ci−1 , Ci ) =
k=1 l=1

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 98 / 168


Interpréter l’ACP : Conclusion
Dans cet exemple, nous avons supposer que la variable Q est mesurée par

T
différents items (Q1 , Q2 , . . . Q11 ).
L’application de l’ACP sans rotation a permis de retenir 4 composantes
principales avec une variabilité totale de 78.43%. (Valeurs propres > à 1)

AF
Après rotation (Varimax), on conclut que :
Ĉ1 capture à elle seule 33,92% (e-value = 3.7315). Ce facteur est
mesuré principalement par : Q6 , Q7 , Q8
Ĉ2 capture à elle seule 16,32% (e-value = 1,795) et une variabilité
cumulée de 50,25%. Ce facteur est mesuré par : Q4 , Q10 , Q11
Ĉ3 capture à elle seule 15,77% (e-value = 1,734) et une variabilité
cumulée de 66,02%. Ce facteur est mesuré par : Q1 , Q9
DR
Ĉ4 capture à elle seule 12,41% (e-value = 1,305) et une variabilité
cumulée de 78,43%. Ce facteur est mesuré par : Q2 , Q3 , Q5
Q est mesurée par 4 construits non colinéaire (orthogonaux). On peut
mener donc des régressions.
Chaque construit est une combinaison linéaire des Items qu’ils le forment.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 99 / 168
Mise en œuvre de l’ACP sous STATA

Exemple 2

T
Données qui correspondent à une Évaluation d’un produit à travers un
questionnaire qui comporte 27 de questions. Cette évaluation concerne 243
répondants. Rappelons le modèle théorique :

AF
Qualité du produit Fidélité au produit

Interaction avec le produit


DR
Satisfaction

L’analyse de la fiabilité à montré que la cohérence interne de


l’instrument de mesure des variables est acceptable.
Maintenant, il est intéressant d’effectuer une analyse ACP acec et sans
rotation pour analyser la Factorisation et la Dimensionnalité

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 100 / 168
Mise en œuvre de l’ACP sous STATA

T
La démarche consiste à redimensionner la structure des données. Pour
chaque variable (nous avons 4 variables) :
1 Effectuer une analyse en composantes principales (sans rotation )

AF
de n items afin de déterminer le nombre de composantes
principales (facteurs) qui maximisent la variabilité entre les items.
Ici, le nombre des composantes est égal au nombre des Items
2 On détecte les valeurs de "Eigen value" qui sont supérieures à 1.
3 Retenir les p composantes principales requis (nouvelle variable)
appelées construits.
DR
4 Effectuer une autre analyse en composantes principales (avec
rotation orthogonale) sur les p facteurs retenus. VARIMAX avec
normalisation de Kaiser.
5 Construire les nouveaux facteurs.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 101 / 168
Mise en œuvre de l’ACP sous STATA
Variable "Qualité du produit", notée : Quality

T
Objectif est de chercher les composantes dont les valeurs propres
sont supérieur à 1. (ACP sans rotation)

AF
DR
Décision : Puisque la valeur de [Link] montre que seul le premier
facteur dépasse 1, On retient donc une seule composante principale
avec une variabilité qui atteint 65,56%.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 102 / 168
Mise en œuvre de l’ACP sous STATA
Variable "Qualité du produit", notée : Quality

T
Stata permet de visualiser le graphique des [Link] : (screeplot,
yline(1))

AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 103 / 168
Mise en œuvre de l’ACP sous STATA

Variable "Qualité du produit", notée : Quality

T
On refait l’ACP mais cette fois en prenant en considération un
seul facteur
La matrice de [Link] est donnée par :

AF
DR
Malgré cette représentation factorielle, les corrélations montre des
valeurs inférieures à 0,5. Mais la partie non expliquée par ce
facteur reste négligeable.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 104 / 168
Mise en œuvre de l’ACP sous STATA
Variable "Qualité du produit", notée : Quality

T
On doit donc appliquer une rotation de ce facteur

AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 105 / 168
Mise en œuvre de l’ACP sous STATA
Interprétation

T
Avant rotation, il semble que le premier facteur traduit à lui seul 66% de
l’information disponible.
Après rotation, la première composante peut être formée de tous les

AF
items mesurant la variable initiale.
On peut considéré que la représentation dans le premier plan factoriel est
assez fidèle du positionnement relatif des items.
Nous avons considéré l’ACP comme une méthode qui permet la réduction de
données (compression de l’information)
DR
Mais attention ! !
Cela n’est possible que si le nouveau système de données présente une certaine
redondance (abondance) d’information.

On doit répondre à une question importante : Est-ce qu’il est possible de


dire que ce (résumé) système de données réduit est bon ?
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 106 / 168
Sommaire

T
5 Structuration factorielle et épuration des échelles

AF
Principe et Méthodes
Procédure de l’analyse en composantes principales
Outils de diagnostique de la solution factorielle
Étude des distributions des nouvelles variables latentes
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 107 / 168
Position du problème

Généralement :

T
Faire une acp suggère parfois de mener plusieurs analyse afin de
pour voir si on obtiendra une solution.
Réexaminer la matrice de corrélation pour voir si il a des
corrélations très élevées de même que l’information sur la qualité de

AF
la représentation.
Vérifier si chaque variable est corrélée à au moins un facteur avec
une saturation factorielle plus grande que 0,30.
Refaire l’analyse de façon itérative jusqu’à arriver à une solution
simple satisfaisante.
De manière précise :
DR
Le critère de la justesse de l’analyse est en partie subjectif : Est-ce
que le regroupement fait sens ?
Il y a une infinité de solutions possibles après rotation. il n’y a donc
pas une seule "bonne" solution. Il est donc difficile de décréter que la
solution présentée est "la solution". Il faut la présenter comme une
solution plausible qui n’est pas contredite par les données.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 108 / 168
Indices de pertinence de la solution factorielle

T
Ces questions soulèvent deux situations :
1 Dans le cas ou les variables sont parfaitement corrélées, un seul axe
factoriel suffira, il restituera 100% de l’information disponible.

AF
2 Dans le cas ou les variables sont deux à deux indépendantes (deux à
deux orthogonales), le nombre de facteur est égale au nombre de
variables.
Donc pour s’assurer que cette réduction de données est bonne, il
faut calculer les indicateurs suivants :
1 Test de sphéricité de Bartlett (ce test se fait normalement avant
DR
la mise en œuvre de l’acp)
2 Indice kmo (ce test normalement se fait après la mise en œuvre de
l’acp)

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 109 / 168
Test de de sphéricité de Bartlett

Objectif

T
Il vise à détecter dans quelle mesure la matrice de corrélation <
des données (matrice observée) diverge significativement de la
matrice unité (matrice théorique sous l’hypothèse nulle H0 ).

AF
Règle de décision :
( (
H0 : |<| = 1 H0 : Déterminant de < = 1

H1 : |<| =
6 1 H1 : Déterminant de < =
6 1
DR
Statistique du Test :
2p + 5
χ2 = −(n − 1 − ) × ln |<|
6
(p − 1)
Sous H0 , elle suit une loi du χ2 à [p × ] degrés de liberté.
2
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 110 / 168
Test de de sphéricité de Bartlett

T
Si le résultat de test indique qu’il faut rejeter l’hypothèse H0
(significativement différent de H0 ), cela signifie que l’on considère

AF
qu’il y a de très fortes redondances dans les données. c-à-d elles ne
recèlent qu’un seul type d’information |<| = 6 1. Dans ce cas, la
statistique du test donne : χ2 < χ2θ
Si le résultat de test indique qu’il faut rejeter à tort "acceptée"
l’hypothèse H0 ( |<| = 1), l’ACP ne servira pas à grand-chose car
les variables sont quasiment orthogonales deux à deux. Dans ce
DR
cas, χ2c > χ2θ .

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 111 / 168
Test de de sphéricité de Bartlett

T
Remarque
Le test de sphéricité de Bartlett n’est pas le même que le test

AF
d’égalité des variances de Bartlett. Il s’agit d’une confusion courante
puisque les deux portent des noms similaires.

Mise en œuvre du test de de sphéricité de Bartlett sur le logiciel


stata :
Malheureusement, à ma connaissance il n’y a pas de commande
DR
spécifique pour la mise en œuvre du test. Mais, on peut créer notre
propre code.
Alors que d’autre logiciel offre cette possibilité : spss et r-studio

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 112 / 168
Mesure d’adéquation de l’échantillon : Test de kmo

Objectif

T
Le tests de kmo (Kaiser-Meyer-Olkin) vise a détecter si il est possible
de trouver une factorisation intéressante des données. Ici l’indice
cherche à confronter la corrélation brute avec la corrélation partielle.

AF
L’idée est que la corrélation brute entre deux variables est
influencée par les (p − 2) autres.
Nous utilisons la corrélation partielle pour mesurer la relation
(nette) entre deux variables en retranchant l’influence des autres.
Règle de décision :
DR
L’indice kmo prend les valeurs entre 0 et 1.
Statistique du test :
P P 2
i j6=i rij
kmo = P P 2 P P 2
i j6=i rij + i j6=i aij

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 113 / 168
Mesure d’adéquation de l’échantillon : Test de kmo

T
Généralement :
S’il est proche de 0, les corrélations partielles sont identiques aux
corrélations brutes. Dans ce cas, une compression efficace n’est pas

AF
possible. Les variables sont deux à deux orthogonales.
S’il est proche de 1, nous aurons un excellent résumé de
l’information sur les premiers axes factoriels.
Dans la pratique :
La règle de décision adoptée dans le cadre de l’acp est la suivante :
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 114 / 168
Mise en œuvre du test sous STATA

Variable "Qualité du produit", notée : Quality

T
AF
DR
La valeur du kmo test affiche une valeur de 0, 88. Cette valeur
renseigne de la bonne qualité de la représentation en utilisant
l’analyse en composantes principales.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 115 / 168
Mise en œuvre du test sous STATA

T
On peut appliquer l’analyse ACP pour les autres variables du modèle :
Fidélité du produit notée : loyalty, et est mesurée par 5 items

AF
Interaction avec le produit notée : behind, et est mesurée par 6
items.
Satisfaction notée : sat, et est mesurée par 4 items.

taf : Étudier la Factorisation et le Dimensionnalité des variables sus


mentionnées.
DR
taf : Utiliser d’autres logiciels : spss, minitab, . . ., etc.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 116 / 168
Sommaire

T
5 Structuration factorielle et épuration des échelles

AF
Principe et Méthodes
Procédure de l’analyse en composantes principales
Outils de diagnostique de la solution factorielle
Étude des distributions des nouvelles variables latentes
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 117 / 168
Calculer les scores agrégés à partir des résultats acp

T
Objectif
Est de calculer le score "moyen" obtenu par chaque individu aux
différents items relatifs à un même construit. Et ce pour tester la

AF
normalité des construit obtenus à partir de l’analyse de l’acp.

En terme de résultat, On devra avoir une nouvelle (ou plusieurs)


variable (s) (facteur (s)) appelée score.
Il faut ensuite étudier la distribution de ce(s) construit(s).
Comment ?
DR
Sur stata : On utilise la commande : predict score1, score

ce score est calculé à partir des résultats de l’acp (c-à-d aprés


avoir tourner l’acp)

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 118 / 168
Étude de la normalité des variables latentes

T
L’analyse des distributions des variables nouvelles est très

AF
important.
Il est donc important de visualiser et de comparer ces distributions
par rapport à la distribution gaussienne.
Mise en œuvre sur stata :
Fournir les statistiques descriptives des scores : summarize score1

Produire le graphique des distributions des scores : histogram


DR
score1, normal ; qnorm score1

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 119 / 168
Exemple de l’étude de normalité des variables latentes

Exemple : score 1 est la variable latente construite à partir des scores des

T
variables formant la première composante principale.

AF
DR
L’analyse de ce graphique confirme que la variable latente nommée "score1" ne
suit pas une loi Normale, au vue de sa symétrie et sa forme luptockurtique

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 120 / 168
Exemple de l’étude de normalité des variables latentes

T
TAF :
Mener une analyse descriptive, et une analyse de normalité de

AF
chaque variable latente du modèle

Qualité du produit Fidélité au produit


DR
Interaction avec le produit
Satisfaction

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 121 / 168
Sommaire

T
AF
6 Structural Equation Modeling
Introduction aux SEM
Approche générale des SEM
Modélisation SEM
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 122 / 168
Sommaire

T
AF
6 Structural Equation Modeling
Introduction aux SEM
Approche générale des SEM
Modélisation SEM
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 123 / 168
Introduction aux SEM

T
Définition
Les SEM, ou Modèles d’équations Structurelles (Structural
Equation Models) sont une classe de modèles statistiques et

AF
d’analyse multivariée.
Ces modèles sont utilisés pour étudier les relations complexes entre
des variables observées (items) et des variables latentes, souvent
représentées sous forme de variables non observables ou théoriques.

Objectifs
DR
Étudier les relations causales entre les différents types de variables
(observées et non observées).
Confirmer un modèle (relation) théorique préétabli.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 124 / 168
Classification des méthodes multivariées

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 125 / 168
Origines de la Modélisation SEM

C’est une méthode née dans certaines branches de la sociologie

T
mais aussi en (Sciences Humaine et Sociales)
Psychologie
Sciences de l’éducation

AF
Sciences politiques
Sciences de l’information et de la communication
Rapidement, elle a été diffusée dans domaines d’études en sciences
de gestion (et rarement en sciences économiques)
Marketing
Gestion de ressources humaines
Stratégies ...
DR
Précisément, l’analyse des relations structurelles «path analysis»
est une méthode statistique développée par Sewall Wright dans
les années 1920. (Commission Cowles dans les années 1950) puis
(l’université de Chicago).

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 126 / 168
Origines de la Modélisation SEM

T
Dans les années 1970 et 1980, Herman Wold (1975, 1982, 1985) a
travaillé sur la création et la construction de modèles et de
méthodes pour les sciences sociales. Il a développé des approches

AF
orientées vers la prédiction.
Wold a proposé ensuite la modélisation d’équations structurelles
partielles par les moindres carrés (Hair et al. 2011).
PLS-SEM estime les paramètres d’un ensemble d’équations dans
un SEM en combinant l’analyse en composantes principales avec
une analyse de path basée sur la régression.
DR
Le PLS-SEM jouit d’une grande popularité dans un large éventail
de disciplines, notamment en sciences de gestion :
Marketing, gestion internationale, ..
Système d’information, supply chain management ....

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 127 / 168
PLS-SEM

T
PLS-SEM est une méthode qui permet :
Aux chercheurs d’estimer des modèles très complexes comportant
de nombreux construits et variables indicatrices, en particulier

AF
lorsque la prédiction est l’objectif de l’analyse.
Une grande flexibilité en termes d’exigences en matière de données
et de spécification des relations entre les construits et les variables
indicatrices.
L’accessibilité de logiciels faciles à utiliser avec une interface
DR
utilisateur graphique tels que ADANCO, PLS-Graph, SmartPLS,
WarpPLS et XLSTAT. Des packages pour les environnements
logiciels de calcul statistique tels que R et r-studio.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 128 / 168
Raisons d’application de PLS-SEM

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 129 / 168
Raisons d’application de PLS-SEM

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 130 / 168
Sommaire

T
AF
6 Structural Equation Modeling
Introduction aux SEM
Approche générale des SEM
Modélisation SEM
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 131 / 168
Position du problème

Les méthodes statistiques multivariées peut être classées en :

T
Méthodes statistiques de première génération : l’hypothèse
générale est que les données sont exprimées sans erreurs. Et on
distingue :

AF
Analyse factorielle Régression multiple Path Analysis
DR
Méthodes statistiques de deuxième génération SEM : ici le
modèle de mesure tente d’estimer ou d’identifier la composante
erreur des données. Et on distingue dans les SEM :
CB-SEM : basée sur la covariance est utilisée pour confirmer (ou
rejeter) des théories.
PLS-SEM : basée sur la variance (aussi appelé PLS path model)

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 132 / 168
Modèles path avec variables latentes

Sont des modèles complexes avec de nombreuses associations intègrent

T
à la fois des variables non observées (latentes) et des variables
observées.

AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 133 / 168
Considérations des SEM

T
Les SEM comportent, plusieurs variables reliées entre elles, plus
les termes d’erreur.
Nous distinguons entre deux types de variables :

AF
1 Les variables observables, dites variables manifestes ou indicateurs
2 Les variables non observables, dites latentes.

Nous distinguons également, dans un SEM à variables latentes,


deux sous-modèles :
1 Le modèle de mesure, dit aussi externe (Outer model), est un
modèle qui permet d’identifier et de mesurer les variables latentes à
DR
partir des variables mesurées (manifestes) correspondantes.
2 Le modèle de structure, appelé également modèle interne (Inner
model), établit les relations causales entre les différentes variables
latentes (ou construits), en indiquant le sens des hypothèses à tester.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 134 / 168
Considérations des SEM

T
AF
DR
Remarque
Ne pas négliger le sens des liaisons qui existent entre les variables
latentes et les variables manifestes qui leurs sont associées (permet
de définir la nature des relations qui les relies ).
Deux types : relation réflective et relation formative.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 135 / 168
Considérations des SEM
Rappel :

T
Mode réflective : quand le sens de la causalité va de la variable
latente vers les variables manifestes qui la reflètent. Ainsi la
variable latente influence les variables manifestes et explique leurs

AF
intercorrélations : X31 = λ31 Y3 + e31
Mode formative : quand le sens de la causalité est inversé : Il va
des variables manifestes (les indicateurs) vers la variable latente (le
P
construit). Ainsi, on retrouve um MR multiple : Y3 = β3j X3j + 

Remarque
DR
Les termes d’erreur (e31 et e32 ) sont liés aux constructions
(endogènes) par le biais des variables de mesure (de manière
réflective) par des flèches à un seul sens.
Les termes d’erreur représentent la variance inexpliquée lorsque les
modèles Path sont estimés.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 136 / 168
Considérations des SEM
Extension :

T
Mode mixte, ou MIMIC (Multiple-Indicator MultIple-Cause),
quand la variable latente comporte des variables manifestes de
type formatif et d’autres de type réflexif.
Soulignons que les variables latentes peuvent être liées entre elles,

AF
alors qu’une variable manifeste ne peut être attachée qu’à une
seule variable latente.
Effet de médiation : Processus intermédiaire
Est créé lorsqu’une troisième variable (construit) intervient entre deux
autres construits déjà liés. Il implique deux types de relations :
DR
Effets directs : Sont la relation qui relie deux variables latentes
avec une seule flèche.
Effets indirects : Sont les relations qui impliquent une séquence de
relations "directes" avec au moins un construit intermédiaire
impliqué (Path composé).
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 137 / 168
Considérations des SEM

D’un point de vue théorique :

T
L’application la plus courante de la médiation consiste à "expliquer"
pourquoi il existe une relation entre un construit exogène et endogène.

AF
DR
On essaie par exemple d’examiner l’effet de la qualité d’un produit
sur la satisfaction des clients.
En tant que chercheurs, nous souhaiterions peut-être expliquer
comment les clients traduisent la qualité par une fidélité plus
intense envers le produit.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 138 / 168
Considérations des SEM
L’effet médiateur est modélisé comme : "Fidélité".

T
Si un client interrogé perçoit un produit comme étant de très
bonne qualité cette évaluation peut conduire à des niveaux de
fidélisation, et en fin de compte à une satisfaction accrue.

AF
Dans de tel cas, la relation Qualité → Satisfaction est une
relation directe.
Et, la séquence Qualité→Fidélité→Satisfaction, est un exemple de
relation indirecte.
Le construit pourrait également affecter directement la relation
entre les variables latentes exogènes et endogènes, mais de manière
DR
différente : (La modération).

Effet modérateur
Se produit lorsque le modérateur (une variable indépendante ou un
construit) modifie la force ou même la direction d’une relation entre
deux construits dans le modèle.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 139 / 168
Considérations des SEM

T
AF
On suppose que le revenu affecte de manière significative la force
de la relation entre la qualité et la satisfaction des clients.
Il a été démontré que la relation entre qualité et satisfaction est
DR
plus faible pour les personnes à revenu élevé que pour celles à
faible revenu.
Important :
La variable modératrice (Revenu) ne dépend pas de la variable
prédictive (Fidélité)
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 140 / 168
Sommaire

T
AF
6 Structural Equation Modeling
Introduction aux SEM
Approche générale des SEM
Modélisation SEM
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 141 / 168
Étapes de la modélisation SEM

T
La modélisation SEM se déroule en cinq étapes :
1 Spécification : Traduire les hypothèses de recherche sous forme de graphe
orienté. Déterminer les relations de causalité (Modes).

AF
2 Identification : Un modèle est identifié lorsqu’il converge vers une
solution unique, où chaque paramètre n’accepte qu’une seule solution.
3 Estimation : Estimer les relations existantes entre les variables. Le choix
de la méthode d’estimation dépend, entre autres, des contraintes liées
aux données de la recherche.
4 Tests : Évaluer le modèle à l’aide d’indicateurs appropriés à l’approche
DR
suivie.
5 Validation et/ ou re-spécification : Modification du modèle en fonction
des résultats des tests, et en tenant compte des soubassements théoriques
de la recherche

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 142 / 168
Méthodes d’estimation des paramètres SEM

T
Il existe plusieurs approches ou méthodes pour l’estimation des
paramètres SEM : Principalement, LISREL et PLS.
1 LISREL (LInear Structural RELationships) :

AF
La plus répandue en science de gestion, elle repose sur l’analyse de
la structure de la covariance CB-SEM (Covariance Based SEM).
Le calcul des paramètres LISREL se fait par la technique du
maximum de vraisemblance.
Cette technique permet d’estimer le modèle complet en estimant
simultanément le modèle de mesure et le modèle de structure.
2 PLS (Partial Least Squares) :
DR
S’adapte aux modèles plus complexes et dont l’approche LISREL
n’est pas applicable. Elle repose sur l’analyse de la variance.
L’estimation du modèle complet passe par des estimations
alternatives des deux sous-modèles (externe et interne).

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 143 / 168
CB-SEM vs PLS-SEM

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 144 / 168
CB-SEM vs PLS-SEM

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 145 / 168
SEM Software / Applications

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 146 / 168
Sommaire

T
7 PLS-SEM

AF
Introduction
Spécification, Estimation et des modèles de mesure
Évaluation des Modèles de mesure réflectifs
Évaluation des Modèles de mesure formatifs
Évaluation du modèle structurel
Prolongements à la médiation et la modération
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 147 / 168
Sommaire

T
7 PLS-SEM

AF
Introduction
Spécification, Estimation et des modèles de mesure
Évaluation des Modèles de mesure réflectifs
Évaluation des Modèles de mesure formatifs
Évaluation du modèle structurel
Prolongements à la médiation et la modération
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 148 / 168
Considérations importantes
Rappelons-le, l’objectif étant de valider le modèle de recherche
(structurel) qui passe par l’estimation des relations qui existent

T
entre les différents types de variables (de mesure, et latentes).
C-à-d en validant le :
Modèle structurel décrit les relations entre les variables latentes

AF
(constructions=nouvel système de données).
Les modèles de mesure représentent les relations entre les
construits et leurs variables indicatrices correspondantes
(généralement appelés modèles externes dans PLS-SEM).
La validation passe aussi par la vérification de la conformité des
résultats aux hypothèses de la recherche impliquant les relations
DR
structurelles sont liées directement aux modèles de mesure qui les
expliquent.

le chercheur doit s’assurer en premier lieu de la fiabilité (α Cronbach)


et de la validité des instruments de mesure (ACP) qu’il a utilisés avant
l’estimation des relations :Examen exploratoire.
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 149 / 168
Considérations importantes

T
La base pour déterminer les relations entre les construits et leurs
indicateurs est la théorie de la mesure 5 .

AF
Une théorie de la mesure solide est une condition nécessaire pour
obtenir des résultats utiles du PLS-SEM.
Les décisions concernant la manière dont le chercheur sélectionne
les indicateurs pour mesurer un concept particulier sont différentes
En sciences de gestion, on utilise des approches de mesure publiées
DR
dans des études de recherche antérieures..

5. Les chercheurs ont généralement le choix entre plusieurs approches de mesure


établies : Théories, concepts, paradigmes
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 150 / 168
Considérations importantes
Le modèle structurel tel qu’il est proposé pour notre exemple :

T
AF
DR
Notez que la relation entre construits et indicateurs est différente.
La construction (mesure) de Satisfaction est dite réflective.
Alors que pour les autres variables latentes, la direction des flèches
va des variables indicatrices mesurées vers les construits
(formative)
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 151 / 168
Préparation du modèle Path PLS : Guidelines

T
Les variables/construits considérées comme pertinentes pour
l’étude doivent être clairement identifiées et définies (mesure).
La discussion sur la mesure doit indiquer comment les construits

AF
sont liés les uns aux autres, et faire la différence entre : dépendants
(endogènes) ou indépendants (exogènes).
Le cas échéant, inclure les relations complexes (médiateur,
modérateur).
Si possible, la nature (positive ou négative) des relations ainsi que
leur direction sont émises sur la base de la théorie, de la logique,
DR
de recherches antérieures ou du jugement du chercheur.
Un modèle ou un cadre conceptuel est préparé pour illustrer
clairement les relations sous-jacentes. (Path).

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 152 / 168
Préparation du modèle Path PLS : Guidelines

T
La discussion sur la mesure indique si les construits sont
conceptualisés comme des construits de 1er ou de 2éme ordre.
La perspective de mesure (réflexive ou formative) doit être

AF
clairement énoncé et motivé.
Concernant les données pour les analyses SEM :
Il est important que les données quantitatives soient disponibles qui
impliquent des données primaires, mais il est possible d’utiliser des
données secondaires.
En général, et en science de gestion on s’appuie sur des données
DR
primaires obtenues à partir de questionnaires structurés.
Lorsque des données empiriques sont collectées à l’aide de
questionnaires : Résoudre les problèmes liés aux les données
manquantes, réponses suspects (incohérentes), les valeurs aberrantes
et la distribution des données.

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 153 / 168
Sommaire

T
7 PLS-SEM

AF
Introduction
Spécification, Estimation et des modèles de mesure
Évaluation des Modèles de mesure réflectifs
Évaluation des Modèles de mesure formatifs
Évaluation du modèle structurel
Prolongements à la médiation et la modération
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 154 / 168
Spécification des modèles de mesure

Les modèles de mesures (PLS-SEM) peuvent être spécifiés comme :

T
Modèle de mesure réflectif Modèle de mesure formatif

AF
DR
Construit à élément unique

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 155 / 168
Modélisation du modèle de mesure formatif

Dans une modélisation formative

T
du modèle de mesure, les relations
Path sont :

AF
Les βk sont : les coefficients des relations Path.
Le Path correspond aux équations :

Sat1 = α1 + β1 X + e1
Sat2 = α2 + β2 X + e2
DR
Sat2 = α3 + β3 X + e3
Sat2 = α4 + β4 X + e4

Il existe une troisième façon d’écrire ce modèle, à savoir :

(x1 ← X) ; (x2 ← X) ; (x3 ← X) ; (x4 ← X)

Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 156 / 168
Spécification du modèle Path

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 157 / 168
Propriétés statistiques

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 158 / 168
Algorithme PLS

T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 159 / 168
Lecture des résultats

T
AF
contenu...
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 160 / 168
Sommaire

T
7 PLS-SEM

AF
Introduction
Spécification, Estimation et des modèles de mesure
Évaluation des Modèles de mesure réflectifs
Évaluation des Modèles de mesure formatifs
Évaluation du modèle structurel
Prolongements à la médiation et la modération
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 161 / 168
T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 162 / 168
T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 163 / 168
Sommaire

T
7 PLS-SEM

AF
Introduction
Spécification, Estimation et des modèles de mesure
Évaluation des Modèles de mesure réflectifs
Évaluation des Modèles de mesure formatifs
Évaluation du modèle structurel
Prolongements à la médiation et la modération
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 164 / 168
Sommaire

T
7 PLS-SEM

AF
Introduction
Spécification, Estimation et des modèles de mesure
Évaluation des Modèles de mesure réflectifs
Évaluation des Modèles de mesure formatifs
Évaluation du modèle structurel
Prolongements à la médiation et la modération
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 165 / 168
Sommaire

T
7 PLS-SEM

AF
Introduction
Spécification, Estimation et des modèles de mesure
Évaluation des Modèles de mesure réflectifs
Évaluation des Modèles de mesure formatifs
Évaluation du modèle structurel
Prolongements à la médiation et la modération
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 166 / 168
T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 167 / 168
T
AF
DR
Soussi (UM5-FSJES Salé) Analyse des Données Oct 2023 168 / 168

Vous aimerez peut-être aussi