0% ont trouvé ce document utile (0 vote)
10 vues4 pages

Examen de Statistique Appliquée ENCG Casablanca

Le document est un examen final de statistiques appliquées, abordant des concepts tels que la différence entre question et questionnement, les types d'études (quantitative, qualitative, mixte), et les méthodes d'échantillonnage. Il traite également des erreurs d'échantillonnage, des outils de visualisation, et de la prise de décision basée sur les données. Enfin, il inclut des exercices sur les intervalles de confiance et l'utilisation des distributions Z et t.

Transféré par

zyad khb
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
10 vues4 pages

Examen de Statistique Appliquée ENCG Casablanca

Le document est un examen final de statistiques appliquées, abordant des concepts tels que la différence entre question et questionnement, les types d'études (quantitative, qualitative, mixte), et les méthodes d'échantillonnage. Il traite également des erreurs d'échantillonnage, des outils de visualisation, et de la prise de décision basée sur les données. Enfin, il inclut des exercices sur les intervalles de confiance et l'utilisation des distributions Z et t.

Transféré par

zyad khb
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Université Hassan II Mohammedia – Casablanca

Ecole Nationale de Commerce et de Gestion


‫المدرسة الوطنية للتجارة والتسيير الدار البيضاء‬

EXAMEN FINAL Nom :


Pr. BOULAHOUAL ADIL ……………………………………….……………………………………….……………………………………….
Matière : Statistique appliquée. Prénom : ……………………………………….……………………………………….……………………………
Aucun document n’est autorisé. Groupe : ……………………………………….……………………………………….……………………………
Durée : 2h. Salle :
……………………………………….…………………………………………………………………………….…. …
Numéro d’examen : ……………………………………….……………….
EXERCICE I statistique appliquée et étude terrain.
1. Différences entre question et questionnement ?
• Une question est une interrogation précise formulée pour obtenir une réponse spécifique, tandis que le
questionnement est un processus plus large qui englobe l'exploration et la réflexion sur un sujet.
• Le questionnement implique une démarche intellectuelle qui pousse à analyser, comparer et approfondir un
sujet, alors qu'une question est souvent isolée et directe.
• En somme, une question est un élément ponctuel du questionnement, qui, lui, représente une démarche
continue de recherche et de compréhension.
2. – Quelles sont les différentes divergences entre les trois études ?
ETUDE QUATITATIVE ETUDE QUALITATIVE ETUDE MIXTE
N

Objectif : Mesurer, quantifier, Objectif : Explorer, comprendre, Objectif : Combiner mesure et


tester des hypothèses interpréter des phénomènes compréhension approfondie
Nature des données : Chiffrées, Nature des données : Nature des données : Mélange
statistiques (ex. : sondages, bases Descriptives, subjectives (ex. : de données numériques et
de données) interviews, observations) qualitatives
Méthodologie : Expérimentations, Méthodologie : Études de cas, Méthodologie : Association des
enquêtes, analyses statistiques entretiens, focus groups, analyse méthodes quantitatives et
Type de questions : Fermées, de contenu qualitatives
structurées (ex. : "Combien ?", "À Type de questions : Ouvertes, Type de questions : Mélange de
quelle fréquence ?") exploratoires (ex. : "Pourquoi ?", questions fermées et ouvertes
"Comment ?")
3. La taille de l’échantillon dépond de quoi ?
• Précision souhaitée
• Niveau de confiance
• Marge d’erreur tolérée
• Variabilité de la population
4. Quelles méthodes d’échantillonnage sont les plus recommandée ? pourquoi ?
Méthode Pourquoi la choisir ?
Aléatoire simple Évite les biais, assure une bonne représentativité.
Stratifié Idéal pour une population hétérogène (meilleure précision).
En grappes Pratique pour des populations vastes et dispersées.
Systématique Simple et efficace pour des études standards.
5. - Comment collecter la donnée ? citez une méthode informelle.
De manière formelle ou, informelle
Informelles : Scraping (Méthode automatisée d’extraction de données depuis des sites web à l’aide de scripts ou d’outils
informatiques, souvent utilisée pour collecter de grandes quantités de données structurées en ligne.
) ou observation (Observation : Méthode manuelle et qualitative où on collecte des données en observant directement des
comportements ou événements dans leur contexte naturel, sans intervention technologique. )
6. Quelles sont les étapes pour valider un questionnaire ? Paradigme de Churchill 1979
7. Quelles différences existe-t-il entre statistiques et paramètres ? et comment les noter ?
Distinctions entre population et échantillon
Population Échantillon
Caractéristique PARAMETRES STATISTIQUES
Taille N n
Ecart type σ s
Pr. BOULAHOUAL Adil

Moyenne µ M ou 𝑥̅
Pourcentage π p
8. La précision ou l’exactitude d’une estimation d’une moyenne dépond de quoi ?
La taille de l'échantillon : Plus l'échantillon est grand, plus l'estimation de la moyenne de la
population est précise, car la variance diminue avec l'augmentation de la taille de l'échantillon.
Cela permet de mieux refléter la moyenne réelle de la population.
La variabilité des données (écart-type) : Plus les données sont dispersées autour de la moyenne, plus
l'estimation sera moins précise. Si les données sont très variables, même un grand échantillon peut
donner une estimation moins fiable. 1
1/31
Ecole Nationale de Commerce et de Gestion de Casablanca, B.P. 2725, Beau site Ain Sebaâ - Casablanca - Maroc
Tel.: +212 5 22 66 08 52/ +212 5 22 66 06 95 | Fax: +212 5 22 66 01 43 | Email: encgcasa@[Link]
[Link]
La méthode d'échantillonnage : Si l'échantillonnage est aléatoire et bien conçu, cela garantit une
estimation plus précise. Un échantillon biaisé peut nuire à la précision de l'estimation.
Les erreurs de mesure : Si les instruments utilisés pour recueillir les données comportent des erreurs,
cela affectera la précision de l'estimation.
9. Quel lien existe-t-il entre la précision d’une estimation et la certitude de cette dernière ?
Lien inverse : pour avoir des estimations plus sures il faut avoir des intervalles plus grand c-à-d des marges
d’erreurs plus grandes.
10. – Quelle est l’hypothèse nulle et la règle de décision de chacune des analyses suivantes :
Analyse H0 Règle de décision
Régression linéaire βi =0 Rejeter H0 si sig de l’ANOVA ≤ α ou
multiple Fc ≥ Ft
Comparaison de µ 1= µ 2 Rejeter H0 si sig du test t ≤ α ou
moyennes 𝑋̅ = µ Tc ≥ Tt
Test de khi-deux Pas d’association Rejeter H0 si sig du test x 2≤ α ou
Distributions identiques Tc ≥ Tt
11. - Citer un outil de visualisation informatisé très réputé. Power BI

12. - Quels sont les avantages d’une prise de décision basée sur les données ?
Optimiser les actions, améliorer la précision, réduire les risques, et favoriser une gestion plus transparente
et responsable. C'est un atout majeur dans un environnement où la concurrence et les exigences de
performance sont élevées.

EXERCICE II
13. Différence entre l'erreur d'échantillonnage et les autres types d'erreurs :
Erreur d'échantillonnage : Elle est liée à la variabilité inhérente du processus de sélection des échantillons.
Elle survient parce que l’échantillon choisi ne reflète pas parfaitement la population entière. Elle varie selon
l'échantillon et peut diminuer avec un échantillon plus grand.
Autres erreurs (systématiques, de mesure, de couverture, etc.) : Ces erreurs sont souvent constantes ou
prévisibles dans la collecte des données, affectant les résultats d'une manière répétée ou biaisée. Elles ne
proviennent pas de l'échantillonnage aléatoire, mais d'imprécisions dans les outils de mesure, dans la
méthode de collecte, ou des biais dans l’échantillon sélectionné.

Solutions pour minimiser les erreurs :


Erreur d'échantillonnage-Solution : Augmenter la taille de l'échantillon. Un échantillon plus large réduit
l'impact de l'erreur d'échantillonnage, rendant les estimations plus proches de la véritable moyenne de la
population. L'échantillonnage aléatoire garantit également une meilleure représentativité.
Erreur systématique (biais)-Solution : Assurer des instruments de mesure bien calibrés, utiliser des méthodes
d’échantillonnage rigoureuses et éviter toute forme de biais dans la collecte des données (par exemple,
s'assurer que tous les groupes de population sont correctement représentés).
Erreur de mesure-Solution : Utiliser des instruments de mesure précis et validés, et former les collecteurs de
données pour minimiser les erreurs humaines. Des vérifications régulières des instruments et des méthodes
de mesure peuvent aussi limiter cette erreur.
Erreur de couverture-Solution : S'assurer que tous les groupes cibles de la population sont inclus dans
l'échantillon. Utiliser des techniques d’échantillonnage qui garantissent une couverture complète et éviter
l’exclusion de certains sous-groupes (par exemple, par l’échantillonnage stratifié).

14. Le biais d'observateur provient de l'influence des attentes, des croyances ou des préjugés de
l'observateur sur la façon dont il interprète ou enregistre les données.
15. Un échantillonnage probabiliste est une méthode où chaque individu de la population a une probabilité
connue et non nulle d'être sélectionné. Sa caractéristique principale est que l'échantillon est tiré de
manière aléatoire, garantissant la représentativité.
16. Types d'échantillonnage non probabiliste :
Pr. BOULAHOUAL Adil

• Échantillonnage par commodité : Sélection des individus disponibles facilement.


• Échantillonnage de quota : Choix des individus selon des critères préétablis.
• Échantillonnage par jugement : Sélection basée sur l'opinion de l'observateur sur la pertinence des
individus.
• Échantillonnage boule de neige : Sélection d'individus qui en recommandent d'autres.

17. L'échantillonnage aléatoire simple consiste à sélectionner des individus au hasard dans la population.
Chaque individu a la même chance d'être choisi, car chaque élément a une probabilité égale d'être
inclus dans l'échantillon. 2
1/31
Ecole Nationale de Commerce et de Gestion de Casablanca, B.P. 2725, Beau site Ain Sebaâ - Casablanca - Maroc
Tel.: +212 5 22 66 08 52/ +212 5 22 66 06 95 | Fax: +212 5 22 66 01 43 | Email: encgcasa@[Link]
[Link]
18. Échantillonnage aléatoire par grappes : Divise la population en grappes (groupes), puis sélectionne
aléatoirement des grappes. Exemple : Sélectionner des écoles puis des élèves au sein de ces écoles.
Échantillonnage stratifié : Divise la population en sous-groupes (strates) homogènes, puis sélectionne
aléatoirement des individus dans chaque strate. Exemple : Sélectionner des étudiants par niveau
d’étude (licence, master, etc.).
19. Dans l'échantillonnage systématique, l'intervalle de tirage (𝐾) est déterminé en divisant la taille de la
population par la taille de l'échantillon. Pour une population de 10 000 et un échantillon de 250, 𝐾 = 10
000 / 250 = 40. On choisit ensuite un individu au hasard entre les 40 premiers, puis on prend chaque 40e
individu.
20. Pour créer la distribution des moyennes des échantillons, on prend toutes les combinaisons possibles
d’échantillons de taille 2 de la série [10, 12, 14]. Les moyennes des échantillons sont :
𝑋̅1 = 11 𝑋̅2 = 12 ; 𝑋̅3 = 13
La distribution des moyennes est donc : [11, 12, 13].
Répondre aux questions du tableau suivant :
Cas Réponse
Échantillonnage stratifié :
1. Nombre de filles : 120 × 60% = 72 filles. Nombre de garçons : 120 × 40% = 48 garçons.
21.
2. Sélectionner 72 filles au hasard parmi les 480 filles et 48 garçons au hasard parmi les 320
garçons.
Échantillonnage systématique :
1. Intervalle de tirage (K) = 5000 / 100 = 50.
22.
2. Si le premier individu est sélectionné au numéro 5, les cinq premiers individus seront : 5,
55, 105, 155, 205.
Échantillonnage par grappes :
1. Nombre de clients dans l’échantillon : 950 + 980 + 1000 = 2930 clients.
23. 2. Avantages : Moins coûteux et plus pratique pour des populations géographiquement
dispersées. Limites : Moins précis si les régions choisies ne sont pas représentatives de
l'ensemble de la population.
Moyenne et erreur type :
1. Erreur type de la moyenne : σₓ̄ = 10 / √25 = 2.
24.
2. Les moyennes des échantillons peuvent varier autour de 50 en raison de la variabilité
aléatoire entre les échantillons.
Application de l’échantillonnage stratifié :
1. Taille de l’échantillon dans chaque strate :
- Strate A (50%) : 500 × 50% = 250.
25. - Strate B (30%) : 500 × 30% = 150.
- Strate C (20%) : 500 × 20% = 100.
2. L’échantillonnage stratifié est préférable pour garantir une représentation
proportionnelle de chaque groupe (strates), ce qui améliore la précision des résultats.

EXERCICE III
26. - Estimer par intervalle de confiance à 95% le temps moyen de sommeil des étudiants universitaires.
IC=6,5±0,332 [6,168,6,832]
27. Estimer par intervalle de confiance à 95% la proportion de clients satisfaits.
IC=0,65±0,066 [0,584,0,716]
28. Quelle devrait être la taille de l'échantillon pour que la marge d'erreur dans l'estimation de cette
proportion au niveau 95% n'excède pas 1%, en supposant que la fréquence observée de satisfaction
reste identique ?
𝑍𝛼2 ∗ 𝑝(1 − 𝑝)
𝑛= 2
𝑒2
Il faudrait un échantillon de 8736 clients pour que la marge d’erreur soit inférieure ou égale à 1% au niveau
de confiance de 95%.
Pr. BOULAHOUAL Adil

EXERCICE IV
29. Z ou t ? pourquoi ?
L’inspecteur doit utiliser la distribution Z ou t ? Pourquoi ?
L'inspecteur doit utiliser la distribution Z car l'écart-type est connu et la taille de l'échantillon est grande (n =
49).
30. Quelle est la valeur critique Z/t pour un seuil α = 0,05 ?
La valeur critique Z pour α = 0,05 est 1,96 (test bilatéral).
3
31. Quelle est la valeur du rapport critique (RC) ?
1/31
Ecole Nationale de Commerce et de Gestion de Casablanca, B.P. 2725, Beau site Ain Sebaâ - Casablanca - Maroc
Tel.: +212 5 22 66 08 52/ +212 5 22 66 06 95 | Fax: +212 5 22 66 01 43 | Email: encgcasa@[Link]
[Link]
Le rapport critique RC est -4.
32. Quelle est la décision appropriée basée sur Z/t et RC ?
Comme |RC| = 4 > 1,96, on rejette l'hypothèse nulle.
33. Quelle est la valeur critique Z/t pour un seuil α = 0,01 ?
La valeur critique Z pour α = 0,01 est 2,576.
34. Quelle est la valeur du rapport critique (RC) ?
Le rapport critique RC est -2,4.
35. Quelle est la décision appropriée basée sur Z/t et RC ?
Comme |RC| = 2,4 < 2,576, on ne rejette pas l'hypothèse nulle.

EXERCICE V
36. Choisir la méthode d’analyse la plus appropriée

La méthode suggérée

• La méthode suggérée • ANOVA ou régression multiple


Pour expliquer une variable par plusieurs autres, lorsque la variable dépendante est numérique ou
ordinale (exemple : comparer les moyennes des notes d’examen selon le type d’enseignement).
• Régression logistique
Pour expliquer une variable à caractère qualitatif avec des variables explicatives numériques
(exemple : prédire si un patient est malade ou non à partir de mesures biologiques).
• Chi-carré
Pour mesurer l’association entre deux variables qualitatives (exemple : étudier la relation entre le
sexe et le choix d’une activité sportive).
• Test t de Student
Pour comparer les moyennes de deux groupes indépendants avec une variable numérique et une
variable qualitative à deux modalités (exemple : comparer le niveau d’intelligence des hommes et
des femmes).
• Test t apparié
Pour comparer les moyennes de deux mesures répétées sur le même échantillon (exemple :
comparer le poids d’un groupe de personnes avant et après un programme de régime).
• Analyse de clusters (k-means)
Pour identifier des groupes homogènes au sein d’un ensemble de données (exemple : regrouper
les clients d’une entreprise selon leur comportement d’achat).
Exercice VI : Justifier vos réponses.

37. Test de Levene (homogénéité des variances) : p-value = 0,000, ce qui indique que les variances ne
sont pas égales entre les deux groupes (processeurs et non-processeurs).
• Test t pour l'égalité des moyennes : p-value = 0,060 (variances inégales), qui est supérieure à 0,05.
Conclusion : Pas de différence significative dans les montants dépensés par les processeurs et non-
processeurs de la carte de fidélité.
38. Rejet ou acceptation de H0
• H0 (hypothèse nulle) : Il n'y a pas de différence significative entre les montants dépensés.
• p-value = 0,060 > 0,05. On ne rejette pas H0, donc il n'y a pas de différence significative.
39. Fonction mathématique
La fonction mathématique ne peut pas être déterminée en raison des bornes de l'intervalle de confiance
qui incluent des valeurs négatives et positives, indiquant que l'effet de la motivation sur le rendement n'est
pas statistiquement significatif.
40. Hypothèse nulle
L'hypothèse nulle (H0) est : La motivation n'a pas d'effet significatif sur le rendement.
41. Acceptation ou rejet du modèle au seuil de confiance de 97%
• Intervalle de confiance pour la motivation (Bêta) : Les bornes sont -1,244 et 2,251.
Pr. BOULAHOUAL Adil

• Conclusion : Comme l'intervalle de confiance inclut 0, cela signifie que l'effet de la motivation
sur le rendement n'est pas statistiquement significatif à un seuil de 97%.
• Réponse : On accepte H0 et on nie la relation entre la motivation et le rendement.
42. Acceptation ou rejet de H0 au seuil de confiance de 97%
• Les bornes de l'intervalle de confiance pour la motivation (-1,244 à 2,251) incluent 0, ce qui signifie
que l'effet de la motivation n'est pas statistiquement significatif. On accepte H0.
43. Interprétation des indicateurs
• Modèle : R = 0,700 (Très forte corrélation entre effort et rendement).
• R² = 0,490 : 49% de la variance du rendement est expliquée par l’effort fourni.
4
1/31
Ecole Nationale de Commerce et de Gestion de Casablanca, B.P. 2725, Beau site Ain Sebaâ - Casablanca - Maroc
Tel.: +212 5 22 66 08 52/ +212 5 22 66 06 95 | Fax: +212 5 22 66 01 43 | Email: encgcasa@[Link]
[Link]

Vous aimerez peut-être aussi