Institut Supérieur des Professions Année Universitaire 2025–2026
Infirmières et Techniques de Santé Module Sondage opacss2m
ISPITS - Rabat Filière – Techniques de santé (S3)
TD n° 1
Exercice 1.
1) Répondre par vrai au faux,
a) Un sondage en statistiques est une méthode d’échantillonnage pour sélectionner des
participants ou des éléments d’une population.
b) L’estimateur de Horvitz-Thompson est un estimateur utilisé dans le cadre des sondages
probabilistes.
c) La probabilité d’inclusion dans le contexte d’un sondage probabiliste est la probabilité
que l’échantillon soit représentatif de la population.
2) Quelles sont les sources d’erreurs dans une enquête par sondage ? Donner des exemples.
3) Donner les principales étapes à suivre pour la mise en place d’une enquête par sondage dans
les cas suivants :
a) Estimation de la Prévalence d’une Mutation Génétique Liée au Cancer du Sein.
b) Satisfaction des patients hospitalisés en oncologie dans un service spécifique et identification
les domaines nécessitant des améliorations.
c) Impact de la vaccination contre le COVID-19 sur différentes tranches d’âge.
Exercice 2.
Une entreprise fabrique un certain type de médicaments dont la durée de vie X, exprimée en
jours, est une variable aléatoire.
Des mesures effectuées sur un échantillon aléatoire de taille 50 ont donné les résultats suivants :
50
X 50
X
xi = 60 000 jours; x2i = 74 × 106 jours2 .
i=1 i=1
1. Donner une estimation ponctuelle de la durée de vie moyenne des médicaments.
2. Donner une estimation ponctuelle de l’écart-type de cette durée de vie.
3. Donner l’intervalle de confiance à 95%, puis à 99% de cette durée de vie moyenne.
4. Quelle aurait dû être la taille de l’échantillon pour que l’intervalle de confiance à 95% de la
durée de vie moyenne des médicaments ait une amplitude de 60 jours ?
Exercice 3.
Suite à quelques intoxications, le propriétaire d’une source d’eau décide de faire des analyses à
différents moments de l’année choisis au hasard. Sur 49 mesures effectuées au total, 13 indiquent une
eau non potable, le reste indiquant une eau potable. N’ayant jamais suivi de cours de statistique,
il en conclut que l’eau est non potable 26.5% du temps.
1) Expliquer pourquoi le propriétaire ne devrait pas donner une valeur exacte.
2) Donner l’intervalle de confiance associé à cet échantillon de mesures.
Exercice 4.
Une machine fabrique des billes métalliques dont le poids, mesuré en gramme, suit une loi
normale. Nous prélevons au hasard dix billes. Les résultats des poids sont les suivants :
19.6; 20; 20.2; 20.1; 20; 19.9; 20; 20.3; 20, 1; 19.8.
1
1. Quel est l’intervalle de confiance à 95% du poids moyen des billes métalliques fabriquées ?
2. En réalité, l’écart-type σ est connu et égal à 0.2. Quel est l’intervalle de confiance à 95% du
poids moyen des billes métalliques fabriquées ?
Exercice 5.
À la veille d’une consultation électorale, nous effectuons un sondage.
1. Dans un échantillon représentatif de 1000 personnes, 500 personnes déclarent vouloir voter
pour Dupond, 250 pour Durand et 50 pour Duroc. Donner les intervalles de confiance à 95%
et 99% du pourcentage de personnes ayant l’intention de voter Dupond, Durand ou Duroc.
2. Nous évaluons le pourcentage de personnes ayant l’intention de voter pour un quatrième
candidat, Duval, à 17%. Combien faut-il interroger de personnes pour obtenir un intervalle
de confiance à 95% du pourcentage de personnes ayant l’intention de voter Duval, avec une
précision de 1% ?
Exercice 6.
Un sondage de 15 individus parmi une population de 300 a été réalisé par un institut. Le sondage
vise à mesurer la fréquentation mensuelle des cinémas par les individus de la population. L’institut
nous transmet les résultats de son enquête via la table suivante :
Individu Fréquentation des cinémas Poids de sondage
A 1 24
B 2 20
C 4 18
D 15 18
E 2 20
F 3 14
G 1 22
H 0 20
I 0 17
J 3 20
K 6 22
L 0 21
M 0 22
N 1 22
O 1 20
1) On rappelle que l’estimateur naı̈f est l’estimateur qui ne prend pas en compte les poids de
sondage. Quel est l’estimateur naı̈f de la fréquentation moyenne ?
2) Quel est l’estimateur pondéré (avec les poids de sondages donnés dans la table) de la
fréquentation moyenne ?
Exercice 7.
Soit la population U = {1, 2, 3, 4}, et p(·) le plan de sondage défini par :
p({1, 2}) = 0.2, p({1, 4}) = 0.1, p({3, 4}) = 0.3,
p({1, 2, 3}) = 0.3, p({2, 3, 4}) = 0.1.
Calculer les probabilités d’inclusion d’ordre 1, et donner la taille moyenne d’échantillon obtenue
à l’aide de ce plan de sondage.
2
Exercice 8.
On se donne une population U = {1, 2, 3} et un plan de sondage p défini par :
1
p({1}) = 0, p({1, 2}) = , p({1, 2, 3}) = 0,
2
1 1
p({2}) = 0, p({1, 3}) = , p({3}) = 0, p({2, 3}) = .
3 6
1) Calcul des probabilités d’inclusion :
a) Calculer les probabilités d’inclusion du premier ordre (simple) πk et du deuxième ordre
(doubles) πkl pour toutes les unités de la population, ainsi que les ∆kl = πkl − πk πl . P
b) Quelle propriété intéressante possède le plan de sondage p ? Que peut-on dire de k∈U πk
dans ce cas ? Le vérifier.
2) Estimateur naı̈f vs Estimateur de Horvitz-Thompson :
On se donne la population et le plan de sondage de la question précédente. On suppose que le
revenu des individus de la population est :
Y1 = 1 000, Y2 = 2 000, Y3 = 3 000.
a) Donner la loi de l’estimateur naı̈f du revenu total : pour chaque échantillon possible,
rappeler sa probabilité de sélection et calculer la valeur de l’estimateur naı̈f. Calculer le biais de cet
estimateur.
b) Donner la loi de l’estimateur de Horvitz-Thompson du revenu total. Calculer le biais de
cet estimateur.
Exercices Supplémentaires
Exercice 9.
Afin de mieux satisfaire leurs clients, une grande société fournisseur de médicaments fait ses
statistiques sur le nombre d’appels reçus en ”hotline”. Elle pourra ainsi évaluer le temps d’attente
pour le client et le nombre d’employés à mettre au standard. Les résultats de l’enquête portent sur
200 séquences consécutives d’une minute, durant lesquelles le nombre d’appels moyen a été de trois
appels par minute.
Nous supposons que les appels sont répartis également dans le temps : nous partageons un
intervalle de temps en unités d’une seconde. Ainsi, dans chaque unité de temps, il y a au plus un
appel.
Donner l’intervalle de confiance à 95 % pour le nombre moyen d’appels en quatre minutes.
Exercice 10.
Un sondeur réalise une enquête ayant pour but de mesurer le patrimoine moyen des ménages
à Rabat. Les individus sont tirés parmi la liste des titulaires d’une carte CNSS pour l’année
2022. Le plan de sondage donne une probabilité de sélection plus forte aux individus habitant des
communes aux revenus médians les plus élevés : Centre Ville Rabat, Agdal, Hay-Riad, Hassane.
L’estimateur utilisé est celui de Horvitz-Thompson. 70% des individus échantillonnés répondent
au questionnaire, mais l’estimateur utilisé ne prend pas en compte la non-réponse.
Que penser des affirmations suivantes ?
1. Donner une probabilité de sélection plus forte pour certains individus conduit à
un échantillon non représentatif de la population ;
3
2. Le poids de sondage d’un individu sélectionné qui vit à Centre Ville Rabat est
supérieur à celui d’un individu sélectionné habitant à Agdal ;
3. L’estimateur de Horvitz-Thompson est biaisé, il vaudrait mieux utiliser l’estimateur
naı̈f ;
4. La base de sondage présente un défaut de couverture, l’estimation est potentiellement
biaisée ;
5. Ne pas prendre en compte la non-réponse n’a pas d’impact sur l’estimation.
Exercice 11.
On considère une population de taille N = 5 individus, pour lesquels on connaı̂t les valeurs de
la variable Y :
y1 = 3, y2 = 1, y3 = 0, y4 = 1, y5 = 5.
On choisit un plan avec une taille d’échantillon n = 3.
1. Donner les valeurs de la moyenne (de la médiane) et de la variance de la variable Y dans la
population. Lister tous les échantillons possibles de taille n = 3. Quelle est la probabilité de
sélection de chaque échantillon ?
2. Pour un échantillon donné, on estime la moyenne (respectivement la médiane) de la population.
Calculer les valeurs de ces estimateurs pour chaque échantillon et en déduire que l’estimateur
de la moyenne est sans biais, alors que l’estimateur de la médiane est biaisé.
2 2
3. Pour chaque échantillon, calculer l’estimateur Sys de SyU et en déduire que cet estimateur
est sans biais.