Kineza Didier A/A :2021-2022
Niyonkuru Alain Daniel Le 15/06/2022
Niyomvo Hugues Arsene
Ntirampeba Syldie
Universite du Burundi
Campus Nyamugerera
ISTA BAC II
Travail Pratique de STATA
TABLE D’EPIDEMIOLOGIE
Quelques définitions concepts utilisé en épidémiologie
[Link]’est-ce que l’épidémiologie ?
Définition : l’étude de la distribution des phénomènes liés à la santé
dans une population déterminée et l’application de cette étude à la
prévention et à la maîtrise des problèmes de santé
• L’épidémiologie est une science fondamentale de la santé publique
qui a grandement contribué à améliorer la santé des populations.
• Il existe souvent un décalage contrariant entre l’acquisition des
données épidémiologiques et leur application aux politiques de santé.
[Link] de l’epidemiologie
Les outils de mesure
1-Le rapport :– Relation entre deux quantités
– Peuvent appartenir ou non au même ensemble.
– Rapports utilisées:
• Proportion,
• Taux,
• Ratio,
• Indice,
• Cotes….
Jetons en peu sur quelques éclaircissements sur ces rapports citez ci
hauts
[Link] PROPORTION : Le numérateur est compris dans le dénominateur
et ils sont de même [Link] PROPORTION est un nombre compris
entre 0 et 1 ou en %.
Exemple : Dans une population de 7500 enfants de moins de 5 ans, on
constate que 5300 sont correctement vaccinés contre la rougeole.
La proportion d’enfants vaccinés contre la rougeole est 5300/7500 =
0,707 = 70,7%
2. LE TAUX: un rapport qui prend en compte la notion de temps. C’est
la probabilité de survenue d’un évènement au cours du temps.
Exemple :taux d’incidence :l'incidence d'une maladie est le nombre de
nouveaux cas de cette maladie observés sur une période donnée. Le taux
d'incidence est calculé en rapportant ce nombre de nouveaux cas (population
incidente) à la taille de la population cible, toujours pendant une période
donnée.
3. Le Ratio : C’est le rapport d’une des fréquences de 2 classes d’une même
variable.
• Numérateur et dénominateur de même nature (appartiennent au même
ensemble)
• Nombre sans unité
Exemple : Dans une population de 100 individus, on observe 40 hommes et 60
femmes.
• Quel est le ratio H/F (Sexe ratio) => 40/60 = 0,66
4. LA COTE : C’est le rapport entre la probabilité d’observer un événement et
celle d’observer l’évènement contraire. La cote c’est un ratio.
Exemple typique : cote des exposés sur les non-exposés (fumeur/non-fumeur)
Exemple • Lors d’une épidémie de TIAC (Toxi Infection Alimentaire Collective),
on a colligé 75 cas (malades) • Parmi les 75 cas: 50, ont consommé la viande
de volaille et 25, ne l’ont pas consommé. • La cote d’exposition chez les cas ?
Est de = 50/25 soit 2
c.à.d. 2 cas exposés à la viande de volaille pour 1 cas non-exposé
5. L’INDICE : Le rapport des 2 effectifs qui sont de nature différente
Exemple : Nombre de lits d’hôpital/médecin 850 lits, 10 médecins 85 lits
pour 1 médecin
• Nombre d’individus par foyer 1 200 personnes, 250 foyers donc 4,8 personnes
par foyer
Logiciel Stata
[Link] exemple pour determiner cote-ratio entre variables des cas(obesite) et la
variable d’exposition(hypertension)
2. pour determiner une cote entre variables des cas(obesite) et la variable
d’exposition(hypertension)
3. pour determiner un taux d’incidence
Question 2. Expliquer brièvement les tests non paramétriques
Les tests non paramétriques ne font aucune hypothèse sur le type de loi de
distribution des données. Ils se basent uniquement sur les propriétés
numériques des é[Link] tests non parametriques ne necessitent pas
l’estimation de la moyenne et de la [Link] plus important est la position
relative des observations, leur [Link] sont utilise lorsque les
conditions d’utilisation des tes parametriques ne sont pas verifiees,dans le cas
de non normalite des variables d’etudes ou d’echantillons de petites tailles.
L' hypothèse nulle ( H O ) est un énoncé qui n'indique aucune différence. Il
existe une référence entre les conditions, les groupes ou les variables. L'
hypothèse alternative tandis que l’hypothèse alternative ou de recherche, est
l'énoncé qui prédit une différence ou relation entre les conditions, les groupes
ou les variables.
Test pour échantillon indépendants :
[Link] de Kolmogorov-Smirnov :
Le test de Kolmogorov- Smirnov vise a détecte toute forme de différenciation
entre les distributions.
[Link] de Mann-Whitney (a deux échantillon):
Comparaison de deux medianes(données des rangs)
[Link] de khi carre
En statistique, le test du khi carré, aussi dit du khi-deux est un test statistique où
la statistique de test suit une loi quelconque sous l’hypothese nulle.
Par exemple, il permet de tester l'adéquation d'une série de données à une
famille de loi de probabilite ou de tester l'indépendance entre deux variables
aleatoire.
[Link] des rangs de Kruskal-Wallis ou test de la mediane :
Le test de Kruskal-Wallis aussi appelé est une méthode non paramétrique
utilisée pour tester si des echantillons trouvent leur origine dans la même
distribution. Ce test s'intéresse aux medianes de populations ( )
(ou treatment dans la littérature en anglais) et propose comme hypothese
nulle que les echantillons sont confondus et proviennent d'un même
échantillon (combiné) d'une population. Le test permet de comparer deux ou
plusieurs échantillons indépendants de taille similaire ou non. Il généralise le
test de Wilcon-Mann-Whitney, qui est utilisé pour comparer seulement deux
groupes.
[Link] de Friedman
Le test considère que les variables étudiées sont mesurées sur une echelle
ordinale (c'est-à-dire avec des rangs). L'hypothese nulle stipule que les
différents echantillons sont issus de la même population, ou plus précisément
de populations avec des médianes identiques. Par conséquent, l'interprétation
des résultats de cette procédure est similaire à celle d'une ANOVA avec
mesures répétées.
[Link] des signes
Le test calcule simplement le nombre de fois où la valeur de la première
variable (A) est supérieure à celle de la seconde variable (B). Sous l'hypothèse
nulle (il n'existe aucune différence entre les deux variables), les valeurs de la
variable A seront supérieures aux valeurs de la variable B dans 50% des cas.
Test paramétriques
Test de student
En statistique, le test de Student, ou test t, est un ensemble de tests
statistique paramétriques où la statistique de test calculée suit une loi de
student lorsque l’hypothese nulle est vraie.
Le test t, également appelé test de Student ou distribution t, est un test
statistique populaire servant à mesurer les différences entre les moyennes de
deux groupes ou d’un groupe par rapport à une valeur standard. Il est basé sur
une loi de probabilité appelée loi de Student. L’exécution de ce test sert à
comprendre si les différences sont statistiquement significatives, c’est-à-dire si
elles ne sont pas le fruit du hasard.
En utilisant le test T, un analyste va être en mesure de savoir s’il existe des
facteurs qui influencent les différences entre les résultats de plusieurs
échantillons observés.
Test de Fisher
La statistique de Fisher est utilisee pour verifier la significativite globale des
variables explicatives sur la variables a explique
Le test de Fisher-Snedecor est egalement utilise pour comparer les variances
de deux échantillons statistiques.
• Données : Un échantillon (x1,...,xp) de valeurs observées de la variable X,
un échantillon (y1,...,yq) de valeurs observées de la variable Y.
• Hypothèse testée : "VX=VY", avec risque d'erreur a.
Question 3. Différence entre R au carre et R au carre ajusté
Le R au carré ajusté (ou coefficient de détermination ajusté) est utilisé dans
une régression multiple pour voir le degré d'intensité ou d'efficacité des
variables indépendantes pour expliquer la variable dépendante.
En termes plus simples, le R au carré ajusté nous indique quel pourcentage de la
variation de la variable dépendante est expliqué collectivement par toutes les
variables independentes.
Contrairement au coefficient de détermination qui mesure l’adéquation entre
un modèle issu d’une régression linéaire simple ou multiple et les données
observes qui ont permis de l’établir.