0% ont trouvé ce document utile (0 vote)
5 vues3 pages

Introduction aux Statistiques et Méthodes

jhj

Transféré par

lina.tenourii
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
5 vues3 pages

Introduction aux Statistiques et Méthodes

jhj

Transféré par

lina.tenourii
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Statistiques

1 Définitions
Définitions 1

Les statistiques ont pour but d’étudier le caractère (ou variable) des individus d’une population
Le caractère peut prendre différentes valeurs (ou modalités). Il peut être qualitatif (nom, couleur) ou
quantitatif
Si le caractère est quantitatif, il peut être :
• Discret : âge, notes
• Continu : poids, taille. Dans ce cas, on peut réunir les valeurs dans des intervalles nommés classes

Faire des statistiques, c’est recueillir, organiser, synthétiser, représenter et exploiter des données, numériques
ou non, dans un but de comparaison, de prévision, de constat...
Les métiers où les statistiques sont beaucoup utilisées sont les assureurs (risques d’accidents, de maladie
des assurés), les médecins (épidémiologie), les démographes (populations et leur dynamique), les économistes
(emploi, conjoncture économique), les météorologues...

Définitions 2

L’effectif d’une valeur est le nombre d’individus dont le caractère est associé à cette valeur
L’effectif total est le nombre total d’individus de la population
La fréquence d’une valeur est le résultat du quotient de son effectif par l’effectif total.
L’ensemble de ces valeurs forme la distribution des fréquences
effectif de la valeur
f=
effectif total
Exemple 1

On considère une classe de 2nde de 25 élèves et les résultats d’un de leur contrôle :
0−2−3−4−4−4−5−5−5−5−6−6−6−6−6−6−7−7−7−7−8−8−8−9−10

Notes 0 1 2 3 4 5 6 7 8 9 10
Effectifs
Fréquences

Caractère : Effectif de 4 Fréquence de 4

Population : Effectif de 8 Fréquence de 8

Individu :

1
Définitions 3
L’effectif (la fréquence) cumulé croissant d’une valeur est la somme des effectifs (fréquences) des valeurs
inférieures ou égales à cette valeur

Notes [0;2] [3;5] [6;8] [9;10]


Effectifs
Effectifs cumulés croissants
Fréquences
Fréquences cumulées croissantes

Quel est l’effectif des notes comprises entre 0 et 5 ?


Quel est l’effectif des notes comprises entre 3 et 10 ?
Quelle est la fréquence des notes supérieures à 6 ?
Quelle est la fréquence des notes inférieures à 8 ?

2 Position
Définition 1
Soit une série statistique de p valeurs x1 , x2 , ... xp d’effectifs n1 , n2 , ... np tels que n1 + ... + np = N et de
fréquences f1 , f2 , ... fp
x1 n1 + x2 n2 + ... + xp np
La moyenne d’une série statistique est notée x = ou x = f1 x1 + f2 x2 + ... + fp xp
N
Exemple 2
Quelle est la moyenne de la classe lors du contrôle ?

Propriété 1 Linéarité de la moyenne


En ajoutant un nombre k à toutes les valeurs d’une série statistique, on augmente la moyenne de k
En multipliant par un nombre a toutes les valeurs d’une série statistique, on multiplie la moyenne par a
Exemple 3
On considère l’âge des 10 membres de l’équipage de Luffy au chapeau de paille.
On obtient les résultats suivants : 19; 21; 20; 19; 21; 17; 30; 34; 90; 46
Quelle est la moyenne d’âge de l’équipage ?
Quels seront les âges dans deux ans ? Quelle sera alors la moyenne ?

2
Exemple 4

Le professeur souhaite mettre les notes obtenues lors du contrôle de l’exemple 1 sur 20.
Quelles sont les nouvelles notes ? Et la moyenne ?

Définitions 4

La médiane M d’une série statistique est la valeur qui sépare la série en deux groupes de même effectif
Si l’effectif est impair, la médiane est la valeur du milieu, s’il est pair, c’est la moyenne des deux termes du
milieu
Les quartiles Q1 , Q2 et Q3 d’une série statistique sont les nombres qui séparent la série en quatre groupes
de même effectif

Exemple 5

Quel est l’âge médian des membres de l’équipage ?


Si l’équipage accueille un nouveau membre de 28 ans, que devient l’âge médian ?

3 Dispersion
Définitions 5

L’ étendue e d’une série statistique est la différence entre la plus grande et la plus petite valeur de la série
L’ écart inter-quartile Q3 − Q1 mesure la dispersion des valeurs autour de la médiane
L’ intervalle inter-quartile [Q1 ; Q3 ] comprend la moitié des valeurs de la série
L’ écart-type σ mesure la dispersion des valeurs autour de la moyenne
Plus l’écart-type est grand plus les valeurs sont dispersées autour de la moyenne et moins celle-ci est représen-
tative

Représentation en diagramme en boîte

Common questions

Alimenté par l’IA

The frequency of a value in a dataset is calculated by dividing the number of occurrences of that value (effectif) by the total number of observations (effectif total). This quotient provides the relative frequency, which indicates how often a particular value appears in comparison to the total dataset .

Discrete quantitative variables are those that take on specific and separate values, often integer counts, like 'âge' (age) or 'notes' (scores). Continuous quantitative variables, however, can assume an infinite number of values within a given range, such as 'poids' (weight) or 'taille' (height). These continuous variables can be grouped into intervals known as classes for analysis .

Statisticians determine whether a variable is qualitative or quantitative based on the nature of the data it represents. Qualitative variables, also known as categorical variables, characterize or describe an individual or group, often using names or labels such as 'nom' or 'couleur'. In contrast, quantitative variables express numeric quantities, which can be measured and ordered, such as 'âge' for discrete variables or 'poids' and 'taille' for continuous variables .

Cumulative frequency is calculated by summing the frequencies of all values equal to or less than a given value in a dataset. It represents the number of observations within a dataset that are less than or equal to a certain value, allowing for a better understanding of the distribution and coverage of data points .

The interquartile range (IQR) is the difference between the third quartile (Q3) and the first quartile (Q1) in a dataset. It measures the dispersion of the middle half of the dataset and helps to understand how tightly the data is clustered around the median. The IQR is particularly useful in identifying outliers and understanding the overall variability in the data .

The mean x of a statistical series is calculated using the formula x = (x1n1 + x2n2 + ... + xpnp) / N or x = (f1x1 + f2x2 + ... + fpxp), where xi are the values, ni their respective frequencies, and N the total number of occurrences. If a constant is added to all values, the mean increases by that constant. When all values are multiplied by a factor, the mean is also multiplied by that factor due to the linearity property of the mean .

'Effectif' refers to the number of individuals or observations that share a particular characteristic within a dataset. 'Effectif total' is the total number of individuals or observations in the entire dataset. 'Effectif' focuses on a subset of the population defined by a certain criterion, while 'effectif total' encompasses all observations .

'Écart-type' or standard deviation measures the dispersion of data values around the mean. A larger standard deviation indicates more spread out values, suggesting that the mean may not be highly representative of the dataset. It is crucial for understanding how much individual data points differ from the average, and for comparing variability across different datasets or time periods .

Statistics are used extensively in fields such as insurance to evaluate risks, medicine for epidemiological studies, demography for population analysis, economics for understanding employment trends and economic conditions, and meteorology by meteorologists for weather prediction and climate research. These fields rely on statistical methods to collect, analyze, and interpret data for informed decision-making and forecasting .

The median of a dataset is the value that divides the dataset into two equal halves. When the number of observations is odd, the median is the middle value in the ordered sequence. When it is even, the median is calculated as the average (mean) of the two middle values in the sequence .

Vous aimerez peut-être aussi