Guide du Test T Apparié en Statistiques
Guide du Test T Apparié en Statistiques
Sur
Test t apparié
Le test t pour échantillons appariés est utilisé dans les études 'avant-après', ou lorsque les échantillons sont les
paires appariées, ou lorsqu'il s'agit d'une étude cas-témoin.
Le test t apparié est basé sur les différences entre les valeurs de chaque paire, c'est-à-dire une.
soustrait de l'autre. Dans la formule pour un test t apparié, cette différence est notée
La formule du test t apparié est le ratio de la somme des différences de chaque paire.
à la racine carrée de n multipliée par la somme des différences au carré moins la somme de la
écarts au carré, tout sur n - 1.
Par exemple, si nous formons un employé d'entreprise et que nous voulons savoir si oui ou non
la formation a eu un impact sur l'efficacité de l'employé, nous pourrions utiliser le jumelé
examen d'échantillon. Nous collectons des données auprès de l'employé sur une échelle de notation de sept niveaux, avant la formation
et après la formation. En utilisant le test t pour échantillons appariés, nous pouvons conclure statistiquement si
ou non la formation a amélioré l'efficacité de l'employé. En médecine, en utilisant le
test t de l'échantillon apparié, nous pouvons déterminer si un médicament guérira ou non la maladie particulière
maladie.
Supposons deux ensembles appariés Xi et Yi pour i = 1, 2… n tels que leur différence appariée est
indépendantes, identiques et normalement distribuées. Alors le test t apparié détermine si
Ils diffèrent les uns des autres de manière significative.
Le test t apparié, également appelé test t sur échantillons appariés ou test t dépendant, est utilisé pour
déterminer si la moyenne d'une variable dépendante (par exemple, poids, niveau d'anxiété, salaire,
le temps de réaction, etc.) est le même dans deux groupes liés (par exemple, deux groupes de participants qui sont
mesuré à deux "temps" différents ou qui subissent deux "conditions" différentes). Pour
par exemple, vous pourriez utiliser un test t apparié pour comprendre s'il y avait une différence dans
les salaires des managers avant et après avoir entrepris un doctorat (c'est-à-dire, votre variable dépendante serait
"salaire", et vos deux groupes liés seraient les deux "moments temporels" différents ; c'est-à-dire,
salaries "before" and "after" undertaking the PhD). Alternately, you could use a paired t-test
pour comprendre s'il y avait une différence dans la consommation quotidienne de cigarettes des fumeurs pendant 6 semaines
après avoir porté des patchs à la nicotine par rapport à des patchs qui ne contenaient pas de nicotine,
appelé un "placebo" (c'est-à-dire que votre variable dépendante serait "consommation quotidienne de cigarettes",
et vos deux groupes liés seraient les deux « conditions » différentes dans lesquelles les participants se trouvaient.
exposé à ; c'est-à-dire, les valeurs de consommation de cigarettes après avoir porté des "patchs de nicotine" (le
groupe de traitement) comparé à après avoir porté le "placebo" (le groupe témoin)). Plus spécifiquement,
vous utilisez un test t apparié pour déterminer si la différence moyenne entre deux groupes est
statistiquement significativement différent de zéro.
Degrés de liberté sous le test t apparié
Les degrés de liberté (ddl) d'un ensemble de données se rapportent au nombre de valeurs qu'il y a dans cela.
données.
2. Pour un test t indépendant, les degrés de liberté (df) correspondent au nombre de personnes dans l'échantillon 1 plus le nombre de
Personnes dans l'échantillon 2 moins 2.
Le niveau de signification, généralement noté par 'alpha', est spécifié avant que les échantillons ne soient
dessiné, de sorte que les résultats obtenus ne devraient pas influencer le choix du décideur. Le
le niveau de signification est spécifié en termes de probabilité de rejeter une hypothèse nulle
hypothèse lorsqu'elle est vraie, c'est-à-dire qu'il s'agit du risque qu'un décideur prend en rejetant l'hypothèse nulle
hypothèse quand c'est vraiment vrai.
Pour l'assurance qualité, c'est 0,01, pour les sondages politiques, c'est 0,10.
1.2 Test T apparié versus Test T non apparié
Lorsqu'on étudie le test t apparié et le test t non apparié, la similarité entre les deux est que les deux
supposer des données provenant de la distribution normale.
La taille de l'échantillon des deux groupes n'a pas besoin d'être égale.
L'intervalle de confiance à 95 % est dérivé de la différence entre les deux ensembles appariés.
observations.
1.3 Hypothèses
Comme de nombreuses procédures statistiques, le test t pour échantillons appariés a deux hypothèses concurrentes, le
l'hypothèse nulle et l'hypothèse alternative. L'hypothèse nulle suppose que la véritable
la différence moyenne entre les échantillons appariés est nulle. Sous ce modèle, toutes les observables
les différences sont expliquées par la variation aléatoire. En revanche, l'hypothèse alternative
suppose que la véritable différence de moyenne entre les échantillons appariés n'est pas égale à zéro. Le
l'hypothèse alternative peut prendre plusieurs formes en fonction du résultat attendu. Si
la direction de la différence n'a pas d'importance, une hypothèse bilatérale est utilisée. Sinon, un
Une hypothèse à une queue supérieure ou à une queue inférieure peut être utilisée pour augmenter la puissance du test. L'hypothèse nulle
l'hypothèse reste la même pour chaque type d'hypothèse alternative. Le test t pour échantillons appariés
les hypothèses sont formellement définies ci-dessous :
1. L'hypothèse nulle (H0) suppose que la véritable différence de moyenne (μd) est égale à zéro.
2. L'hypothèse alternative à deux queues (H1) suppose que μ n'est pas égal à zéro.
3. L'hypothèse alternative à une seule extrémité (H1) suppose que μ est supérieur à zéro.
4. L'hypothèse alternative à queue inférieure (H1) suppose que μ est inférieur à zéro.
Les représentations mathématiques des hypothèses nulle et alternative sont définies ci-dessous :
H0:μd= 0
H1 : μd ≠ 0 (bilatéral)
H1 : μd > 0 (test unilatéral supérieur)
H1:μd< 0 (à queue inférieure)
Note. Il est important de se rappeler que les hypothèses ne portent jamais sur les données, elles portent sur le
processus qui produisent les données. Dans les formules ci-dessus, la valeur de μd est inconnue. Le
L'objectif des tests d'hypothèse est de déterminer l'hypothèse (nulle ou alternative) avec laquelle le
les données sont plus cohérentes.
1.4 STEPS FOR CONDUCTING PAIRED t-Test:
1. Établir une hypothèse : Nous avons établi deux hypothèses. La première est l'hypothèse nulle, qui
suppose que la moyenne de deux échantillons appariés est égale. La deuxième hypothèse sera une
hypothèse alternative, qui suppose que les moyennes de deux échantillons appariés ne sont pas égales.
2.Sélectionnez le niveau de signification : Après avoir formulé l'hypothèse, nous définissons le niveau de
signification. Dans la plupart des cas, le niveau de signification est fixé à 5 %, (en médecine, le
le seuil de signification est fixé à 1 % en raison de la nature critique de celui-ci.
Où d barre est la différence moyenne entre deux échantillons, s² est la variance de l'échantillon, n est le
La taille de l'échantillon et t est un test t pour échantillons appariés avec n-1 degrés de liberté.
[Link] de l'hypothèse ou prise de décision : Après avoir calculé le paramètre, nous allons
comparez la valeur calculée avec la valeur du tableau.
Si la valeur calculée est supérieure à la valeur du tableau, alors nous allons rejeter l'hypothèse nulle.
hypothèse pour le test t pour échantillons appariés. Si la valeur calculée est inférieure à celle du tableau
valeur, alors nous accepterons l'hypothèse nulle et dirons qu'il n'y a pas de moyenne significative
différence entre les deux échantillons appariés.
Hypothèses pour le test t apparié :
1. La variable dépendante doit être mesurée au niveau d'intervalle ou de "ratio" (c'est-à-dire qu'elles sont
continu
2. Les variables indépendantes doivent se composer de deux catégories, "groupes liés" ou "appairés".
pairs".
3. Seules les paires appariées peuvent être utilisées pour effectuer le test.
7. Il ne devrait pas y avoir d'outliers significatifs dans les différences entre les deux groupes liés.
Les données doivent être saisies dans SPSS en deux colonnes, où une colonne indique le pré-
Mark et l'autre ont le timbre postal - voir à droite (une troisième colonne fournit l'identité de l'affaire)
numéros). Pour que le test t des échantillons appariés soit valide, les différences entre les valeurs appariées
devrait être approximativement distribué normalement. Pour calculer les différences entre avant et
post-marks, depuis l'Éditeur de données dans SPSS, choisissez Transformer - Calculer une variable et
complétez les cases comme indiqué ci-dessous à droite.
La normalité de Diff doit d'abord être vérifiée – voir Vérification de la normalité pour les tests paramétriques
feuille de travail.
Il n'y a aucune preuve pour soupçonner que les données ne sont pas distribuées normalement.
3. Exécution du test t pour échantillons appariés
•Sélectionnez les deux variables appariées comme les Variables Appariées, en sélectionnant d'abord la variable après.
(Post), suivi de la variable précédente (Pre) comme indiqué ci-dessous et cliquez sur OK.
1.5 Hypothèses
Il y a quatre "hypothèses" qui sous-tendent le test t apparié. Si l'une de ces quatre hypothèses
ne sont pas satisfaites, vous ne pouvez pas analyser vos données en utilisant un test t apparié car vous n'obtiendrez pas un
résultat valide. Puisque les hypothèses #1 et #2 sont liées à votre conception d'étude et au choix des variables,
ils ne peuvent pas être testés à l'aide de Stata. Cependant, vous devez décider si votre étude répond à
ces hypothèses avant de partir.
Heureusement, vous pouvez vérifier les hypothèses n°3 et n°4 en utilisant Stata. En passant à
hypothèses #3 et #4, nous suggérons de les tester dans cet ordre car cela représente un ordre
où, si une violation de l'hypothèse n'est pas corrigeable, vous ne pourrez plus utiliser un
test t apparié. En fait, ne soyez pas surpris si vos données ne remplissent pas une ou plusieurs de ces hypothèses
puisque cela est assez typique lorsque l'on travaille avec des données du monde réel plutôt qu'avec des exemples de manuels,
qui montrent souvent uniquement comment réaliser un test t apparié lorsque tout se passe bien.
Cependant, ne vous inquiétez pas car même lorsque vos données ne respectent pas certaines hypothèses, il y a souvent un
solution pour surmonter cela (par exemple, transformer vos données ou utiliser un autre test statistique
au lieu de cela). Souvenez-vous simplement que si vous ne vérifiez pas que vos données respectent ces hypothèses ou
vous les testez incorrectement, les résultats que vous obtenez en exécutant un test t apparié pourraient ne pas être
valide.
oHypothèse n°3 : Il ne devrait pas y avoir d'écart significatif dans les différences entre
les deux groupes liés. Un point aberrant est simplement un seul point de données dans vos données qui
ne suit pas le schéma habituel (par exemple, dans une étude sur les scores de QI de 100 étudiants, où le
le score moyen était de 108 avec seulement une petite variation entre les étudiants, un étudiant avait un
un score de 156, ce qui est très inhabituel, et pourrait même la placer dans le top 1 % des scores de QI
À l’échelle mondiale). Le problème avec les valeurs aberrantes, c'est qu'elles peuvent avoir un effet négatif sur le
test t apparié, distordant les différences entre les deux groupes liés (que ce soit
augmenter ou diminuer les scores sur la variable dépendante), ce qui réduit le
exactitude de vos résultats. De plus, ils peuvent affecter la signification statistique de la
test. Heureusement, lorsque vous utilisez Stata pour exécuter un test t apparié sur vos données, vous pouvez facilement
détecter les valeurs aberrantes possibles.
En pratique, vérifier les hypothèses #3 et #4 prendra probablement la majeure partie de votre temps.
lors de la réalisation d'un test t apparié. Cependant, ce n'est pas une tâche difficile, et Stata fournit tout le
outils dont vous avez besoin pour faire cela.
CHAPITRE 2 - PROFIL D'ENTREPRISE
Jennex a été fondée en 1996 avec pour mission de fournir des produits de construction en pierre de qualité mondiale.
pour le marché de la construction international. Le spectre des produits de Jennex comprend des produits naturels
pierre, marbre, granit, grès, calcaire, ardoise, dalles, carreaux, mosaïque, comptoirs, et découpé à
produits en pierre de taille.
Le bureau de la société Jennex est situé à New Delhi, la capitale nationale de l'Inde.
les entreprises associées sont Jennex Granites Industries Pvt. Ltd., Jennex International Exports,
Stonex, Jennex International et Jennex Rocks and Minerals Pvt. Ltd., Jennex a
des unités de fabrication purement orientées vers l'exportation équipées d'installations de pointe en pierre
fonctionne la technologie à Hosur dans l'État du Tamil Nadu. Jennex réunit les dernières
technologie et professionnalisme impeccable et dévouement à la qualité.
Sous la direction de M. Yogesh Anand, Jennex a connu une croissance constante depuis sa création et
est un nom réputé parmi les exportateurs de pierre indiens aujourd'hui. Il a une clientèle forte et en croissance.
à travers le Royaume-Uni, les États-Unis, le Canada, l'Afrique du Sud, l'Australie, le Moyen-Orient et le Proche-Orient. A
destinataire régulier de la Promotion des Exportations de Produits Chimiques et Alliés (CAPEXIL)
Le prix d'excellence du conseil, Jennex est devenu un symbole de qualité pour les produits en pierre.
le globeabc.
Chez Jennex, nous nous concentrons sur deux domaines : premièrement, sur les clients et deuxièmement, en poursuivant avec le
investissements dans nos entreprises et notre main-d'œuvre afin de maximiser la productivité qui va
soutenir notre produit qualité à tous times.
As one of the prominent developers and exporters of marbles, granites and natural stones, our
la priorité est de s'assurer que nous continuons à fournir aux clients existants et futurs le
service and support that is required. To us, Customer Service is not a department, but an
attitude !
Le statut actuel de l'entreprise est - Actif
Leurs produits sont conformes à diverses normes internationales - BS1139, EN74, ANZ, JIS
et ARAMCO en fonction des exigences des clients.
Statut juridique de l'entreprise : Société à responsabilité limitée. Enregistrée sous la Loi sur les sociétés de 1956
Noida-201305, (U.P.)
CHAPITRE 3 - Problème Hypothétique
Nous avons collecté les données de l'entreprise. Au total, il y a environ 100 employés dans le
entreprise. Nous avons sélectionné un échantillon de 20 personnes au hasard.
Supposons, selon l'entreprise, qu'un employé efficace est celui qui peut effectuer une
tâche spécifique qui lui a été assignée dans un minimum de temps. Donc, nous avons pris une ou deux personnes de divers
les équipes et ont enregistré les observations qui nous ont été données. Pour référence, l'entreprise voit sur la base
du nombre de paquets de carreaux de marbre ou de mélanges réalisés par la personne en une heure.
Nous avons donc essayé de comparer l'efficacité des travailleurs avant la formation et après.
Entraînement qui est comme suit : -
AVANT APRÈS
ENTRAÎNEMENT ENTRAÎNEMENT
45 70
60 75
28 50
55 72
61 70
48 52
62 65
70 78
58 55
34 52
15 40
30 40
18 20
26 52
68 80
72 98
50 62
39 50
61 91
28 60
Solution:
Étape I :
Ho : L'entreprise affirme qu'elle maintient déjà des travailleurs formés, donc l'efficacité des travailleurs peut
non augmenter.
Étape II :
(BT) (AT) (AT-BT) (D-d) (D-d)2
45 70 25 9.7 94,09
60 75 15 -0,3 0,09
28 50 22 6.7 44,89
55 72 17 1.7 2.89
61 70 9 -6,3 39,69
48 52 4 -11.3 127.69
62 65 3 -12,3 151,29
70 78 8 -7,3 53,29
58 55 -3 -18,3 334,89
34 52 18 2.7 7,29
15 40 25 9,7 94,09
30 40 10 -5,3 28.09
18 20 2 -13.3 176,89
26 52 26 10.7 114,49
66 80 14 -1,3 1.69
72 98 26 10,7 114,49
50 62 12 -3,3 10,89
39 50 11 -4.3 18,49
61 91 30 14,7 216,09
28 60 32 16,7 278,89
306 1910.2
α = 5%
Step III:
d = 306/20 S.D=100,536
√
=15.3 10,02
S.E=10,02/4,47
= 2,24
α = 0,025
df = 19
Ainsi, nous pouvons dire que l'efficacité des travailleurs s'est améliorée après la formation et le
La revendication de la société n'est pas acceptable.
Valeur de la table :
CALCUL DEPUIS SPSS : -
CHAPITRE 4 - APPRENTISSAGE ET SUGGESTION
Comme l'hypothèse alternative a été acceptée, on conclut qu'il y a un impact de la formation sur le
performance des employés.
Une valeur de "d bar" supplémentaire indique que le changement est positif, donc nous pouvons dire qu'il y a
amélioration de l'efficacité des employés après avoir fourni une formation.
L'entreprise se concentrera sur la formation des travailleurs après les avoir employés au lieu de
embaucher des travailleurs formés. Ainsi, l'efficacité des travailleurs peut être augmentée régulièrement. Ils peuvent
emballer au moins 100 palettes en 1 heure.