Probabilités et Biostatistique
PCEM1 Pitié-Salpêtrière
A. Mallet et V. Morice
Cours 9 et 10
Quelques tests usuels (ch.12-15)
Test d’égalité d’une proportion ‘vraie’ à
une valeur donnée (déjà connu)
1. H0: ϕ=ϕ0
H1: ϕ≠ϕ0
Pn − ϕ 0 ~
2. Z = N(0,1)
ϕ 0 (1 − ϕ 0 )
n
condition de validité: nϕ0>5, n(1-ϕ0)>5
3. IP0,95 = [-1,96 1,96 ]
4,5,6. Standards
Test d’égalité d’une proportion ‘vraie’ à
une valeur donnée: remarques (1)
Notamment: rejet de H0 si :
ϕ 0 (1 − ϕ 0 )
p - ϕ 0 > 1,96
n
c’est-à-dire si p diffère suffisamment de ϕ0
Une telle différence suffisante s’appelle
différence significative entre p et ϕ0.
Une différence significative entre deux
nombres est une différence suffisamment
importante pour qu’elle signifie que les
grandeurs théoriques sous-jacentes ne sont
pas égales (ici une seule grandeur: ϕ)
Test d’égalité d’une proportion ‘vraie’ à
une valeur donnée: remarques (2)
Notamment: rejet de H0 si :
ϕ 0 (1 − ϕ 0 )
p - ϕ 0 > 1,96
n
Le fait que la décision se prenne sur la base
de l’écart entre p et ϕ0 justifie la
dénomination suivante pour le test:
‘test de comparaison (statistique) d’une
proportion observée (p) à une valeur
donnée (ϕ0)’
Remarque: dénomination usuelle mais
dangereuse
Test d’égalité d’une proportion ‘vraie’ à
une valeur donnée
Nombre de sujets nécessaires pour obtenir
une puissance donnée si ϕ=ϕ1.
(formule approchée)
[1,96 ϕ 0 (1 − ϕ 0 ) + u 2β ϕ1 (1 − ϕ1 ) ]2
n=
[ϕ 0 − ϕ1 ]2
condition de validité: nϕ0>5, n(1-ϕ0)>5
Exemple: β=0,2 (u2β=0,842); ϕ0=0,2; ϕ1=0,1.
n>118
Différence détectable avec 90 sujets (β=0,2):
|ϕ0-ϕ1|>0,17
Test d’égalité d’une moyenne ‘vraie’ à une
valeur donnée ou de comparaison d’une moyenne
observée à une valeur donnée. (1)
1. H0: µ=µ0
(ex: la taille moyenne de la tumeur est de 25 mm)
H1: µ≠µ0
M n − µ0 ~
2. Z= 2
N(0,1)
Sn
n
condition de validité: n>30
3. IP0,95(Z) = [-1,96 1,96 ]
Test d’égalité d’une moyenne ‘vraie’ à une
valeur donnée ou de comparaison d’une moyenne
observée à une valeur donnée. (2)
4. Règle fondée sur l’appartenance ou
non appartenance de
m − µ0
z=
s2
n
à [-1,96 1,96]
5,6. Standards (la moyenne observée des tailles des
tumeurs diffère significativement de 25 mm)
Test d’égalité d’une moyenne ‘vraie’ à une
valeur donnée (3). Portée pratique
Ce test est surtout pratiqué avec µ0=0, la
variable étudiée étant une différence entre
deux variables s’attachant à la même unité
statistique. Cette situation s’appelle situation
appariée.
Exemples:
On veut mettre à l’épreuve l’égalité de sévérité de
deux correcteurs A et B. Chaque copie sera notée
par les deux (notes X et Y); on formulera pour
hypothèse nulle: E(X-Y)=0 ; pour mettre en œuvre
la règle de décision on utilisera l’échantillon des
valeurs des différences des paires ‘note donnée par
A et note donnée par B à la même copie’.
On veut mettre en évidence l’activité d’un somnifère.
X (Y) sera la durée de sommeil sans (avec)
traitement et on analysera les différences yi-xi
Test d’égalité d’une moyenne ‘vraie’ à une
valeur donnée (4).
Nombre de sujets nécessaires pour
rejeter H0 avec une puissance donnée
1-β lorsque
µ=µ1
Var(X)=σ2
2
σ
n = [1,96 + u 2β ]2
[µ 0 − µ1 ]2
condition de validité: n>30
Test voisin, sans condition de taille d’échantillon:
test de symétrie d’une distribution: hors
programme (présenté dans le polycopié)
Critique de l’exemple des souris: notions sur les
essais cliniques contrôlés (1)
Supposons que 8 souris sur les 100 ont développé un
cancer (rappel: IP0,95(P100) sous H0=[0,12 0,28])
On conclut: ‘la probabilité de survenue du cancer
chez les souris traitées est inférieure à 0,2’
Peut-on dire:
La probabilité du cancer chez les souris traitées est inférieure à la
probabilité de survenue du cancer chez les souris non traitées ?
Suppose que chez les souris non traitées, ϕ=0,2; en est-on bien certain ?
Le traitement réduit la probabilité de survenue du cancer (chez ces
souris) ?
Suppose que le traitement soit la cause de la réduction; en est-on bien
certain ?
Notions sur les essais cliniques contrôlés (2)
Premier point.
On ne peut être certain que ϕ=0,2 chez les souris non
traitées.
On renonce à cette supposition et on inclut des souris non
traitées dans l’étude.
On aboutit à une ETUDE COMPARATIVE entre population
des souris non traitées et population des souris traitées
Il conviendra généralement de constituer deux échantillons
d’unités statistiques (exception: appariement au sens
précédent )
-> nouvelle formulation de la question: la probabilité de
survenue du cancer diffère-t-elle entre les souris
traitées et les souris non traitées
Remarque: l’immense majorité des essais réels de
mise en évidence d’activité d’une action, d’un
traitement, sont comparatifs
Notions sur les essais cliniques contrôlés (3)
Second point.
Comment être certain que le traitement est la cause
des différences certifiées ?
Doutes possibles: les souris traitées sont « d’une nature
différente » des non traitées (exemple: vous avez traité les
plus vigoureuses)
Solution impérative:
1. vous devez être maître de l’administration du traitement (ou
du facteur étudié): on dit que l’on CONTRÔLE le traitement
2. vous devez vous en remettre au hasard pour décider chez
un sujet de l’expérience de l’administration ou non du
traitement: on parle de tirage au sort ou de randomisation: les
échantillons de souris traitées et non traitées sont finalement
constitués au hasard: les souris des deux échantillons ne
diffèrent que par leur statut vis-à-vis du traitement
Notions sur les essais cliniques contrôlés (4)
Second point.
Comment être certain que le traitement est la cause
des différences certifiées ?
Aspects complémentaires recommandés (renforcent la
force de la preuve)
Il serait bon que les souris ‘non traitées’ reçoivent un semblant
de traitement, appelé placebo. Surtout recommandé chez
l’homme où traitement inefficace et absence de traitement
n’ont pas les mêmes effets. Utile en expérimentation animale
pour assurer l’insu (voir plus bas)
Assurer l’objectivité du recueil du critère de jugement de
l’activité du traitement. Un moyen: que la nature du traitement
ne soit connue ni du malade ni du médecin. On parle d’étude
en double insu ou en double aveugle.
Notions sur les essais cliniques contrôlés (5)
Notion complémentaire
Lors d’un essai clinique (thérapeutique) contrôlé, pour
évaluer l’effet que l’on peut attendre d’un traitement
dans une population, on doit fonder le test statistique
de l’étude sur toutes les données recueillies: même les
sujets qui ont cessé de prendre le traitement ou qui en
ont changé sont analysés et continuent d’appartenir à
leur échantillon d’origine. Une analyse de ce type est
dite ‘analyse en intention de traiter’.
Exemple de comparaison ‘biaisée’: exclusion des sujets
qui cessent de prendre le traitement- mais qui en
réalité le font en cas d’inefficacité (ex: antalgique
contre douleur chronique)
Test d’égalité de deux proportions ‘vraies’
ou comparaison de deux proportions observées (1)
1. H0: ϕΑ=ϕB
H1: ϕΑ≠ϕB
Pn AA − Pn BB n A Pn AA + n B Pn BB
2. Z = ˆ
, Π=
ˆ (1 − Π
Π ˆ) Π ˆ (1 − Πˆ) nA + nB
+
nA nB
suit une loi N(0,1).
Conditions de validité à vérifier ultérieurement
(dépendent des résultats expérimentaux)
Test d’égalité de deux proportions ‘vraies’
ou comparaison de deux proportions observées (2)
3. IP0,95 (Z)= [-1,96 1,96 ]
4. Standard
Décision selon que
pA − pB n A pA + n BpB
z= , π̂ =
π̂(1 − π̂) π̂(1 − π̂) nA + nB
+
nA nB
∈ ou ∉ à IP0,95 ( Z)
conditions de validité:
n A π̂ ≥ 5, n A (1 − π̂) ≥ 5, n B π̂ ≥ 5, n B (1 − π̂) ≥ 5
5,6. Standards
Test d’égalité de deux proportions ‘vraies’
ou comparaison de deux proportions observées (3)
Nombre de sujets nécessaires pour
assurer une puissance donnée
(formule approchée)
n: taille commune de chaque échantillon
2 ϕˆ (1 − ϕˆ ) ϕA + ϕB
n = [1,96 + u 2β ]
2
, ϕˆ =
[ϕ A − ϕ B ] 2
2
conditions de validité: nϕA>5,n(1-ϕA)>5,
nϕB>5, n(1-ϕB)>5
Exemple: β=0,2; ϕA=0,2; ϕB=0,1
n>200 (par échantillon)
Test d’égalité de deux moyennes ‘vraies’
ou comparaison de deux moyennes observées. Cas des
grands échantillons (1)
1. H0: µΑ=µB
H1: µΑ≠µB
M n A A − M n BB ~
2. Z = 2 2
N (0,1)
Sn A A Sn BB
+
nA nB
suit une loi N(0,1).
Condition de validité: nA>30, nB>30
3,4,5,6. Standards
Test d’égalité de deux moyennes ‘vraies’
ou comparaison de deux moyennes observées. Cas des
grands échantillons (2)
3,4. Standards
Décision selon que:
m − mB
z = A2 ∈ ou ∉ [-1,96 1,96]
s A s 2B
+
nA nB
5,6. Standards
Test d’égalité de deux moyennes ‘vraies’
ou comparaison de deux moyennes observées. Cas des
grands échantillons (3)
Nombre de sujets nécessaires pour
détecter une différence de moyennes
Variance de la variable d’intérêt dans la population
A: σA2
Variance de la variable d’intérêt dans la population
B: σB2
n: nombre de sujets par échantillon
σ 2
+ σ 2
n = [1,96 + u 2β ]2 A B
[µ A − µ B ]2
condition de validité: n>30
Test d’égalité de deux distributions: test de
Mann-Whitney-Wilcoxon (1)
1. H0: les densités de probabilité de la
variable d’intérêt (taille des tumeurs), dans les
deux populations A et B, coïncident: fA=fB
H1:les densités diffèrent: fA≠fB
2. Construction du paramètre du test
Par convention, étiquetage de A et B de
sorte que nA≤nB
repose sur l’ordre des valeurs issues de
l’expérience -> vu sur un exemple
Test d’égalité de deux distributions: test de
Mann-Whitney-Wilcoxon (2)
Ordonner par valeurs croissantes l’ensemble des
données expérimentales
1,7 ; 6,1 ; 3,2 ; 1,5; 4,3 ; 0,5 ; 1,1 ; 2,7 ; 5,4
0,5 (B) ; 1,1 (B) ; 1,5 (A) ; 1,7 (A) ; 2,7 (B) ; 3,2 (A) ;
4,3 (B) ; 5,4(B); 6,1(A)
Calculer la somme des rangs de l’échantillon de la
population A, soit TA.
Calculer également δ = TA- nA(nA+nB+1)/2.
Puis calculer T’A :
T’A = TA - 0,5 si δ > 0
T’A = TA + 0,5 si δ < 0
Test d’égalité de deux distributions: test de
Mann-Whitney-Wilcoxon (3)
TA − n A (n A + n B + 1)/2
Lorsque nA et nB < 10 : Z=
n A n B (n A + n B + 1)/12
Z a, pour chaque couple nA,nB une distribution connue,
tabulée; on peut en construire un intervalle de pari
TA' − n A (n A + n B + 1)/2
Lorsque nA ou nB> 10 : Z =
n A n B (n A + n B + 1)/12
Z a, dans ce cas une distribution N(0,1); on peut en
construire un intervalle de pari
Test d’égalité de deux distributions: test de
Mann-Whitney-Wilcoxon (4)
3. l’intervalle de pari est du type
IP1-α = [-Mα Mα]
4. règle de décision:
Si z ∉ IP0,95, on conclut que les deux distributions
diffèrent; si z>0 ( z<0) on dira ‘la variable étudiée
est plutôt plus grande (plus petite) dans A que
dans B
Si z ∈ IP0,95, on ne conclut pas
5,6. Standards
FIN DU CHAPITRE
Test de symétrie d’une distribution: test de
Wilcoxon (1). Hors programme 2006
1. H0: la distribution de X est symétrique par
rapport à µ0 (ou X-µ0 et µ0-X ont même
distribution)
H1:elle n’est pas symétrique par rapport à µ0
2. construction du paramètre du test
repose sur l’ordre des valeurs xi-µ0 issues de
l’expérience -> vu sur un exemple
0,9
Série2
0
0 25 50 75 100
0,9
Série2
Série1
0
0 25 50 75 100
Test de symétrie d’une distribution: test de
Wilcoxon (2). Hors programme 2006
Ordonner les valeurs absolues des xi-µ0
-2,3; 4,1; 1; 5,6; -1,2
1(+) ; 1,2(-) ; 2,3(-) ; 4,1(+) ; 5,6(+)
Sommer les rangs des +, T+ (ici 1+4+5)
paramètre du test:
T + − n(n + 1)/4
Z=
n(n + 1)(2n + 1)/24
a une distribution connue
Test de symétrie d’une distribution: test de
Wilcoxon (3). Hors programme 2006
4. Règle de décision
En cas de rejet de H0, on dira:
La distribution de X n’est pas symétrique autour de µ0
Si T+>0 (T+<0): la variable X est plutôt plus grande (
plus petite) que µ0
5,6. Standards
0,9
Série1
0
0 25 50 75 100
0,9
Série2
0
0 25 50 75 100
Tests sur variables qualitatives
(sauf indépendance) (ch.13)
Comparaison d’une répartition observée à une
répartition donnée: test du χ2 d’ajustement (1)
Contexte: la variable aléatoire d’intérêt est
qualitative, à k modalités. On cherche à montrer
que la répartition de cette variable ne coïncide
pas avec une répartition donnée.
Exemples:
L’équilibre d’Hardy-Weinberg n’est pas vérifié
pour ce locus biallélique de fréquence π
La répartition de la couleur (blonds, bruns,
roux) des cheveux des habitants de la région A
n’est pas 0,4 0,3 0,3
Comparaison d’une répartition observée à une
répartition donnée: test du χ2 d’ajustement (2)
Notations:
ϕi = Pr(X=modalité i)
ϕhi: valeur supposée de ϕi sous H0
Etape1.
H0: ϕi = ϕhi , pour toutes les modalités i =
1, …., k
H1: ϕi ≠ ϕhi , pour au moins une modalité i
Remarque.
Si k=2 (2 modalités), H0 se réduit à ϕ1=ϕh1, identique
au ϕ=ϕ0 du test ‘comparaison d’une proportion à une
valeur donnée’, déjà vu.
Comparaison d’une répartition observée à une
répartition donnée: test du χ2 d’ajustement (3)
Etape 2. Une expérience portant sur n
unités statistiques est envisagée. Elle
produira des effectifs observés, notés oi.
Blonds Bruns Roux
Effectifs 25 9 3
observés
(oi)
Ces effectifs sont encore aléatoires, Oi
Comparaison d’une répartition observée à une
répartition donnée: test du χ2 d’ajustement (4)
Sous H0: O i ~ B(n, ϕ hi ) et E(Oi) = n ϕhi
Effectif attendu, noté Ai
Paramètre:
k
(Oi − A i ) ~ 2
2
Q=∑ χ (k − 1)
i =1 Ai
condition de validité: tous les Ai >5
Modalité 1 Modalité 2 Modalité 3
Effectifs
observés O1 O2 O3
dans le futur
(aléatoires)
Effectifs A1 A2 A3
théoriques
x
Distribution
donnée ϕh1 ϕh2 ϕh3
n
(taille échantillon)
Modalité 1 Modalité 2 Modalité 3
Effectifs
observés O1 O2 O3
dans le futur
(aléatoires)
Effectifs 14,8 11,1 11,1
théoriques
x
Distribution
donnée 0,4 0,3 0,3
37
(taille échantillon)
Q
Modalité 1 Modalité 2 Modalité 3
Effectifs
observés 25 9 3
réellement
Effectifs 14,8 11,1 11,1
théoriques
x
Distribution
donnée 0,4 0,3 0,3
37
(taille échantillon)
Qc =13,3
Comparaison d’une répartition observée à une
répartition donnée: test du χ2 d’ajustement (5)
Etape 3. IP0,95 (Q). Rejet de H0 si Q trop grand ->
0,03
0,025 chi2 à 8ddl
0,02
0,015 α
0,01 K8;α
0,005
0
0 2 4 6 8 10 12 14 16 18 20
IP0,95(Q) = [ 0 Kk-1;0,05 ]
Comparaison d’une répartition observée à une
répartition donnée: test du χ2 d’ajustement (6)
4,5,6. Standards.
Ici Qc = 13,3 > K2;0,05 = 5,991.
On rejette donc H0. La variable n’a pas la
distribution donnée
Remarque. Si k=2 (variable à deux modalités):
Q=(paramètre du test d’égalité d’une proportion à une
valeur donnée)2
K1;0,05=u0,052=3,84
Le présent test est équivalent au test d’égalité d’une
proportion à une valeur donnée, qu’il généralise
Comparaison de deux (ou plusieurs) répartitions
observées: test du χ2 d’homogénéité (1)
Contexte. La variable aléatoire d’intérêt est
qualitative à k modalités. On veut montrer que cette
variable n’a pas la même distribution dans deux (ou
plusieurs) populations.
Exemples
Les répartitions génotypiques en un locus biallélique ne sont
pas identiques dans les populations 1 et 2
Les répartitions de la couleur des cheveux des habitants des
régions 1 et 2 diffèrent
Les répartitions typologiques des cancers présentés par les
souris traitées et non traitées diffèrent
Comparaison de deux (ou plusieurs) répartitions
observées: test du χ2 d’homogénéité (2)
Notations:
ϕ1i = Pr(X=modalité i dans la population 1)
ϕ2i = Pr(X=modalité i dans la population 2)
Etape1.
H0: ϕ1i = ϕ2i , pour toutes les modalités i =
1, …., k
H1: ϕ1i ≠ ϕ2i , pour au moins une modalité i
Remarque.
Si k=2 (2 modalités), H0 se réduit à ϕ11=ϕ21, identique
au ϕΑ=ϕB du test ‘comparaison de deux proportions’,
déjà vu.
Comparaison de deux (ou plusieurs) répartitions
observées: test du χ2 d’homogénéité (3)
Etape 2. Une expérience portant sur n1 (n2) unités statistiques
de la population 1 (de la population 2) est envisagée. Elle
produira des effectifs observés, notés o1i (o2i).
Blonds Bruns Roux
Effectifs 25 9 3
observés (o1i)
Effectifs 13 17 10
observés (o2i)
Tableau appelé TABLEAU DE CONTINGENCE
Ces effectifs sont encore aléatoires, O1i et O2i.
Modalité 1 Modalité 2 Modalité 3 Total
Effectifs observés
(aléatoires) O11 O12 O13 n1
Echantillon 1
Effectifs observés
(aléatoires) O21 O22 O23 n2
Echantillon 2
Mélange
O11+O21 O12+O22 O13+O23 n1+ n2
Répartition
« donnée » O11+O21 O12+O22 O13+O23
n1+ n2 n1+ n2 n1+ n2
pchapeau 1 pchapeau 2 pchapeau 3
Modalité 1 Modalité 2 Modalité 3 Total
Effectifs observés
(aléatoires) O11 O12 O13 n1
Echantillon 1 x
Effectifs observés
(aléatoires) O21 O22 A22 O23 n2
Echantillon 2
Mélange
O11+O21 O12+O22 O13+O23 n1+ n2
Répartition
« donnée » O11+O21 O12+O22 O13+O23
n1+ n2 n1+ n2 n1+ n2
pchapeau 1 pchapeau 2 pchapeau 3
Comparaison de deux (ou plusieurs) répartitions
observées: test du χ2 d’homogénéité (4)
Etape 2 (suite). Paramètre:
k
(O1i − A1i ) 2 k (O 2i − A 2i ) 2
Q=∑ +∑
i =1 A1i i =1 A 2i
nombre de cases du tableau (O j − A j ) 2
De façon générale: Q = ∑
j=1 Aj
si m distributions sont à comparer, le tableau
comporte m x k cases
Sous H0, Q ~ χ ((k − 1)x(m − 1))
2
Conditions de validité à vérifier plus loin:
tous les aj > 5
Réalisation de Aj
Modalité 1 Modalité 2 Modalité 3 Total
Effectifs observés
(aléatoires) 25 9 3 37
Echantillon 1 x
Effectifs observés
(aléatoires) 13 17 13,6 10 40
Echantillon 2
Mélange
38 26 13 77
Répartition
« donnée » 0,49 0,34 0,17
Comparaison de deux (ou plusieurs) répartitions
observées: test du χ2 d’homogénéité (5)
Etapes 3,4,5,6. Standards. Exemple:
En cas de rejet de H0: ‘ les 2 (ou m) répartitions
‘vraies’ diffèrent entre elles’ ou ‘les répartitions
observées diffèrent significativement’
Remarque. Si k=2 et m=2 (variable à deux
modalités, deux populations):
Q=(paramètre du test d’égalité entre deux proportions)2
K1;0,05=u0,052=3,84
Le présent test est équivalent au test d’égalité entre deux
proportions, qu’il généralise