LOGIQUE ET THÉORIE DES
ENSEMBLES
Antoine Chambert-Loir
Antoine Chambert-Loir
Université Paris Cité.
E-mail : [Link]-Loir@[Link]
Version du 1er octobre 2025, 21h59
La version la plus récente de ce texte devrait être accessible en ligne, à
l’adresse http:// [Link]/ ~[Link]-loir/ enseignement/
2025-26/ logique/ [Link]
©2025, Antoine Chambert-Loir 〈[Link]-loir@[Link]〉
TABLE DES MATIÈRES
Préface . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . v
1. Propositions et valeurs de vérité — Calculer . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 1
1.1. Le calcul booléen . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 1
1.2. Formules propositionnelles . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 5
1.3. Conséquences logiques, tautologies . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 13
1.4. Démonstrations . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 16
2. Ensembles et nombres entiers — Compter . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 21
2.1. Ensembles et classes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 21
2.2. Graphes et fonctions . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 28
2.3. Axiome de l’infini. Nombres entiers ensembles finis. . . . . . . . . . . . . . . . . . . . . . . . 30
2.4. Axiome du choix . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 38
2.5. Ensembles dénombrables . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 40
3. Arithmétiques transfinies — Ordonner . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 45
3.1. Ensembles ordonnés . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 45
3.2. Ensembles bien ordonnés . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 47
3.3. Ordinaux . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 56
3.4. Arithmétique des ordinaux . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 60
3.5. Cardinaux infinis . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 66
3.6. Arithmétique des cardinaux . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 67
3.7. Cofinalité . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 73
3.8. Axiome de fondation . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 78
4. Langages du premier ordre — Parler . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 79
4.1. Alphabets, mots, langages . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 79
4.2. Termes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 81
4.3. Formules . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 87
4.4. Variables libres, variables liées, substitution . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 91
5. Réalisations, modèles — Interpréter . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 93
5.1. Structures . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 93
5.2. Équivalence sémantique . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 99
iv TABLE DES MATIÈRES
5.3. Morphismes de structures . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 101
5.4. Extension de langages . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 104
5.5. Théories, modèles . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 105
5.6. Extensions élémentaires, théorème de Löwenheim–Skolem . . . . . . . . . . . . . . . . 106
5.7. Filtres et ultrafiltres . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 109
5.8. Ultraproduits, théorème de Łos . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 113
5.9. Théorème de compacité et théorème de Tarski . . . . . . . . . . . . . . . . . . . . . . . . . . . . 118
6. Théorie de la démonstration — Raisonner . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 123
6.1. Démonstrations formelles . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 124
6.2. Démonstration et satisfaction . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 128
6.3. Théories cohérentes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 131
6.4. Théories henkiniennes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 134
6.5. Le théorème de complétude de Gödel . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 139
Bibliographie . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 143
Index . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 145
PRÉFACE
La logique mathématique est la branche des mathématiques qui s’inté-
resse tout particulièrement aux fondements de l’activité mathématique.
Un premier aspect de cette étude a trait au raisonnement mathématique.
On y analyse les formules que l’on écrit, la façon de les interpréter et,
éventuellement, de leur donner une valeur de vérité, que ce soit par le
calcul ou par la démonstration. La discipline recoupe ici la philosophie et
la linguistique.
Un second aspect de cette étude, la théorie des modèles, considère les
théories mathématiques elles-mêmes comme un objet d’étude mathéma-
tique en soi. Souvent liée à des théories particulières comme la théorie
des groupes, l’algèbre linéaire, la théorie des corps. . ., elle vise à extraire
des motifs communs de ces développements souvent disjoints, par l’intro-
duction de concepts originaux, que le caractère élémentaire de ce cours
ne nous permettra cependant à peine d’aborder.
Le dernier aspect de cette étude est lié à une théorie mathématique
spécifique, la théorie des ensembles, en tant qu’elle a servi, en particu-
lier par les travaux de G. Cantor et E. Zermelo à la fin du xixesiècle
et au début du xxesiècle, de base à l’édification de l’ensemble des struc-
tures mathématiques modernes. D’autres approches possibles, comme la
théorie des types ou celle des catégories, mais force est de constater que
la théorie des ensembles est le langage commun de la plus grande par-
tie des mathématiques contemporaines. Cette théorie a également sus-
cité un certain nombre de questions mathématiques emblématiques (pour
ne citer qu’elles, l’indépendance de l’axiome du choix et l’hypothèse du
continu) qui ont motivé le développement de la logique mathématique au
vi PRÉFACE
textscxxesiècle. Elle lui offre enfin des outils fondamentaux pour le déve-
loppement des mathématiques, par exemple le « lemme de Zorn ».
Comme l’expliquent Cori et Lascar dans l’introduction de leur ou-
vrage (Cori et Lascar, 2003a ; Cori et Lascar, 2003b), la logique mathé-
matique utilise non seulement le raisonnement mathématique, mais aussi
tout l’attirail développé au cours des siècles, tant en algèbre qu’en topo-
logie. Cette mise en abîme en inquiète certains, en indiffère beaucoup, et
attise la curiosité d’autres. Si ce cours s’adresse par nature à ces derniers,
j’espère qu’il rassurera les premiers et suscitera quelque intérêt chez les
seconds.
CHAPITRE 1
PROPOSITIONS ET VALEURS DE VÉRITÉ —
CALCULER
« Oui, vous y gagnerez. J’ai fait un petit calcul en moi-même. . . »
— Molière, Les fourberies de Scapin, acte ii, scène 5
1.1. Le calcul booléen
Commençons cette excursion dans la logique mathématique en pré-
sentant l’interprétation mathématique de la logique d’Aristote (384–322
av. J.-C.) que permet le calcul booléen, du nom de son inventeur George
Boole (1815–1864).
On raisonne avec les deux valeurs de vérité, vrai/faux, que l’on peut
aussi noter V/F, 1/0, ⊤/⊥. . . Nous adopterons plutôt la notation 1/0.
Ces valeurs de vérité peuvent être combinées et transformées par di-
verses opérations logiques, et, ou, négation, implication. . ., qui sont consi-
dérées comme des opérations arithmétiques dont le résultat est synthétisé
par des tables de vérité, tout à fait analogues aux tables de multiplication
de l’école élémentaire.
L’opération de négation, notée ¬, échange les deux valeurs de vérité :
¬0 = 1 et ¬1 = 0.
Les autres opérations combinent deux valeurs de vérité — on dit qu’elles
sont binaires — et nous les noterons de manière analogue aux opérations
arithmétiques classiques, en plaçant le symbole adéquat entre les deux
valeurs de vérité qu’elles transforment.
2 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
L’opération et est notée ∧ ; si 𝑥 et 𝑦 sont deux valeurs de vérité, alors
𝑥 ∧𝑦 vaut 1 lorsque 𝑥 et 𝑦 sont toutes deux égales à 1. Plus généralement, si
Ó
(𝑥𝑖 )𝑖∈I est une famille (finie) de valeurs de vérités, on définit 𝑖∈I 𝑥𝑖 comme
valant 1 si et seulement si chacune des 𝑥𝑖 vaut 1 ; c’est en particulier le cas
si I = ∅.
L’opération ou est notée ∨ ; si 𝑥 et 𝑦 sont deux valeurs de vérité, alors
𝑥 ∨ 𝑦 vaut 1 lorsque l’une au moins de 𝑥 et de 𝑦 sont égales à 1. Plus
généralement, si (𝑥𝑖 )𝑖∈I est une famille (finie) de valeurs de vérités, on
Ó
définit 𝑖∈I 𝑥𝑖 comme valant 1 si et seulement si au moins l’une des 𝑥𝑖
Ó
vaut 1 ; en particulier, lorsque I = ∅, on a 𝑖∈I 𝑥𝑖 = 0.
L’opération d’implication, notée →, est définie de sorte que 𝑥 → 𝑦
vaut 0 si et seulement si 𝑥 = 1 et 𝑦 = 0.
L’opération d’équivalence, notée ↔, est définie de sorte que 𝑥 ↔ 𝑦
vaut 1 si et seulement si les valeurs 𝑥 et 𝑦 sont égales.
Exercice (1.1.1). — Soit 𝑥, 𝑦, 𝑧 des valeurs de vérité. Vérifier les relations
suivantes :
a) ¬(¬𝑥) = 𝑥 ;
b) ¬(𝑥 ∨ 𝑦) = (¬𝑥) ∧ (¬𝑦) ;
c) ¬(𝑥 ∧ 𝑦) = (¬𝑥) ∨ (¬𝑦) ;
d) 𝑥 → 𝑦 = (¬𝑥) ∨ 𝑦 ;
e) 𝑥 ↔ 𝑦 = (𝑥 → 𝑦) ∧ (𝑦 → 𝑥).
f ) (𝑥 ∧ 𝑦) → 𝑧 = 𝑥 → (𝑦 → 𝑧) ;
g) 𝑥 ∧ (𝑦 ∨ 𝑧) = (𝑥 ∧ 𝑦) ∨ (𝑥 ∧ 𝑧) ;
h) 𝑥 ∨ (𝑦 ∧ 𝑧) = (𝑥 ∨ 𝑦) ∧ (𝑥 ∨ 𝑧).
Exercice (1.1.2). — a) Montrer que les opérations ∧ et ∨ sont commu-
tatives et associatives. Vérifier qu’alors la conjonction et la disjonction
d’une famille finie de valeurs de vérité coïncide avec leur définition par
récurrence.
b) Les autres opérations logiques introduites sont-elles commutatives ?
associatives ?
1.1. LE CALCUL BOOLÉEN 3
Exercice (1.1.3). — On interprète les valeurs de vérité 0 et 1 comme les
deux éléments correspondants de l’anneau Z/2Z.
a) Déterminer les opérations logiques introduites en termes de l’addi-
tion et de la multiplication de Z/2Z.
b) Interpréter les formules algébriques 𝑥 2 = 𝑥 et 𝑥 (1 − 𝑥) = 0, pour
𝑥 ∈ Z/2Z.
Exercice (1.1.4). — Soit 𝑥, 𝑦, 𝑧 des valeurs de vérité. Démontrer que les
formules logiques suivantes sont identiquement égales à 1 (on dit que ce
sont des tautologies) :
a) 𝑥 ∨ (¬𝑥) ;
b) 𝑥 → 𝑥 ;
c) ((𝑥 → 𝑦) → 𝑥) → 𝑥 ;
d) (𝑥 → 𝑦) ∧ (𝑦 → 𝑧) → (𝑥 → 𝑧).
Exercice (1.1.5). — L’opération ou exclusif, notée ⊕, est définie de sorte
que 𝑥 ⊕ 𝑦 vaut 1 lorsque exactement l’une de 𝑥 et de 𝑦 est égale à 1. Dé-
montrer que 𝑥 ⊕ 𝑦 = (𝑥 ∧ ¬𝑦) ∧ (𝑦 ∧ ¬𝑥).
Proposition (1.1.6). — Toute fonction de {0, 1}𝑛 dans {0, 1} peut être ex-
primée à l’aide des opérations ∨, ∧ et ¬ uniquement.
Démonstration. — Notons 𝜃 1 : {0, 1} → {0, 1} la fonction identique et
𝜃 0 : {0, 1} → {0, 1} la fonction ¬. Par construction, pour 𝑎, 𝑥 ∈ {0, 1},
on a 𝜃 𝑎 (𝑥) = 1 si et seulement si 𝑥 = 𝑎.
On commence par traiter le cas particulier d’une fonction qui ne prend
qu’une fois exactement la valeur 1. Soit 𝑎 ∈ {0, 1}𝑛 et soit 𝛿𝑎 : {0, 1}𝑛 →
{0, 1} la fonction telle que 𝛿𝑎 (𝑎) = 1 et 𝛿𝑎 (𝑥) = 0 pour 𝑥 ≠ 𝑎. Remarquons
que l’on a
𝛿𝑎 (𝑥) = 𝜃 𝑎1 (𝑥 1 ) ∧ · · · ∧ 𝜃 𝑎𝑛 (𝑥𝑛 ).
En effet, pour tout 𝑖 ∈ ⟦1, 𝑛⟧, on a 𝜃 𝑎𝑖 (𝑥𝑖 ) = 1 si et seulement si 𝑥𝑖 = 𝑎𝑖 . Par
suite, 𝛿𝑎 (𝑥) = 1 si et seulement si 𝑥𝑖 = 𝑎𝑖 pour tout 𝑖 ∈ ⟦1, 𝑛⟧, c’est-à-dire
si et seulement si 𝑥 = 𝑎.
4 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
Traitons maintenant le cas général. Soit A = 𝑓 −1 (1) l’ensemble des 𝑎 ∈
{0, 1}𝑛 tels que 𝑓 (𝑎) = 1. Observons que l’on a
Ü
𝑓 (𝑥) = 𝛿𝑎 (𝑥)
𝑎∈A
pour tout 𝑥 ∈ {0, 1}𝑛 , puisque le membre de gauche vaut 1 lorsque 𝑥 ∈ A,
et celui de droite lorsqu’il existe 𝑎 ∈ A tel que 𝑥 = 𝑎. D’après la première
partie, les fonctions 𝛿𝑎 s’expriment uniquement en termes de ∧ et ¬. Nous
avons donc exprimé la fonction 𝑓 en termes des opérations ∨, ∧ et ¬, ainsi
qu’il fallait démontrer. □
Corollaire (1.1.7). — a) Toute fonction de {0, 1}𝑛 dans {0, 1} peut être
exprimée à l’aide des opérations ∨ et ¬ uniquement.
b) Toute fonction de {0, 1}𝑛 dans {0, 1} peut être exprimée à l’aide des
opérations ∧ et ¬ uniquement.
Démonstration. — En effet, la relation 𝑥 ∧ 𝑦 = ¬(¬𝑥 ∨ ¬𝑦) permet d’éli-
miner les utilisations de l’opération ∧. De même, la relation 𝑥 ∨ 𝑦 =
¬(¬𝑥 ∧ ¬𝑦) permet d’éliminer les utilisations de l’opération ∨. □
Exercice (1.1.8). — Les opérations ∧ et ∨ ne permettent pas d’exprimer
toute fonction de {0, 1}𝑛 dans {0, 1}. Vérifier en effet qu’une telle fonction
serait croissante.
Exercice (1.1.9). — a) L’opération de Sheffer, notée ↑, est définie de sorte
que 𝑥 ↑ 𝑦 vaut 1 lorsque l’une au moins de 𝑥 ou 𝑦 vaut 0. Démontrer que
𝑥 ↑ 𝑦 = ¬(𝑥 ∧ 𝑦).
b) Inversement, démontrer que ¬𝑥 = 𝑥 ↑ 𝑥, 𝑥 ∧ 𝑦 = (𝑥 ↑ 𝑦) ↑ (𝑥 ↑ 𝑦) et
𝑥 ∨ 𝑦 = (𝑥 ↑ 𝑥) ↑ (𝑦 ↑ 𝑦).
c) Démontrer que toute fonction de {0, 1}𝑛 dans {0, 1} peut être expri-
mée à l’aide de l’opération de Sheffer uniquement.
1.2. FORMULES PROPOSITIONNELLES 5
1.2. Formules propositionnelles
Dans le paragraphe précédent, nous avons introduit les opérations lo-
giques et écrit des formules qui les mettent en jeu de façon naturelle. Nous
voulons ici préciser ce qu’est une telle formule, et en particulier, expli-
quer le fait expérimental que leur interprétation n’a donné lieu à aucune
ambiguïté. De fait, les formules que nous avions écrites utilisaient des
parenthèses qui rendaient explicites les arguments sur lesquels portaient
les opérations logiques. D’ailleurs, un tel système de parenthèses est né-
cessaire, comme l’indiquent les deux expressions (¬𝑥) ∨ 𝑦 et ¬(𝑥 ∨ 𝑦),
visiblement non équivalentes puisque lorsque 𝑦 = 1, la première vaut 1 et
la seconde 0.
Plusieurs systèmes sont possibles. Celui utilisé par Cori et Lascar
(2003a) met en jeu des parenthèses d’une façon un peu différente du
précédent, en écrivant (A ∨ B) pour désigner la disjonction de deux
formules A et B, et de même pour la conjonction, l’implication. . . Une
variante permet de s’abstenir de certaines parenthèses moyennant l’in-
troduction de règles de priorité, analogues à celles qui interprètent 3+4×5
comme 3 + 20 = 23 et non comme 7 × 5 = 35.
Un autre système, dit polonais, a été introduit par Jan Łukasiewicz
(1878–1956) en 1924 et permet de s’abstenir de toute parenthèse ! Il
consiste à écrire d’abord l’opération, puis les formules sur lesquelles elle
opère. Ainsi, la disjonction de deux formules A et B s’écrit ∨AB. Les deux
formules précédentes s’écrivent alors ∨¬𝑥𝑦 et ¬∨𝑥𝑦.
Un troisième système, plus conceptuel, accepte le fait qu’une formule
n’est pas un texte, écrit linéairement, mais plutôt un arbre orienté et éti-
queté qui décrit son évaluation. Dans cette représentation, la disjonction
de deux formules A et B est l’arbre dont la racine est marquée du sym-
bole ∨, et les deux branches sont données par les arbres correspondant aux
formules A et B. Les formules qui nous servent d’exemple correspondent
alors aux deux arbres de la figure 1.2.1.
Dans ce cours, nous faisons le choix un peu paradoxal d’utiliser le sys-
tème polonais lorsque nous raisonnons sur les formules, tout en conti-
nuant à les écrire de façon usuelle.
6 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
𝑥 𝑥 𝑦
¬ 𝑦 ∨
∨ ¬
Figure 1.2.1. Les deux arbres correspondant aux formules (¬𝑥) ∨ 𝑦 et
¬(𝑥 ∨ 𝑦)
On introduit un ensemble V de symboles dits, de variables. Typique-
ment, ce sera un ensemble du type {𝑥, 𝑦, 𝑧} (s’il y a trois variables), du
type {𝑥 1, 𝑥 2, . . . , 𝑥𝑛 } (si l’y a 𝑛 variables), voire du type {𝑥 1, . . . , 𝑥𝑛 , . . . } si
l’y en a une infinité. Pour simplifier la compréhension, si 𝑣 est un élément
de V, on écrira plutôt 𝑥𝑣 pour la variable correspondante.
On demande que cet ensemble de symboles soit disjoint de l’ensemble
L = {0, 1, ∨, ∧, ¬, →, ↔, . . . } des symboles correspondant aux valeurs de
vérité 0 et 1 et aux opérations logiques.
La réunion A = V ∪ L de ces ensembles V et L est l’alphabet ; une suite
finie (éventuellement vide) d’éléments de V ∪ L est appelée un mot. Si
𝛼 = (𝑎 1, . . . , 𝑎𝑚 ) est un tel mot, on dit qu’il est de longueur 𝑚, et on la
note note ℓ (𝛼). Le mot vide est de longueur 0 ; on le note 𝜀. Les éléments
de A définissent des mots de longueur 1.
Si 𝛼 = (𝑎 1, . . . , 𝑎𝑚 ) et 𝛽 = (𝑏 1, . . . , 𝑏𝑛 ) sont deux mots, on note 𝛼𝛽 le
mot concaténé (𝑎 1, . . . , 𝑎𝑚 , 𝑏 1, . . . , 𝑏𝑛 ) ; il est de longueur ℓ (𝛼𝛽) = 𝑚 + 𝑛.
L’opération (𝛼, 𝛽) ↦→ 𝛼𝛽 dans l’ensemble A∗ des mots sur l’alphabet A est
associative. Le mot vide est un élément neutre. Par ailleurs, tout mot est
simplifiable à droite et à gauche. En identifiant un élément de A au mot
de longueur 1 correspondant, on a (𝑎 1, . . . , 𝑎𝑚 ) = 𝑎 1 . . . 𝑎𝑚 , et on préfèrera
cette notation.
Si 𝛼 = 𝑎 1 . . . 𝑎𝑚 est un mot, les mots de la forme 𝑎 1 . . . 𝑎𝑘 , pour 𝑘 ⩽ 𝑚,
sont appelés les préfixes, ou segments initiaux, de 𝛼 ; ceux de la forme
𝑎𝑘 . . . 𝑎𝑚 sont appelés les suffixes, ou segments terminaux, de 𝛼. Dire que
𝛼 ′ est un préfixe de 𝛼 signifie qu’il existe un mot 𝛼 ′′ tel que 𝛼 = 𝛼 ′𝛼 ′′.
1.2. FORMULES PROPOSITIONNELLES 7
Définition (1.2.1). — On définit par récurrence les formules proposition-
nelles à variables dans V :
a) Le mot 0 est une formule propositionnelle ;
b) Le mot 1 est une formule propositionnelle ;
c) Pour tout 𝑣 ∈ V, le mot 𝑥𝑣 est une formule propositionnelle ;
d) Pour toute formule propositionnelle 𝛼, le mot ¬𝛼 est une formule pro-
positionnelle ;
e) Si 𝛼 et 𝛽 sont des formules propositionnelles, les mots ∨𝛼𝛽, ∧𝛼𝛽, →𝛼𝛽,
↔𝛼𝛽 sont des formules propositionnelles.
Pour être plus précis, on dit qu’un ensemble de mots est admissible s’il
contient les mots 0, 1, 𝑥𝑣 pour tout 𝑣 ∈ V, le mot ¬𝛼 pour tout mot 𝛼 qu’il
contient, ainsi que les mots ∨𝛼𝛽,. . ., pour tous mots 𝛼 et 𝛽 qu’il contient.
L’ensemble FV des formules propositionnelles à variables dans V est le
plus petit ensemble de mots qui est admissible : c’est l’intersection de tous
les ensembles de mots qui sont admissibles.
Donnons un exemple en montrant comment démontrer qu’une formule
n’est jamais le mot vide. Considérons en effet l’ensemble F des formules
qui ne sont pas le mot vide : cet ensemble F vérifie les propriétés précé-
dentes, donc est égal à FV , ce qui signifie que le mot vide 𝜀 n’appartient
pas à FV .
Cette définition fournit un moyen d’établir une propriété des formules
propositionnelles par récurrence sur leur définition : il suffit de démontrer
que cette propriété vaut pour les formules 0 et 1, pour les formules 𝑥𝑣 pour
𝑣 ∈ V, et que si elle vaut pour des formules 𝛼 et 𝛽, elle vaut également
pour les formules ¬𝛼, ∨𝛼𝛽, etc.
Théorème (1.2.2). — Soit 𝛼 une formule propositionnelle. Alors une et une
seule des assertions suivantes est vérifiée :
a) On a 𝛼 = 0 ;
b) On a 𝛼 = 1 ;
c) Il existe 𝑣 ∈ V tel que 𝛼 = 𝑥𝑣 ;
d) Il existe une formule propositionnelle 𝛽 telle que 𝛼 = ¬𝛽 ;
e) Il existe des formule propositionnelle 𝛽 et 𝛾 telles que 𝛼 = ∨𝛽𝛾 ;
8 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
f) Il existe des formule propositionnelle 𝛽 et 𝛾 telles que 𝛼 = ∧𝛽𝛾 ;
g) Il existe des formule propositionnelle 𝛽 et 𝛾 telles que 𝛼 = →𝛽𝛾 ;
h) Il existe des formule propositionnelle 𝛽 et 𝛾 telles que 𝛼 = ↔𝛽𝛾.
De plus, dans chacun des cas c) à h), le symbole 𝑣, la formule 𝛽, les formules 𝛽
et 𝛾 sont uniquement déterminées.
La partie existence de l’énoncé du théorème 1.2.2 est banale et découle
directement de la définition des formules propositionnelles. Ce sont les
énoncés d’unicité qui en font l’importance en ce qu’ils assurent que la
lecture des formules ne donne lieu à aucune ambiguïté.
La démonstration du théorème 1.2.2 utilise un critère numérique qui
permet de décider si un mot est, ou non, une formule propositionnelle.
Le poids d’un symbole de l’alphabet V ∪ L est défini par 𝑝 (0) = 𝑝 (1) =
−1, 𝑝 (𝑥𝑣 ) = −1 pour tout 𝑣 ∈ V, 𝑝 (¬) = 0 et 𝑝 (∨) = 𝑝 (∧) = 𝑝 (→) =
𝑝 (↔) = 1. On remarquera que le poids d’un symbole est simplement un
de moins que le nombre d’arguments qu’il exige pour faire sens. Le poids
d’un mot 𝛼 = (𝑎 1, . . . , 𝑎𝑚 ) est la somme 𝑝 (𝛼) = 𝑝 (𝑎 1 ) + · · · + 𝑝 (𝑎𝑚 ) des
poids de ses symboles.
Proposition (1.2.3). — Soit 𝛼 un mot dans l’alphabet V ∪ L. Pour que 𝛼
soit une formule propositionnelle, il faut et il suffit que les deux propriétés
suivantes soient satisfaites :
(i) On a 𝑝 (𝛼) = −1 ;
(ii) Pour tout préfixe 𝛼 ′ de 𝛼 tel que 𝛼 ′ ≠ 𝛼, on a 𝑝 (𝛼 ′) ⩾ 0.
Démonstration. — Démontrons d’abord que ces propriétés soient satis-
faites par toute formule propositionnelle ; raisonnons par récurrence sur
leur définition.
Par définition du poids, on a 𝑝 (0) = 𝑝 (1) = −1, de même que 𝑝 (𝑥𝑣 ) = −1
pour tout 𝑣 ∈ V. Comme ces mots sont de longueur 1, leur seul préfixe
strict est le mot vide, qui est de poids 0, ce qui démontre les propriétés (i)
et (ii) pour ces formules.
Soit 𝛼 une formule propositionnelle qui vérifie les propriétés (i) et (ii) et
démontrons qu’il en est de même de la formule ¬𝛼. Son poids est 0+𝑝 (𝛼) =
−1. Comme une formule propositionnelle n’est pas le mot vide, les préfixes
1.2. FORMULES PROPOSITIONNELLES 9
stricts de ¬𝛼 sont le mot vide et les mots de la forme ¬𝛼 ′ où 𝛼 ′ est un
préfixe strict de 𝛼. Le poids du mot vide est égal à 0, celui d’un mot du
type ¬𝛼 ′ est égal à 0 + 𝑝 (𝛼 ′) ⩾ 0, donc est positif ou nul.
Soit 𝛼 et 𝛽 des formules propositionnelles qui vérifient les propriétés (i)
et (ii) et démontrons qu’il en est de même des formules ∨𝛼𝛽, ∧𝛼𝛽, etc.
L’argument est identique pour chacune des opérations logiques, donc on
se contente de traiter le cas de ∨. Le poids de ∨𝛼𝛽 est égal à 1 + 𝑝 (𝛼) +
𝑝 (𝛽) = −1. Par ailleurs, les préfixes stricts du mot ∨𝛼𝛽 sont le mot vide,
les mots du type ∨𝛼 ′ où 𝛼 ′ est un préfixe strict du mot 𝛼, et les mots du
type ∨𝛼𝛽 ′ où 𝛽 ′ est un préfixe strict du mot 𝛽. Le poids du mot vide est
égal à 0, celui des mots du type ∨𝛼 ′ est égal à 1 + 𝑝 (𝛼 ′) ⩾ 1 ⩾ 0, celui des
mots du type ∨𝛼𝛽 ′ est égal à 1 + 𝑝 (𝛼) + 𝑝 (𝛽 ′) ⩾ 0.
Nous avons démontré que les formules propositionnelles vérifient
les propriétés (i) et (ii) de la proposition. Établissons maintenant la
réciproque.
On raisonne toujours par récurrence, mais maintenant sur la longueur
du mot considéré. Soit 𝑛 un entier naturel ; on suppose que tout mot de
longueur < 𝑛 qui vérifie les propriétés (i) et (ii) est une formule proposi-
tionnelle et on considère un mot 𝛼 = 𝑎 1 . . . 𝑎𝑛 de longueur 𝑛 qui vérifie ces
propriétés ; il s’agit de démontrer que 𝛼 est une formule propositionnelle.
Comme 𝑝 (𝜀) = 0 et 𝑝 (𝛼) = −1, le mot 𝛼 n’est pas le mot vide. On a
donc 𝑛 ⩾ 1, ce qui permet de considérer le premier symbole 𝑎 1 de 𝛼s et
de raisonner suivant chaque cas.
Supposons 𝑎 1 = 0 et écrivons 𝛼 = 0𝛼 ′, où 𝛼 ′ est un mot de longueur 𝑛−1.
Si 𝛼 ′ n’est pas le mot vide, le mot 𝑎 1 est un préfixe strict de 𝛼 ; l’hypo-
thèse (ii) entraîne alors −1 = 𝑝 (0) ⩾ 0, ce qui est absurde. Ainsi, 𝛼 ′ est
le mot vide et 𝛼 = 0. Cela démontre que toute formule propositionnelle
dont le premier symbole est 0 est réduite au mot 0.
L’argument est similaire lorsque 𝑎 1 = 1 ou 𝑎 1 est du type 𝑥𝑣 , pour 𝑣 ∈ V.
Supposons maintenant que 𝑎 1 = ¬ et écrivons de nouveau 𝛼 = ¬𝛽, où 𝛽
est un mot de longueur 𝑛 − 1 ; il s’agit de démontrer que 𝛽 est une formule
propositionnelle. Par récurrence, il suffit de démontrer que 𝛽 vérifie les
propriétés (i) et (ii). Puisque 𝑝 (¬) = 0, on a 𝑝 (𝛽) = 𝑝 (¬𝛽) − 𝑝 (¬) = −1.
10 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
Par ailleurs, si 𝛽 ′ est un préfixe strict de 𝛽, alors ¬𝛽 ′ est un préfixe strict
de 𝛼 et l’on a donc 𝑝 (𝛽 ′) = 𝑝 (¬𝛽 ′) ⩾ 0. Cela prouve l’assertion dans ce
cas. La formule 𝛽 est uniquement déterminée par 𝛼 puisque c’est le mot
obtenu à partir de 𝛼 par suppression du premier symbole.
Supposons maintenant que 𝑎 1 est l’un des symboles ∨, ∧, etc., et écri-
vons 𝛼 = 𝑎 1𝛼 ′, où 𝛼 ′ est un mot de longueur 𝑛 − 1. Puisque 𝑛 ⩾ 1 et
𝑝 (𝑎 1 ) + · · · +𝑝 (𝑎𝑛 ) = −1, il existe un plus petit entier naturel 𝑚 ⩽ 𝑛 tel que
𝑚 ⩾ 1 et 𝑝 (𝑎 1 ) + · · · + 𝑝 (𝑎𝑚 ) ⩽ 0. Puisque 𝑝 (𝑎 1 ) = 1, on a 𝑚 ⩾ 2 ; posons
𝛽 = 𝑎 2 . . . 𝑎𝑚 et 𝛾 = 𝑎𝑚+1 . . . 𝑎𝑛 , de sorte que 𝛼 = 𝑎 1 𝛽𝛾. Les mots 𝛽 et 𝛾
sont de longueurs < 𝑛 ; nous allons démontrer que ce sont des formules
propositionnelles en établissant qu’ils vérifient les propriétés (i) et (ii).
Par minimalité de 𝑚, on a 𝑝 (𝑎 1 ) +· · ·+𝑝 (𝑎𝑚−1 ) ⩾ 1 ; comme 𝑝 (𝑎𝑚 ) ⩾ −1,
il en résulte que 𝑝 (𝑎 1 ) + · · · + 𝑝 (𝑎𝑚 ) ⩾ 0. Ainsi, 𝑝 (𝑎 1 ) + · · · + 𝑝 (𝑎𝑚 ) = 0
et 𝑝 (𝛽) = −1. Comme −1 = 𝑝 (𝛼) = 1 + 𝑝 (𝛽) + 𝑝 (𝛾), on en déduit que
𝑝 (𝛾) = −1. En particulier, 𝛽 et 𝛾 ne sont pas égaux au mot vide. Soit 𝛽 ′
un préfixe strict de 𝛽 ; il s’écrit 𝑎 2 . . . 𝑎𝑘 , où 𝑘 < 𝑚 ; par minimalité de 𝑚,
on a 𝑝 (𝑎 1 ) + · · · + 𝑝 (𝑎𝑘 ) ⩾ 1, c’est-à-dire 𝑝 (𝑎 1 ) + 𝑝 (𝛽 ′) ⩾ 1. Comme
𝑝 (𝑎 1 ) = 1, on en déduit 𝑝 (𝛽 ′) ⩾ 0. Cela démontre que 𝛽 est une formule
propositionnelle. Soit maintenant 𝛾 ′ un préfixe strict de 𝛾 ; alors 𝑎 1 𝛽𝛾 ′ est
un préfixe strict de 𝛼, si bien que 𝑝 (𝑎 1 𝛽𝛾 ′) ⩾ 0. Puisque 𝑝 (𝑎 1 ) = 1 et
𝑝 (𝛽) = −1, on en déduit que 𝑝 (𝛾 ′) ⩾ 0. Cela prouve que 𝛾 est une formule
propositionnelle. □
Corollaire (1.2.4). — Si 𝛼 est une formule propositionnelle, aucun préfixe
strict de 𝛼 ne l’est.
Démonstration. — En effet, une formule propositionnelle est de poids −1
tandis qu’un préfixe strict d’une formule propositionnelle est de poids au
moins 0. □
Démonstration du théorème 1.2.2. — Comme dit avant, la partie existence
est évidente compte tenu de la définition des formules propositionnelles ;
il s’agit d’établir les différentes assertions d’unicité : le fait que les cas a)
à h) s’excluent mutuellement, et le fait que dans chacun des cas c) à h), le
symbole 𝑥𝑣 ou les formules 𝛽 et 𝛾 sont uniquement déterminées.
1.2. FORMULES PROPOSITIONNELLES 11
On commence par observer que les assertions a) à h) s’excluent mutuel-
lement car dans chacun de ces cas, le premier caractère de la formule 𝛼
est distinct : c’est 0 et 1 dans les assertions a) et b), un élement de V dans
le cas c), le symbole ¬ dans le cas d), etc.
Dans le cas c), le symbole de variable 𝑣 est le premier (et seul) caractère
de 𝛼 ; il est donc uniquement déterminé par 𝛼.
Dans le cas d), la formule propositionnelle 𝛽 est le mot obtenu à partir
de 𝛼 en en ôtant le premier symbole ; elle est donc uniquement déterminée
par 𝛼.
Supposons que l’on est dans le cas e) et considérons des formules pro-
positionnelles 𝛽, 𝛾, 𝛽 ′, 𝛾 ′ telles que 𝛼 = ∨𝛽𝛾 = ∨𝛽 ′𝛾 ′. Par simplification, on
a 𝛽𝛾 = 𝛽 ′𝛾 ′ ; si les longueurs de 𝛽 ′ et 𝛽 sont égales, on en déduit que 𝛽 = 𝛽 ′
et 𝛾 = 𝛾 ′. Sinon, l’une des deux longueurs, de 𝛽 ou de 𝛽 ′, est strictement
inférieure à l’autre ; supposons, pour fixer les idées, que la longueur de 𝛽 ′
est strictement inférieure à celle de 𝛽. Comme 𝛽 ′𝛾 ′ = 𝛽𝛾, on voit que 𝛽 ′
est un préfixe strict de 𝛽, contrairement au fait qu’un préfixe strict d’une
formule propositionnelle n’en est pas une.
Le raisonnement est identique dans les cas f ) à h). □
Le théorème 1.2.2 entraîne la possibilité d’effectuer des définitions par
récurrence sur la définition d’une formule.
On considère un ensemble Λ muni de deux éléments 𝜆0 , 𝜆1 , d’une famille
d’éléments 𝜆𝑣 , pour 𝑣 ∈ V, et d’opérations 𝜆¬ : FV ×A → A, 𝜆∨ : FV ×A2 →
A, etc. Alors, il existe une unique application 𝜆 : FV → A telle que l’on ait
𝜆(0) = 𝜆0 , 𝜆(1) = 𝜆1 , 𝜆(𝑥𝑣 ) = 𝜆𝑣 pour tout 𝑣 ∈ V, et telle que pour toutes
formules propositionnelles 𝜑 et 𝜓 , on ait 𝜆(¬𝜑) = 𝜆¬ (𝜑, 𝜆(𝜑)), 𝜆(∨𝜑𝜓 ) =
𝜆∨ (𝜑, 𝜆(𝜑), 𝜆(𝜓 )), 𝜆(∧𝜑𝜓 ) = 𝜆∧ (𝜑, 𝜆(𝜑), 𝜆(𝜓 )), etc.
Les trois corollaires suivants sont des cas particuliers important de cette
construction générale. Le premier définit l’ensemble des sous-formules
d’une formule propositionnelle ; on prend pour ensemble Λ l’ensemble
des parties finies de FV .
Corollaire (1.2.5). — Il existe une unique application S de FV dans l’en-
semble des parties finies de FV qui vérifie les propriétés suivantes :
12 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
a) On a S(0) = {0} et S(1) = {1} ;
b) Pour tout 𝑣 ∈ V, on a S(𝑥𝑣 ) = {𝑥𝑣 } ;
c) Si 𝜑 est une formule propositionnelle, on a S(¬𝜑) = {𝜑 } ∪ S(𝜑) ;
d) Si 𝜑 et 𝜓 sont des formules propositionnelles, on a S(∨𝜑𝜓 ) = {∨𝜑𝜓 } ∪
S(𝜑) ∪ S(𝜓 ), et de même pour ∧𝜑𝜓, →𝜑𝜓, ↔𝜑𝜓 .
Les éléments de S(𝜑) sont appelés les sous-formules de 𝜑.
Une seconde application de cette proposition est la définition de l’éva-
luation logique d’une formule propositionnelle. On prend pour Λ l’en-
semble {0, 1} des valeurs de vérité.
Corollaire (1.2.6). — Pour tout 𝑎 ∈ {0, 1}V , il existe une unique application
𝜀𝑎 : FV → {0, 1} telle que
(i) On a 𝜀𝑎 (0) = 0 et 𝜀𝑎 (1) = 0 ;
(ii) Pour tout 𝑣 ∈ V, on a 𝜀𝑎 (𝑥𝑣 ) = 𝑎𝑣 ;
(iii) Si 𝛽, 𝛾 sont des formules propositionnelles, on a 𝜀𝑎 (¬𝛽) = ¬(𝜀𝑎 (𝛽)),
𝜀𝑎 (∨𝛽𝛾) = 𝜀𝑎 (𝛽) ∨ 𝜀𝑎 (𝛾), etc.
On appelle l’application d’évaluation des formules propositionnelles au
point 𝑎.
Une troisième application importante permet de substituer des va-
riables par des formules propositionnelles, éventuellement à variables
dans un autre ensemble W ; on y prend pour ensemble Λ l’ensemble FW
des formules propositionnelles à variables dans W
Corollaire (1.2.7). — Soit W un ensemble disjoint de l’ensemble L des sym-
boles logiques. Pour toute famille 𝜉 = (𝜉𝑣 )𝑣 ∈V ∈ (FW ) V de formules proposi-
tionnelles à variables dans W, il existe une unique application 𝜎𝜉 : FV → FW
telle que
(i) On a 𝜎𝜉 (0) = 0 et 𝜎𝜉 (1) = 0 ;
(ii) Pour tout 𝑣 ∈ V, on a 𝜎𝜉 (𝑥𝑣 ) = 𝜉𝑣 ;
(iii) Si 𝛽, 𝛾 ∈ FV sont des formules propositionnelles, on a 𝜎𝜉 (¬𝛽) =
¬𝜎𝜉 (𝛽), 𝜎𝜉 (∨𝛽𝛾) = ∨𝜎𝜉 (𝛽)𝜎𝜉 (𝛾), etc.
On dit que c’est l’application de substitution simultanée des symboles
de variables 𝑥𝑣 par les formules propositionnelles 𝜉𝑣 .
1.3. CONSÉQUENCES LOGIQUES, TAUTOLOGIES 13
Exercice (1.2.8). — Considérons les trois formules propositionnelles 𝜑 =
∧𝑥 1𝑥 2 , 𝛼 = ∨𝑥 1𝑥 2 et 𝛽 = →𝑥 1𝑥 2 .
a) Écrire la formule propositionnelle déduite de 𝜑 par substitution si-
multanée de 𝑥 1 par 𝛼 et 𝑥 2 par 𝛽.
b) Écrire la formule propositionnelle déduite de 𝜑 par substitution suc-
cessive de 𝑥 1 par 𝛼, 𝑥 2 étant inchangée, puis de 𝑥 2 par 𝛽, 𝑥 1 étant inchan-
gée.
c) Écrire la formule propositionnelle déduite de 𝜑 en effectuant ces sub-
stitutions dans l’autre ordre. Comparer.
Remarque (1.2.9). — Soit 𝜑 une formule propositionnelle à variables
dans V ; soit W l’ensemble des symboles de variables qui apparaissent
dans 𝜑. Si 𝑎 et 𝑏 sont deux éléments de AV tels que 𝑎𝑣 = 𝑏𝑣 pour tout
𝑣 ∈ W, alors 𝜀𝑎 (𝜑) = 𝜀𝑏 (𝜑). Cela se démontre par récurrence sur 𝜑,
en observant que les symboles de variables qui apparaissent dans une
sous-formule de 𝜑 sont contenus dans W.
Enfin, notons que substitution et évaluation interagissent de façon na-
turelle :
Proposition (1.2.10). — Soit W un ensemble disjoint de l’ensemble L des
symboles logiques. Pour toute famille 𝜉 = (𝜉𝑣 )𝑣 ∈V ∈ (FW ) V de formules
propositionnelles à variables dans W et soit 𝑏 ∈ {0, 1}W . Soit 𝑎 ∈ {0, 1}V la
famille définie par 𝑎𝑣 = 𝜀𝑏 (𝜉𝑣 ). Pour toute formule propositionnelle 𝜑 ∈ FV ,
on a
𝜀𝑏 (𝜎𝜉 (𝜑)) = 𝜀𝑎 (𝜑).
Démonstration. — Cela se démontre immédiatement par récurrence sur
la définition de 𝜑. □
1.3. Conséquences logiques, tautologies
Soit V un ensemble de symboles de variables.
14 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
Définition (1.3.1). — On dit que deux formules propositionnelles 𝜑 et 𝜓 à
variables dans V sont logiquement équivalentes, et on note 𝜑 ∼ 𝜓 , si pour
tout 𝑎 ∈ {0, 1}V , on a 𝜀𝑎 (𝜑) = 𝜀𝑎 (𝜓 ).
Il s’agit d’une relation d’équivalence : si 𝜑,𝜓, 𝜃 sont des formules pro-
positionnelles à variables dans V, on a
(i) (réflexivité) 𝜑 ∼ 𝜑 ;
(ii) (symétrie) si 𝜑 ∼ 𝜓 , alors 𝜓 ∼ 𝜑 ;
(iii) (transitivité) si 𝜑 ∼ 𝜓 et 𝜓 ∼ 𝜃 , alors 𝜑 ∼ 𝜃 .
De plus, l’équivalence logique est préservée par substitution de for-
mules : si 𝜑 et 𝜓 sont des formules propositionnelles à variables dans un
ensemble W qui sont logiquement équivalentes, alors pour toute famille
(𝜉𝑤 ) dans FV , les formules propositionnelles 𝜎𝜉 (𝜑) et 𝜎𝜉 (𝜓 ) sont logique-
ment équivalentes.
Définition (1.3.2). — Soit V un ensemble de symboles de variables et soit
𝜑 une formule propositionnelle à variables dans V.
a) On dit que 𝜑 est une tautologie, et on note ⊨ 𝜑, si pour tout 𝑎 ∈ {0, 1}V ,
on a 𝜀𝑎 (𝜑) = 1.
b) Soit Σ un ensemble de formules propositionnelles à variables dans V.
On dit que 𝜑 est conséquence logique de Σ, et on note Σ ⊨ 𝜑, si pour tout
𝑎 ∈ {0, 1}V tel que 𝜀𝑎 (𝜎) = 1 pour tout 𝜎 ∈ Σ, on a 𝜀𝑎 (𝜑) = 1.
Noter qu’une formule propositionnelle est une tautologie si et seule-
ment si elle est logiquement équivalente à la formule 1, et si et seulement
si elle est conséquence logique de la famille vide de formules proposi-
tionnelles. Une formule propositionnelle 𝜑 logiquement équivalente à la
formule 0 est parfois appelée antilogie ; cela signifie que ¬𝜑 est une tau-
tologie.
Lemme (1.3.3). — Soit V un ensemble de symboles de variables. Soit 𝜑 et 𝜓
deux formules propositionnelles à variables dans V.
a) Les formules propositionnelles 𝜑 et ¬¬𝜑 sont logiquement équivalentes ;
b) Les formules propositionnelles →𝜑𝜓 et ∨¬𝜑𝜓 sont logiquement équi-
valentes ;
1.3. CONSÉQUENCES LOGIQUES, TAUTOLOGIES 15
c) Les formules propositionnelles ¬∨𝜑𝜓 et ∧¬𝜑¬𝜓 sont logiquement équi-
valentes ;
d) Les formules propositionnelles ¬∧𝜑𝜓 et ∨¬𝜑¬𝜓 sont logiquement équi-
valentes ;
e) Les formules propositionnelles ↔𝜑𝜓 et ∧→𝜑𝜓 →𝜓𝜑 sont logiquement
équivalentes ;
f) La formule ∨𝜑¬𝜑 est une tautologie ;
g) Si 𝜑 et 𝜓 sont des tautologies, alors ∧𝜑𝜓 est une tautologie ;
h) Si l’une au moins de 𝜑 ou de 𝜓 est une tautologie, alors ∨𝜑𝜓 est une
tautologie ;
i) Si 𝜓 est une tautologie, alors →𝜑𝜓 est une tautologie ;
j) Si ¬𝜑 est une tautologie, alors →𝜑𝜓 est une tautologie.
Théorème (1.3.4) (Théorème d’interpolation de Craig)
Soit V un ensemble de symbole de variables. Soit 𝜑 et 𝜓 des formules
propositionnelles à variables dans V et soit W l’ensemble des symboles de
variables qui apparaissent à la fois dans 𝜑 et 𝜓 . Les deux propriétés suivantes
sont équivalentes :
(i) La formule →𝜑𝜓 est une tautologie ;
(ii) Il existe une formule propositionnelle 𝜃 dont les seuls symboles de va-
riables appartiennent à W telle que les deux formules →𝜑𝜃 et →𝜃𝜓 sont des
tautologies.
Démonstration. — L’implication (ii)⇒(i) est banale, et ne fera pas usage
de l’hypothèse sur 𝜃 . Supposons en effet que →𝜑𝜃 et →𝜃𝜓 soient des tau-
tologies et démontrons que 𝜀𝑎 (→𝜑𝜓 ) = 1 pour tout 𝑎 ∈ {0, 1}V . C’est vrai
si 𝜀𝑎 (𝜑) = 0. Sinon, on a 𝜀𝑎 (𝜑) = 1 et le fait que →𝜑𝜃 soit une tautologie
entraîne que 𝜀𝑎 (𝜃 ) = 1 ; on en déduit de même que 𝜀𝑎 (𝜓 ) = 1 ; cela prouve
que 𝜀𝑎 (→𝜑𝜓 ) = 1.
Démontrons l’implication (i)⇒(ii) en raisonnant par récurrence sur le
cardinal de W.
Traitons d’abord le cas où W = ∅, c’est-à-dire celui où 𝜑 et 𝜓 n’ont pas
de symboles de variables en commun. Nous allons démontrer que soit ¬𝜑,
16 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
soit 𝜓 est une tautologie ; dans le premier cas, on pourra prendre 𝜃 = 0,
dans le second cas, on pourra prendre 𝜃 = 1.
Raisonnons par l’absurde en supposant que ni ¬𝜑 ni 𝜓 n’est une tauto-
logie. Il existe donc 𝑎 ∈ {0, 1}V tel que 𝜀𝑎 (¬𝜑) = 0 et 𝑏 ∈ {0, 1}V tel que
𝜀𝑣 (𝜓 ) = 0. Définissons 𝑐 ∈ {0, 1}V de la façon suivante : si 𝑣 ∈ V est un
symbole de variable qui apparaît dans la formule 𝜑, on pose 𝑐 𝑣 = 𝑎𝑣 ; sinon,
on pose 𝑐 𝑣 = 𝑏𝑣 . Comme 𝑐 𝑣 = 𝑎𝑣 pour tout symbole de variable 𝑣 qui appa-
raît dans 𝜑, on a 𝜀𝑐 (𝜑) = 𝜀𝑎 (𝜑) ; puisque 𝜀𝑎 (¬𝜑) = 0, on a 𝜀𝑎 (𝜑) = 1, d’où
𝜀𝑐 (𝜑) = 1. Si 𝑣 est un symbole de variable qui apparaît dans 𝜓 , il n’apparaît
pas dans 𝜑, par hypothèse, donc 𝑐 𝑣 = 𝑏𝑐 ; par suite, on a 𝜀𝑐 (𝜓 ) = 𝜀𝑏 (𝜓 ) = 0.
Alors, 𝜀𝑐 (→𝜑𝜓 ) = 0, ce qui prouve que →𝜑𝜓 n’est pas une tautologie.
Supposons maintenant que W n’est pas vide, fixons un élément 𝑤 ∈ W
et posons W′ = W {𝑤 }. Soit 𝜑 0 la formule obtenue par substitution si-
multanée en remplaçant 𝑥𝑤 par 0 et en laissant inchangé tout autre sym-
bole de variable ; définissons de même 𝜑 1 . Définissons de même 𝜓 0 et 𝜓 1 .
Alors, →𝜑 0𝜓 0 et →𝜑 1𝜓 1 sont des tautologies, puisqu’elles sont déduites de
la substitution de 𝑥𝑤 par 0 et par 1 dans la tautologie →𝜑𝜓 . Par récurrence,
il existe donc deux formules propositionnelles 𝜃 0 et 𝜃 1 dont les seuls sym-
boles de variables appartiennent à W′ telles que →𝜑 0𝜃 0 , →𝜃 0𝜓 0 , →𝜑 1𝜃 1 et
→𝜃 1𝜓 1 soient des tautologies. Posons 𝜃 = ∨∧𝑥𝑤 𝜃 1 ∧¬𝑥𝑤 𝜃 0 ; les seuls sym-
boles de variables qui apparaissent dans 𝜃 sont 𝑥𝑤 et ceux des formules
propositionnelles 𝜃 0 et 𝜃 1 ; ils sont donc contenus dans W. Comme 𝜑 est lo-
giquement équivalente à la formule ∨∧𝑥𝑤 𝜑 1 ∧¬𝑥𝑤 𝜑 0 , et de même pour 𝜓 ,
les deux formules →𝜑𝜃 et →𝜃𝜓 sont des tautologies, ce qui conclut la
démonstration du théorème. □
1.4. Démonstrations
On fixe un ensemble V de symboles de variables.
Un séquent est un couple formé d’un ensemble Σ de formules propo-
sitionnelles et d’une formule propositionnelle 𝜑. L’ensemble Σ est appelé
le contexte du séquent. La théorie de la démonstration vise à définir et
1.4. DÉMONSTRATIONS 17
étudier la propriété qu’un séquent est démontrable, on notera Σ ⊢ 𝜑 si ce
séquent est démontrable.
La définition de cette propriétés repose sur un certain nombre de règles
de déduction qui mettent en jeu les différentes opérations logiques. De
fait, pour chaque opération logique, on donne des règles d’introduction qui
donnent un moyen de démonstration, et de règles d’élimination qui disent
comment les utiliser dans une démonstration. Chacune de ces règles est
mise en page de la façon suivante : on écrit au-dessus d’un trait horizontal
les séquents qui servent d’hypothèse, et en dessous de ce trait le séquent
qu’on en déduit.
La première règle affirme que toute formule du contexte est démon-
trable dans ce contexte :
(A) si 𝜑 ∈ Σ.
Σ⊢𝜑
La formule 0 n’a pas de règle d’introduction (on ne se donne pas de
moyen de démontrer le faux) et une règle d’élimination qui dit qu’elle
entraîne n’importe quoi :
Σ ⊢ 0 (E ).
Σ⊢𝜑 0
La formule 1 a une règle d’introduction affirmant qu’il est démontrable
dans tout contexte :
(I1 )
Σ⊢1
et n’a pas de règle d’élimination.
L’opération de négation a une règle d’introduction :
Σ, 𝜑 ⊢ 0
(I )
Σ ⊢ ¬𝜑 ¬
qui, lue dans l’autre sens, fournit sa règle d’élimination :
Σ ⊢ ¬𝜑
(E )
Σ, 𝜑 ⊢ 0 ¬
L’opération ∨ a deux règles d’introduction, à gauche et à droite :
Σ⊢𝜑 Σ ⊢𝜓
(I∨,g ) (I )
Σ ⊢ 𝜑 ∨𝜓 Σ ⊢ 𝜑 ∨ 𝜓 ∨,d
18 CHAPITRE 1. PROPOSITIONS ET VALEURS DE VÉRITÉ — CALCULER
et une règle d’élimination qui justifie les démonstrations par disjonction
de cas :
Σ ⊢ 𝜑 ∨𝜓 Σ, 𝜑 ⊢ 𝜃 Σ,𝜓 ⊢ 𝜃
(E∨ )
Σ⊢𝜃
L’opération ∧ a une règle d’introduction :
Σ⊢𝜑 Σ ⊢𝜓
(I∧ )
Σ ⊢ 𝜑 ∧𝜓
et deux règles d’élimination, à gauche et à droite :
Σ ⊢ 𝜑 ∧𝜓 Σ ⊢ 𝜑 ∧𝜓
(E∧,g ) (E∧,d )
Σ⊢𝜑 Σ ⊢𝜓
L’opération → a une règle d’introduction :
Σ, 𝜑 ⊢ 𝜓
(I )
Σ ⊢𝜑 →𝜓 →
et une règle d’élimination :
Σ ⊢𝜑 →𝜓 Σ⊢𝜑
(E→ )
Σ ⊢𝜓
Finalement, l’opération ↔ a une règle d’introduction
Σ, 𝜑 ⊢ 𝜓 Σ,𝜓 ⊢ 𝜑
(I↔ )
Σ ⊢𝜑 ↔𝜓
et deux règles d’élimination :
Σ ⊢𝜑 ↔𝜓 Σ ⊢𝜑 ↔𝜓
(E↔,g ) (E↔,d )
Σ, 𝜑 ⊢ 𝜓 Σ,𝜓 ⊢ 𝜑
On ajoute à ces règles l’axiome du tiers-exclu :
(TE)
Σ ⊢ 𝜑 ∨ ¬𝜑
Par récurrence, on en déduit la notion de séquent démontrable : c’est
un séquent qui apparaît au dénominateur d’une règle de déduction pour
laquelle les séquents du numérateur sont démontrables. Comme trois de
ces règles, (A), (1) et (TE), n’ont pas d’hypothèse, l’ensemble des séquents
démontrables n’est pas vide.
Une démonstration d’un séquent est un arbre étiqueté par des séquents,
dont la racine est le séquent considéré, et tel que chaque nœud correspond
à une règle de déduction. Chacun des séquents qui apparaît dans cette
démonstration est donc démontrable.
1.4. DÉMONSTRATIONS 19
Proposition (1.4.1) (Cohérence). — Si un séquent Σ ⊢ 𝜑 est démontrable,
alors la formule 𝜑 est conséquence logique de Σ.
Démonstration. — Cela se démontre par récurrence sur les démonstra-
tions. Il suffit de vérifier que si les séquent au numérateur d’une règle de
déduction vérifient la proposition, il en est de même du séquent au déno-
minateur.
C’est évident pour la règle (A) et pour la règle d’introduction (I1 ).
Considérons la règle d’élimination (E0 ). Si 0 est conséquence logique
de Σ, cela signifie qu’il n’y a aucun 𝑎 ∈ {0, 1}V tel que 𝜀𝑎 (𝜃 ) = 1 pour tout
𝜃 ∈ Σ. Alors, toute formule propositionnelle 𝜑 est conséquence logique
de Σ.
Vérifions les deux règles concernant la négation : Si 0 est conséquence
logique de Σ ∪ {𝜑 }, c’est que pour tout 𝑎 ∈ {0, 1}V tel que 𝜀𝑎 (𝜃 ) = 1 pour
tout 𝜃 ∈ Σ, alors 𝜀𝑎 (𝜑) = 0 ; cela prouve que 𝜀𝑎 (¬𝜑) = 1, et donc ¬𝜑 est
conséquence logique de Σ. L’argument est symétrique et traite le cas de
la règle d’élimination.
Les règles d’introduction (I∨,g ) et (I∨,d ) se prouvent immédiatement. La
règle d’élimination (E∨ ) est un peu plus délicate : supposons que 𝜑 ∨ 𝜓
soit conséquence logique de Σ, et que 𝜃 soit conséquence logique des deux
contextes Σ ∪ {𝜑 } et Σ ∪ {𝜃 }. Soit 𝑎 ∈ {0, 1}V tel que 𝜀𝑎 (𝜎) = 1 pour tout
𝜎 ∈ Σ et démontrons que 𝜀𝑎 (𝜃 ) = 1. On sait que 𝜀𝑎 (𝜑 ∨ 𝜓 ) = 1, si bien que
𝜀𝑎 (𝜑) = 1 ou 𝜀𝑎 (𝜓 ) = 1. Dans le premier cas, le fait que 𝜃 soit conséquence
logique de Σ ∪ {𝜑 } entraîne que 𝜀𝑎 (𝜃 ) = 1. On raisonne de même dans le
second cas en utilisant le fait que 𝜃 est conséquence logique de Σ ∪ {𝜓 }.
Les règles d’introduction et d’élimination du et, de l’implication et de
l’équivalence se démontrent de façon analogue.
L’axiome du tiers exclu résulte de ce que 𝜀𝑎 (𝜑∨¬𝜑) = 𝜀𝑎 (𝜑)∨¬𝜀𝑎 (𝜑) = 1
pour tout 𝑎 ∈ {0, 1}V , puisque soit 𝜀𝑎 (𝜑) = 1, soit 𝜀𝑎 (𝜑) = 0 et alors
¬𝜀𝑎 (𝜑) = 1. □
Théorème (1.4.2) (Complétude de la déduction naturelle)
Si une formule propositionnelle 𝜑 est conséquence logique d’un contexte Σ,
alors le séquent Σ ⊢ 𝜑 est démontrable.
CHAPITRE 2
ENSEMBLES ET NOMBRES ENTIERS —
COMPTER
« Oui ; cela n’est pas mal ; mais ce compte-là n’est rien de réel. »
— Molière, L’Avare, acte ii, scène 5
La logique mathématique est la branche des mathématiques dont l’ob-
jet d’étude est l’ensemble des théories mathématiques elles-mêmes. Cette
mise en abîme en inquiète certains, en indiffère beaucoup, et attise la cu-
riosité d’autres. Si ce cours s’adresse par nature à ces derniers, j’espère
qu’il rassurera les premiers et suscitera quelque intérêt chez les seconds.
Comme l’expliquent Cori et Lascar dans l’introduction de leur ou-
vrage (Cori et Lascar, 2003a ; Cori et Lascar, 2003b), la logique mathé-
matique utilise non seulement le raisonnement mathématique, mais aussi
tout l’attirail développé au cours des siècles, tant en algèbre qu’en topolo-
gie. La théorie des ensembles y joue un rôle particulier en ce qu’elle a posé
un certain nombre de questions emblématiques (pour ne citer qu’elles,
l’indépendance de l’axiome du choix et l’hypothèse du continu) qui ont
motivé le développement de la logique mathématique au 20e siècle. Mais
elle offre également des outils fondamentaux pour le développement des
mathématiques, par exemple le « lemme de Zorn ».
Ce premier chapitre développe quelques aspects de théorie des en-
sembles que nous utiliserons par la suite.
2.1. Ensembles et classes
2.1.1. — La notion naïve d’ensemble semble claire, et semblait claire aux
mathématiciens de la fin du 19e siècle qui ont contribué à son développe-
ment.
Un ensemble possède des éléments, qui peuvent d’ailleurs eux-mêmes
être des ensembles ; on écrit 𝑥 ∈ A pour dire qu’un élément 𝑥 appartient
à l’ensemble A, et 𝑥 ∉ A pour dire qu’il n’y appartient pas. La théorie des
ensembles est guidée par deux principes :
22 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
a) Deux ensembles qui ont les mêmes éléments sont égaux (extension) ;
b) Si P (𝑥) est une propriété d’un objet, on peut former l’ensemble
{𝑥 ; P(𝑥)} des objets qui la vérifient (compréhension).
Comme l’a observé B. Russell, les choses ne peuvent pas être aussi
simples.
Théorème (2.1.2) (Paradoxe de Russell). — Il n’existe pas d’ensemble
dont les éléments soient les ensembles vérifiant la propriété 𝑥 ∉ 𝑥.
Je renvoie à l’excellent (Doxiadis et Papadimitriou, 2009) (pages 162
et suivantes) pour un récit savoureux de la découverte de ce paradoxe.
Démonstration. — Raisonnons par l’absurde en supposant qu’un tel en-
semble existe et notons-le R. La contradiction apparaît lorsqu’on cherche
à savoir si R appartient à R ou pas.
Si R appartient à R, on a R ∈ R, donc R ∉ R par définition de l’en-
semble R ; c’est une contradiction. Donc R n’appartient pas à R, c’est-à-
dire que R ∉ R, donc R ∈ R par définition de R ; apparaît de nouveau une
contradiction. □
2.1.3. — Ce paradoxe indique qu’une formalisation précise de la théorie
des ensembles est nécessaire. Parmi les formalisations possibles, l’axioma-
tique (zf) de E. Zermelo et A.-Fraenkel complémentée (zfc) par l’axiome
du choix, est la plus couramment utilisée. Elle possède un défaut de ne
pouvoir mentionner certaines « collections » d’ensembles. L’axiomatique
(nbg) de J. von Neumann, P. Bernays et K. Gödel introduit la notion de
classe qui sont de sortes de « gros »ensembles et nous allons commencer
ce cours par présenter cette théorie..
Une fois ce développement mis en place, nous nous contenterons en fait
d’une compréhension intuitive de la théorie des ensembles, telle qu’elle
est développée en licence. En particulier, nous utiliserons librement
l’axiome du choix ; il sera parfois invoqué sous la forme du théorème
de Zorn (théorème 3.2.17), mais parfois aussi dans des raisonnements
d’apparence anodine dont la formalisation le nécessite.
2.1.4. Extensionalité. — La théorie des classes a pour objets qu’elle
nomme classes, reliées par un symbole ∈ qui se prononce « appartient ».
Si X ∈ C, on dit que X est un élément de C. L’axiome d’extensionalité
postule que deux classes qui ont les mêmes éléments sont égales.
2.1. ENSEMBLES ET CLASSES 23
On ajoute aussi le symbole d’inclusion ⊆ : si C1 et C2 sont des classes,
C1 ⊆ C2 signifie que que pour toute classe X telle que X ∈ C1 , on a X ∈ C2 .
L’égalité des deux classes C1 et C2 est équivalente à la double inclusion
C1 ⊆ C2 et C2 ⊆ C1 .
On dit qu’une classe A est un ensemble s’il existe une classe C tel que
A ∈ C ; on note cette propriété M (A). On peut alors retraduire le principe
d’extension : deux classes C1 et C2 sont égales si et seulement si pour tout
ensemble 𝑥, on a 𝑥 ∈ C1 si et seulement si 𝑥 ∈ C2 .
Trois axiomes supplémentaires permettent de construire l’intersection,
la réunion et le complémentaire de classes. Si C1 et C2 sont deux classes,
la classe C1 ∪ C2 a pour éléments les X qui appartiennent à C1 ou à C2 ,
tandis que la classe C1 ∩ C2 a pour éléments les X qui appartiennent à C1
et à C2 . Enfin, si C est une classe, la clase Cc a pour éléments les X tels
que X ∉ C. (Par l’axiome d’extensionalité, ces classes C1 ∪ C2 , C1 ∩ C2 et
Cc sont uniquement déterminées par ces propriétés.)
L’axiome de l’intersection postule que si 𝑥 est un ensemble et C est une
classe, alors 𝑥 ∩C est un ensemble. Une conséquence est que si une classe C
est contenue dans un ensemble A, alors C est un ensemble. (En effet, l’in-
clusion C ⊆ A entraîne que C = C ∩ A.)
2.1.5. Parité. — L’axiome de la paire postule que si 𝑥 et 𝑦 sont des en-
sembles, il existe un ensemble dont les seuls éléments sont 𝑥 et 𝑦. En vertu
de l’axiome d’extensionalité, il existe un seul tel ensemble ; on le note en-
semble {𝑥, 𝑦}.
Lorsque 𝑥 = 𝑦, cet ensemble est noté plus simplement {𝑥 } ; c’est le
singleton {𝑥 }. Observons que si {𝑥, 𝑦} = {𝑧}, alors 𝑥 = 𝑦 = 𝑧.
Une foix que l’on dispose de paires, une technique due à C. Kuratowski
permet de construire des couples : si 𝑥 et 𝑦 sont des ensembles, posons
(𝑥, 𝑦) = {{𝑥 }, {𝑥, 𝑦}}.
Proposition (2.1.6). — Soit 𝑥, 𝑦, 𝑥 ′, 𝑦 ′ des ensembles. Les couples (𝑥, 𝑦) et
(𝑥 ′, 𝑦 ′) sont égaux si et seulement si 𝑥 = 𝑥 ′ et 𝑦 = 𝑦 ′.
Démonstration. — Supposons 𝑥 = 𝑥 ′ et 𝑦 = 𝑦 ′. Les ensembles {𝑥, 𝑦} et
{𝑥 ′, 𝑦 ′ } ont les mêmes éléments, donc sont égaux. De même, les ensembles
{𝑥 } et {𝑥 ′ } sont égaux. Alors, les couples (𝑥, 𝑦) et (𝑥 ′, 𝑦 ′) ont les mêmes
éléments ; ils sont donc égaux.
24 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
Inversement, supposons (𝑥, 𝑦) = (𝑥 ′, 𝑦 ′). Les ensembles {𝑥 } et {𝑥 ′, 𝑦 ′ }
appartiennent au couple (𝑥, 𝑦) ; ils appartiennent donc au couple (𝑥 ′, 𝑦 ′),
c’est-à-dire qu’ils sont égaux à {𝑥 ′ } ou à {𝑥 ′, 𝑦 ′ }. Il y a donc quatre cas à
distinguer :
a) On a {𝑥 } = {𝑥 ′ } et {𝑥, 𝑦} = {𝑥 ′ } ; démontrons que 𝑥 = 𝑦 = 𝑥 ′ = 𝑦 ′.
Dans ce cas, on a 𝑥 = 𝑥 ′ et 𝑥 = 𝑦 = 𝑥 ′ ; le couple (𝑥, 𝑦) est donc l’ensemble
{{𝑥 }}. Comme l’ensemble {𝑥 ′, 𝑦 ′ } appartient au couple (𝑥 ′, 𝑦 ′), il appar-
tient au couple (𝑥, 𝑦), donc est égal à {𝑥 }. Alors 𝑥 est le seul élément de
{𝑥 ′, 𝑦 ′ }, d’où 𝑥 = 𝑥 ′ = 𝑦 ′.
b) On a {𝑥 } = {𝑥 ′ } et {𝑥, 𝑦} = {𝑥 ′, 𝑦 ′ }. Alors 𝑥 = 𝑥 ′. Comme 𝑦 est
un élément de {𝑥, 𝑦}, c’est un élément de {𝑥 ′, 𝑦 ′ }, et on a donc 𝑦 = 𝑥 ′
ou 𝑦 = 𝑦 ′. Dans le second cas, on a fini ; supposons donc 𝑦 = 𝑥 ′. Alors
(𝑥, 𝑦) = (𝑥 ′, 𝑥 ′) = {{𝑥 ′ }} et (𝑥, 𝑦) = (𝑥 ′, 𝑦 ′) = {{𝑥 ′ }, {𝑥 ′, 𝑦 ′ }}. Par suite,
{𝑥 ′ } = {𝑥 ′, 𝑦 ′ } ce qui entraîne 𝑥 ′ = 𝑦 ′. On a donc 𝑦 = 𝑥 ′ = 𝑦 ′, comme il
fallait démontrer.
c) On a {𝑥 } = {𝑥 ′, 𝑦 ′ } et {𝑥, 𝑦} = {𝑥 ′ }. Dans ce cas, on a 𝑥 = 𝑥 ′ = 𝑦 ′ et
𝑥 ′ = 𝑥 = 𝑦, d’où 𝑥 = 𝑦 = 𝑥 ′ = 𝑦 ′.
d) On a {𝑥 } = {𝑥 ′, 𝑦 ′ } et {𝑥, 𝑦} = {𝑥 ′, 𝑦 ′ }. Alors on a 𝑥 = 𝑥 ′ = 𝑦 ′, d’où
{𝑥, 𝑦} = {𝑥 ′ } si bien que 𝑥 = 𝑦 = 𝑥 ′. On a donc 𝑥 = 𝑦 = 𝑥 ′ = 𝑦 ′.
Cela conclut la démonstration. □
2.1.7. — Une fois que l’on dispose de couples, on peut construire des
trouples, quadruples. . . en posant (𝑥, 𝑦, 𝑧) = ((𝑥, 𝑦), 𝑧), (𝑥, 𝑦, 𝑧, 𝑦) =
(((𝑥, 𝑦, 𝑧), 𝑡), etc.
Proposition (2.1.8). — Soit 𝑚 et 𝑛 des entiers naturels ⩾ 1 et 𝑥 1, . . . , 𝑥𝑚 , 𝑦1, . . . , 𝑦𝑛
des ensembles. Pour que (𝑥 1, . . . , 𝑥𝑚 ) = (𝑦1, . . . , 𝑦𝑛 ), il faut et il suffit que
𝑚 = 𝑛 et 𝑥 1 = 𝑦1 ,. . ., 𝑥𝑚 = 𝑦𝑚 .
Démonstration. — Récurrence. □
2.1.9. — Les axiomes suivants permettent de construire de nouvelles
classes faisant intervenir des couples :
a) Il existe une classe E tels que pour tous ensembles 𝑥, 𝑦, on a (𝑥, 𝑦) ∈ E
si et seulement si 𝑥 ∈ 𝑦. C’est le « graphe » de la relation d’appartenance.
2.1. ENSEMBLES ET CLASSES 25
b) Si C est une classe, il existe une classe C′ telle que pour tout ensemble
𝑥, 𝑥 ∈ C′ si et seulement si il existe un ensemble 𝑦 tel que (𝑥, 𝑦) ∈ C ; une
telle classe est le « domaine » de la classe C. De même, il existe une classe
C′′ telle que pour tout ensemble 𝑦, 𝑦 ∈ C′′ si et seulement si il existe un
ensemble 𝑥 tel que (𝑥, 𝑦) ∈ C ; c’est le « codomaine » de la classe C.
c) Si C est une classe, il existe une classe C′ telle que pour tout ensemble
𝑦, (𝑥, 𝑦) ∈ C′ si et seulement si 𝑥 ∈ C ; c’est une classe dont C est le
domaine. De même, il existe une classe C′′ telle que pour tout ensemble
𝑥, (𝑥, 𝑦) ∈ C′′ si et seulement si 𝑦 ∈ C ; c’est une classe donc C est le
codomaine.
Il nous faut également un axiomes sur les trouples.
a) Si C est une classe, il existe une classe D telle que pour tous ensembles
𝑥, 𝑦, 𝑧, on a (𝑥, 𝑦, 𝑧) ∈ D si et seulement si (𝑦, 𝑥, 𝑧) ∈ C. De même, il existe
une classe D′ telle que pour tous ensembles 𝑥, 𝑦, 𝑧, on a (𝑥, 𝑦, 𝑧) ∈ D′ si et
seulement si (𝑥, 𝑧, 𝑦) ∈ C.
Ces classes ne sont pas uniquement déterminées par l’axiome d’exten-
sionalité car leurs « définitions » prescrivent uniquement leurs couples ou
les trouples.
Proposition (2.1.10) (La classe vide). — Il existe une classe et une seule
qui n’a aucun élément.
On dit que c’est la classe vide et on la note ∅.
Un axiome de la théorie nbgpostule que la classe vide est un ensemble.
Sans cet axiome, rien ne garantit l’existence d’ensembles.
La classe U = ∅c est appelée univers ; par définition, 𝑥 ∈ U pour tout
ensemble 𝑥. Pour toute classe C, on a C ⊆ U.
La démonstration du théorème 2.1.2 démontre que la la classe R dont
les éléments sont les ensembles 𝑥 tels que 𝑥 ∉ 𝑥 n’est pas un ensemble. (Si
R ∈ R, alors R est un ensemble et R ∉ R, une contradiction. Par suite, R ∉ R.
Si R est un ensemble, cela entraîne que R ∈ R, une contradiction, d’où
l’assertion.) Comme toute sous-classe d’un ensemble est un ensemble, cela
entraîne que U n’est pas non plus un ensemble. entraîne que U n’est pas
un ensemble.
26 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
Démonstration. — L’axiome sur le graphe de la relation d’appartenance
fournit une classe M. On peut alors former la classe M ∩ Mc . Par construc-
tion, elle n’a aucun élément. D’après l’axiome d’extensionalité, c’est la
seule telle classe. □
Proposition (2.1.11). — a) Soit A et B des classes. Il existe une classe et
une seule dont les éléments sont les couples (𝑥, 𝑦), pour 𝑥 ∈ A et 𝑦 ∈ B.
b) Plus généralement, soit 𝑛 un entier ⩾ 1 et soit A1, . . . , A𝑛 des classes. Il
existe une classe et une seule dont les éléments sont les suites (𝑥 1, . . . , 𝑥𝑛 ) où
𝑥 1, . . . , 𝑥𝑛 sont des ensembles tels que 𝑥 1 ∈ A1 , . . ., 𝑥𝑛 ∈ A𝑛 .
On note ces classes A × B et A1 × · · · × A𝑛 . Lorsque toutes les
classes A1, . . . , A𝑛 sont une même classe A, on note A𝑛 la classe produit
A1 × · · · × A𝑛 .
Démonstration. — L’axiome d’extensionalité affirme qu’il existe au plus
une telle classe. Il existe une classe A′ telle que pour tout ensemble 𝑥, on
a 𝑥 ∈ A′ si et seulement s’il existe un ensemble 𝑦 tel que (𝑥, 𝑦) ∈ A. De
même, il existe une classe B′ telle que pour tout ensemble 𝑦, on a 𝑦 ∈
B′ si et seulement s’il existe un ensemble 𝑥 tel que (𝑥, 𝑦) ∈ B. La clase
intersection C = A′ ∩ B′ convient. □
Exercice (2.1.12). — a) Soit A et B des classes. Démontrer que A × B est
vide si et seulement si A est vide ou B est vide.
b) Soit A, B des classes non vides et soit A′, B′ des classes. Démontrer
que A′ × B′ ⊆ A × B si et seulement si A′ ⊆ A et B′ ⊆ B.
Exercice (2.1.13). — Construire une classe D dont les éléments sont les
couples (𝑥, 𝑦) d’ensembles tels que 𝑥 = 𝑦.
Proposition (2.1.14) (Réunion). — Pour toute classe C, il existe une classe,
et une seule, dont les éléments sont les éléments des éléments de C.
Ð
On dit que c’est la réunion de C et on la note C.
Ð La théorie nbgajoute l’axiome de la réunion : si C est un ensemble, alors
C est un ensemble.
Démonstration. — Soit C une classe. Soit E une classe telle pour tous en-
sembles 𝑥, on a (𝑥, 𝑦) ∈ E si et seulement si 𝑥 ∈ 𝑦. Soit C′ une classe
telle que pour tout ensemble 𝑦, on a 𝑦 ∈ C si et seulement s’il existe un
2.1. ENSEMBLES ET CLASSES 27
ensemble 𝑥 tel que (𝑥, 𝑦) ∈ C. L’intersection E ∩ C′ des classes E et C′ a
pour éléments les couples (𝑥, 𝑦) tels que 𝑥 ∈ 𝑦 et 𝑦 ∈ C′. Soit D un do-
maine de E. Si 𝑥 est un ensemble, on a 𝑥 ∈ D si et seulement s’il existe un
ensemble 𝑦 tel que 𝑥 ∈ 𝑦 et 𝑦 ∈ C′. □
Exercice
Ð (2.1.15). — Soit 𝑥 et 𝑦 des ensembles. Démontrer que 𝑥 ∪ 𝑦 =
{𝑥, 𝑦}.
Proposition (2.1.16). — Pour toute classe C, il existe une classe, et une
seule, dont les éléments sont les sous-ensembles de C.
On dit que c’est la classe des parties de C et on la note 𝔓(C). La théo-
rie nbgajoute l’axiome des parties : si C est un ensemble, alors 𝔓(C) est
un ensemble.
Démonstration. — Soit C une classe. L’axiome d’extensionalité garantit
qu’il existe au plus une classe vérifiant la condition de l’énoncé. Pour la
construire, on commence par construire une classe T telle qu’un trouple
(𝑥, 𝑦, 𝑧) d’ensembles appartient à T si et seulement si 𝑥 ∈ 𝑦 entraîne 𝑥 ∈ 𝑧.
Pour cela, on part d’une classe E telle qu’un couple (𝑥, 𝑦) appartient à E
si et seulement si 𝑥 ∈ 𝑦 et on construit deux classes E1 et E2 telles qu’un
trouple (𝑥, 𝑦, 𝑧) appartient à E1 (resp. E2 ) si et seulement si 𝑥 ∈ 𝑦 (resp.
𝑦 ∈ 𝑧). On pose alors T = Ec1 ∪ E2 . On construit alors une classe C′ telle
qu’un trouple (𝑥, 𝑦, 𝑧) d’ensembles appartient à C′ si et seulement si 𝑧 ∈ C.
L’intersection T ∩ C′ convient. □
Proposition (2.1.17). — a) Pour toute classe C, il existe une classe, et une
seule, dont les éléments sont les ensembles qui sont éléments de tous les élé-
ments de C.
b) Si C est la classe vide, cette classe est l’univers.
c) Si C est un ensemble non vide, cette classe est un ensemble.
Ñ
On dit que c’est la intersection de C et on la note C.
Démonstration. — a) La démonstration est semblable aux précédentes.
On considère une classe E telle qu’un couple (𝑥, 𝑦) appartient à E si et
seulement si 𝑥 ∈ 𝑦, et une classe C′ telle qu’un couple (𝑥, 𝑦) appartient
à C′ si et seulement si 𝑦 ∈ C. Un couple (𝑥, 𝑦) appartient à Ec ∩ C′ si et
seulement si 𝑦 ∈ C et 𝑥 ∉ 𝑦. Soit D le domaine de cette classe Ec ∩ C′ ; un
28 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
ensemble 𝑥 appartient à D si et seulement s’il existe 𝑦 ∈ C tel que 𝑥 ∉ 𝑦.
Le complémentaire de D convient. Ñ
b) Il suffit de démontrer
Ñ que tout ensemble appartient à ∅. Si 𝑥 est
un ensemble, alors 𝑥 ∈ ∅ signifie que pour tout ensemble 𝑦 ∈ ∅, on a
𝑥 ∈ 𝑦. La condition est vide, donc vérifiée.
c) Supposons que C soit un ensemble non vide.ÑIl existe alors un en-
semble A tel que A ∈ C. Par
Ñ définition de la classe C, elle est contenue
dans A. Par conséquent, C est un ensemble.
□
2.2. Graphes et fonctions
2.2.1. — On dit qu’une classe G est un graphe si tous ses éléments sont
des couples.
Soit G un graphe. Le domaine dom(G) de G est la classe dont les élé-
ments sont les ensembles 𝑥 tels qu’il existe un ensemble 𝑦 tel que (𝑥, 𝑦) ∈
G. Le codomaine codom(G) de G est la classe dont les éléments sont les
ensembles 𝑦 tels qu’il existe un ensemble 𝑥 tel que (𝑥, 𝑦) ∈ G.
Le symétrique G−1 d’un graphe G est le graphe dont les éléments sont
les couples (𝑥, 𝑦) tels que (𝑦, 𝑥) ∈ G. Son domaine est le codomaine de G,
son codomaine est le domaine de G, son symétrique est G.
Proposition (2.2.2). — Soit G un graphe et soit C une classe. Il existe une
classe, et une seule, dont les éléments sont les ensembles 𝑦 tels qu’il existe
𝑥 ∈ C vérifiant (𝑥, 𝑦) ∈ G.
On note cette classe G⟨C⟩. Elle est contenue dans le codomaine de G, et
est vide si et seulement si C ∩ dom(G) est vide.
Démonstration. — La classe G ∩ (C × U) a pour éléments les couples (𝑥, 𝑦)
tels que 𝑥 ∈ C et (𝑥, 𝑦) ∈ G. Son codomaine convient, et l’axiome d’ex-
tensionalité garantit qu’il existe au plus une telle classe. □
Exercice (2.2.3). — Soit G un graphe et soit C, D des classes telles que
C ⊆ D. Démontrer que G⟨C⟩ ⊆ G⟨D⟩.
2.2. GRAPHES ET FONCTIONS 29
2.2.4. — Une classe F est dite fonctionnelle si pour tous ensembles 𝑥, 𝑦, 𝑧
tels que (𝑥, 𝑦) ∈ F et (𝑥, 𝑧) ∈ F, on a 𝑦 = 𝑧. Autrement dit, pour tout
ensemble 𝑥, il existe au plus un ensemble 𝑦 tel que (𝑥, 𝑦) ∈ F. Ou encore :
la classe F⟨𝑥⟩ possède au plus un élément.
L’axiome de remplacement postule que si F est une classe fonctionnelle
et 𝑥 un ensemble, alors F⟨𝑥⟩ est un ensemble.
Si F est une classe fonctionnelle et 𝑥 est un ensemble appartenant au
domaine de F, la réunion de la classe F⟨{𝑥 }⟩ est un ensemble 𝑦 tel que
F⟨{𝑥 }⟩ = {𝑦} ; cet ensemble est noté F(𝑥).
Ainsi, on peut ainsi considérer une classe fonctionnelle F comme une
fonction définie sur le domaine de F. Pour tout 𝑥 ∈ dom(F), on a F(𝑥) ∈
codom(F).
Si A et B sont des classes, on notera 𝑓 : A → B pour dire que 𝑓 est
une classe fonctionnelle dont le domaine est A et dont le codomaine est
contenu dans B. On dira que 𝑓 est une fonction, ou une application.
Exercice (2.2.5). — Soit F une classe fonctionnelle, soit 𝑥 et 𝑦 des
ensembles appartenant au domaine de F. Démontrer que F⟨{𝑥, 𝑦}⟩ =
{F(𝑥), F(𝑦)}.
2.2.6. — Soit F et G des graphes. On définit un graphe G ◦ F dont les
éléments sont des couples (𝑥, 𝑧) tels qu’il existe un ensemble 𝑦 de sorte
que (𝑥, 𝑦) ∈ F et (𝑦, 𝑧) ∈ G. Son domaine est égal à dom(F)∩F−1 ⟨dom(G)⟩,
son codomaine est égal à G⟨codom(F)⟩, son symétrique est égal à F−1 ◦G−1 .
Si F et G sont des graphes fonctionnels, c’est un graphe fonctionnel.
Si 𝑓 et 𝑔 sont les fonctions correspondantes, on note 𝑔 ◦ 𝑓 la fonction de
graphe F ◦ G.
2.2.7. — Soit 𝑓 : A → B une application. On dit que 𝑓 est injective
([Link], [Link]) si tout élément de B a au plus ([Link]
moins, [Link] un) antécédent par 𝑓 .
Lemme (2.2.8). — Soit 𝑓 : A → B et 𝑔 : B → C des applications.
a) Si 𝑓 et 𝑔 sont injectives, alors 𝑔 ◦ 𝑓 est injective ;
b) Si 𝑓 et 𝑔 sont surjectives, alors 𝑔 ◦ 𝑓 est surjective ;
c) Si 𝑔 ◦ 𝑓 est injective, alors 𝑓 est injective ;
d) Si 𝑔 ◦ 𝑓 est surjective, alors 𝑔 est surjective.
e) En particulier, si 𝑓 et 𝑔 sont bijectives, alors 𝑔 ◦ 𝑓 est bijective.
30 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
2.2.9. — Soit 𝑓 : A → B une application et soit F son graphe. Que 𝑓 soit
injective signifie que F−1 est un graphe fonctionnel. Que 𝑓 soit surjective
signifie que le codomaine de F est égal à B. Par suite, 𝑓 est bijective si et
seulement si le graphe F−1 est le graphe d’une fonction 𝑓 −1 : B → A qui
est la bijection réciproque de 𝑓 .
Proposition (2.2.10). — Soit 𝑓 : A → B une application.
a) Si 𝑓 est injective et A n’est pas vide, il existe une application 𝑔 : B → A
telle que 𝑔 ◦ 𝑓 = IdA (rétraction).
b) Si 𝑓 est surjective, il existe une application 𝑔 : B → A telle que 𝑓 ◦ 𝑔 =
IdB (section).
Démonstration. — a) Choisissons un élément 𝑎 ∈ A et définissons 𝑔
comme suit : si 𝑏 ∈ B appartient à l’image de 𝑓 , on note 𝑔(𝑏) son unique
antécédent ; sinon, on pose 𝑔(𝑏) = 𝑎. Par construction, on a a 𝑔(𝑓 (𝑥)) = 𝑥
pour tout 𝑥 ∈ A.
b) Cela se déduit de l’« axiome du choix » en choisissant, pour tout 𝑏 ∈
B, un antécédent 𝑔(𝑏) de 𝑏 par 𝑓 .
□
2.3. Axiome de l’infini. Nombres entiers ensembles finis.
2.3.1. — Si 𝑥 est un ensemble, on note 𝑥 + l’ensemble 𝑥 ∪ {𝑥 }. Notons que
l’on a 𝑥 ∈ 𝑥 + et 𝑥 ⊆ 𝑥 + .
On dit qu’une classe C est inductive si elle contient l’ensemble vide et
si pour tout 𝑥 ∈ C, on a 𝑥 + ∈ C.
L’univers est évidement une classe inductive.
Proposition (2.3.2). — Soit C uneÑclasse non vide dont tous les éléments
sont des ensembles inductifs. Alors C est un ensemble inductif.
Démonstration. — Comme C est l’intersection d’une classe non vide,
Ñ
c’est un ensemble. Démontrons queÑcet ensemble Ñ est inductif. Pour tout
A ∈ C, on a ∅ ∈ A ; par suite, ∅ ∈ C. Soit 𝑥 ∈ C ; pour tout A ∈ C,
on aÑ𝑥 ∈ A, donc 𝑥 + ∈ A puisque A est un ensemble inductif ; par suite,
𝑥 ∈ C. □
2.3. AXIOME DE L’INFINI. NOMBRES ENTIERS ENSEMBLES FINIS. 31
2.3.3. — L’axiome de l’infini de la théorie nbgpostule l’existence d’un en-
semble inductif.
Cette formulation un peu mystérieuse est due à J. von Neumann.
La classe des ensembles inductifs n’est donc pas vide, et son intersec-
tion 𝜔 est un ensemble inductif contenu dans tout ensemble inductif.
Proposition (2.3.4) (Principe de récurrence). — Soit S une partie de 𝜔.
Si 0 ∈ S et si pour tout 𝑥 ∈ 𝜔, on a 𝑥 + ∈ S, alors S = 𝜔.
Démonstration. — En effet, l’hypothèse affirme que S est inductif. Par dé-
finition de 𝜔, on a donc 𝜔 ⊆ S, d’où S = 𝜔 puisque S ⊆ 𝜔. □
Proposition (2.3.5). — Soit 𝑥, 𝑦 ∈ 𝜔.
a) On a 𝑥 ⊆ 𝜔.
b) Si 𝑦 ∈ 𝑥, on a 𝑦 ⊆ 𝑥.
c) On a 𝑥 ≠ 𝑥 + .
d) Si 𝑥 ≠ 0, il existe un unique élément 𝑦 ∈ 𝜔 tel que 𝑥 = 𝑦 + .
e) Exactement l’une des trois propriétés suivantes est vérifiée : (i) 𝑥 ∈ 𝑦 ;
(ii) 𝑥 = 𝑦 ; (iii) 𝑦 ∈ 𝑥.
Démonstration. — La démonstration requiert plusieurs étapes. Disons
qu’un ensemble A est transitif si pour tout élément 𝑥 ∈ A, on a 𝑥 ⊆ A.
a) L’ensemble 𝜔 est transitif. Soit 𝑥 ∈ 𝜔 ; démontrons que 𝑥 ⊆ 𝜔. On
raisonne par récurrence.
Si 𝑥 = 0, on a 𝑥 ⊆ 𝜔 puisque 𝑥 = ∅.
Supposons l’assertion vérifiée pour 𝑥 et démontrons-la pour 𝑥 + . Par dé-
finition, on a 𝑥 + = 𝑥 ∪ {𝑥 }. Par hypothèse, on a 𝑥 ⊆ 𝜔. Comme 𝑥 ∈ 𝜔, on
a aussi {𝑥 } ⊆ 𝜔. Par conséquent, 𝑥 + ⊆ 𝜔.
b) Pour tout 𝑥 ∈ 𝜔, l’ensemble 𝑥 est transitif.
Soit 𝑦 ∈ 𝑥 ; démontrons que 𝑦 ⊆ 𝑥. On raisonne par récurrence sur 𝑦.
Si 𝑦 = 0, on a 𝑦 = ∅, donc l’hypothèse 𝑥 ∈ 𝑦 n’est jamais vérifiée.
Supposons l’assertion vérifiée pour 𝑦 et démontrons-la pour 𝑦 + . Suppo-
sons donc 𝑥 ∈ 𝑦 + ; par définition, on a 𝑥 ∈ 𝑦 ou 𝑥 = 𝑦. Si 𝑥 ∈ 𝑦, il vient
𝑥 ⊆ 𝑦 par récurrence, d’où 𝑥 ⊆ 𝑦 + puisque 𝑦 ⊆ 𝑦 + . Si 𝑥 = 𝑦, on a alors
𝑥 = 𝑦 ⊆ 𝑦 +.
c) Pour tout 𝑥 ∈ 𝜔, on a 𝑥 ∉ 𝑥.
On raisonne par récurrence.
L’assertion est évidente pour 𝑥 = 0 puisque 𝑥 ∉ ∅.
32 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
Supposons donc que 𝑥 ∉ 𝑥 et démontrons que 𝑥 + ∉ 𝑥 + . Supposons donc
que 𝑥 + ∈ 𝑥 + . Puisque 𝑥 + = 𝑥 ∪ {𝑥 }, cela entraîne 𝑥 + ∈ 𝑥 ou 𝑥 + = 𝑥. Dans
le premier cas, on en déduit que 𝑥 + ⊆ 𝑥, car 𝑥 est transitif, et de même
dans le second cas puisque 𝑥 ⊆ 𝑥 + . Comme 𝑥 ∈ 𝑥 + , on a donc 𝑥 ∈ 𝑥, ce
qui contredit l’hypothèse de récurrence.
d) Pour tous 𝑥, 𝑦 ∈ 𝜔, les assertions 𝑥 ∈ 𝑦 et 𝑥 + ∈ 𝑦 + sont équivalentes.
⇒. Supposons 𝑥 ∈ 𝑦 et démontrons que 𝑥 + ∈ 𝑦 + . On raisonne par
récurrence sur 𝑦. Il n’y a rien à démontrer si 𝑦 = ∅. Supposons donc
que pour tout 𝑥 ∈ 𝑦, on ait 𝑥 + ∈ 𝑦 + et démontrons que 𝑥 ∈ 𝑦 + entraîne
𝑥 + ∈ 𝑦 ++ .
Soit 𝑥 ∈ 𝑦 + . Puisque 𝑦 + = 𝑦 ∪ {𝑦}, on a 𝑥 ∈ 𝑦 ou 𝑥 = 𝑦. Dans le premier
cas, l’hypothèse de récurrence entraîne que l’on a 𝑥 + ∈ 𝑦 + , donc 𝑥 + ∈ 𝑦 ++
puisque 𝑦 + ⊆ 𝑦 ++ . Dans le second cas, on a 𝑥 + = 𝑦 + ∈ 𝑦 ++ .
⇐. Supposons que 𝑥 + ∈ 𝑦 + et démontrons que 𝑥 ∈ 𝑦. Comme 𝑦 + =
𝑦 ∪ {𝑦}, on a donc 𝑥 + ∈ 𝑦 ou 𝑥 + = 𝑦. Dans le second cas, l’assertion à
démontrer découle de ce que 𝑥 ∈ 𝑥 + . Dans le premier cas, il vient 𝑥 + ⊆ 𝑦,
car 𝑦 est un ensemble transitif, d’où 𝑥 ∈ 𝑦 car 𝑥 ∈ 𝑥 + .
e) Pour tout 𝑥 ∈ 𝜔 tel que 𝑥 ≠ 0, il existe 𝑦 ∈ 𝜔 tel que 𝑥 = 𝑦 + .
On raisonne par récurrence sur 𝑥. L’assertion est vide si 𝑥 = 0.
Supposons-la vraie pour 𝑥 et démontrons-la pour 𝑥 + . Il existe alors 𝑦 ∈ 𝜔
tel que 𝑥 =𝑦 + , à savoir 𝑦 = 𝑥 !
f) Pour tout 𝑥 ∈ 𝜔 tel que 𝑥 ≠ ∅, on a ∅ ∈ 𝑥.
On raisonne par récurrence. L’assertion est vide si 𝑥 = ∅. Si ∅ ∈ 𝑥, alors
∅ ∈ 𝑥 + , car 𝑥 ⊆ 𝑥 + .
g) Pour tous 𝑥, 𝑦 ∈ 𝜔, exactement l’une des trois assertions suivantes est
vérifiée : (1) 𝑥 ∈ 𝑦 ; (2) 𝑥 = 𝑦 ; (3) 𝑦 ∈ 𝑥.
Démontrons qu’au plus une de ces trois assertions est vérifiée. Si 𝑥 ∈ 𝑦
et 𝑥 = 𝑦, alors 𝑥 ∈ 𝑥, ce qui contredit un résultat antérieur ; on raisonne
de même si 𝑦 ∈ 𝑥 et 𝑥 = 𝑦. Enfin, si 𝑥 ∈ 𝑦 et 𝑦 ∈ 𝑥, on a 𝑥 ⊆ 𝑦 et 𝑦 ⊆ 𝑥,
donc 𝑥 = 𝑦, donc 𝑥 ∈ 𝑥 et on retrouve une contradiction.
Raisonnons alors par récurrence sur 𝑥.
Supposons 𝑥 = 0, c’est-à-dire 𝑥 = ∅. Si 𝑦 = ∅, alors 𝑥 = 𝑦. Sinon, on a
∅ ∈ 𝑦, c’est-à-dire 𝑥 ∈ 𝑦.
Supposons que pour tout 𝑦, l’une des trois assertions 𝑥 ∈ 𝑦, 𝑥 = 𝑦 et
𝑦 ∈ 𝑥 est vérifiée, et prouvons que pour tout 𝑦, l’une des trois assertions
𝑥 + ∈ 𝑦, 𝑥 + = 𝑦 et 𝑦 ∈ 𝑥 + est vérifiée.
2.3. AXIOME DE L’INFINI. NOMBRES ENTIERS ENSEMBLES FINIS. 33
Si 𝑦 ∈ 𝑥 ou si 𝑦 = 𝑥, alors 𝑦 ∈ 𝑥 + . Supposons donc que 𝑥 ∈ 𝑦. D’après
un résultat antérieur, on a donc 𝑥 + ∈ 𝑦 + , d’où 𝑥 + ∈ 𝑦 ou 𝑥 + = 𝑦, compte
tenu de la définition de 𝑦 + .
h) Pour tous 𝑥, 𝑦 ∈ 𝜔 tels que 𝑥 + = 𝑦 + , on a 𝑥 = 𝑦.
D’après le résultat précédent, on a 𝑥 ∈ 𝑦 ou 𝑥 = 𝑦 ou 𝑦 ∈ 𝑥 ; par symétrie,
il suffit de déduire une contradiction de l’hypothèse 𝑥 ∈ 𝑦. Alors, 𝑥 + ∈ 𝑦 + ,
donc 𝑥 + ∈ 𝑥 + , ce qui est impossible.
□
Proposition (2.3.6) (Construction par récurrence)
Soit A un ensemble, soit F : 𝜔 × A → A une application et soit 𝑎 ∈ A.
Il existe une unique application 𝑢 : 𝜔 → A telle que 𝑢 (∅) = 𝑎 et 𝑢 (𝑥 + ) =
F(𝑥, 𝑢 (𝑥)) pour tout 𝑥 ∈ 𝜔.
Démonstration. — Démontrons d’abord l’unicité d’une telle application 𝑢.
Soit 𝑢, 𝑣 des applications vérifiant ces propriétés. Si 𝑥 = ∅, on a 𝑢 (∅) =
𝑣 (∅) = 𝑎. Si 𝑢 (𝑥) = 𝑣 (𝑥), alors 𝑢 (𝑥 + ) = F(𝑥, 𝑢 (𝑥)) = F(𝑥, 𝑣 (𝑥)) = 𝑣 (𝑥 + ).
Par récurrence, il s’ensuite que 𝑢 (𝑥) = 𝑣 (𝑥) pour tout 𝑥 ∈ 𝜔.
Démontrons maintenant l’existence d’une telle application. On dit
qu’une partie G de 𝜔 × A est F-admissible si elle contient (∅, 𝑎) et si pour
tout (𝑥, 𝑦) ∈ G, on a (𝑥 +, F(𝑥, 𝑦)) ∈ G. Il existe des parties F-admissibles,
par exemple 𝜔 ×A. Soit G l’intersection de toutes les parties F-admissibles
de 𝜔 × A. Il est immédiat que c’est une partie F-admissible.
Démontrons que G est le graphe d’une application 𝜔 → A. Il s’agit de
prouver que pour tout 𝑥 ∈ 𝜔, il existe exactement un élément 𝑦 ∈ A tel
que (𝑥, 𝑦) ∈ G. Raisonnons par récurrence sur 𝑥.
Supposons 𝑥 = ∅. Si 𝑏 ≠ 𝑎, alors G {(∅, 𝑏)} est encore F-admissible.
Par suite, 𝑦 = 𝑎 est le seul élément de A tel que (∅, 𝑦) ∈ G.
Supposons maintenant qu’il existe exactement un élément 𝑦 ∈ A tel que
(𝑥, 𝑦) ∈ G et démontrons qu’il existe exactement un élément 𝑧 ∈ A tel que
(𝑥 +, 𝑧) ∈ G. Par définition d’une partie F-admissible, 𝑧 = F(𝑥, 𝑦) convient.
Soit 𝑧 ′ un élément de A distinct de 𝑧. Alors G {(𝑥 +, 𝑧 ′)} est encore une
partie F-admissible. Par conséquent, elle contient G, ce qui prouve que
(𝑥, 𝑧 ′) ∉ G. Ainsi, 𝑧 est le seul élément de A tel que (𝑥 +, 𝑧) ∈ G. □
2.3.7. Relation d’ordre. — Considérons a relation d’appartenance
« 𝑥 ∈ 𝑦 » dans 𝜔. Si 𝑥 ∈ 𝑦 et 𝑦 ∈ 𝑧, alors 𝑦 ⊆ 𝑧, donc 𝑥 ∈ 𝑧 : cette relation
34 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
est transitive. Pour tout 𝑥, on n’a pas 𝑥 ∈ 𝑥 : cette relation est irréflexive.
C’est donc une relation d’ordre strict dans 𝜔.
La dernière propriété de la proposition signifie que la relation d’ordre
large associée, « 𝑥 ∈ 𝑦 ou 𝑥 = 𝑦 », est totale. En fait, cette relation large
équivaut à « 𝑥 ⊆ 𝑦 » : Si 𝑥 ∈ 𝑦 ou 𝑥 = 𝑦, on a 𝑥 ⊆ 𝑦. Inversement, si 𝑥 ⊆ 𝑦,
il s’agit de prouver que l’on n’a pas 𝑦 ∈ 𝑥. Or, si 𝑦 ∈ 𝑥 et 𝑥 ⊆ 𝑦, on en
déduit 𝑦 ∈ 𝑦, ce qui est absurde.
2.3.8. — À ce point, l’ensemble 𝜔, muni de l’opération 𝑥 ↦→ 𝑥 + , vérifie
précisément les propriétés postulées par R. Dedekind et G. Peano pour
l’ensemble des nombres entiers.
L’opération 𝑥 ↦→ 𝑥 + est appelée successeur.
L’ensemble vide appartient à 𝜔 ; on le note 0 ; l’ensemble 0+ = ∅∪{∅} =
{∅} = {0} est noté 1 ; l’ensemble 1+ = 1 ∪ {1} = {∅, {∅}} = {0, 1} est
noté 2, etc. Plus généralement, l’ensemble 𝑛 est l’ensemble {0, 1, . . . , 𝑛 − 1}
des entiers 𝑚 tels que 𝑚 < 𝑛 (ou 𝑚 ∈ 𝑛).
Une construction assez fastidieuse permet de définir les opérations
arithmétiques sur l’ensemble des nombres entiers, que l’on note plutôt N.
2.3.9. Addition. — On démontre qu’il existe une unique application
𝑎 : N × N → N vérifiant les deux propriétés
a) Pour tout 𝑥 ∈ N, on a 𝑎(𝑥, 0) = 𝑥 ;
b) Pour tous 𝑥, 𝑦 ∈ N, on a 𝑎(𝑥, 𝑦 + ) = 𝑎(𝑥, 𝑦) + .
On établit en outre que 𝑎 est associative, commutative et que 0 est un
élément neutre. C’est l’addition des entiers naturels. On note bien sûr 𝑥 +
𝑦 = 𝑎(𝑥, 𝑦). On a 𝑥 + 1 = 𝑥 + .
L’addition est simplifiable : si 𝑥 + 𝑦 = 𝑥 + 𝑧, alors 𝑦 = 𝑧.
On démontre que 𝑥 ⩽ 𝑦 si et seulement s’il existe 𝑧 tel que 𝑥 + 𝑧 = 𝑦. Il
existe au plus un tel entier, et on le note 𝑦 − 𝑥.
2.3.10. Multiplication. — On démontre qu’il existe une unique appli-
cation 𝑚 : N × N → N vérifiant les deux propriétés
a) Pour tout 𝑥 ∈ N, on a 𝑚(𝑥, 0) = 0 ;
b) Pour tous 𝑥, 𝑦 ∈ N, on a 𝑚(𝑥, 𝑦 + ) = 𝑚(𝑥, 𝑦) + 𝑥.
On établit que 𝑚 est associative, commutative, que 1 est un élément
neutre, et que 𝑚 est distributive par rapport à l’addition. C’est la multipli-
cation des entiers naturels et l’on note 𝑥 · 𝑦 = 𝑚(𝑥, 𝑦).
2.3. AXIOME DE L’INFINI. NOMBRES ENTIERS ENSEMBLES FINIS. 35
Lemme (2.3.11). — Soit 𝑚 et 𝑛 des entiers naturels.
a) Pour qu’il existe une surjection 𝑓 : 𝑚 → 𝑛, il faut et il suffit que 𝑚 ⩾ 𝑛.
b) Pour qu’il existe une injection 𝑓 : 𝑚 → 𝑛, il faut et il suffit que 𝑚 ⩽ 𝑛.
c) Pour qu’il existe une bijection 𝑓 : 𝑚 → 𝑛, il faut et il suffit que 𝑚 = 𝑛.
Démonstration. — a) Supposons 𝑚 ⩾ 𝑛. Si 𝑛 = 0, c’est-à-dire 𝑛 = ∅,
il ne peut exister d’application 𝑓 : 𝑚 → 𝑛 que si 𝑚 = 0 ; l’application
identique convient. On suppose donc 𝑛 ≠ 0. Alors 0 ∈ 𝑛 et 𝑛 ⊆ 𝑚 ; l’ap-
plication qui coïncide avec l’application identique sur 𝑛 et applique tout
autre élément sur 0 convient.
Supposons maintenant qu’il existe une surjection 𝑓 : 𝑚 → 𝑛 et démon-
trons que 𝑚 ⩾ 𝑛. Il n’y a rien a démontrer si 𝑛 = 0, car l’ensemble 𝑛 est
alors vide. Supposons l’assertion vérifiée pour 𝑛 et démontrons-la pour 𝑛 + .
Soit 𝑓 : 𝑚 → 𝑛 + = 𝑛 ∪ {𝑛} une application surjective. Nécessairement, on
a 𝑚 ≠ ∅, de sorte que 𝑚 s’écrit 𝑝 + . Si 𝑛 = 0, on a 𝑛 ⩽ 𝑝, donc 𝑛 + ⩽ 𝑝 + .
Si 𝑛 ≠ 0 et 𝑓 (𝑚) = 𝑛, on définit une application 𝑔 : 𝑚 → 𝑛 en posant
𝑔(𝑎) = 𝑓 (𝑎) si 𝑓 (𝑎) ≠ 𝑛 et 𝑔(𝑎) = 0 sinon. Elle est surjective ; par récur-
rence, on a donc 𝑚 ⩾ 𝑛, d’où 𝑚 + ⩾ 𝑛 + .
Si 𝑓 (𝑚) ≠ 𝑛, on choisit un antécédent 𝑏 de 𝑛 par 𝑓 et on compose 𝑓 avec
la transposition qui échange 𝑏 et 𝑛 ; la nouvelle application 𝑓 ′ : 𝑚 → 𝑛 est
surjective et applique 𝑚 sur 𝑛 ; on est ainsi ramené au cas précédent.
b) Si 𝑚 ⩽ 𝑛, on a 𝑚 ⊆ 𝑛 et l’application d’inclusion est injective.
Soit 𝑓 : 𝑚 → 𝑛 une application injective et démontrons que 𝑚 ⩽ 𝑛.
On raisonne par récurrence sur 𝑚. Si 𝑚 = 0, l’assertion est évidente.
Supposons-la pour un entier 𝑚 et démontrons-la pour 𝑚 + ; soit 𝑓 : 𝑚 + → 𝑛
une application injective. Comme 𝑚 + ≠ ∅, on a 𝑛 ≠ ∅ ; par suite, il existe
un entier 𝑝 tel que 𝑛 = 𝑝 + . Soit 𝑎 ∈ 𝑚 ; si 𝑓 (𝑎) ∉ 𝑝, on a 𝑓 (𝑎) = 𝑝 ; comme 𝑓
est injective et 𝑎 ≠ 𝑚, on a 𝑓 (𝑚) ≠ 𝑝, donc 𝑓 (𝑚) ∈ 𝑝. On définit ainsi une
application 𝑔 : 𝑚 → 𝑝 en posant 𝑔(𝑎) = 𝑓 (𝑎) si 𝑓 (𝑎) ∈ 𝑝, et 𝑔(𝑎) = 𝑓 (𝑚)
sinon. Cette application est injective. Par récurrence, on a 𝑚 ⩽ 𝑝 ; par
suite, 𝑚 + ⩽ 𝑝 + = 𝑛.
c) Cela résulte des deux points précédents.
□
Définition (2.3.12). — On dit qu’un ensemble A est fini s’il existe un entier
naturel 𝑛 et une bijection 𝑓 : {0, 1, . . . , 𝑛 − 1} → A. Il existe alors un seul tel
36 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
entier ; on dit que c’est le cardinal de l’ensemble A et on le note Card(A), ou
|A|.
L’ensemble vide est le seul ensemble fini de cardinal 0.
Les ensembles finis de cardinal 1 sont les singletons {𝑥 } est fini.
Les ensembles finis de cardinal 2 sont les paires {𝑥, 𝑦}, pour 𝑥 ≠ 𝑦.
Lemme (2.3.13). — Soit 𝑛 un entier et soit A une partie de 𝑛. Il existe une
bijection 𝑓 : 𝑛 → 𝑛 et un entier 𝑚 ⩽ 𝑛 tels que 𝑓 ⟨𝑚⟩ = A.
Démonstration. — On raisonne par récurrence sur 𝑛.
Si 𝑛 = 0, alors A et 𝑛 sont vides et on pose 𝑚 = 0 et 𝑓 = Id.
Soit alors A une partie de 𝑛 + . Si A = 𝑛 + , on pose 𝑚 = 𝑛 + et 𝑓 = Id.
Sinon, il existe un élément 𝑎 ∈ 𝑛 + tel que 𝑎 ∉ A. Soit 𝑔 la transposition
qui échange les éléments 𝑎 et 𝑛 de 𝑛 + . L’ensemble B = 𝑔⟨A⟩ est une partie
de 𝑛 + qui ne contient pas 𝑛 ; on la considère comme une partie de 𝑛 ; par
récurrence, il existe une bijection 𝑓 : 𝑛 → 𝑛 et un entier 𝑚 ⩽ 𝑛 tels que
𝑓 ⟨𝑚⟩ = B. Prolongeons 𝑓 en une bijection 𝑓 ′ : 𝑛 + → 𝑛 + en posant 𝑓 ′ (𝑛) =
𝑛. La bijection 𝑔−1 ◦ 𝑓 ′ convient. □
Proposition (2.3.14). — Soit A un ensemble fini. Pour toute partie B de A,
l’ensemble B est fini et l’on a Card(B) ⩽ Card(A). Plus précisément, A B
est également fini et l’on a Card(A) = Card(B) + Card(A B).
Démonstration. — Soit 𝑛 = Card(A) et soit 𝑓 : 𝑛 → A une bijection.
Si 𝑛 = 0, alors 𝑛 est vide, donc A et B aussi et l’on a le résultat voulu.
On suppose maintenant que 𝑛 ≠ 0.
Soit 𝑔 : 𝑛 → 𝑛 une bijection et soit 𝑚 un entier tels que 𝑔⟨𝑚⟩ = 𝑓 −1 ⟨B⟩.
alors 𝑓 ◦𝑔 est une bijection de 𝑛 sur A telle que 𝑓 ◦𝑔⟨𝑚⟩ = B. Cela démontre
que B est fini, de cardinal 𝑚. En particulier, Card(B) ⩽ Card(A).
Par le même argument, A B est fini et son cardinal est le même que
celui de la partie {𝑚, . . . , 𝑛 − 1} de 𝑛. Il reste à observer l’application 𝑝 ↦→
𝑝 + 𝑚 est une bijection de (𝑛 − 𝑚) sur cette partie, si bien qu’elle est de
cardinal 𝑛 − 𝑚, □
Corollaire (2.3.15). — Soit A et B des ensembles finis tels que Card(A) =
Card(B) et soit 𝑓 : A → B une application. Les conditions suivantes sont
équivalentes :
2.3. AXIOME DE L’INFINI. NOMBRES ENTIERS ENSEMBLES FINIS. 37
a) 𝑓 est injective ;
b) 𝑓 est surjective ;
c) 𝑓 est bijective.
Démonstration. — Supposons que 𝑓 est injective. Elle induit une bijection
de A sur son image ; on a alors Card(𝑓 ⟨A⟩) = Card(A) = Card(B), donc
Card(B 𝑓 ⟨A⟩) = 0 et B 𝑓 ⟨A⟩ = ∅, c’est-à-dire 𝑓 (A) = B. Par suite, 𝑓
est surjective.
Supposons que 𝑓 est surjective et soit 𝑔 : B → A une section de 𝑓 .
Comme 𝑔 est injective, le cas déjà traité entraîne que 𝑔 est surjective, donc
bijective. Puisque 𝑓 ◦ 𝑔 = IdB , l’application 𝑓 = 𝑔−1 est bijective.
Enfin, si 𝑓 est bijective, elle est également injective. □
Corollaire (2.3.16). — L’ensemble N n’est pas fini.
Démonstration. — Supposons que N soit fini et soit 𝑝 son cardinal. Puis-
quei l’inclusion de 𝑝 + dans N est une application injective, on a donc
𝑝 + ⩽ 𝑝, ce qui contredit un résultat antérieur. □
Corollaire (2.3.17). — Soit A un ensemble fini et soit (A1, . . . , A𝑝 ) une par-
tition finie de Í
A. Pour tout entier 𝑖 ∈ {1, . . . , 𝑝}, l’ensemble A𝑖 est fini et l’on
a Card(A) = 𝑖=1 Card(A𝑖 ).
𝑝
Démonstration. — Cela se déduit de la proposition par récurrence sur 𝑝.
□
Corollaire (2.3.18). — Soit 𝑓 : A → B une application. On suppose que B
est fini et que pourÍtout 𝑏 ∈ B, l’ensemble 𝑓 −1 (𝑏) est fini ; alors A est fini et
l’on a Card(A) = 𝑏∈B Card(𝑓 −1 (𝑏)).
Démonstration. — Soit 𝑔 : 𝑝 → B une bijection ; pour tout 𝑖 ∈ 𝑝, on pose
A𝑖 = 𝑓 −1 (𝑔(𝑖)). La suite (A0, . . . , A𝑝−1 ) est une partition de A. Par suite,
Card(A) = 𝑖=0 Card(A𝑖 ) = 𝑏∈B Card(𝑓 −1 (𝑏)).
Í𝑝−1 Í
□
Corollaire (2.3.19). — Soit A et B des ensembles finis. L’ensemble A × B est
fini, de cardinal Card(A) Card(B).
38 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
Démonstration. — Considérons la seconde projection 𝑝 : (𝑎, 𝑏) ↦→ 𝑏 de
A × B dans B. Pour tout 𝑏 ∈ B, l’application 𝑎 ↦→ (𝑎, 𝑏) est une bijec-
tion de A sur l’ensemble 𝑝 −1 (𝑏). Le corollaire résulte donc du corollaire
précédent, appliqué à l’application 𝑝. □
Proposition (2.3.20). — Soit A et B des ensembles finis. L’ensemble
F (A; B) des applications de A dans B est fini, de cardinal Card(B) Card(A) .
Démonstration. — Soit 𝑛 un entier et soit 𝑓 : {0, . . . , 𝑛 − 1} → A une bi-
jection. On démontre la proposition par récurrence sur 𝑛. Si 𝑛 = 0, alors
A = ∅ et il n’y a qu’une application de A dans B (dont le graphe est vide).
Alors, Card(F (A; B)) = 1 = Card(B) 0 . Posons sinon 𝑎 = 𝑓 (𝑛 − 1) et
A′ = A {𝑎}. L’application 𝑢 ↦→ (𝑢 | A′ , 𝑢 (𝑎)) est une bijection de F (A; B)
sur F (A′; B) × B. Par récurrence, l’ensemble F (A′; B) est fini, de cardinal
′
Card(B) Card(A ) . Ainsi, l’ensemble F (A; B) est fini et son cardinal est égal
à
′
Card(F (A′; B)) Card(B) = Card(B) Card(A ) Card(B)
′
= Card(B) Card(A )+1
= Card(B) Card(A) . □
Corollaire (2.3.21). — Pour tout ensemble fini A, l’ensemble P (A) des par-
ties de A est fini, de cardinal 2Card(A) .
Démonstration. — Pour toute partie B de A, notons 𝜒 B sa fonction indi-
catrice, définie par 𝜒 B (𝑎) = 1 si 𝑎 ∈ B et 𝜒 B (𝑎) = 0 sinon. L’application
B ↦→ 𝜒 B est une bijection de P (A) dans F (A; {0, 1}). D’après la propo-
sition précédente, l’ensemble F (A; {0, 1}) est fini, de cardinal 2Card(A) . Le
corollaire en résulte. □
2.4. Axiome du choix
2.4.1. — L’axiome du choix global postule qu’il existe une classe fonction-
nelle C tel que tout ensemble non vide 𝑥 appartient au domaine de C et
C(𝑥) appartient à 𝑥.
2.4. AXIOME DU CHOIX 39
Une telle classe C est appelée « classe de choix globale ». C’est un
axiome assez fort, indépendant des axiomes antérieurs. On l’utilisera
dans une variante restreinte aux ensembles.
Proposition (2.4.2) (Axiome du choix). — Soit A un ensemble. Il existe
une graphe fonctionnel CA contenu dans 𝔓(A) × A tel que si 𝑥 est une partie
non vide de A, l’ensemble 𝑐 appartient au domaine de CA et CA (𝑥) ∈ 𝑥.
Démonstration. — Soit C une classe de choix globale et soit CA = C ∩
(𝔓(A) × A). C’est une partie d’un graphe fonctionnel donc est un graphe
fonctionnel. Soit 𝑥 une partie non vide de A. Alors 𝑥 appartient au do-
maine de C, donc il existe un ensemble 𝑦 tel que (𝑥, 𝑦) ∈ C. De plus,
𝑥 ∈ 𝔓(A). Par définition de C, on a 𝑦 ∈ 𝑥 ; par conséquent, 𝑦 ∈ A, ce qui
prouve que (𝑥, 𝑦) ∈ CA . Ainsi, 𝑥 appartient au domaine de CA . De plus,
on a C(𝑥) = 𝑦, si bien que CA vérifie la propriété voulue. □
Corollaire (2.4.3). — Soit I un ensemble
Î et soit (A𝑖 )𝑖∈I une famille d’en-
sembles non vides. L’ensemble produit 𝑖∈I A𝑖 n’est pas vide.
Démonstration. — Soit A la réunion de la famille (A𝑖 ). Soit CA une fonc-
tion de choix sur A : aour toute partie non vide 𝑥 de A, CA (𝑥)Îest un élé-
ment de 𝑥. L’application 𝑖 ↦→ CA (A𝑖 ) est donc un élément de 𝑖 A𝑖 . □
Remarque (2.4.4). — Il est important d’observer que l’axiome du choix
concerne les ensembles infinis. En effet, si I est un ensemble fini et (A𝑖 )
une famille d’ensembles
Î non vides, on n’a pas besoin de l’axiome du choix
pour démontrer que 𝑖∈I A𝑖 n’est pas vide, on peut raisonner par récur-
rence sur Card(I).
Proposition (2.4.5) (Axiome du choix dépendant dénombrable)
Soit A un ensemble et soit (R𝑛 ) une suite de parties de A × A. On suppose
que pour tout 𝑛 ∈ 𝜔 et tout 𝑎 ∈ A, il existe 𝑏 ∈ A tel que (𝑎, 𝑏) ∈ R𝑛 .
Pour tout 𝑎 ∈ A, il existe une application 𝑓 : 𝜔 → A telle que 𝑓 (0) = 𝑎 et
(𝑓 (𝑛), 𝑓 (𝑛 + )) ∈ R𝑛 pour tout 𝑛 ∈ 𝜔.
Démonstration. — On fixe une fonction de choix global C. Pour tout 𝑛 ∈ 𝜔
et tout 𝑥 ∈ A, notons A(𝑛, 𝑥) l’ensemble des 𝑦 ∈ A tels que (𝑥, 𝑦) ∈ R𝑛 .
Par hypothèse, c’est un ensemble non vide. Soit alors F : 𝑛 × A → A l’ap-
plication (𝑛, 𝑥) ↦→ C(A(𝑛, 𝑥)). Il existe une unique application 𝑓 : 𝜔 → A
40 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
telle que 𝑓 (0) = 𝑎 et 𝑓 (𝑛 + ) = F(𝑛, 𝑓 (𝑛)) pour tout 𝑛 ∈ 𝜔. Par construction,
on a (𝑓 (𝑛), 𝑓 (𝑛 + )) ∈ R𝑛 pour tout 𝑛. Comme 𝑓 (0) = 𝑎, cela montre que la
fonction 𝑓 convient. □
Proposition (2.4.6). — Soit A un ensemble qui n’est pas fini. Il existe une
application injective 𝑓 : 𝜔 → A.
Démonstration. — Pour tout 𝑛 ∈ 𝜔, soit R𝑛 l’ensemble des couples (𝑓 , 𝑔),
où 𝑓 : 𝑛 → A et 𝑔 : 𝑛 + → A sont des applications injectives telles que
𝑓 (𝑥) = 𝑔(𝑥) pour tout 𝑥 ∈ 𝑛.
Soit 𝑛 ∈ 𝜔 et soit 𝑓 : 𝑛 → A une application injective. toute application
injective. Elle n’est pas bijective, car A n’est pas fini. Par suite, elle n’est pas
surjective et il existe un élément 𝑎 ∈ A tel que 𝑎 ∉ 𝑓 ⟨𝑛⟩. Soit 𝑔 : 𝑛 + → A
l’application prolongeant 𝑓 telle que 𝑔(𝑛) = 𝑎. Elle est injective et l’on a
(𝑓 , 𝑔) ∈ R𝑛 .
D’après le principe du choix dépendant, il existe une suite (𝑓𝑛 ) où pour
tout 𝑛, 𝑓𝑛 : 𝑛 → A est une application injective et (𝑓𝑛 , 𝑓𝑛+ ) ∈ R𝑛 .
Soit ℎ : 𝜔 → A l’application donnée par ℎ(𝑛) = 𝑓𝑛+ (𝑛) pour tout 𝑛 ∈ 𝜔.
Par construction, on a ℎ(𝑛) = 𝑓𝑚 (𝑛) pour tout 𝑚 > 𝑛. On en déduit que ℎ
est injective. □
Corollaire (2.4.7). — Soit A un ensemble qui n’est pas fini. Il existe une
application injective 𝑓 : A → A qui n’est pas surjective.
C’est Dedekind qui a mis en évidence ce critère qui explique, enfin, le
nom donné à l’axiome de l’infini.
Démonstration. — Soit ℎ : 𝜔 → A une application injective. On définit
une application 𝑓 : A → A de la façon suivante : si 𝑎 ∈ A appartient
à ℎ⟨𝜔⟩, on pose 𝑓 (𝑎) = ℎ(𝑛 + ), où 𝑛 est l’unique entier tel que 𝑎 = ℎ(𝑛) ;
sinon, on pose 𝑓 (𝑎) = 𝑎. Cette application est injective et n’est pas sur-
jective puisque ℎ(0) n’appartient pas à son image. □
2.5. Ensembles dénombrables
Définition (2.5.1). — Soit A un ensemble. On dit que A est dénombrable
s’il existe une application injective de A dans 𝜔.
2.5. ENSEMBLES DÉNOMBRABLES 41
Un ensemble fini est dénombrable.
Une partie d’un ensemble dénombrable est dénombrable.
Lemme (2.5.2). — Soit 𝑓 : A → B une application surjective. Si A est dé-
nombrable, alors B est dénombrable.
Démonstration. — Soit 𝑔 : B → A une section de l’application 𝑓 . C’est une
bijection de B sur une partie de A. Par suite, B est dénombrable. □
Proposition (2.5.3). — Soit A une partie de N. Si A n’est pas finie, il existe
une unique bijection croissante 𝑓 : N → A.
Démonstration. — Pour tout entier 𝑚 ∈ N et toute application 𝑓 : {0, . . . , 𝑚−
1} → A, l’ensemble A {𝑓 (0), . . . , 𝑓 (𝑚 − 1)} n’est pas fini, donc n’est
pas vide ; il possède donc un plus petit élément. On définit alors une
application 𝑓 : N → A par récurrence de la façon suivante : pour tout
entier 𝑚, 𝑓 (𝑚) est le plus petit élément de A {𝑓 (0), . . . , 𝑓 (𝑚 − 1)}.
L’application 𝑓 ainsi définie est strictement croissante. Soit en effet un
élément 𝑚 ∈ N tel que 𝑚 ⩾ 1 ; par hypothèse, 𝑓 (𝑚 − 1) est le plus petit
élément de A {𝑓 (0), . . . , 𝑓 (𝑚 − 2)} et 𝑓 (𝑚) est le plus petit élément
de A {𝑓 (0), . . . , 𝑓 (𝑚 − 1)}. Cela entraîne 𝑓 (𝑚) ≠ 𝑓 (𝑚 − 1) ; si l’on
avait 𝑓 (𝑚) ⩽ 𝑓 (𝑚 − 1), on aurait 𝑓 (𝑚) < 𝑓 (𝑚 − 1) ce qui contredirait
la définition de 𝑓 (𝑚 − 1). En particulier, l’application 𝑓 est injective.
Démontrons qu’elle est surjective. Raisonnons par l’absurde et suppo-
sons qu’un élément 𝑎 ∈ A n’appartient pas à l’image de 𝑓 . Comme 𝑓 est
injective, on a 𝑓 (𝑚) ⩾ 𝑚 pour tout entier 𝑚 ; en particulier, 𝑓 (𝑎) ⩾ 𝑎,
donc 𝑓 (𝑎) > 𝑎. Par suite, 𝑎 est un élément de A {𝑓 (0), . . . , 𝑓 (𝑎 − 1)}
strictement inférieur à 𝑓 (𝑎), ce qui contredit la définition de 𝑓 (𝑎). Ainsi,
𝑓 : N → A est une bijection croissante.
Soit 𝑔 : N → A une bijection croissante et posons ℎ = 𝑔−1 ◦ 𝑓 . L’appli-
cation ℎ est une bijection croissante de N dans N ; démontrons par récur-
rence sur 𝑛 que ℎ(𝑛) = 𝑛 pour tout 𝑛 ∈ N. Soit 𝑎 l’antécédent de 0 par ℎ.
Comme 𝑎 ⩾ 0, on a 0 = ℎ(𝑎) ⩾ ℎ(0) ⩾ 0, d’où ℎ(0) = 0. Supposons que
ℎ(𝑚) = 𝑚 pour tout entier 𝑚 tel que 𝑚 < 𝑛 et démontrons que ℎ(𝑛) = 𝑛 ;
soit 𝑎 l’antécédent de 𝑛 par ℎ. Comme ℎ(𝑚) < 𝑛 pour 𝑚 < 𝑛, on a 𝑎 ⩾ 𝑛.
Par suite, 𝑛 = ℎ(𝑎) ⩾ ℎ(𝑛) > ℎ(𝑛 − 1) = 𝑛 − 1, donc 𝑛 = ℎ(𝑛). On a donc
ℎ = Id, d’où 𝑓 = 𝑔. □
42 CHAPITRE 2. ENSEMBLES ET NOMBRES ENTIERS — COMPTER
Corollaire (2.5.4). — Soit A un ensemble dénombrable. Si A n’est pas fini,
il existe une bijection de N dans A.
Démonstration. — Soit 𝑓 : A → N une application injective et soit
𝑓 ′ : 𝑓 (A) → A l’application qui associe à un élément de 𝑓 (A) son unique
antécédent par 𝑓 . Alors 𝑓 (A) est une partie de N qui n’est pas finie. Il
existe donc une bijection 𝑔 : N → 𝑓 (A) et l’application 𝑓 ′ ◦ 𝑔 est une
bijection de N sur A. □
Proposition (2.5.5). — L’ensemble N × N est dénombrable.
Démonstration. — Voici deux preuves.
a) Soit 𝑓 : N × N → N l’application définie par 𝑓 (𝑚, 𝑛) = 2𝑚 3𝑛 ; elle est
injective, en vertu de l’unicité de la décomposition en facteurs premiers.
Cela démontre que N × N est dénombrable.
b) On construit une application de N × N dans N en parcourant le qua-
drant N2 diagonale descendante par diagonale descendante, par la formule
suivante :
𝑚+𝑛−1
∑︁ 1
𝑓 (𝑚, 𝑛) = (𝑝 + 1) + 𝑚 = (𝑚 + 𝑛)(𝑚 + 𝑛 + 1) + 𝑚.
𝑝=0
2
On vérifie que 𝑓 est bijective, d’où la proposition.
□
Corollaire (2.5.6). — Soit 𝑓 : A → B une application. On suppose que l’en-
semble B est dénombrable et que, pour tout élément 𝑏 ∈ B, l’ensemble 𝑓 −1 (𝑏)
est dénombrable. Alors l’ensemble A est dénombrable.
Démonstration. — Soit 𝑔 : B → N une application injective. Pour tout 𝑏 ∈
B, soit ℎ𝑏 : 𝑓 −1 (𝑏) → N une application injective. Soit alors ℎ : A → N × N
l’application définie par ℎ(𝑎) = (𝑔(𝑓 (𝑎)), ℎ 𝑓 (𝑎) (𝑎)). Démontrons que ℎ est
injective. Soit 𝑎, 𝑎′ ∈ A tels que ℎ(𝑎) = ℎ(𝑎′) et démontrons que 𝑎 = 𝑎′.
On a d’abord 𝑔(𝑓 (𝑎)) = 𝑔(𝑓 (𝑎′)) ; comme 𝑔 est injective, cela entraîne
𝑓 (𝑎) = 𝑓 (𝑎′). Comme ℎ 𝑓 (𝑎) est injective, on a donc 𝑎 = 𝑎′. Par suite, ℎ est
injective, donc A est dénombrable. □
Corollaire (2.5.7). — La réunion d’une suite (A𝑛 )𝑛∈N d’ensembles
Ð
𝑛∈N A𝑛
dénombrables est dénombrable.
2.5. ENSEMBLES DÉNOMBRABLES 43
Démonstration. — Soit A = 𝑛∈N A𝑛 la réunion de la suite (A𝑛 ) et soit A′
Ð
sa somme ; rappelons que A′ est la partie de N × A formée des couples
(𝑛, 𝑎) tels que 𝑎 ∈ A𝑛 . Soit 𝑓 : A′ → N et 𝑔 : A′ → A les deux projections.
D’après le corollaire précédent appliqué à l’application 𝑓 , l’ensemble A′
est dénombrable. Comme 𝑔 est surjective, l’ensemble A est dénombrable.
□
Corollaire (2.5.8). — Soit 𝑛 un entier et soit A1, . . . , A𝑛 des ensembles dé-
nombrables ; l’ensemble A1 × · · · × A𝑛 est dénombrable.
Démonstration. — Le résultat est évident si 𝑛 = 1. Démontrons le
cas général par récurrence sur 𝑛. Posons B = A1 × · · · × A𝑛−1 et
soit 𝑓 : A1 × · · · × A𝑛 → B l’application définie par 𝑓 (𝑎 1, . . . , 𝑎𝑛 ) =
(𝑎 1, . . . , 𝑎𝑛−1 ). Par hypothèse de récurrence, B est dénombrable ; de plus,
pour tout 𝑏 = (𝑎 1, . . . , 𝑎𝑛−1 ), l’application 𝑎 ↦→ (𝑎 1, . . . , 𝑎𝑛−1, 𝑎) induit une
bijection de A𝑛 sur 𝑓 −1 (𝑏), si bien que 𝑓 −1 (𝑏) est dénombrable. Par suite,
A1 × · · · × A𝑛 est dénombrable. □
CHAPITRE 3
ARITHMÉTIQUES TRANSFINIES —
ORDONNER
« Mais suis-je pas bien fat de vouloir raisonner
Où de droit absolu j’ai pouvoir d’ordonner ? »
— Molière, Sganarelle ou Le cocu imaginaire, acte i, scène 1
3.1. Ensembles ordonnés
3.1.1. — Une relation d’ordre dans une classe C est une relation binaire
qui est réflexive, transitive et antisymmétrique. Si cette relation est no-
tée ⩽, cela signifie les trois conditions :
(i) Pour tous 𝑥 ∈ C, on a 𝑥 ⩽ 𝑦 ;
(ii) Pour tous 𝑥, 𝑦, 𝑧 ∈ C tels que 𝑥 ⩽ 𝑦 et 𝑦 ⩽ 𝑧, on a 𝑥 ⩽ 𝑧 ;
(iii) Pour tous 𝑥, 𝑦 ∈ C tels que 𝑥 ⩽ 𝑦 et 𝑦 ⩽ 𝑥, on a 𝑥 = 𝑦.
3.1.2. — Alternativement, on peut considérer des relations d’ordre strict
qui sont des relations irréflexives et transitives. Si une telle relation est
notée <, cela signifie les deux conditions :
(i) Pour tout 𝑥 ∈ C, on n’a pas 𝑥 < 𝑥 ;
(ii) Pour tous 𝑥, 𝑦, 𝑧 ∈ C tels que 𝑥 < 𝑦 et 𝑦 < 𝑧, on a 𝑥 < 𝑧.
On passe d’une relation d’ordre à une relation d’ordre strict en définis-
sant « 𝑥 < 𝑦 » par « 𝑥 ⩽ 𝑦 et 𝑥 ≠ 𝑦 » ; on passe d’une relation d’ordre strict
à une relation d’ordre en définissant « 𝑥 ⩽ 𝑦 » par « 𝑥 < 𝑦 ou 𝑥 = 𝑦 ».
3.1.3. — Une relation d’ordre dans une classe C est dite relation d’ordre
total si pour tous 𝑥, 𝑦 ∈ C, l’une des deux inégalités 𝑥 ⩽ 𝑦 ou 𝑦 ⩽ 𝑥 est
vérifiée.
Du point de vue des relations d’ordre strict, cela se traduit en la condi-
tion de trichotomie : pour tous 𝑥, 𝑦 ∈ C, l’une des trois propriétés sui-
vantes est satisfaite : 𝑥 < 𝑦, 𝑥 = 𝑦, 𝑦 < 𝑥.
46 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Dans le contexte d’une relation d’ordre total, la négation de l’inégalité
𝑥 ⩽ 𝑦 est l’inégalité stricte 𝑦 < 𝑥.
3.1.4. — Soit C une classe munie d’une relation d’ordre, soit A une partie
de C et soit 𝑎 ∈ A.
3.1.5. — On dit que 𝑎 ∈ C majore A si l’on a 𝑥 ⩽ 𝑎 pour tout 𝑥 ∈ C ; on
dit qu’il minore A si l’on a 𝑎 ⩽ 𝑥 pour tout 𝑥 ∈ C. Si l’on a de plus 𝑎 ∈ C,
on dit que 𝑎 est le plus grand élément (resp. le plus petit élément) de C.
Une partie qui possède un majorant est dite majorée ; une partie qui
possède un minorant est dite minorée.
3.1.6. — On dit que 𝑎 est une borne supérieure de A si c’est le plus petit
des majorants de A : cela signifie que 𝑎 est un majorant de A (𝑥 ⩽ 𝑎 pour
tout 𝑥 ∈ A) et que pour tout majorant 𝑏 de A, on a 𝑎 ⩽ 𝑏. Dans le cas d’une
relation d’ordre total, cette dernière propriété peut être reformulée : pour
tout 𝑏 ∈ C tel que 𝑏 < 𝑎, 𝑏 n’est pas un majorant de A, c’est-à-dire qu’il
existe 𝑥 ∈ A tel que 𝑏 < 𝑥.
De même, on dit que 𝑎 est une borne inférieure de A si c’est le plus grand
des minorants de A : cela signifie que 𝑎 est un minorant de A (𝑎 ⩽ 𝑥 pour
tout 𝑥 ∈ A) et que pour tout minorant 𝑏 de A, on a 𝑏 ⩽ 𝑎. Dans le cas
d’une relation d’ordre total, cette dernière propriété peut également être
reformulée : pour tout 𝑏 ∈ C tel que 𝑎 < 𝑏, 𝑏 n’est pas un minorant de A,
c’est-à-dire qu’il existe 𝑥 ∈ A tel que 𝑥 < 𝑏.
3.1.7. — On dit que 𝑎 est un élément maximal de A si 𝑎 ∈ A et si 𝑥 = 𝑎 est
le seul élément de A tel que 𝑎 ⩽ 𝑥. On dit que c’est un élément minimal
si 𝑥 = 𝑎 est le seul élément de A tel que 𝑥 ⩽ 𝑎.
Dans une relation d’ordre total, un élément maximal est un plus grand
élément, un élément minimal est le plus petit élément, mais ce n’est pas le
cas en général. Par exemple, si l’on considère les entiers ⩾ 2 munis de la
relation de divisibilité, les éléments minimaux sont les nombres premiers.
Proposition (3.1.8). — Soit C une classe ordonnée telle que toute suite crois-
sante dans C soit stationnaire. Alors, pour toute partie A de C et tout 𝑥 ∈ A,
il existe un élément maximal 𝑎 ∈ A tel que 𝑥 ⩽ 𝑎.
3.2. ENSEMBLES BIEN ORDONNÉS 47
Par symétrie, si toute suite décroissante dans C est stationnaire, alors pour
toute partie A de C et tout 𝑥 ∈ A, il existe un élément minimal 𝑎 ∈ C tel que
𝑎 ⩽ 𝑥.
Démonstration. — Raisonnons par l’absurde. Soit A une partie de C et 𝑥
un élément de A tels qu’il n’existe pas d’élément maximal 𝑎 ∈ A tel que
𝑥 ⩽ 𝑎. Cela signifie que pour tout 𝑦 ∈ A tel que 𝑥 ⩽ 𝑦, 𝑦 n’est pas maximal,
autrement dit, il existe 𝑧 ∈ A tel que 𝑦 < 𝑧.
Soit A′ l’ensemble des éléments 𝑎 ∈ A tels que 𝑥 ⩽ 𝑎, et soit R l’en-
semble des couples (𝑎, 𝑏) d’éléments de A′ tels que 𝑎 < 𝑏. Soit 𝑎 ∈ A′ ;
on a 𝑥 ⩽ 𝑎, donc par hypothèse, 𝑎 n’est pas un élément maximal de A ;
il existe donc un élément 𝑏 ∈ A tel que 𝑎 < 𝑏 ; on a alors 𝑏 ∈ A′, d’où
(𝑎, 𝑏) ∈ R. Par le principe du choix dépendant, il existe une application
𝑓 : 𝜔 → A′ telle que 𝑓 (𝑛) < 𝑓 (𝑛 + ) pour tout 𝑛 ∈ 𝜔. C’est une suite stric-
tement croissante dans A′, donc dans A, et elle n’est pas stationnaire. □
3.2. Ensembles bien ordonnés
Définition (3.2.1). — On dit qu’une classe ordonnée est bien ordonnée si
toute partie non vide possède un plus petit élément.
Toute partie d’une classe bien ordonnée est bien ordonnée. Si une classe
bien ordonnée n’est pas vide, elle possède un plus petit élément.
Une classe bien ordonnée est totalement ordonnée. En effet, pour 𝑥, 𝑦 ∈
C, on considère la paire {𝑥, 𝑦}, qui, par hypothèse, possède un plus petit
élément. Si cet élément est 𝑥, on a 𝑥 ⩽ 𝑦 ; si cet élément est 𝑦, on a 𝑦 ⩽ 𝑥.
3.2.2. — Si C une classe ordonnée et soit 𝑎 ∈ C, une classe du type C𝑎 =
{𝑥 ∈ C ; 𝑥 < 𝑎} est appelé section commençante de C. La partie C𝑎 est
majorée (par 𝑎). Pour qu’elle admette un plus grand élément, il faut et
il suffit que 𝑎 soit successeur ; dans le cas contraire, sa borne supérieure
est 𝑎.
3.2.3. — Par exemple, 𝜔 est un ensemble bien ordonné.
En revanche, l’ensemble des nombres réels n’est pas bien ordonné : l’en-
semble des nombres réels strictement positifs n’a pas de plus petit élé-
ment. Il a une borne inférieure (0), mais ce n’est pas un plus petit élément.
48 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Exemple (3.2.4). — a) Soit C et D des classes ordonnées. Leur somme
C ⊔ D est une partie de la classe (C ∪ D) × {0, 1} formée des couples (𝑥, 𝑛)
tels que soit 𝑛 = 0 et 𝑥 ∈ C, soit 𝑛 = 1 et 𝑦 ∈ D. Munissons-la de la
relation telle que (𝑥, 0) ⩽ (𝑥 ′, 0) si et seulement si 𝑥 ⩽ 𝑥 ′, (𝑦, 1) ⩽ (𝑦 ′, 1)
si et seulement si 𝑦 ⩽ 𝑦 ′, et (𝑥, 0) ⩽ (𝑦, 1) pour tous 𝑥 ∈ C et tous 𝑦 ∈ D.
C’est une relation d’ordre.
Si C et D sont bien ordonnées, alors C ⊔ D est bien ordonnée. Considé-
rons en effet une partie non vide S de C ⊔ D. Soit A la classe des 𝑥 ∈ C tels
que (𝑥, 0) ∈ S. Supposons-la non vide. Soit alors 𝑎 son plus petit élément ;
le couple (𝑎, 0) est le plus petit élément de S. Inversement, si A est vide, la
classe B des 𝑦 ∈ C tels que (𝑦, 1) ∈ S n’est pas vide, car S n’est pas vide ;
soit 𝑏 son plus petit élément ; alors le couple (𝑏, 1) est le plus petit élément
de S.
b) Soit C et D des classes ordonnées. Leur produit C × D est la classe
dont les éléments sont les couples (𝑥, 𝑦) avec 𝑥 ∈ C et 𝑦 ∈ D. On munit ce
produit de la relation donnée par (𝑥, 𝑦) ⩽ (𝑥 ′, 𝑦 ′) si, soit 𝑦 < 𝑦 ′, soit 𝑦 = 𝑦 ′
et 𝑥 ⩽ 𝑥 ′. C’est une relation d’ordre, qu’on appelle ordre lexicographique
inverse car on commence par comparer les deuxièmes « lettres ».
Supposons que C et D soient bien ordonnées ; alors il en est de même de
C × D. Considérons en effet une partie non vide S de C × D. Soit B le classe
des 𝑦 ∈ D tels qu’il existe 𝑥 ∈ C avec (𝑥, 𝑦) ∈ S ; elle n’est pas vide ; soit 𝑏
son plus petit élément. Soit alors A la classe des 𝑥 ∈ C tels que (𝑥, 𝑏) ∈ S ;
elle n’est pas vide ; soit 𝑎 son plus petit élément. Alors (𝑎, 𝑏) est le plus
petit élément de S.
c) Soit (A𝑖 )𝑖∈I une famille d’ensembles ordonnés indexée par un en-
semble totalement
Ð ordonné I. On considère l’ensemble Φ des fonctions 𝑓
de I dans A𝑖 telles que 𝑓 (𝑖) ∈ A𝑖 pour tout 𝑖 et on le munit de l’ordre lexi-
cographique inverse : 𝑓 < 𝑔 s’il existe 𝑖 tel que 𝑓 (𝑖) < 𝑔(𝑖) et 𝑓 (𝑥) = 𝑔(𝑥)
pour tout 𝑥 > 𝑖. Elle est manifestement irréflexive, et transitive : si 𝑓 < 𝑔
et 𝑔 < ℎ, on considère 𝑖 tel que 𝑓 (𝑖) < 𝑔(𝑖) et 𝑓 (𝑥) = 𝑔(𝑥) pour tout 𝑥 > 𝑖,
et 𝑗 tel que 𝑔( 𝑗) < ℎ( 𝑗) et 𝑔(𝑥) = ℎ(𝑥) pour tout 𝑥 > 𝑗. Si 𝑖 = 𝑗, alors
𝑓 (𝑖) < 𝑔(𝑖) < ℎ(𝑖) et 𝑓 (𝑥) = 𝑔(𝑥) = ℎ(𝑥) pour tout 𝑥 > 𝑗 ; si 𝑖 < 𝑗, alors
𝑓 ( 𝑗) = 𝑔( 𝑗) < ℎ( 𝑗) et 𝑓 (𝑥) = 𝑔(𝑥) = ℎ(𝑥) pour tout 𝑥 > 𝑗 ; enfin, si 𝑗 < 𝑖,
on a 𝑓 (𝑖) < 𝑔(𝑖) = ℎ(𝑖) et 𝑓 (𝑥) = 𝑔(𝑥) = ℎ(𝑥) pour tout 𝑥 > 𝑖. Dans les
trois cas, on a 𝑓 < ℎ.
3.2. ENSEMBLES BIEN ORDONNÉS 49
Supposons de plus que les A𝑖 soient totalement ordonnés et possèdent
un plus petit élément. On appelle support d’une fonction 𝑓 ∈ Φ l’en-
semble |𝑓 | des 𝑖 ∈ I tels que 𝑓 (𝑖) ≠ min(A𝑖 ). Soit alors Φ0 l’ensemble des
fonctions 𝑓 ∈ Φ dont le support est fini.
Démontrons que l’ordre précédent fait de Φ0 un ensemble totalement
ordonné. Soit 𝑓 , 𝑔 ∈ Φ0 ; supposons 𝑓 ≠ 𝑔. L’ensemble des 𝑖 ∈ I tels que
𝑓 (𝑖) ≠ 𝑔(𝑖) est contenu dans |𝑓 | ∪ |𝑔| ; il est donc fini. S’il est vide, on a
𝑓 = 𝑔. Sinon, soit 𝑖 son plus grand élément ; si l’on a 𝑓 (𝑖) < 𝑔(𝑖), on a
𝑓 < 𝑔 ; sinon, on a 𝑔(𝑖) < 𝑓 (𝑖) et 𝑔 < 𝑓 .
Supposons maintenant que I soit bien ordonné, de même que les A𝑖 , et
démontrons que Φ0 est bien ordonné. On adjoint un plus grand élément ∗
à I, avec A∗ = {0}, et on démontre par récurrence transfinie que pour
tout 𝑖 ∈ I∗ , l’ensemble des fonctions à support fini 𝑓 sur ]←; 𝑖 [ telles que
𝑓 (𝑥) ∈ A𝑥 pour tout 𝑥, est bien ordonné. L’assertion voulue est le cas
𝑖 = ∗.
Supposons donc l’assertion vraie pour 𝑖 et démontrons-la pour 𝑖 + .
Notons Φ′0 l’ensemble des fonctions de support fini sur ]←; 𝑖 + [ telles
que 𝑓 (𝑥) ∈ A𝑥 pour tout 𝑥, et Φ0 l’ensemble analogue avec 𝑖. On a
]←; 𝑖 + [ = ]←; 𝑖 [ ∪ {𝑖} ; en associant à toute fonction 𝑓 ′ sur ]←; 𝑖 + [ le
couple (𝑓 , 𝑓 ′ (𝑖)), où 𝑓 est la restriction de 𝑓 ′ à ]←; 𝑖 [, on définit une
bijection de Φ′0 sur Φ0 × A𝑖 . On constate que cette bijection est un iso-
morphisme d’ensembles ordonnés lorsqu’on munit Φ0 × A𝑖 de l’ordre
lexicographique inverse déduit des ordres sur Φ0 et A𝑖 . Par hypothèse de
récurrence, Φ0 est bien ordonné ; par hypothèse, A𝑖 est bien ordonné ; il
résulte alors de l’assertion b) que Φ0 × A𝑖 est bien ordonné, et donc Φ′0
aussi.
3.2.5. — Soit C une classe bien ordonnée.
Soit 𝑥 ∈ C. Si 𝑥 n’est pas le plus grand élément de C, l’ensemble {𝑦 ∈
C ; 𝑥 < 𝑦} n’est pas vide ; on note 𝑥 + son plus petit élément et on dit que
c’est le successeur de 𝑥.
Par définition, on a 𝑥 < 𝑥 + et on a 𝑥 + ⩽ 𝑦 pour tout 𝑦 tel que 𝑥 < 𝑦.
Si 𝑥 et 𝑦 sont deux éléments de C tels que 𝑥 < 𝑦, on a 𝑥 + ⩽ 𝑦, donc
𝑥 + < 𝑦 +.
Un élément de C de la forme 𝑥 + est dit successeur ; sinon, on dit que 𝑥
est limite.
50 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Lemme (3.2.6). — Soit C une classe bien ordonnée et soit 𝑥 un élément de C.
Pour que 𝑥 soit successeur, il faut et il suffit que la classe des 𝑦 ∈ C tels
que 𝑦 < 𝑥 ait un plus grand élément.
Démonstration. — Supposons que 𝑥 = 𝑦 + . Alors, 𝑦 < 𝑥. Si 𝑧 est un élément
de C tel que 𝑧 < 𝑥, vérifions que 𝑧 ⩽ 𝑦. Sinon, on a 𝑦 < 𝑧 ; par suite,
𝑥 = 𝑦 + ⩽ 𝑧, ce qui est absurde. □
L’intérêt de la notion de classe bien ordonnée est de permettre un rai-
sonnement par récurrence que l’histoire conduit à qualifier de transfini
(« au-delà du fini »).
Proposition (3.2.7) (Récurrence transfinie). — Soit C une classe bien
ordonnée et soit A une partie de C.
On suppose que A vérifie la propriété suivante : pour tout 𝑥 ∈ C, si la
classe C𝑥 = {𝑦 ∈ C ; 𝑦 < 𝑥 } est contenue dans A, alors 𝑥 ∈ A.
Alors A = C.
Démonstration. — Raisonnons par l’absurde et supposons A ≠ C. Son
complémentaire Ac n’est donc pas vide ; puisque C est bien ordonnée, Ac
possède un plus petit élément ; notons-le 𝑎. Par définition d’un plus petit
élément, on a 𝑥 ∈ A pour tout 𝑥 ∈ C tel que 𝑥 < 𝑎. L’hypothèse sur A
entraîne alors que 𝑎 ∈ A, ce qui est absurde. □
Proposition (3.2.8). — Soit C une classe bien ordonnée et soit 𝑓 : C → C
une application strictement croissante. Pour tout 𝑥 ∈ S, on a 𝑥 ⩽ 𝑓 (𝑥).
Démonstration. — Démontrons ce résultat par récurrence transfinie. Soit
𝑎 un élément de C. Supposons que pour tout 𝑥 ∈ C tel que 𝑥 < 𝑎, on
a 𝑥 ⩽ 𝑓 (𝑥), et démontrons 𝑎 ⩽ 𝑓 (𝑎). Sinon, on a 𝑓 (𝑎) < 𝑎. Comme 𝑓
est strictement croissante, on a donc 𝑓 (𝑓 (𝑎)) < 𝑓 (𝑎), ce qui contredit
l’hypothèse de récurrence que 𝑓 (𝑎) ⩽ 𝑓 (𝑓 (𝑎)). □
Corollaire (3.2.9). — Soit C une classe bien ordonnée et soit 𝑓 : C → C une
application strictement croissante bijective. Alors 𝑓 = IdC .
Démonstration. — D’après la proposition, on a 𝑥 ⩽ 𝑓 (𝑥) pour tout 𝑥 ∈ C.
Soit 𝑔 la bijection réciproque de 𝑓 ; elle est strictement croissante et la
proposition affirme que 𝑦 ⩽ 𝑔(𝑦) pour tout 𝑦 ∈ C. En prenant 𝑦 = 𝑓 (𝑥),
3.2. ENSEMBLES BIEN ORDONNÉS 51
on obtient 𝑓 (𝑥) ⩽ 𝑔(𝑓 (𝑥)) = 𝑥 pour tout 𝑥 ∈ C. Par suite, 𝑥 = 𝑓 (𝑥) pour
tout 𝑥 ∈ C. □
Corollaire (3.2.10). — Soit C une classe bien ordonnée. Alors C n’est iso-
morphe, en tant qu’ensemble ordonné, à aucune des ses sections commen-
çantes.
Démonstration. — Soit 𝑎 ∈ C et soit 𝜑 : C → C𝑎 une application crois-
sante bijective de C sur la section commençante C𝑎 . D’après la proposi-
tion appliquée à la composition 𝑗 ◦ 𝜑, où 𝑗 est l’inclusion de C𝑎 dans C,
on a 𝑥 ⩽ 𝜑 (𝑥) pour tout 𝑥 ∈ C. En particulier, 𝑎 ⩽ 𝜑 (𝑎), ce qui contredit
l’hypothèse que l’image de 𝜑 est contenue dans C𝑎 . □
Proposition (3.2.11) (Principe de construction transfinie)
Soit D une classe et soit S une classe bien ordonnée. Soit CS la classe des
couples (𝑎, 𝑓 ), où 𝑎 ∈ S et 𝑓 : S𝑎 → D est une application, et soit Φ : CS → D
une application. Il existe une unique application F : S → D telle que F(𝑎) =
Φ(𝑎, F| S𝑎 ) pour tout 𝑎 ∈ A.
Démonstration. — On démontre d’abord que pour tout 𝑎 ∈ S, il existe
une unique application F : S𝑎 → D qui vérifie la relation F(𝑥) = Φ(𝑥, F| S𝑥 )
pour tout 𝑥 ∈ S𝑎 . On raisonne par récurrence transfinie. Soit 𝑎 ∈ S ; suppo-
sons qu’il existe une unique application F : S𝑎 → D qui vérifie la relation
F(𝑥) = Φ(𝑥, F| S𝑥 ) pour tout 𝑥 ∈ S𝑎 . Soit alors F′ : S𝑎+ → D la fonction qui
prolonge F et telle que F′ (𝑎) = Φ(𝑎, F) ; elle vérifie la relation de récurrence
souhaitée, et c’est la seule.
Soit 𝑎 et 𝑏 des éléments de S et soit F𝑎 : S𝑎 → D et F𝑏 : S𝑏 → D des
applications vérifiant la relation de récurrence demandée. Si 𝑎 < 𝑏, la res-
triction de F𝑏 à S𝑎 vérifie ladite relation de récurrence, donc est égale à F𝑎 .
Cela prouve qu’il existe une unique application F : S → D qui, pour tout 𝑎,
coïncide avec F𝑎 sur S𝑎 . Cette application vérifie la relation de récurrence
voulue et c’est la seule. □
Proposition (3.2.12). — Soit S et T des ensembles bien ordonnés. L’une et
l’une seule des assertions suivantes est vérifiée :
(i) Il existe une bijection croissante de S sur T ;
52 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
(ii) Il existe une bijection croissante de S sur une section commençante
de T ;
(iii) Il existe une bijection croissante d’une section commençante de S
sur T.
En outre, dans chacun des cas, la section commençante et la bijection sont
uniquement déterminées.
Démonstration. — Le fait que ces trois cas s’excluent mutuellement est
une conséquence du corollaire précédent. Par exemple, la conjonction
de (i) et (ii) fournirait une bijection croissante de T sur une section com-
mençante de T.
Vérifions l’unicité dans le cas (i). Si 𝑓 et 𝑔 sont des bijections croissantes
de S sur T, alors 𝑔 ◦ 𝑓 −1 est une bijection croissante de T sur lui-même ;
on a donc 𝑔 ◦ 𝑓 −1 = idT , d’où 𝑔 = 𝑓 .
L’argument est analogue dans le cas (ii). Soit 𝑓 : S → T𝑎 et 𝑔 : S → T𝑏
des bijections croissantes de S sur des sections commençantes de T. Si
𝑎 < 𝑏, alors 𝑓 ◦ 𝑔−1 : T𝑏 → T𝑎 est une bijection croissante de T𝑏 sur une
section commençante de T𝑏 , ce qui est absurde. De même, l’hypothèse
𝑏 < 𝑎 est absurde. On a donc 𝑎 = 𝑏, et 𝑓 , 𝑔 sont deux bijections croissantes
de S sur T𝑎 ; d’après l’argument fait dans le cas (i), on a 𝑓 = 𝑔.
L’argument dans le cas (iii) est symétrique.
Il reste à déterminer dans lequel des trois cas on se trouve et construire
la bijection correspondante. La construction procède par récurrence
transfinie. Adjoignons à T un élément ∞ tel que 𝑡 < ∞ pour tout 𝑡 ∈ T.
L’ensemble T∗ ainsi défini est encore bien ordonné et ∞ est son plus grand
élément. Si 𝑓 : S𝑎 → T∗ est une application d’une section commençante
de S dans T∗ , on prolonge 𝑓 à S𝑎+ = S𝑎 ∪ {𝑎} en définissant 𝑓 (𝑎) comme
le plus petit élément de l’ensemble non vide (𝑓 ⟨S𝑎 ⟩) c ∪ {∞}.
Par récurrence transfinie, on démontre les propriétés suivantes :
a) L’application 𝑓 est croissante. Soit en effet 𝑎, 𝑏 ∈ S tels que 𝑎 ⩽ 𝑏 ; par
définition, 𝑓 (𝑏) est le plus petit élément de 𝑓 (S𝑏 ) c ∪{∞} alors que 𝑓 (𝑎) est
le plus petit élément de 𝑓 (S𝑎 ) c ∪ ∞. Puisque S𝑎 ⊆ S𝑏 , on a 𝑓 (S𝑎 ) ⊆ 𝑓 (S𝑏 )
puis 𝑓 (S𝑏 ) c ∪ {∞} ⊆ 𝑓 (S𝑎 ) c ∪ {∞}. En particulier, on a 𝑓 (𝑏) ⩾ 𝑓 (𝑎), ce
qu’il fallait démontrer.
b) Si 𝑓 (𝑎) = ∞, alors 𝑓 (𝑏) = ∞ pour tout 𝑏 > 𝑎. Par définition, 𝑓 (𝑎) est
le plus petit élément de 𝑓 (S𝑎 ) c ∪ {∞} ; cela entraîne que 𝑓 (S𝑎 ) contient T.
En particulier, 𝑓 (S𝑏 ) contient T et 𝑓 (𝑏) = ∞.
3.2. ENSEMBLES BIEN ORDONNÉS 53
c) Si 𝑎 < 𝑏 et 𝑓 (𝑎) = 𝑓 (𝑏), alors 𝑓 (𝑎) = ∞. Supposons 𝑎 < 𝑏, 𝑓 (𝑎) =
𝑓 (𝑏) et 𝑓 (𝑏) ≠ ∞. Par définition, 𝑓 (𝑏) est le plus petit élément de 𝑓 (S𝑏 ) c ∪
{∞}. Comme 𝑓 (𝑎) = 𝑓 (𝑏) ̸ ∞, il vient 𝑓 (𝑎) ∈ 𝑓 (S𝑏 ) c , ce qui contredit le
fait que 𝑎 ∈ S𝑏 .
d) Si 𝑦 ⩽ 𝑓 (𝑎), il existe 𝑥 ⩽ 𝑎 tel que 𝑓 (𝑥) = 𝑦. Comme 𝑦 < 𝑓 (𝑎) et que
𝑓 (𝑎) est le plus petit élément de 𝑓 (S𝑎 ) c ∪ {∞}, on a 𝑦 ∉ 𝑓 (S𝑎 ) c ∪ {∞},
c’est-à-dire 𝑦 ∈ 𝑓 (S𝑎 ). Il existe donc 𝑥 < 𝑎 tel que 𝑓 (𝑥) = 𝑦.
Supposons maintenant que 𝑓 ne prenne pas la valeur ∞ ; son image est
donc contenue dans T. D’après ce qui précède, elle est injective et crois-
sante ; c’est donc une bijection croissante de S sur 𝑓 (S). Si 𝑓 est surjective,
c’est ainsi une bijection croissante de S sur T et on est dans le cas (i).
Sinon, soit 𝑏 le plus petit élément de 𝑓 (S) c et vérifions que 𝑓 (S) = T𝑏 .
Soit 𝑎 ∈ S et démontrons 𝑓 (𝑎) < 𝑏 ; sinon, on a 𝑏 ⩽ 𝑓 (𝑎) et ce qui précède
démontre qu’il existe 𝑥 tel que 𝑓 (𝑥) = 𝑏, ce qui contredit le fait que 𝑏 ∉
𝑓 (S). Inversement, soit 𝑦 ∈ T tel que 𝑦 < 𝑏 ; l’hypothèse 𝑦 ∈ 𝑓 (S) c ,
contredit le fait que 𝑏 soit le plus petit élément de 𝑓 (S) c , on a donc 𝑦 ∈
𝑓 (S). On est ainsi dans le cas (ii).
Supposons maintenant que 𝑓 prenne la valeur ∞ et soit 𝑎 le plus petit
élément de S tel que 𝑓 (𝑎) = ∞. Alors 𝑓 définit par restriction une applica-
tion de S𝑎 dans T qui est injective est croissante. Par définition, 𝑓 (𝑎) = ∞
est le plus petit élément de 𝑓 (S𝑎 ) c ∪ {∞} ; nécessairement 𝑓 (S𝑎 ) = T et 𝑓
est surjective. C’est une bijection croissante de S𝑎 sur T et on est dans le
cas (iii). □
Lemme (3.2.13) (Hartogs). — Soit X un ensemble. Il existe un ensemble
bien ordonné S tel qu’aucune application 𝑓 : S → X soit injective.
Démonstration. — Soit C l’ensemble des couples (A, ⪯A ), où A est une
partie de X et ⪯A est une relation de bon ordre sur X. On munit C de la
relation pour laquelle (A, ⪯A ) ⪯ (B, ⪯B ) si et seulement si A ⊆ B et ⪯B
coïncide avec ⪯A sur A ; c’est une relation d’ordre. Soit C ′ l’ensemble des
classes d’équivalence d’ordre dans C. Pour (A, ⪯A ) ∈ C, on note (A, ⪯A ) ′
cette classe d’équivalence, c’est l’ensemble des (B, ⪯B ) ∈ C pour lesquels
il existe une application bijective croissante 𝑗 : B → A.
Alors C ′ est un ensemble ordonné. C’est même un ensemble bien or-
donné. Considérons un élément 𝛼 ∈ C ′ et soit (A, ⪯A ) ∈ C un élément de
54 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
classe 𝛼. Pour tout (B, ⪯B ) ∈ C tel que (B, ⪯B ) ′ ≺ 𝛼, il existe une applica-
tion injective croissante, et une seule, de B dans A, dont l’image est une
section commençante de A ; notons 𝑓 (B) l’unique élément de A tel que
cette section soit {𝑥 ∈ A ; 𝑥 < 𝑓 (B)}. L’application 𝑓 induit une bijection
d’ensembles ordonnés de {𝛽 ∈ C ; 𝛽 < 𝛼 } sur A. Il en résulte que C est
bien ordonné.
Démontrons que C ′ convient. Soit 𝑓 : C ′ → X une application injective
et soit A son image. Par 𝑓 , on peut transférer le bon ordre de C ′ à A, ce
qui fournit un bon ordre ⪯A sur A. Soit 𝛼 sa classe dans C ′.
Pour tout 𝑥 ∈ C ′, {𝑎 ∈ A ; 𝑎 < 𝑓 (𝑥)} est une partie bien ordonnée
de A ; sa classe 𝑔(𝑥) dans C ′ vérifie 𝑔(𝑥) ≺ 𝛼. Par définition de l’ordre
sur A, l’application 𝑓 est strictement croissante ; par suite, l’application
𝑔 : C ′ → C ′ est également strictement croissante. On a donc 𝑥 ⪯ 𝑔(𝑥)
pour tout 𝑥 ∈ C ′. Par suite, 𝑥 ≺ 𝛼 pour tout 𝑥 ∈ C ′. En particulier, 𝛼 ≺ 𝛼,
ce qui est absurde. □
Corollaire (3.2.14). — La classe des ensembles bien ordonnés n’est pas un
ensemble.
Démonstration. — Soit C cette classe et supposons que ce soit un en-
semble. Munissons-le de la relation de « préordre » pour laquelle S ≺ T
s’il existe une injection croissante de S sur une section commençante de T.
Sur l’ensemble C′ des classes d’équivalences, cette relation de préordre
définit un ordre strict. Pour cette relation d’ordre, C′ est bien ordonné.
Soit S un ensemble bien ordonné. Pour tout 𝑎 ∈ S, soit 𝑓 (𝑎) ∈ C′ la
classe d’équivalence de S𝑎 . Cela fournit une injection de S dans C′ qui
contredit le lemme de Hartogs. □
Théorème (3.2.15) (Zermelo). — Sur tout ensemble, on peut définir un
bon ordre.
Démonstration. — Soit X un ensemble, soit ∞ un ensemble qui n’appar-
tient pas à X et posons X∗ = X ∪ {∞}. Soit S un ensemble bien ordonné
tel qu’il n’existe pas d’application injective de S dans X∗ . À l’aide d’une
fonction de choix, on se donne, pour toute partie T de X∪ {∞} un élément
𝜑 (T) tel que 𝜑 (T) ∈ X T si cet ensemble n’est pas vide, c’est-à-dire si T
ne contient pas X, et 𝜑 (T) = ∞ sinon. Par construction transfinie, il existe
3.2. ENSEMBLES BIEN ORDONNÉS 55
une unique application F : S → X∗ telle que F(𝑎) = 𝜑 (F⟨S𝑎 ⟩) pour tout
𝑎 ∈ S.
Par définition de X∗ , l’application F n’est pas injective ; soit donc 𝑎 le
plus petit élément de S tel que F(𝑎) ∈ F⟨S𝑎 ⟩ ou F(𝑎) = ∞.
Par définition de 𝜑, on a X ⊆ F⟨S𝑎 ⟩ et F⟨S𝑎 ⟩ ⊆ X ; par suite, F⟨S𝑎 ⟩ = X.
De plus, F| S𝑎 est injective. Sinon, il existerait 𝑥 et 𝑦 dans S tels que 𝑥 <
𝑦 < 𝑎 et F(𝑥) = F(𝑦). On aurait donc F(𝑦) = 𝜑 (F⟨S𝑦 ⟩) ∈ F⟨S𝑦 ⟩, ce qui
contredit la minimalité de 𝑎.
Ainsi, l’application F est une bijection de l’ensemble bien ordonné S𝑎
sur X. Par son truchement, on peut donc transférer le bon ordre de S𝑎 à X,
ce qui prouve que X possède un bon ordre. □
3.2.16. — Soit S un ensemble ordonné.
On dit que S est inductif si toute partie totalement ordonnée de S est
majorée.
On dit que S est faiblement inductif si toute partie bien ordonnée de S
est majorée.
Théorème (3.2.17) (Zorn). — Soit X un ensemble muni d’une relation
d’ordre ⩽. On suppose que X est faiblement inductif. Alors, X possède un
élément maximal.
Plus généralement, pour tout élément 𝑥 de X, il existe un élément maxi-
mal 𝑚 tel que 𝑥 ⩽ 𝑚.
Démonstration. — On raisonne par l’absurde en considérant un élé-
ment 𝑥 ∈ X pour lequel il n’existe pas d’élément maximal 𝑚 tel que
𝑥 ⩽ 𝑚.
Soit S un ensemble bien ordonné tel qu’il n’existe pas d’application in-
jective de S dans X. Alors S n’est pas vide ; notons 0 son plus petit élément.
Soit 𝑠 ∈ S et soit 𝑓 : S𝑠 → X une application strictement croissante telle
que 𝑥 ⩽ 𝑓 (𝑡) pour tout 𝑡 ∈ S𝑠 .
Supposons que 𝑠 soit successeur, 𝑠 = 𝑡 + ; alors 𝑥 ⩽ 𝑓 (𝑡) et 𝑓 (𝑡) n’est pas
un élément maximal de X, par hypothèse. On choisit un élément 𝑓 ′ (𝑠) ∈ X
tel que 𝑥 ⩽ 𝑓 (𝑡) < 𝑓 ′ (𝑠).
Sinon, 𝑓 ⟨S𝑠 ⟩ est bien ordonné ; on en choisit un majorant 𝑓 ′ (𝑠), choisi
de sorte que 𝑥 = 𝑓 ′ (𝑠) si 𝑠 = 0 et S𝑠 = ∅.
56 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Par construction transfinie, il existe une application strictement crois-
sante F : S → X telle que 𝑓 (𝑠) soit un majorant strict de 𝑓 ⟨S𝑠 ⟩ pour tout
𝑠 ∈ S.
Cela contredit le choix de S. □
3.3. Ordinaux
3.3.1. — On doit à von Neumann une définition concrète d’ensembles
bien ordonnés, appelés ordinaux, qui fournit des représentants privilégiés
de chaque classe d’ensemble bien ordonnés. Cette construction repose sur
deux idées, déjà explorées lors de l’étude des nombres entiers : d’une part
que la relation d’ordre naturelle sur les ordinaux soit induite par la relation
d’appartenance ; d’autre part, qu’un ordinal soit l’ensemble des ordinaux
strictement inférieurs.
Définition (3.3.2). — On dit qu’une classe C est transitive si pour tout
𝑥 ∈ C, on a 𝑥 ⊆ C.
Définition (3.3.3). — On dit qu’un ensemble S est un ordinal s’il est tran-
sitif si la relation « 𝑥 ∈ 𝑦 » dans S est une relation de bon ordre strict.
Les ordinaux forment une classe Ord . De manière générale, ils sont
notés à l’aide de lettres grecques.
Si 𝛼 est un ordinal, la définition d’une relation d’ordre strict entraîne
que 𝑥 ∉ 𝑥 pour tout 𝑥 ∈ 𝛼. Cela entraîne que 𝛼 ∉ 𝛼 ; en effet, si l’on avait
𝛼 ∈ 𝛼, alors 𝑥 = 𝛼 serait un élément de 𝛼 qui contredit l’assertion 𝑥 ∉ 𝑥.
Exemple (3.3.4). — L’ensemble vide est un ordinal. Plus généralement,
tout entier est un ordinal. En fait, dans la construction des nombres entiers
que nous avons menée, on a 𝑚 ∈ 𝑛 si et seulement si 𝑚 < 𝑛.
Exemple (3.3.5). — L’ensemble 𝜔 est un ordinal.
Exemple (3.3.6). — Si 𝛼 est un ordinal, l’ensemble 𝛼 + = 𝛼 ∪ {𝛼 } est un
ordinal.
Vérifions d’abord que cet ensemble est transitif. Soit 𝑥 ∈ 𝛼 + ; démon-
trons que 𝑥 ⊆ 𝛼 + . Si 𝑥 ∈ 𝛼, on a 𝑥 ⊆ 𝛼, car 𝛼 est transitif, donc 𝑥 ⊆ 𝛼 + .
Sinon, on a 𝑥 = 𝛼, d’où 𝑥 ⊆ 𝛼 + .
3.3. ORDINAUX 57
La relation d’appartenance dans 𝛼 + est une relation d’ordre strict. Elle
coïncide avec la même relation dans 𝛼 ; Comme 𝛼 est le plus grand élément
de 𝛼 + , c’est une relation de bon ordre.
Lemme (3.3.7). — Soit 𝛼 un ordinal et soit 𝛽 un élément de 𝛼. On a les
propriétés suivantes :
a) On a 𝛽 ⊆ 𝛼 ;
b) On a 𝛽 = {𝑥 ∈ 𝛼 ; 𝑥 ∈ 𝛽}.
c) L’ensemble 𝛽 est un ordinal.
Démonstration. — a) En effet, 𝛼 est un ensemble transitif.
b) On vient de voir l’inclusion 𝛽 ⊆ 𝛼 ; la propriété résulte donc de
l’axiome d’extensionalité.
c) Vérifions que 𝛽 est un ensemble transitif. Soit 𝑥 ∈ 𝛽 et soit 𝑦 ∈ 𝑥 ;
démontrons que 𝑦 ∈ 𝛽. Comme 𝛽 ⊆ 𝛼, on a 𝑥 ∈ 𝛼 ; par suite, 𝑦 ∈ 𝛼. Par
transitivité de la relation d’appartenance dans 𝛼 entraîne donc que 𝑦 ∈ 𝛽.
La relation « 𝑥 ∈ 𝑦 » dans 𝛽 est ainsi la restriction de la même relation
dans 𝛼 ; c’est donc également une relation de bon ordre strict. Cela prouve
que 𝛽 est un ordinal. □
Proposition (3.3.8). — Soit 𝛼 et 𝛽 des ordinaux tels que 𝛽 ⊆ 𝛼. Si 𝛽 ≠ 𝛼,
alors 𝛽 ∈ 𝛼.
Démonstration. — Supposons 𝛽 ≠ 𝛼 et soit 𝛾 le plus petit élément de 𝛼 𝛽.
Comme 𝛼 est transitif, on a 𝛾 ⊆ 𝛼.
Démontrons que 𝛾 = 𝛽.
Soit 𝑥 ∈ 𝛼.
Si 𝑥 ∉ 𝛽, c’est-à-dire 𝛼 𝛽, la définition d’un plus petit élément entraîne
que 𝛾 ⪯ 𝑥, c’est-à-dire la négation de 𝑥 < 𝛾, par définition de la relation
d’ordre dans 𝛼. D’après le lemme précédent, on n’a pas 𝑥 ∈ 𝛾.
Inversement, supposons 𝑥 ∈ 𝛽 et démontrons 𝑥 ∈ 𝛾. Sinon, par défini-
tion de la relation d’ordre dans 𝛼, il vient 𝛾 = 𝑥 ou 𝛾 ∈ 𝑥. Dans les deux
cas, on en déduit 𝛾 ∈ 𝛽, soit directement, soit par transitivité de la relation
d’appartenance des ordinaux, ce qui est asburde. □
Corollaire (3.3.9). — Soit 𝛼 et 𝛽 des ordinaux. Une et une seule des trois
assertions suivantes est vérifiée :
(i) On a 𝛼 ∈ 𝛽 ;
58 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
(ii) On a 𝛼 = 𝛽 ;
(iii) On a 𝛽 ∈ 𝛼.
Ainsi, la relation d’appartenance dans la classe Ord est une relation d’ordre
strict. Pour cette raison, on la notera désormais <.
Observons que les deux premiers cas entraînent 𝛼 ⊆ 𝛽, car 𝛽 est un
ensemble transitif ; dans les deux derniers, on a 𝛽 ⊆ 𝛼. Par suite, la relation
d’ordre large dans les ordinaux correspond à l’inclusion.
Démonstration. — Comme 𝛼 ∉ 𝛼, les deux premiers cas s’excluent mu-
tuellement ; de même, les deux derniers cas s’excluent mutuellement. Si
l’on avait simultanément 𝛼 ∈ 𝛽 et 𝛽 ∈ 𝛼, il viendrait 𝛼 ∈ 𝛼, par transiti-
vité, ce qui est absurde.
Posons 𝛾 = 𝛼 ∩ 𝛽 ; c’est un ensemble transitif et la relation d’apparte-
nance est une relation de bon ordre dans 𝛾, si bien que 𝛾 est un ordinal.
On a 𝛾 ⊆ 𝛼. D’après la proposition précédente, soit 𝛾 = 𝛼, soit 𝛾 ∈ 𝛼 ; de
même, soit 𝛾 = 𝛽, soit 𝛾 ∈ 𝛽.
Si 𝛾 = 𝛼 et 𝛾 ∈ 𝛽, on en déduit 𝛼 ⊆ 𝛽.
Si 𝛾 = 𝛼 et 𝛾 = 𝛽, on en déduit 𝛼 = 𝛽.
Si 𝛾 ∈ 𝛼 et 𝛾 = 𝛽, on en déduit 𝛽 ∈ 𝛼.
Supposons enfin 𝛾 ∈ 𝛼 et 𝛾 ∈ 𝛽. Alors, 𝛾 ∈ 𝛼 ∩ 𝛽 = 𝛾, ce qui est
absurde. □
Corollaire (3.3.10). — a) Soit C une classe non vide d’ordinaux ; alors
C est un ordinal, et c’est la borne inférieure
Ð de C.
Ñ
b) Soit S un ensemble d’ordinaux ; alors S est un ordinal et c’est la borne
supérieure de S.
Démonstration.
Ñ
Ñ — a) Soit 𝛼 un élément de C. On a C ⊆ 𝛼,Ñ de sorte
que C est un ensemble. C’est un ensemble transitif : soit Ñ𝑦 ∈ C ; pour
tout 𝛽 ∈ C, on a 𝑦 ∈Ñ𝛽, donc 𝑦 ⊆ 𝛽 ; par suite, 𝑦 ⊆ C. La relation
d’appartenance dans C coïncide avec la même relation dans 𝛼 ; c’est
donc une Ñrelation de bon ordre strict. Ñ
On a C ⊆ 𝛼 pour tout 𝛼 ∈ C ; autrement dit, C minore C. Inver-
sement,
Ñ si 𝛽 est Ñ un minorant de C, on a 𝛽 ⊆ 𝛼 pour tout 𝛽 ∈ C, donc
𝛽 ⊆ C. Ainsi, C est le plus grand minorant de C, c’est donc sa borne
inférieure. Ð
b) Par l’axiome Ð de la réunion, S est un ensemble. Vérifions qu’il est
transitif : soit 𝑦 ∈ S ; il existe donc un ordinal 𝛼 tel que 𝛼 ∈ S et 𝑦 ∈ 𝛼.
3.3. ORDINAUX 59
Ð Ð
Alors 𝑦 ⊆ 𝛼, donc 𝑦 ⊆ S. La relation d’appartenance Ð dans S est une
relation d’ordre strict. Soit A une partie non vide de S ; soit 𝑥 un élément
de A et soit 𝛼 ∈ S un ordinal tel que 𝑥 ∈ 𝛼. Soit 𝑚 le Ð
plus petit élément de
A ∩𝛼 ; démontrons que c’est le plus petit élément de S. Soit donc 𝑦 ∈ A ;
démontrons que 𝑚 ⩽ 𝑦. Soit 𝛽 ∈ S un ordinal tel que 𝑦 ∈ 𝛽 ; si 𝑦 ∈ 𝛼, on a
𝑦 ∈ A ∩ 𝛼 et 𝑚 ⩽ 𝑦 ; sinon, 𝛼 est un segment initial de 𝛽 et cela entraîne
𝑥 ⩽ 𝑦, d’où 𝑚 ⩽ 𝑦. Ð Ð
Pour tout 𝛼 ∈ S, on a 𝛼 ⊆ S, si bien que S majore S.Ð Inversement,
si un ordinal 𝛽Ðmajore S, on a 𝛼 ⊆ 𝛽 pour tout 𝛼 ∈ S, donc S ⊆ 𝛽. Cela
démontre que S est la borne supérieure de S.
□
Théorème (3.3.11). — La classe Ord des ordinaux est bien ordonnée.
Démonstration. — Soit C une partie non vide de Ord et soit 𝛼 un élément
de C. Si 𝛼 est le plus petit élément de C, on a terminé. Sinon, la classe C𝛼
des 𝛽 ∈ C tels que 𝛽 < 𝛼 n’est pas vide, et c’est une partie de 𝛼. Comme
𝛼 est bien ordonné, C𝛼 admet un plus petit élément, qui est le plus petit
élément de C. □
Corollaire (3.3.12). — Tout ensemble bien ordonné S est isomorphe à un
ordinal et un seul.
Cet ordinal est appelé type d’ordre de S, ou ordinal de S, et est noté
Ord(S).
Démonstration. — On construit une application 𝑓 : S → Ord par récur-
rence transfinie de sorte que pour tout 𝑥 ∈ S, l’ensemble bien ordonné 𝑥
soit isomorphe à 𝑓 (𝑥) : si 𝑥 est successeur, 𝑥 = 𝑦 + , on pose 𝑓 (𝑥) = 𝑓 (𝑦) + ;
si 𝑥 est limite, on pose 𝑓 (𝑥) = sup𝑦<𝑥 𝑓 (𝑦). L’ensemble 𝑓 ⟨S⟩ est la borne
supérieure des 𝑓 (𝑥), pour 𝑥 ∈ S. □
Corollaire (3.3.13). — La classe Ord des ordinaux n’est pas un ensemble.
Démonstration. — Supposons que Ord soit un ensemble ; il existe alors
un ordinal 𝛼 tel que Ord soit égal à l’ensemble des 𝑥 tels que 𝑥 < 𝛼. Alors
𝛼 ∉ Ord , ce qui est absurde. □
60 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Corollaire (3.3.14). — Soit 𝛼 et 𝛽 deux ordinaux. Pour que l’on ait 𝛼 ⩽ 𝛽,
il faut et il suffit qu’il existe une injection croissante de 𝛼 dans 𝛽.
Démonstration. — Si 𝛼 ⩽ 𝛽, c’est-à-dire si 𝛼 ⊆ 𝛽, l’application identique
est une injection croissante de 𝛼 dans 𝛽. Supposons inversement qu’il
existe une telle injection, 𝑓 , et démontrons que 𝛼 ⩽ 𝛽, c’est-à-dire 𝛼 ⊆ 𝛽.
Pour tout 𝑥 ∈ 𝛼, on a 𝑥 ⩽ 𝑓 (𝑥), d’après la proposition 3.2.8. Si 𝑥 = 𝑓 (𝑥),
il en découle 𝑥 ∈ 𝛽 ; sinon, 𝑥 ∈ 𝑓 (𝑥), et l’inclusion 𝑓 (𝑥) ⊆ 𝛽 entraîne
𝑥 ∈ 𝛽. □
3.4. Arithmétique des ordinaux
3.4.1. Addition. — Si 𝛼 et 𝛽 sont des ordinaux, on définit l’ordinal 𝛼 +
𝛽 comme l’unique ordinal isomorphe (comme ensemble bien ordonné) à
l’ensemble bien ordonné somme de 𝛼 et 𝛽.
Proposition (3.4.2). — Soit 𝛼, 𝛽, 𝛾 des ordinaux.
a) On a 𝛼 + 0 = 0 + 𝛼 = 𝛼 ;
b) On a 𝛼 + 1 = 𝛼 + ;
c) On a 𝛼 + 𝛽 + = (𝛼 + 𝛽) + ;
d) On a (𝛼 + 𝛽) + 𝛾 = 𝛼 + (𝛽 + 𝛾).
Démonstration. — a) Soit A un ensemble bien ordonné. L’application
évidente de A vers l’ensemble somme de A et ∅ est bijective et croissante ;
si le premier correspond à l’ordinal 𝛼, le second correspond à l’ordinal 𝛼 +
0. On a donc l’égalité 𝛼 = 𝛼 + 0. De même, l’application évidente de A vers
l’ensemble somme de ∅ et A est bijective et croissante ; d’où l’on déduit
que 𝛼 = 0 + 𝛼.
b) L’ordinal 𝛼 + 1 est celui associé à l’ensemble bien ordonné donc 𝛼
est une section commençante, auquel on adjoint un plus grand élément,
supérieur à tous ceux de 𝛼. On constate que 𝛼 + est exactement de cette
forme, l’élément 𝛼 en étant le plus grand élément.
c) C’est une variante : L’ordinal 𝛼 + 𝛽 + est constitué d’une section com-
mençante isomorphe à 𝛼, continuée de l’ordinal 𝛽 + , lequel est constitué
des éléments de l’ordinal 𝛽 puis d’un plus grand élément (donné par 𝛽).
L’ordinal (𝛼 + 𝛽) + est exactement de le même forme.
d) C’en est également une variante : En tant qu’ensemble ordonné, l’or-
dinal 𝛼 + (𝛽 +𝛾) est constitué d’une section commençante isomorphe à 𝛼,
3.4. ARITHMÉTIQUE DES ORDINAUX 61
continuée de l’ordinal 𝛽 + 𝛾, lequel est constitué des éléments de l’ordi-
nal 𝛽 continué par l’ordinal 𝛾. L’ordinal (𝛼 + 𝛽) + 𝛾 est exactement de le
même forme. □
Proposition (3.4.3). — Soit 𝛼, 𝛽 des ordinaux.
a) Pour que 𝛼 ⩽ 𝛽, il faut et il suffit qu’il existe un ordinal 𝛾 tel que
𝛽 = 𝛼 + 𝛾. Il existe alors un seul tel ordinal ;
b) Si 𝛼 ⩽ 𝛽, alors 𝛼 + 𝛾 ⩽ 𝛽 + 𝛾 et 𝛾 + 𝛼 ⩽ 𝛾 + 𝛽 pour tout ordinal 𝛾 ;
c) Si 𝛼 < 𝛽, alors 𝛾 + 𝛼 < 𝛾 + 𝛽 pour tout ordinal 𝛾 ;
d) Si 𝛽 est un ordinal limite, alors 𝛼 + 𝛽 = sup𝑥 <𝛽 (𝛼 +𝑥) = lim𝑥→𝛽 (𝛼 +𝑥).
Démonstration. — a) Supposons 𝛼 ⩽ 𝛽, c’est-à-dire 𝛼 ⊆ 𝛽, et soit 𝛾
l’ordinal associé à l’ensemble bien ordonné 𝛽 𝛼. Par construction, on a
𝛽 = 𝛼 + 𝛾. Inversement, si 𝛽 = 𝛼 + 𝛾, l’application identique de 𝛼 dans
lui-même s’interprète une application croissante injective de 𝛼 dans l’en-
semble bien ordonné somme de 𝛼 et 𝛾 ; ainsi, 𝛼 ⩽ 𝛼 + 𝛾, d’où 𝛼 ⩽ 𝛽.
b) Supposons 𝛼 ⩽ 𝛽. Par définition, l’ordinal 𝛼 + 𝛾 correspond à l’en-
semble ordonné somme de 𝛼 et 𝛾 ; on construit une application stricte-
ment croissante de ce dernier ensemble dans l’ensemble ordonné somme
de 𝛽 et 𝛾 en prenant l’application identique de 𝛼 dans 𝛽, et l’application
identique de 𝛾 dans lui-même. On a donc 𝛼 + 𝛾 ⩽ 𝛽 + 𝛾.
De même, considérons l’application de 𝛼 + 𝛾 dans 𝛽 + 𝛾 qui est déduite
de l’application identique de 𝛼 dans 𝛽 et l’identité de 𝛾 dans 𝛾 ; elle est
strictement croissante ; on a donc 𝛾 + 𝛼 ⩽ 𝛾 + 𝛽.
c) Si 𝛼 < 𝛽, c’est-à-dire 𝛼 ∈ 𝛽, on a 𝛼 + ⩽ 𝛽. D’après ce qui précède, on
a donc 𝛾 + 𝛼 + ⩽ 𝛾 + 𝛽. Puisque que 𝛾 + 𝛼 + = (𝛾 + 𝛼) + , on en déduit que
𝛾 + 𝛼 ∈ 𝛾 + 𝛽, c’est-à-dire 𝛾 + 𝛼 < 𝛾 + 𝛽.
d) Pour tout 𝑥 < 𝛽, on a 𝛼 + 𝑥 < 𝛼 + 𝛽. Par suite, sup𝑥 <𝛽 (𝛼 + 𝑥) ⩽ 𝛼 + 𝛽.
Inversement, soit 𝑦 < 𝛼 + 𝛽 et démontrons que 𝑦 < sup𝑥 <𝛽 (𝛼 + 𝑥). C’est
évident si 𝑦 < 𝛼 ; supposons donc 𝛼 ⩽ 𝑦 et soit 𝛾 l’ordinal (correspondant
à l’ensemble bien ordonné 𝑦 𝛼) tel que on a 𝑦 = 𝛼 +𝛾. Pour tout ordinal 𝑥
tel que 𝛾 < 𝑥 < 𝛽, on a 𝑦 = 𝛼 +𝛾 < 𝛼 + 𝑥 < 𝛼 + 𝛽. Puisque 𝛽 est un ordinal
limite, il existe de tels ordinaux 𝑥, d’où l’assertion. □
Remarque (3.4.4). — L’addition ordinale n’est pas commutative : On a
1 + 𝜔 = 𝜔 ≠ 𝜔 + 1.
62 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
De même, on a 0 < 1 mais 0 + 𝜔 = 1 + 𝜔. On ne peut donc pas simplifier
à droite.
En revanche, il résulte de la propriété c) que l’on peut simplifier à
gauche : si 𝛾 + 𝛼 = 𝛾 + 𝛽, alors 𝛼 = 𝛽.
3.4.5. Produit. — Soit 𝛼 et 𝛽 des ordinaux. On définit leur produit 𝛼 · 𝛽
comme l’ordinal associé à l’ensemble bien ordonné 𝛼 × 𝛽 muni de l’ordre
lexicographique inverse.
Proposition (3.4.6). — Soit 𝛼, 𝛽, 𝛾 des ordinaux.
a) On a 𝛼 · 0 = 0 · 𝛼 = 0 ;
b) On a 𝛼 · 1 = 1 · 𝛼 = 𝛼 ;
c) On a (𝛼 · 𝛽) · 𝛾 = 𝛼 · (𝛽 · 𝛾) ;
d) On a 𝛼 · 𝛽 + = (𝛼 · 𝛽) + 𝛼 ;
e) On a 𝛼 · (𝛽 + 𝛾) = 𝛼 · 𝛽 + 𝛼 · 𝛾.
Démonstration. — a) L’ordinal 0 est l’ensemble vide, ainsi l’ordinal 𝛼 · 0
est associé à l’ensemble bien ordonné 𝛼×∅ qui est vide, si bien que 𝛼 ·0 = 0.
On démontre de même que 0 · 𝛼 = 0.
b) L’ordinal 1 est réduit à un élément. Ainsi, la première projection est
une bijection croissante de l’ensemble bien ordonné 𝛼 × 1 sur 𝛼 ; on en
déduit que 𝛼 · 1 = 𝛼. On démontre de même que 1 · 𝛼 = 𝛼.
c) Les deux ordinaux (𝛼 · 𝛽) · 𝛾 et 𝛼 · (𝛽 · 𝛾) correspondent tous deux
à l’ensemble 𝛼 × 𝛽 × 𝛾 muni de l’ordre lexicographique inverse. Ils sont
donc égaux.
d) L’ensemble bien ordonné 𝛽 + est l’ensemble somme des ensembles
bien ordonnés 𝛽 et 1. Cette décomposition induit une bijection de 𝛼 × 𝛽 +
sur l’ensemble somme de 𝛼 × 𝛽 et 𝛼 × 1 ; cette bijection est croissante. On
a donc 𝛼 · 𝛽 + = 𝛼 · 𝛽 + 𝛼 · 1, d’où l’assertion.
e) C’en est une variante : l’ordinal 𝛽 + 𝛾 est celui associé à l’ensemble
bien ordonné somme des ensembles 𝛽 et 𝛾. Cette bijection induit une bi-
jection de l’ensemble bien ordonné 𝛼 × (𝛽 + 𝛾) sur l’ensemble bien or-
donné somme des ensembles bien ordonnés 𝛼 × 𝛽 et 𝛼 × 𝛾. L’assertion en
résulte. □
Proposition (3.4.7). — Soit 𝛼, 𝛽, 𝛾 des ordinaux.
a) Si 𝛼 ⩽ 𝛽, alors 𝛼 · 𝛾 ⩽ 𝛽 · 𝛾 et 𝛾 · 𝛼 ⩽ 𝛾 · 𝛽 ;
3.4. ARITHMÉTIQUE DES ORDINAUX 63
b) Si 𝛼 < 𝛽 et 0 < 𝛾, alors 𝛾 · 𝛼 < 𝛾 · 𝛽 ;
c) Si 𝛽 est un ordinal limite, alors 𝛼 · 𝛽 = sup𝑥 <𝛽 𝛼 · 𝑥 = lim𝑥→𝛽 𝛼 · 𝑥.
Démonstration. — a) Par hypothèse, 𝛼 ⊆ 𝛽. L’application identique
de 𝛼 dans 𝛽 et l’application identique de 𝛾 dans lui-même fournissent des
applications injectives croissantes de 𝛼 × 𝛾 dans 𝛽 × 𝛾 et de 𝛾 × 𝛼 dans
𝛾 × 𝛽. On en déduit donc les deux inégalités annoncées.
b) Par hypothèse, 𝛼 + ⩽ 𝛽. On a donc 𝛾 · 𝛼 ⩽ 𝛾 · 𝛼 + ⩽ 𝛾 · 𝛽. Or, 𝛾 · 𝛼 + =
𝛾 · 𝛼 + 𝛾. Puisque 0 < 𝛾, on a donc 𝛾 · 𝛼 < 𝛾 · 𝛼 + , si bien que 𝛾 · 𝛼 < 𝛾 · 𝛽.
c) Si 𝑥 < 𝛽, alors 𝛼 · 𝑥 ⩽ 𝛼 · 𝛽, donc sup𝑥 <𝛽 𝛼 · 𝑥 ⩽ 𝛼 · 𝛽. Inversement,
supposons 𝑦 < 𝛼 · 𝛽 et démontrons qu’il existe un ordinal 𝑥 < 𝛽 tel que
𝑦 < 𝛼 · 𝑥. Par définition de l’ordinal 𝛼 · 𝛽, 𝑦 correspond à un couple (𝑎, 𝑏),
où 𝑎 ∈ 𝛼 et 𝑏 ∈ 𝛽. En particulier, on a 𝑏 ∈ 𝛽 + , et 𝑏 + < 𝛽 car 𝛽 est un
ordinal limite. Alors, 𝑦 ∈ 𝛼 × 𝑏 + ce qui entraîne que l’on a 𝑦 < 𝛼 · 𝑏 + ;
l’ordinal 𝑏 + convient. De plus, pour tout ordinal 𝑥 tel que 𝑏 + ⩽ 𝑥 < 𝑏, on
a 𝑦 < 𝛼 · 𝑥 < 𝛼 · 𝛽. Cela entraîne l’assertion voulue. □
Remarque (3.4.8). — La multiplication ordinale n’est pas commutative :
on a par exemple 2 · 𝜔 = 𝜔 ≠ 𝜔 + 𝜔. Ce même exemple montre qu’elle
n’est pas non plus distributive à gauche : 2 · 𝜔 = (1 + 1) · 𝜔 n’est pas égal
à 𝜔 + 𝜔.
3.4.9. Exponentiation. — Si A et B sont des ensembles bien ordonnés,
l’ensemble des fonctions de B dans A est noté AB ; le support d’une fonc-
tion 𝑓 ∈ AB est l’ensemble des 𝑏 ∈ B tels que 𝑓 (𝑏) ne soit pas le plus petit
élément de A. Notons A (B) le sous-ensemble de AB formé des fonctions de
support fini, muni de l’ordre lexicographique inverse. C’est un ensemble
bien ordonné (exemple 3.2.4).
Soit 𝛼 et 𝛽 des ordinaux. On définit l’ordinal 𝛼 𝛽 comme celui associé à
l’ensemble bien ordonné 𝛼 (𝛽) .
Proposition (3.4.10). — Soit 𝛼, 𝛽, 𝛾 des ordinaux.
a) On a 𝛼 0 = 1 et 𝛼 1 = 𝛼 ;
b) Si 𝛽 ≠ 0, alors 0𝛽 = 0 ;
c) On a 𝛼 𝛽+𝛾 = 𝛼 𝛽 · 𝛼 𝛾 ;
+
d) On a 𝛼 𝛽 = 𝛼 𝛽 · 𝛼 ;
e) On a (𝛼 𝛽 )𝛾 = 𝛼 𝛽·𝛾 .
64 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Démonstration. — a) L’ensemble 𝛼 0 est réduit à un élément ; l’ordinal
correspondant est donc égal à 1. L’application 𝑓 ↦→ 𝑓 (0) qui à une fonc-
tion de 1 dans 𝛼 associe sa valeur en 0 est bijective et strictement crois-
sante. Comme l’ordinal 1 est fini, la condition de support est automatique.
Par suite, 𝛼 1 = 𝛼.
b) Puisque l’ensemble 𝛽 n’est pas vide, il n’y a pas de fonction de 𝛽 dans
l’ensemble vide, l’ordinal correspondant à 0𝛽 est donc égal à 0.
c) À une fonction 𝑓 de l’ensemble somme de 𝛽 et 𝛾 dans l’ensemble 𝛼,
associons le couple (𝑓 | 𝛽 , 𝑓 |𝛾 ) de ses deux restrictions. Pour que 𝑓 soit à
support fini, il faut et il suffit que ses deux restrictions le soient. Ainsi, cette
application définit une bijection de l’ensemble des fonctions de support
fini de 𝛽 + 𝛾 dans 𝛼, dans l’ensemble somme des ensembles de fonctions
à support fini de 𝛽 dans 𝛼, et de 𝛾 dans 𝛼. Cette bijection est strictement
croissante, d’où l’égalité d’ordinaux 𝛼 𝛽+𝛾 = 𝛼 𝛽 + 𝛼 𝛾 .
+
d) D’après l’assertion précédente, on a 𝛼 𝛽 = 𝛼 𝛽+1 = 𝛼 𝛽 · 𝛼 1 , d’où la
relation voulue en utilisant a).
e) L’égalité à démontrer provient de l’existence de l’existence d’une bi-
jection croissante de A (B×C) sur (A (B) ) (C) , lorsque A, B, C sont des en-
sembles bien ordonnés. En effet, si 𝑓 : B × C → A est une application,
on note 𝑓˜ l’application qui, à 𝑐 ∈ C, associe l’application 𝑏 ↦→ 𝑓 (𝑏, 𝑐) ;
autrement dit, 𝑓˜(𝑐)(𝑏) = 𝑓 (𝑏, 𝑐). L’application 𝑓 ↦→ 𝑓˜ est bijective. Si le
support de 𝑓 est fini, alors l’ensemble des couples (𝑏, 𝑐) tels que 𝑓 (𝑏, 𝑐)
ne soit pas le plus petit élément de A est fini ; a fortiori, l’ensemble des 𝑐
tels que 𝑓˜(𝑐) ne soit pas la fonction constante de valeur ce plus petit élé-
ment est fini, donc le support de 𝑓˜ est fini. Inversement, si le support
de 𝑓˜ est fini, la réunion, lorsque 𝑐 parcourt ce support, des ensembles finis
supp( 𝑓˜(𝑐)) × {𝑐}, est le support de 𝑓 ; il est donc fini. Ainsi, 𝑓 ↦→ 𝑓˜ réalise
une bijection de A (B×C) sur (A (B) ) (C) . Cette bijection est croissante : sup-
posons 𝑓 < 𝑔 et soit (𝑏, 𝑐) le couple tel que 𝑓 (𝑏, 𝑐) < 𝑔(𝑏, 𝑐) et 𝑓 (𝑧) = 𝑔(𝑧)
pour (𝑏, 𝑐) < 𝑧. Si 𝑦 > 𝑐, on a 𝑓˜(𝑦) = 𝑔(𝑦), ˜ car (𝑏, 𝑐) < (𝑥, 𝑦) pour
tout 𝑥 ∈ B, et 𝑓˜(𝑦)(𝑥) = 𝑓 (𝑥, 𝑦) = 𝑔(𝑥, 𝑦) = 𝑔(𝑦)(𝑥).
˜ D’autre part, on a
˜
𝑓 (𝑐) < 𝑔(𝑐),
˜ ˜
car 𝑓 (𝑐)(𝑏) = 𝑓 (𝑏, 𝑐) < 𝑔(𝑏, 𝑐) = 𝑔(𝑐)(𝑏),
˜ tandis que pour
tout 𝑥 ∈ B tel que 𝑏 < 𝑥, on a (𝑏, 𝑐) < (𝑥, 𝑐) donc 𝑓˜(𝑐)(𝑥) = 𝑓 (𝑥, 𝑐) =
˜
𝑔(𝑥, 𝑐) = 𝑔(𝑐)(𝑥). Ainsi, 𝑓˜ < 𝑔.˜
□
3.4. ARITHMÉTIQUE DES ORDINAUX 65
Proposition (3.4.11). — Soit 𝛼, 𝛽, 𝛾 des ordinaux.
a) Si 𝛼 ⩽ 𝛽, alors 𝛼 𝛾 ⩽ 𝛽𝛾 ;
b) Si 𝛼 ≠ 0 et 𝛽 ⩽ 𝛾, alors 𝛼 𝛽 ⩽ 𝛼 𝛾 ;
c) Si 1 < 𝛼 et 𝛽 < 𝛾, alors 𝛼 𝛽 < 𝛼 𝛾 .
d) Si 𝛽 est un ordinal limite, alors 𝛼 𝛽 = lim𝑥→𝛽 𝛼 𝑥 = sup𝑥 <𝛽 𝛼 𝑥 .
Démonstration. — a) L’injection de 𝛼 dans 𝛽 induit une application in-
jective et croissante de l’ensemble des fonctions à support fini de 𝛾 dans 𝛼
dans celui des fonctions à support fini de 𝛾 dans 𝛽. On en déduit l’inégalité
voulue.
b) Comme 𝛼 ≠ 0, on a 0 ∈ 𝛼. Si 𝑓 est une fonction à support fini de 𝛽
dans 𝛼, son « prolongement par zéro »est encore une fonction à support
fini de 𝛾 dans 𝛼. Cela définit une injection croissante et entraîne l’inégalité
voulue.
c) Supposons de plus que 𝛽 < 𝛾. On a alors 𝛽 + ⩽ 𝛾. D’après ce qui
+ +
précède, on a 𝛼 𝛽 ⩽ 𝛼 𝛽 ⩽ 𝛼 𝛾 . Or, on a 𝛼 𝛽 = 𝛼 𝛽 · 𝛼. Comme 1 < 𝛼, on a
+
1 ⩽ 𝛼 𝛽 , puis 𝛼 𝛽 < 𝛼 𝛽 · 𝛼. Par conséquent, 𝛼 𝛽 < 𝛼 𝛽 ⩽ 𝛼 𝛾 , d’où l’assertion.
d) Lorsque 𝛼 = 0, on a 𝛼 𝑥 = 0 sauf pour 𝑥 = 0 ; la relation est alors
vérifiée. Supposons désormais que 𝛼 ≠ 0.
Pour 𝑥 < 𝛽, on a 𝛼 𝑥 ⩽ 𝛼 𝛽 . Inversement, soit 𝛾 < 𝛼 𝛽 et démontrons
qu’il existe 𝛿 < 𝛽 tel que 𝛾 < 𝛼 𝑥 pour tout ordinal 𝑥 tel que 𝑥 > 𝛿. Cela
entraînera l’égalité 𝛼 𝛽 = lim𝑥→𝛽 𝛼 𝑥 ; comme 𝛽 est un ordinal limite, il
existe un ordinal 𝑥 tel que 𝛿 < 𝑥 < 𝛽, si bien que l’égalité 𝛼 𝛽 = sup𝑥 <𝛽 𝛼 𝑥
s’ensuit également.
Par définition, 𝛾 correspond à une fonction 𝑔 : 𝛽 → 𝛼 de support fini.
Soit 𝑏 ∈ 𝛽 tel que 𝑔(𝑥) = 0 pour tout ordinal 𝑥 ∈ 𝛽 tel que 𝑏 ⩽ 𝑥 (si 𝑠
est la borne supérieure du support de 𝑔, on peut prendre 𝑏 = 𝑠 + ). L’or-
dinal 𝑏 correspond à la section commençante de 𝛽 délimitée par 𝑏 et la
fonction 𝑔|𝑏 définit un élément de 𝛼 (𝑏) dont le prolongement par zéro
est 𝑔 ; ainsi, 𝛾 ∈ 𝛼 𝑏 , c’est-à-dire 𝛾 < 𝛼 𝑏 . Alors, pour tout ordinal 𝑥 tel
que 𝑏 ⩽ 𝑥 < 𝛽, on a 𝛾 < 𝛼 𝑏 ⩽ 𝛼 𝑥 . Cela conclut la démonstration.
□
66 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
3.5. Cardinaux infinis
Définition (3.5.1). — On dit que deux ensembles A et B sont équipotents
s’il existe une bijection 𝑓 : A → B.
C’est une relation d’équivalence. Le but de ce paragraphe est d’associer
à tout ensemble A un ensemble particulier Card(A) qui lui est équipotent,
de sorte que Card(A) = Card(B) si et seulement si A et B sont équipotents.
3.5.2. — Si A et B sont des ensembles, notons A ⪯ B s’il existe une injec-
tion de A dans B, et A ≡ B s’il existe une bijection de A sur B.
S’il existe une application surjective 𝑓 de A dans B, toute section 𝑔 de 𝑓
est une application injective de B dans B, de sorte que B ⪯ A.
Théorème (3.5.3). — Soit A et B des ensembles.
a) Ou bien A ⪯ B, ou bien B ⪯ A (Théorème de Cantor) ;
b) Si A ⪯ B et B ⪯ A, alors A ≡ B (Théorème de Cantor-Bernstein).
Démonstration. — a) Munissons A et B d’un bon ordre ; il existe alors
un isomorphisme d’ensembles ordonnés de A sur B ou un segment initial
de B, ou un isomorphisme d’ensembles ordonnés de B sur un segement
initial de A. Dans le premier cas, cela fournit une injection de A dans B,
de sorte que A ⪯ B ; dans le second une injection de B dans A de sorte
que B ⪯ A.
b) Soit 𝑓 : A → B et 𝑔 : B → A des applications injectives et construi-
sons une application bijective ℎ de A dans B. On définit des ensembles
(A𝑛 ) et (B𝑛 ) par récurrence sur 𝑛 en posant A0 = A, B0 = B, et, pour
𝑛 ⩾ 0, A𝑛+1 = 𝑔(B𝑛 ) et B𝑛+1 = 𝑓Ñ (A𝑛 ) ; on pose aussi A𝑛∗ = A𝑛 A𝑛+1 et
B𝑛∗ = B𝑛 B𝑛+1 ; soit enfin A∞ = 𝑛∈N A𝑛 et B∞ = 𝑛∈N B𝑛 .
Ñ
Par construction, la suite (A∗0, A∗1, . . . , A∞ ) est une partition de A, et la
suite (B∗0, B∗1, . . . , B∞ ) est une partition de B. Par restriction, l’application 𝑓
induit une bijection de A𝑛∗ sur B𝑛+1 ∗ , pour tout 𝑛 ∈ N, et une bijection de A
∞
∗
sur B∞ ; de même, l’application 𝑔 induit une bijection de B𝑛 sur A𝑛+1 , pour ∗
tout entier 𝑛.
On définit une application ℎ : A → B de la façon suivante. Soit 𝑎 ∈ A.
Si 𝑎 ∈ A∞ , on pose ℎ(𝑎) = 𝑓 (𝑎). Sinon, soit 𝑛 l’unique entier tel que
𝑎 ∈ A𝑛∗ ; si 𝑛 est pair, on pose ℎ(𝑎) = 𝑓 (𝑎) ; si 𝑛 est impair, alors 𝑎 appartient
à A1 = 𝑔(B), donc il possède un unique antécédent par 𝑔 que l’on note
ℎ(𝑎). L’application ℎ est bijective. □
3.6. ARITHMÉTIQUE DES CARDINAUX 67
3.5.4. — D’après le théorème précédent, la relation A ⪯ B sur les en-
sembles induit par restriction une relation d’ordre total sur les cardinaux,
notée ⪯ ou, plus simplement, ⩽.
On note ℵ0 le cardinal de l’ensemble N ; c’est le plus petit cardinal in-
fini. (1)
3.6. Arithmétique des cardinaux
3.6.1. — Soit 𝛼, 𝛽 des cardinaux. On note respectivement 𝛼 + 𝛽, 𝛼𝛽 et
𝛼 𝛽 les cardinaux des ensembles somme des ensembles 𝛼 et 𝛽, produit des
ensembles 𝛼 et 𝛽, et de l’ensemble F (𝛽, 𝛼) des fonctions de 𝛽 dans 𝛼.
Lemme (3.6.2). — Soit A, A′, B, B′ des ensembles tels que A′ ⪯ A et B′ ⪯ B.
On a les relations A′ + B′ ⪯ A + B et A′ × B′ ⪯ A × B. Sauf si A = B′ = ∅
et B ≠ ∅, on a de plus F (B′, A′) ⪯ F (B, A).
En particulier, Card(A + B) = Card(A) + Card(B), Card(A × B) =
Card(A) Card(B) et Card(F (B, A)) = Card(AB ) = Card(A) Card(B) .
Démonstration. — Choisissons des injections 𝑓 : A′ → A et 𝑔 : B′ → B ;
pour traiter la deuxième assertion, on suppose que 𝑓 et 𝑔 sont bijectives
et que A′ = Card(A) et B′ = Card(B).
L’unique application ℎ de A′ + B′ dans A + B dont la restriction à A′ est
égale à 𝑓 et la restriction à B′ est égale à 𝑔 est injective ; elle est bijective
lorsque 𝑓 et 𝑔 sont bijectives. Cela prouve la première inégalité, ainsi que
l’égalité Card(A + B) = Card(A) + Card(B).
De même, l’application de A′ × B′ dans A × B définie par (𝑎, 𝑏) ↦→
(𝑓 (𝑎), 𝑔(𝑏)) est injective, et bijective si 𝑓 et 𝑔 sont bijectives. Par suite,
on a A′ × B′ ⪯ A × B, ainsi que Card(A × B) = Card(A) Card(B).
Pour démontrer la dernière inégalité, supposons d’abord que l’in-
jection 𝑔 possède une rétraction 𝑔′ : B → B′ ; c’est par exemple le cas
lorsque B′ ≠ ∅ ou lorsque 𝑔 est bijective. L’application 𝑘 de F (B′, A′)
dans F (B, A) donnée par 𝑢 ↦→ 𝑓 ◦ 𝑢 ◦ 𝑔′ est alors injective ; on a donc
F (B′, A′)) ⪯ F (B, A). Si 𝑓 et 𝑔 sont bijectives, l’application 𝑘 est bijec-
tive, d’où l’égalité Card(AB ) = Card(F (B, A)) = Card(A) Card(B) . Enfin,
(1) Lesymbole ℵ, aleph, est la première lettre de l’alphabet hébreu. Elle a été introduite vers 1893
par Georg Cantor pour noter les cardinaux infinis, parce que « les autres alphabets étaient déjà
trop largement utilisés. » La notation a été conservée depuis.
68 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
dans le cas où B′ = ∅, l’ensemble des fonctions de B′ dans A est réduit
à un élément ; comme A ≠ ∅, l’ensemble F (B; A) n’est pas vide, d’où
l’inégalité F (B′; A′) ⪯ F (B; A). □
Théorème (3.6.3) (Hessenberg). — Soit A un ensemble infini. L’ensemble
A × A est équipotent à A.
Démonstration. — Soit I l’ensemble des couples (V, 𝑓 ), où V est une partie
de A et 𝑓 : V → V × V est bijective ; on note aussi (V𝑖 , 𝑓𝑖 ) l’élement 𝑖 de I.
Munissons I de la relation définie par (V, 𝑓 ) ⪯ (W, 𝑔) si V ⊆ W et si
𝑔| V = 𝑓 ; démontrons que c’est une relation d’ordre. Pour tout (V, 𝑓 ) ∈
I, on a (V, 𝑓 ) ⪯ (W, 𝑓 ). Soit (V, 𝑓 ) et (W, 𝑔) des éléments de I tels que
(V, 𝑓 ) ⩽ (W, 𝑔) et (W, 𝑔) ⩽ (V, 𝑓 ) ; alors V ⊆ W ⊆ V, de sorte que
V = W ; puis 𝑓 = 𝑔| V = 𝑔, donc (V, 𝑓 ) = (W, 𝑔). Soit enfin (V, 𝑓 ), (W, 𝑔)
et (X, ℎ) des élements de I tels que (V, 𝑓 ) ⩽ (W, 𝑔) et (W, 𝑔) ⩽ (X, ℎ) ; on
a V ⊆ W ⊆ X, donc V ⊆ X ; de plus, 𝑓 = 𝑔| V = ℎ| W | V = ℎ| V , ce qui prouve
que (V, 𝑓 ) ⩽ (X, ℎ).
Démontrons que l’ensemble ordonné (I, Ð ⩽) est inductif. Soit J une par-
tie totalement ordonnée de I ; posons V = 𝑗 ∈J V 𝑗 . Pour tout 𝑎 ∈ V, l’en-
semble des éléments 𝑗 ∈ J tels que 𝑎 ∈ V 𝑗 n’est pas vide. soit 𝑎 ∈ V et
soit 𝑗, 𝑘 ∈ J tels que 𝑎 ∈ V 𝑗 ∩ V𝑘 . Si 𝑗 ⩽ 𝑘, alors V 𝑗 ⊆ V𝑘 et 𝑓𝑘 | V 𝑗 = 𝑓 𝑗 ,
de sorte que 𝑓 𝑗 (𝑎) = 𝑓𝑘 (𝑎) ; par symétrie, cette égalité vaut aussi lorsque
𝑘 ⩽ 𝑗. Il existe alors une unique application 𝑓 : V → A × A telle que
𝑓 (𝑎) = 𝑓 𝑗 (𝑎) pour tout 𝑗 ∈ J tel que 𝑎 ∈ V 𝑗 . Démontrons que 𝑓 est injec-
tive et que son image est égale à V × V. Soit 𝑎, 𝑏 ∈ V tels que 𝑓 (𝑎) = 𝑓 (𝑏).
Soit 𝑗, 𝑘 ∈ J tels que 𝑎 ∈ V 𝑗 et 𝑏 ∈ V𝑘 ; si 𝑗 ⩽ 𝑘, alors V 𝑗 ⊆ V𝑘 , de sorte que
𝑓𝑘 (𝑎) = 𝑓 (𝑎) = 𝑓 (𝑏) = 𝑓𝑘 (𝑏), d’où 𝑎 = 𝑏 car 𝑓𝑘 est injective ; on raisonne
de même si 𝑘 ⩽ 𝑗. Cela démontre que 𝑓 est injective. Soit 𝑎 ∈ V et soit
𝑗 ∈ J tel que 𝑎 ∈ V 𝑗 ; alors, 𝑓 (𝑎) = 𝑓 𝑗 (𝑎) ∈ V 𝑗 × V 𝑗 ⊆ V × V. L’image
de 𝑓 est donc contenue dans V × V. Soit enfin (𝑎, 𝑏) ∈ V ; soit 𝑗, 𝑘 ∈ J
tels que 𝑎 ∈ V 𝑗 et 𝑏 ∈ V𝑘 . Si 𝑗 ⩽ 𝑘, alors 𝑎, 𝑏 ∈ V𝑘 ; puisque l’image
de 𝑓𝑘 est égale à V𝑘 × V𝑘 , il existe 𝑐 ∈ V𝑘 tel que 𝑓𝑘 (𝑐) = (𝑎, 𝑏) ; on a alors
𝑐 ∈ V et 𝑓 (𝑐) = 𝑓𝑘 (𝑐) = (𝑎, 𝑏). On raisonne de même si 𝑘 ⩽ 𝑗. Par suite,
le couple (V, 𝑓 ) est un élément de I ; il majore J par construction. Cela
prouve que l’ensemble I est inductif.
Comme A est infini, il contient une partie B0 équipotente à N, laquelle
est équipotente à N × N ; soit 𝑓0 : B0 → B0 × B0 une bijection. Soit (B, 𝑓 )
3.6. ARITHMÉTIQUE DES CARDINAUX 69
un élément de I qui est maximal et majore (B0, 𝑓0 ) (il en existe, en vertu
du théorème de Zorn) ; posons C = A B. Par construction, l’ensemble B
est infini. Par suite, on a les inégalités
Card(B) ⩽ 2 Card(B) ⩽ 3 Card(B) ⩽ Card(B) 2 = Card(B),
d’où les égalités
Card(B) 2 = 3 Card(B) = 2 Card(B) = Card(B).
Pour démontrer que B est équipotent à A, nous allons prouver
que Card(C) < Card(B). Raisonnons par l’absurde et supposons que
Card(C) ⩾ Card(B). Soit alors B1 une partie de C qui est équipotente à B.
Posons B′ = B ∪ B1 et définissons une application 𝑓 ′ : B′ → B′ × B′ qui
prolonge 𝑓 . L’ensemble B′ × B′ est la réunion des parties B × B, B1 × B,
B × B1 et B1 × B1 , deux à deux disjointes et toutes équipotentes à B × B,
donc à B. Comme Card(B) = 3 Card(B), il existe une bijection 𝑓1 de B1
sur (B1 × B) ∪ (B × B1 ) ∪ (B1 × B1 ). L’application 𝑓 ′ : B′ → B′ × B′ définie
par 𝑓 ′ (𝑎) = 𝑓 (𝑎) pour 𝑎 ∈ B et par 𝑓 ′ (𝑎) = 𝑓1 (𝑎) pour 𝑎 ∈ B1 est bijective.
Le couple (B′, 𝑓 ′) appartient à I, majore (B, 𝑓 ) et est distinct de (B, 𝑓 ), ce
qui contredit l’hypothèse que (B, 𝑓 ) est un élément maximal de I.
Par conséquent, Card(C) < Card(B), d’où Card(A) = Card(B) +
Card(C) = Card(B) puisque B est infini. Ainsi, Card(A × A) =
Card(B × B) = Card(B) = Card(A), ce qu’il fallait démontrer. □
Corollaire (3.6.4). — Soit 𝛼 et 𝛽 des cardinaux tels que 1 ⩽ 𝛽 ⩽ 𝛼 ; Sup-
posons que 𝛼 est infini. On a alors 𝛼 + 𝛽 = 𝛼 et 𝛼𝛽 = 𝛼. En particulier,
𝛼 2 = 2𝛼 = 𝛼.
Démonstration. — Comme 𝛼 est infini, le théorème précédent implique
l’égalité 𝛼𝛼 = 𝛼. Puisque 2 ⩽ 𝛼, on a l’inégalité 𝛼 ⩽ 𝛼 + 𝛽 ⩽ 𝛼 + 𝛼 ⩽ 2𝛼 ⩽
𝛼𝛼 = 𝛼, si bien que 𝛼 + 𝛽 = 𝛼. Comme 𝛽 ≠ 0, on a aussi 𝛼 ⩽ 𝛼𝛽 ⩽ 𝛼𝛼 = 𝛼,
d’où l’égalité 𝛼𝛽 = 𝛼. □
Corollaire (3.6.5). — Soit A, B des ensembles et soit 𝑓 : A → B une appli-
cation. Soit 𝛼 un cardinal infini tel que Card(B) ⩽ 𝛼 et Card(𝑓 −1 (𝑏)) ⩽ 𝛼
pour tout 𝑏 ∈ B ; alors, Card(A) ⩽ 𝛼.
70 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Démonstration. — Pour tout 𝑏 ∈ B, soit 𝑔𝑏 : 𝑓 −1 (𝑏) → 𝛼 une application
injective. L’application 𝑔 : A → B × 𝛼 définie par 𝑔(𝑎) = (𝑓 (𝑎), 𝑔 𝑓 (𝑎) (𝑏))
est injective. On a donc Card(A) ⩽ Card(B × 𝛼) ⩽ 𝛼𝛼 = 𝛼. □
Corollaire (3.6.6). — Soit 𝛼 un cardinal infini.ÐSoit I un ensemble et soit
(A𝑖 )𝑖∈I une famille d’ensembles ; on note A = 𝑖∈I A𝑖 . Si Card(I) ⩽ 𝛼 et
Card(A𝑖 ) ⩽ 𝛼 pour tout 𝑖 ∈ I, alors Card(A) ⩽ 𝛼.
Démonstration. — Soit A′ la somme de la famille A𝑖 ; c’est l’ensemble des
couples (𝑖, 𝑎) ∈ I × A tels que 𝑎 ∈ A𝑖 . Soit 𝑓 : A′ → I et 𝑔 : A′ → A les
deux projections. Pour tout 𝑖 ∈ I, l’application de A𝑖 dans 𝑓 −1 (𝑖) définie
par 𝑎 ↦→ (𝑖, 𝑎) est bijective, donc Card(𝑓 −1 (𝑖)) ⩽ 𝛼 ; d’après le corollaire
précédent, on a donc Card(A′) ⩽ 𝛼. L’application 𝑔 est surjective, par
hypothèse, donc Card(A) ⩽ Card(A′) ⩽ 𝛼. □
Théorème (3.6.7) (Cantor). — Soit A un ensemble. Il n’existe pas d’appli-
cation surjective de A dans P (A).
Démonstration. — Raisonnons par l’absurde et considérons une applica-
tion surjective 𝑓 : A → P (A). Soit B l’ensemble des éléments 𝑎 ∈ A tels
que 𝑎 ∉ 𝑓 (𝑎). Par hypothèse, il existe un élément 𝑏 ∈ A tel que B = 𝑓 (𝑏).
Si 𝑏 ∈ B, alors 𝑏 ∉ 𝑓 (𝑏) = B, par définition de B ; donc 𝑏 ∉ B, c’est-à-dire
𝑏 ∈ 𝑓 (𝑏) = B, contradiction. □
Corollaire (3.6.8). — Pour tout cardinal 𝛼, on a 2𝛼 > 𝛼.
Proposition (3.6.9). — Les ensembles P (N) et R sont équipotents.
On dit qu’ils ont la puissance du continu.
Démonstration. — En identifiant une partie A de N à sa fonction carac-
téristique 𝜒 A : N → {0, 1}, on remplace P (N) par l’ensemble {0, 1}N
des fonctions de N dans {0, 1}. L’idée de la construction est de repré-
senter un nombre réel par son développement en base 2. Cependant,
certains nombres réels ont plusieurs développements, par exemple
1,000 · · · = 0,1111 . . . , ce qui nous oblige à quelque précaution. Pour
𝑎 ∈ A, on pose
∞
∑︁
𝑓 (𝑎) = 0,𝑎 0𝑎 1𝑎 2 · · · = 𝑎𝑛 2−𝑛−1 .
𝑛=0
3.6. ARITHMÉTIQUE DES CARDINAUX 71
L’image de 𝑓 est l’intervalle [0, 1], d’où l’inégalité
Card([0, 1]) ⩽ Card(F (N, {0, 1})).
Soit 𝑎, 𝑏 ∈ A tels que 𝑓 (𝑎) = 𝑓 (𝑏) et 𝑎 ≠ 𝑏 ; soit 𝑚 le plus pe-
tit entier tel que 𝑎𝑚 ≠ 𝑏𝑚 ; quitte à échanger 𝑎 et 𝑏, on suppose que
𝑎𝑚 = 0 et 𝑏𝑚 = 1. Démontrons que 𝑎 = (𝑎 0, . . . , 𝑎𝑚−1, 0, 1, 1, . . . )
et 𝑏 = (𝑎 0, . . . , 𝑎𝑚−1, 1, 0, 0, . . . ). Posons 𝑎′ = (𝑎𝑚 , 𝑎𝑚+1, . . . ) et 𝑏 ′ =
(𝑏𝑚 , 𝑏𝑚+1, . . . ) ; on a donc
𝑚−1
! 𝑚−1
!
∑︁ ∑︁
𝑓 (𝑎′) = 2𝑚+1 𝑓 (𝑎) − 𝑎𝑛 2−𝑛−1 = 2𝑚+1 𝑓 (𝑏) − 𝑏𝑛 2−𝑛−1 = 𝑓 (𝑏 ′),
𝑛=0 𝑛=0
ce qui permet de supposer que 𝑚 = 0 et ramène à prouver 𝑎 = (0, 1, 1, . . . )
et 𝑏 = (1, 0, 0, . . . ). On déduit de la définition de 𝑓 que 𝑓 (𝑎) ⩽ 1 ⩽ 𝑓 (𝑏),
donc 𝑓 (𝑎) = 𝑓 (𝑏) = 1. Supposons qu’il existe un entier 𝑚 ⩾ 1 tel que
𝑎𝑚 ≠ 1, on a
∞
∑︁ ∑︁ ∑︁
−𝑛−1 −𝑛−1
𝑓 (𝑎) = 𝑎𝑛 2 ⩽ 𝑎𝑛 2 ⩽ 2−𝑛−1 = 1 − 2−𝑚−1 < 1.
𝑛=0 𝑛=0 𝑛=0
𝑛≠𝑚 𝑛≠𝑚
Cette contradiction prouve que 𝑎 = (0, 1, 1, . . . ). De même, s’il existe un
entier 𝑚 ⩾ 1 tel que 𝑏𝑚 ≠ 0, on a
∞
∑︁
𝑓 (𝑏) = 𝑏𝑛 2−𝑛−1 ⩾ 1 + 2−𝑚−1 > 1,
𝑛=0
si bien que 𝑏 = (1, 0, 0, . . . ). Par conséquent, chaque élément de [0, 1] a au
plus deux antécédents. Appliquons le corollaire 3.6.5 à l’application 𝑓 et
au cardinal Card([0, 1]) ; on en déduit
Card(F (N, {0, 1})) ⩽ 2 · Card([0, 1]) = Card([0, 1]).
On a donc l’égalité Card([0, 1]) = Card(P (N)).
Pour conclure la démonstration de la proposition, il reste à vérifier que
Card([0, 1]) = Card(R). L’application 𝑡 ↦→ cot(𝜋𝑡) définit une bijection
de ]0, 1[ sur R ; on a donc
Card([0, 1]) ⩽ Card(R) = Card(]0, 1[ ⩽ Card([0, 1]),
d’où l’égalité voulue. □
72 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Théorème (3.6.10) (König). — Soit (𝜅Í𝑖 )𝑖∈I et (𝜆Î
𝑖 )𝑖∈I des familles de cardi-
naux tels que 𝜅𝑖 < 𝜆𝑖 pour tout 𝑖. On a 𝑖∈I 𝜅𝑖 < 𝑖∈I 𝜆𝑖 .
Démonstration. — Soit (B𝑖 )𝑖∈I une Î famille d’ensembles tels que 𝜆𝑖 =
Card(B𝑖 ) pour tout 𝑖 ; posons B = B𝑖 . pour
Í tout 𝑖, soit A𝑖 une partie
Ð Card(A𝑖 ) = 𝜅𝑖 . Le cardinal 𝑖∈I 𝜅𝑖 est le cardinal de la
de B𝑖 telle que
partie A de B𝑖 × I formée des couples (𝑎, 𝑖) tels que 𝑎 ∈ A𝑖 . Pour 𝑖 ∈ I
et 𝑎 ∈ A𝑖 , on définit un élément 𝜑 (𝑎, 𝑖) de B par 𝜑 (𝑎, 𝑖) 𝑗 = 0 si 𝑗 ≠ 𝑖,
et 𝜑 (𝑎, 𝑖)𝑖 = 𝑎. L’application 𝜑 : A → B ainsi définie est injective, donc
Card(A) ⩽ Card(B).
Ð tout 𝑖, soit C𝑖 une partie de B de cardinal Card(A𝑖 ) ; démontrons
Pour
que 𝑖∈I C𝑖 ≠ B. Il en résultera qu’il n’existe pas d’application surjective
de A dans B, et en particulier Card(A) < Card(B). Pour tout 𝑖, notons
𝑝𝑖 : B → B𝑖 la projection d’indice 𝑖. On a Card(𝑝𝑖 (C𝑖 )) ⩽ Card(C𝑖 ) =
Card(A𝑖 ) < Card(B𝑖 ) ; il existe donc un élément 𝑏𝑖 ∈ B𝑖 𝑝𝑖 (C𝑖 ). Posons
𝑏 = (𝑏𝑖 ) ∈ B. PourÐ tout 𝑖, on a 𝑝𝑖 (𝑏) = 𝑏𝑖 ∉ 𝑝𝑖 (C𝑖 ), donc 𝑏 ∉ C𝑖 ; par
conséquent, 𝑏 ∉ C𝑖 . □
Exercice (3.6.11). — Déduire le théorème de Cantor du théorème de Kö-
nig.
Remarque (3.6.12). — L’hypothèse du continu, proposée par G. Cantor
en 1878, postule qu’il n’existe aucun cardinal 𝛼 tel que ℵ0 < 𝛼 < 2ℵ0 ;
autrement dit, si une partie de R n’est pas dénombrable, son cardinal
est la puissance du continu. C’était le premier des problèmes suggérés
par D. Hilbert en 1900 lors de son exposé au Congrès international des
mathématiciens de Paris. D’après des théorèmes remarquables de Gödel
(1938) et Cohen (1963), elle ne peut en fait ni être infirmée, ni démontrée,
à partir des simples axiomes de la théorie des ensembles (zfc, ou nbg).
Cela ne signifie pas que cette hypothèse aurait un statut de vérité indé-
terminé, quelque part entre vrai et faux, mais simplement que les axiomes
de la théorie des ensembles ne sont pas assez riches pour rendre compte de
toutes leurs propriétés escomptées. Le théorème d’incomplétude de Gö-
del (1931) affirme que tout système d’axiomes assez riche, et énonçable
de façon raisonnable, fourmille d’énoncés indécidables. C’est cependant
un sujet de recherches actuels que de déterminer des axiomes supplémen-
taires « raisonnables » qui permettraient de résoudre cette question.
3.7. COFINALITÉ 73
3.7. Cofinalité
Définition (3.7.1). — Soit X un ensemble ordonné. On dit qu’une partie A
de X est cofinale dans X si pour tout 𝑥 ∈ X, il existe 𝑎 ∈ A tel que 𝑥 ⩽ 𝑎.
Lemme (3.7.2). — Soit X un ensemble ordonné et soit A une partie de X.
a) Si A est cofinale, alors A contient tout élément maximal de X.
b) On suppose que X est totalement ordonné et possède un plus grand élé-
ment 𝑎. Alors A est cofinale si et seulement si 𝑎 ∈ A.
c) On suppose que X est totalement ordonné et ne possède pas de plus
grand élément. Alors A est cofinale si et seulement si A n’est pas majorée
dans X.
Démonstration. — a) Supposons que A soit cofinale et soit 𝑥 un élément
maximal de X. Soit 𝑎 ∈ A tel que 𝑥 ⩽ 𝑎. Comme 𝑥 est maximal, on a 𝑥 = 𝑎,
et donc 𝑥 ∈ A.
b) D’après ce qui précède, si A est cofinale, on a 𝑎 ∈ A. Supposons
inversement que 𝑎 ∈ A et prouvons que A est cofinale. Soit 𝑥 ∈ X. Comme
X est totalement ordonné, on a 𝑥 ⩽ 𝑎 ; puisque 𝑎 ∈ A, cela prouve que A
est cofinale.
c) Supposons que A soit majorée et soit 𝑥 ∈ X un majorant de A.
Comme X n’a pas de plus grand élément, il existe 𝑦 ∈ X tel que 𝑥 < 𝑦. Par
hypothèse, on a 𝑎 ⩽ 𝑥 < 𝑦 pour tout 𝑎 ∈ A ; cela entraîne que A n’est pas
cofinale. Supposons inversement que A ne soit pas majorée et démontrons
que A est cofinale. Soit 𝑥 ∈ X ; puisque A n’est pas majorée, l’élément 𝑥
ne majore pas 𝑥, donc il existe 𝑎 ∈ A tel que 𝑥 < 𝑎 ; en particulier 𝑥 ⩽ 𝑎,
si bien que A est cofinale dans X.
□
Définition (3.7.3). — Soit X un ensemble bien ordonné. On appelle cofina-
lité de X, et on note cof (X), la borne inférieure des ordinaux qui sont types
d’ordre d’une partie cofinale de X.
La cofinalité d’un ensemble bien ordonné est donc un ordinal.
Remarque (3.7.4). — On remarque que X est une partie cofinale d’elle-
même, donc la borne inférieure qui apparaît dans la définition est en fait
un plus petit élément. Il existe en particulier une partie cofinale A de X
dont le type d’ordre est égal à cof (X). Par définition du type d’ordre d’une
74 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
partie bien ordonnée, il existe une bijection de cof (X) sur A. L’application
correspondante 𝑓 : cof (X) → X, d’image A, est injective, croissante, et
son image est cofinale.
Exemple (3.7.5). — Soit X un ensemble bien ordonné.
a) Si X est vide, on a cof (∅) = 0. En effet, ∅ est la seule partie de X, et
elle est cofinale.
b) Si X est successeur, on a cof (X) = 1. En effet, X possède un plus grand
élément, disons 𝑥, et une partie A de X est cofinale si et seulement si
elle contient cet élément 𝑥, et son type d’ordre est au moins égal à l’ordi-
nal 1. Comme la partie {𝑥 } est cofinale et de type d’ordre égal à 1, il vient
cof (X) = 1.
c) Si X est limite, alors cof (X) est infini. En effet, une partie A est cofinale
si et seulement si elle n’est pas bornée ; elle est nécessairement infinie,
d’où cof (X) ⩾ 𝜔.
Proposition (3.7.6). — Soit 𝑓 : X → Y une application croissante entre
ensembles bien ordonnés dont l’image est cofinale.
a) On a cof (Y) ⩽ cof (X).
b) Si Y n’a pas de plus grand élément, on a cof (X) = cof (Y).
Démonstration. — a) Soit A une partie de X de type d’ordre cof (X). La
partie 𝑓 (A) de Y est cofinale : soit 𝑦 ∈ Y ; comme 𝑓 (X) est cofinale dans Y,
il existe 𝑥 ∈ X tel que 𝑦 ⩽ 𝑓 (𝑥) ; comme A est cofinale dans X, il existe
𝑎 ∈ A tel que 𝑥 ⩽ 𝑎 ; alors, 𝑦 ⩽ 𝑓 (𝑥) ⩽ 𝑓 (𝑎), car 𝑓 est croissante. Ainsi, la
cofinalité de Y est au plus égale au type d’ordre de 𝑓 (A).
Si 𝑓 | A est injective, le type d’ordre de 𝑓 (A) est égal à celui de A, et on
en déduit cof (Y) ⩽ Ord(𝑓 (A)) = Ord(A) = cof (X).
Dans le cas général, on introduit la partie A′ de A formée des éléments
𝑎 ∈ A tels que pour tout 𝑥 ∈ A tel que 𝑓 (𝑎) = 𝑓 (𝑥), on ait 𝑎 ⩽ 𝑥. Elle
vérifie 𝑓 (A′) = 𝑓 (A) : en effet, pour tout 𝑥 ∈ A, il existe un plus petit
élément 𝑎 ∈ A tel que 𝑓 (𝑎) = 𝑓 (𝑥), et cet élément appartient à A′. Le
type d’ordre de 𝑓 (A′) est égal à celui de A′, qui est au plus celui de A. Par
conséquent, cof (Y) ⩽ cof (X).
b) Comme 𝑓 (X) est cofinale, pour tout 𝑦 ∈ Y, il existe un élément 𝑥 ∈ X
tel que 𝑓 (𝑥) ⩾ 𝑦 ; on définit une application 𝑔 : Y → X en posant pour 𝑔(𝑦)
le plus petit élément 𝑥 ∈ X tel que 𝑓 (𝑥) ⩾ 𝑦.
3.7. COFINALITÉ 75
La définition d’un plus petit élément entraîne que 𝑓 (𝑔(𝑦)) ⩾ 𝑦, pour
tout 𝑦 ∈ Y.
Soit 𝑥 ∈ X et 𝑦 ∈ Y. Si 𝑥 < 𝑔(𝑦), la définition de 𝑔 entraîne que 𝑓 (𝑥) < 𝑦.
Inversement, si 𝑥 ⩾ 𝑔(𝑦), on a 𝑓 (𝑥) ⩾ 𝑓 (𝑔(𝑦)), car 𝑓 est croissante, donc
𝑓 (𝑥) ⩾ 𝑓 (𝑦). Cela prouve que les propriétés 𝑓 (𝑥) ⩾ 𝑦 et 𝑥 ⩾ 𝑔(𝑦) sont
équivalentes.
Démontrons ensuite que l’application 𝑔 est croissante. Soit 𝑦, 𝑦 ′ ∈ Y tels
que 𝑦 ⩽ 𝑦 ′ et démontrons que 𝑔(𝑦) ⩽ 𝑔(𝑦 ′) ; d’après ce qui précède, cette
inégalité équivaut à l’inégalité 𝑓 (𝑔(𝑦 ′)) ⩾ 𝑦, laquelle est vraie puisque
𝑓 (𝑔(𝑦 ′)) ⩾ 𝑦 ′ ⩾ 𝑦.
Prouvons enfin que 𝑔(Y) est cofinale dans X. Soit 𝑥 ∈ X. Puisque Y n’a
pas de plus grand élément, l’élément 𝑓 (𝑥) ne majore pas Y et il existe
𝑦 ∈ Y tel que 𝑓 (𝑥) < 𝑦. Alors 𝑥 < 𝑔(𝑦), car on aurait, sinon, 𝑥 ⩾ 𝑔(𝑦),
d’où 𝑓 (𝑥) ⩾ 𝑦.
En appliquant la première partie de la proposition à l’application 𝑔, on
en déduit l’inégalité cof (X) ⩽ cof (Y), ce qui conclut la démonstration.
□
Proposition (3.7.7). — Pour tout ensemble bien ordonné X, la cofinalité
de X est un cardinal et vérifie cof (cof (X)) = cof (X).
Démonstration. — L’assertion est évidente lorsque X = ∅ ou lorsque X
possède un plus grand élément, puisqu’on a respectivement cof (X) = 0
et cof (X) = 1, et que ces ordinaux sont respectivement vide et succes-
seur. Supposons maintenant que X n’est pas vide et n’a pas de plus grand
élément.
Soit A une partie cofinale de X de type d’ordre cof (X) et soit
𝑓 : cof (X) → A l’unique bijection croissante de cof (X) sur A. L’ap-
plication composée cof (X) → A → X est croissante, son image
est A, donc est cofinale ; la proposition précédente entraîne que l’on
a cof (cof (X)) = cof (X).
Démontrons que cof (X) est un cardinal. Sinon, il existe un ordinal 𝛽 <
cof (X) qui est équipotent à cof (X). Soit A une partie cofinale de X de type
d’ordre cof (X). et soit 𝑓 : 𝛽 → A une bijection. Soit A∗ l’ensemble bien
ordonné déduit de A par adjonction d’un plus grand élément ∗. on définit
alors une application 𝑓 ′ : 𝛽 → A∗ . par 𝑓 ′ (𝑏) = sup𝑥⩽𝑏 𝑓 (𝑥) pour 𝑏 ∈ 𝛽.
Elle est croissante ; soit 𝛼 l’ensemble des 𝑏 ∈ 𝛽 tels que 𝑓 ′ (𝑏) < ∗ ; c’est un
76 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
ordinal ; démontrons que l’application 𝑓 ′ |𝛼 : 𝛼 → A est d’image cofinale
dans X. Supposons d’abord que 𝛼 = 𝛽. Soit alors 𝑥 ∈ X ; par hypothèse,
il existe 𝑎 ∈ A tel que 𝑥 ⩽ 𝑎, donc il existe 𝑏 ∈ 𝛽 tel que 𝑥 ⩽ 𝑓 (𝑏). En
particulier, 𝑓 ′ (𝑏) ⩾ 𝑓 (𝑏) ⩾ 𝑥. Supposons maintenant que 𝛼 < 𝛽 et soit 𝑏
le plus petit élément de 𝛽 tel que 𝑓 (𝑏) = ∗. Comme 𝑓 (𝑏) = sup𝑎∈𝛼 𝑓 (𝑎),
on voit que 𝑓 (𝛼) n’est pas majoré dans A, donc est cofinale dans A, si bien
que 𝑓 (𝛼) est cofinale dans X.
On a donc cof (X) = cof (𝛼) ⩽ 𝛼 ⩽ 𝛽 < cof (X), une contradiction. □
Corollaire (3.7.8). — Pour tout ensemble bien ordonné X, on a cof (X) ⩽
Card(X).
Corollaire (3.7.9). — Soit 𝜅 un cardinal infini. Toute partie de 𝜅 de cardi-
nal < cof (𝜅) est majorée.
Démonstration. — On raisonne par contraposition. Soit A une partie non
majorée de 𝜅 ; elle est donc cofinale dans 𝜅, si bien que cof (𝜅) ⩽ Ord(A).
Puisque cof (𝜅) est un cardinal, on a donc cof (𝜅) ⩽ Card(A). □
Corollaire (3.7.10). — La cofinalité d’un cardinal infini 𝜅 est le plus petit
cardinal 𝜆 tel Í
qu’il existe une famille (𝜅𝑖 )𝑖∈𝜆 de cardinaux vérifiant 𝜅𝑖 < 𝜅
pour tout 𝑖 et 𝑖 𝜅𝑖 = 𝜅.
Démonstration. — Soit A une partie cofinale de 𝜅 de type d’ordre cof (𝜅)
et soit 𝑗 : cof (𝜅) → A une bijection croissante ; pour 𝑖 ∈ cof (𝜅), posons
S𝑖 = {𝑥 ∈ 𝜅 ; 𝑥 ⩽ 𝑗 (𝑖)} et 𝜅𝑖 = Card(S𝑖 ). On a 𝜅𝑖 Ð
< 𝜅 pour tout 𝑖, car 𝜅 est
un cardinal. Comme A est cofinale dans 𝜅, on a 𝑖∈cof (𝜅) S𝑖 = 𝜅. Ainsi,
∑︁
𝜅⩽ 𝜅𝑖 ⩽ cof (𝜅) · sup 𝜅𝑖 = sup(cof (𝜅), sup 𝜅𝑖 ),
𝑖∈cof (𝜅) 𝑖∈cof (𝜅) 𝑖∈cof (𝜅)
d’après le corollaire 3.6.4. Par suite,
∑︁
𝜅⩽ 𝜅𝑖 ⩽ 𝜅,
𝑖∈cof (𝜅)
d’où l’égalité.
Considérons maintenant un cardinal Í 𝜆 et une famille (𝜅𝑖 )𝑖∈𝜆 de cardi-
naux tels que 𝜅𝑖 < 𝜅 pour tout 𝑖 vérifiant 𝑖∈𝜆 𝜅𝑖 = 𝜅. Il s’agit de démontrer
que 𝜆 ⩾ cof (𝜅).
On a 𝜅 ⩽ 𝜆 · sup𝑖 𝜅𝑖 = sup(𝜆, sup𝑖 𝜅𝑖 ).
3.7. COFINALITÉ 77
Supposons d’abord 𝜆 ⩾ sup𝑖 𝜅𝑖 , de sorte que sup(𝜆, sup𝑖 𝜅𝑖 ) = 𝜆. D’après
ce qui précède, on a donc 𝜅 ⩽ 𝜆 ; a fortiori, cof (𝜅) ⩽ 𝜆.
Supposons maintenant que 𝜆 ⩽ sup𝑖 𝜅𝑖 , de sorte que que sup(𝜆, sup𝑖 𝜅𝑖 ) =
sup𝑖 𝜅𝑖 . D’après ce qui précède, on a donc 𝜅 ⩽ sup𝑖 𝜅𝑖 ; comme 𝜅𝑖 ⩽ 𝜅 pour
tout 𝑖, il vient sup𝑖 𝜅𝑖 ⩽ 𝜅 ; on en déduit que 𝜅 = sup𝑖 𝜅𝑖 , c’est-à-dire que
la famille {𝜅𝑖 ; 𝑖 < 𝜆} de 𝜅 est cofinale. Comme elle est de cardinal 𝜆, cela
prouve l’inégalité cof (𝜅) ⩽ 𝜆. □
Exemple (3.7.11). — Par construction, le cardinal ℵ𝜔 est la borne supé-
rieure des cardinaux ℵ𝑛 , pour 𝑛 ∈ 𝜔. Il en résulte que cof (ℵ𝜔 ) ⩽ 𝜔.
Comme cette cofinalité est infinie, on a donc cof (ℵ𝜔 ) = 𝜔.
Corollaire (3.7.12). — Pour tout cardinal 𝜆 ⩾ 2, on a cof (𝜆𝜅 ) > 𝜅.
Démonstration. — Pour tout 𝑖 < 𝜅, soit 𝜅𝑖 un cardinalÍ tel que 𝜆𝜅 .
Î 𝜅𝜅𝑖 < 𝜅·𝜅
D’après le théorème de König (théorème 3.6.10), on a 𝜅𝑖 < 𝑖 𝜆 = 𝜆 .
D’après
Í le théorème d’Hessenberg (corollaire 3.6.4), on a 𝜅 · 𝜅 = 𝜅. Par
suite, 𝜅𝑖 < 𝜆 . Comme 𝜆𝜅 est infini, il s’ensuit que cof (𝜆𝜅 ) > 𝜅.
𝜅 □
Exemple (3.7.13). — En particulier, on a cof (2ℵ0 ) > ℵ0 . Comme
cof (ℵ𝜔 ) = ℵ0 , cela démontre que 2ℵ0 ≠ ℵ𝜔 .
Corollaire (3.7.14). — Pour tout cardinal infini 𝜅, on a 𝜅 cof (𝜅) > 𝜅.
Démonstration. — Par définition
Í de cof (𝜅), il existe une famille (𝜅𝑖 )𝑖<𝜅 de
cardinaux tels
Í que 𝜅Î𝑖 < 𝜅 est 𝑖 𝜅𝑖 = 𝜅. D’après le théorème de König, on
a alors 𝜅 = 𝑖 𝜅𝑖 < 𝑖 𝜅 = 𝜅 cof (𝜅) , comme il fallait démontrer. □
Définition (3.7.15). — On dit qu’un cardinal 𝜅 est régulier s’il est égal à
sa cofinalité : cof (𝜅) = 𝜅 ; sinon, on dit que 𝜅 est singulier.
Les cardinaux 0 et 1 sont réguliers ; les autres cardinaux finis sont sin-
guliers. On a 𝜔 ⩽ cof (ℵ0 ) ⩽ ℵ0 , donc cof (ℵ0 ) = ℵ0 . Ainsi, ℵ0 est un
cardinal régulier. En revanche, ℵ𝜔 est un cardinal singulier, puisque sa
cofinalité est égale à 𝜔.
Exemple (3.7.16). — Si X est un ensemble bien ordonné, on a cof (cof (X)) =
cof (X). Ainsi, la cofinalité d’un ensemble bien ordonné est un cardinal ré-
gulier.
78 CHAPITRE 3. ARITHMÉTIQUES TRANSFINIES — ORDONNER
Exemple (3.7.17). — Un cardinal successeur est régulier. Soit 𝜆 un cardinal
infini et soit 𝜅 = 𝜆+ le plus petit cardinal tel que 𝜅 > 𝜆 ; démontrons que 𝜅
est de cofinalité 𝜅. Considérons une famille (𝜆𝑖 )𝑖<𝜆Íd’éléments de 𝜅 Pour
tout 𝑖, on a 𝜆𝑖 < 𝜅, donc 𝜆𝑖 ⩽ 𝜆. Alors, sup(𝜆𝑖 ) ⩽ 𝑖 𝜆𝑖 ⩽ 𝜆 · 𝜆 = 𝜆 < 𝜅.
Autrement dit, la famille (𝜆𝑖 )𝑖<𝜆 est majorée. Par conséquent, cof (𝜅) > 𝜆,
d’où cof (𝜅) ⩾ 𝜅.
3.7.18. — La question de la régularité des cardinaux limite est plus sub-
tile. On a vu que ℵ0 en fait partie ; les autres, c’est-à-dire les cardinaux
non dénombrables, limite et réguliers, sont appelés faiblement inacessibles.
Soit 𝜅 un cardinal (non dénombrable) limite et soit 𝜆 l’ordinal tel que
𝜅 = ℵ𝜆 . On a 𝜆 > 0, et 𝜆 est un ordinal limite. Si 𝜅 est régulier, on a
ℵ𝜆 = 𝜅 = cof (𝜅) = cof (ℵ𝜆 ) = cof (𝜆) ⩽ 𝜆, donc ℵ𝜆 = 𝜆 puisque 𝜆 ⩽ ℵ𝜆 .
Par conséquent, on a 𝜅 = ℵ𝜅 : le cardinal 𝜅 est un point fixe de la fonction
𝜆 ↦→ ℵ𝜆 .
La réciproque est loin d’être vraie. Considérons par exemple la suite
(𝜆𝑛 ) définie par 𝜆𝑛+1 = ℵ𝜆𝑛 . Sa borne supérieure est un cardinal 𝜆 tel que
𝜆 = ℵ𝜆 , mais, par construction, ce cardinal est de cofinalité 𝜔.
En fait, les axiomes zfcne permettent pas de démontrer l’existence d’un
cardinal faiblement inaccessible.
3.8. Axiome de fondation
3.8.1. — L’axiome de fondation de la théorie nbgpostule que tout en-
semble non vide 𝑥 possède un élément 𝑦 tel que 𝑥 ∩ 𝑦 = ∅.
Exercice (3.8.2). — Soit 𝑥 un ensemble. Démontrer que 𝑥 ∉ 𝑥.
Exercice (3.8.3). — Soit 𝑥 un ensemble. Démontrer qu’il n’existe pas de
suite (𝑥𝑛 ) telle que 𝑥 0 = 𝑥 et 𝑥𝑛+1 ∈ 𝑥𝑛 pour tout 𝑛.
CHAPITRE 4
LANGAGES DU PREMIER ORDRE — PARLER
« (...) J’enrage
Lorsque j’entends tenir ces sortes de langage. »
— Molière, Le Tartuffe, acte ii, scène 3
4.1. Alphabets, mots, langages
4.1.1. — Soit A un ensemble non vide. On note A∗ l’ensemble des suites
finies d’éléments de A, c’est-à-dire la réunion des ensembles A𝑛 , lorsque
𝑛 parcourt N. L’ensemble A est appelé alphabet ; un élément de A∗ est
appelé mot sur l’alphabet A. Si 𝑚 = (𝑎 0, . . . , 𝑎𝑛−1 ) est un élément de A∗ ,
l’entier 𝑛 est appelé longueurdu mot 𝑚 et noté ℓ (𝑚). La suite de longueur 0
est le mot vide ; on la notera 𝜀. On identifiera aussi l’alphabet A à la partie
de A∗ des mots de longueur 1.
Lemme (4.1.2). — Soit A un alphabet. L’ensemble A∗ des mots sur l’alpha-
bet A est équipotent à N si A est dénombrable, et à A sinon.
Démonstration. — Supposons d’abord que A est fini. Pour tout entier 𝑛,
l’ensemble A𝑛 est fini. Comme une réunion dénombrable d’ensembles fi-
nis est dénombrable, l’ensemble A∗ est dénombrable. Par ailleurs, comme
l’alphabet A n’est pas vide, A∗ contient des mots de toute longueur. Par
suite, A∗ est infini. On a donc A∗ ≡ N.
Supposons maintenant que A est infini. Pour tout entier 𝑛 ⩾ 1, on a
donc Card(A𝑛 ) = Card(A). Puisque ℵ0 ⩽ Card(A), on en déduit que
Card(A∗ ) ⩽ Card(A). D’autre part, l’ensemble des mots de longueur 1 est
une partie de A∗ équipotente à A, donc Card(A) ⩽ Card(A∗ ). Il en résulte
que Card(A∗ ) = Card(A). □
80 CHAPITRE 4. LANGAGES DU PREMIER ORDRE — PARLER
4.1.3. — Soit A un alphabet. Soit 𝑚 = (𝑎 0, . . . , 𝑎𝑛−1 ) et 𝑚′ = (𝑎′0, . . . , 𝑎𝑛′ ′ −1 )
des mots dans l’alphabet A. On note 𝑚𝑚′ = (𝑎 0, . . . , 𝑎𝑛−1, 𝑎′0, . . . , 𝑎𝑛′ ′ −1 ) le
mot obtenu par concaténation de 𝑚 et 𝑚′. On a ℓ (𝑚𝑚′) = ℓ (𝑚 + 𝑚′).
L’opération (𝑚, 𝑚′) ↦→ 𝑚𝑚′ dans A∗ est associative, le mot vide est un
élément neutre. Par ailleurs, tout mot est simplifiable à droite et à gauche.
Compte tenu de l’identification des éléments de A avec les mots de lon-
gueur 1, on a 𝑚 = 𝑎 0 . . . 𝑎𝑛−1 .
Définition (4.1.4). — Soit A un alphabet et soit 𝑚 = (𝑎 0, . . . , 𝑎𝑛−1 ) un mot
sur A.
a) Soit 𝑎 ∈ A. On dit que 𝑎 apparaît dans 𝑚 s’il existe un entier 𝑘 tel que
0 ⩽ 𝑘 ⩽ 𝑛 − 1 et 𝑎 = 𝑎𝑘 ; un tel entier est appelé occurrence de la lettre 𝑎.
b) On dit qu’un mot 𝑚′ est un segment initial ([Link]) de 𝑚 s’il
existe un mot 𝑚′′ tel que 𝑚 = 𝑚′𝑚′′ (resp.𝑚 = 𝑚′′𝑚′) ; cela revient à dire
qu’il existe un entier 𝑘 tel que 0 ⩽ 𝑘 ⩽ 𝑛 et 𝑚′ = (𝑎 0, . . . , 𝑎𝑘−1 ) (resp.𝑚′ =
(𝑎𝑘 , . . . , 𝑎𝑛−1 )).
4.1.5. — Soit V un ensemble. Ses éléments sont appelés symboles de va-
riables. Conformément aux usages, nous supposons que V est infini et dé-
nombrable et notons 𝑥 0, 𝑥 1, 𝑥 2, . . . ses éléments. Cependant, d’autres no-
tations (𝑥, 𝑦, 𝑦0, 𝑦1, . . . ) sont possibles, et parfois plus pratiques. Cet en-
semble sera supposé fixé dans toute la suite.
4.1.6. — Un langage du premier ordre est la donnée de deux suites (R𝑛 )𝑛⩾0
et (F𝑛 )𝑛⩾0 d’ensembles, deux à deux disjoints, et disjoints de l’ensemble V
et de l’ensemble formé des symboles ), (, ∨, ∧, ¬, ⇒, ⇔, ∀, ∃.
Les éléments de R𝑛 sont appelés symboles de relations 𝑛-aires, ceux de F𝑛
symboles de fonctions 𝑛-aires, ou constantes lorsque 𝑛 = 0. On suppose
aussi que l’ensemble R0 contient deux éléments ⊤ (« vrai ») et ⊥ (« faux »)
et que l’ensemble R2 contient le symbole = (« égalité »).
Si ces symboles n’ont aucune signification à ce stade de la théorie, le
rôle ultime d’un langage est d’exprimer les propriétés utilisées dans une
théorie mathématique donnée, données par des mots de l’alphabet
Ø∞ ∞
Ø
V∪ R𝑛 ∪ F𝑛 ∪ ¬, ∧, ∨, ⇒, ⇔, (, ) .
𝑛=0 𝑛=0
Exemple (4.1.7). — Voici ainsi quelques exemples de langages.
4.2. TERMES 81
a) Ensembles. L’ensemble F0 possède un élément ∅ ; l’ensemble R2 pos-
sède deux éléments, ∈ et = ; les autres ensembles de relations et de fonc-
tions sont vides. Dans ce langage, on peut écrire les axiomes de la théorie
des ensembles et développer cette théorie, les relations et fonctions sup-
plémentaires sont codées via leur graphe.
b) Groupes. L’ensemble F0 possède un unique élément 𝑒 ; l’ensemble F1
possède un unique élément 𝑖 ; l’ensemble F2 possède un unique éléments · ;
l’ensemble R2 possède un unique élément = ; les autres ensembles de re-
lations et de fonctions sont vides. Dans ce langage, on peut en effet écrire
les axiomes de la théorie des groupes et la développer ; le symbole de
constante 𝑒 correspond à l’élément neutre, le symbole 𝑖 à la fonction in-
verse et le symbole · à la loi de groupe. La propriété, pour un groupe, d’être
commutatif s’écrit, par exemple, ∀𝑥∀𝑦 𝑥 · 𝑦 = 𝑦 · 𝑥.
c) Anneaux. L’ensemble F0 possède deux éléments 0 et 1 ; l’ensemble R2
possède quatre éléments +, −, · et =.
d) Géométrie plane. L’ensemble R1 possède deux éléments D et P, cor-
respondant respectivement à la propriété d’être une droite et à la propriété
d’être un point ; l’ensemble R2 possède un élément ∈, correspondant à la
relation d’incidence, c’est-à-dire, pour un point d’appartenir à une droite.
L’axiome des parallèles s’énonce par exemple
∀𝑥∀𝑦 (P(𝑥) ∧ D(𝑦) ∧ ¬𝑥 ∈ 𝑦) ⇒ (∃𝑧 (D(𝑧) ∧ ∀𝑡 (P(𝑡) ∧ 𝑡 ∈ 𝑧 ⇒ ¬𝑡 ∈ 𝑦)),
c’est-à-dire pour tout point 𝑥 et toute droite 𝑦 ne contenant pas 𝑥, il existe
une droite 𝑧 passant par 𝑥 et ne contenant aucun point de 𝑦.
4.2. Termes
4.2.1. — On fixe un langage du premier ordre L, d’ensemble de symboles
de variables V, de symboles de relations (R𝑛 ), de symboles de fonctions
(F𝑛 ). On notera AL l’alphabet correspondant, réunion de V, des R𝑛 , des F𝑛 ,
et de l’ensemble des symboles logiques ¬, ∧, ∨, ⇒, ⇔, (, ).
Définition (4.2.2). — On note TL l’intersection de toutes les parties T de A∗L
qui vérifient les propriétés suivantes :
– T contient les symboles de variables V ;
– Pour tout entier 𝑛 ∈ N, tout symbole 𝑓 ∈ F𝑛 de fonction 𝑛-aire et toute
suite (𝑡 1, . . . , 𝑡𝑛 ) d’éléments de T, le mot 𝑓 𝑡 1 . . . 𝑡𝑛 appartient à T.
82 CHAPITRE 4. LANGAGES DU PREMIER ORDRE — PARLER
On voit immédiatement que TL vérifie les deux propriétés précédentes ;
c’est donc la plus petite partie de A∗L qui les vérifie. Un élément de TL est
appelé un terme dans le langage L.
Soit T une partie de A∗L . Pour prouver que T contient TL , il suffit d’établir
les propriétés de la définition pour l’ensemble T. Cela donne lieu à une
méthode de « raisonnement par récurrence sur la définition d’un terme ».
Par exemple, vérifions ainsi que les seuls symboles apparaissant dans
un terme sont les symboles de fonctions et de variables. Soit donc T l’en-
semble des termes dans le langage L qui ne contiennent que des symboles
de fonctions et de variables ; démontrons que T = TL . L’inclusion T ⊆ TL
étant évidente, il suffit de démontrer que TL ⊆ T et, pour cela, que T vé-
rifie les deux propriétés de la définition 4.2.2. Or, si 𝑥 ∈ V est un symbole
de variable, le terme 𝑥 est ne contient que des symboles de fonctions et de
variables, donc appartient à T. De même, si 𝑛 est un entier naturel, 𝑓 ∈ F𝑛
est un symbole de fonction 𝑛-aire et 𝑡 1, . . . , 𝑡𝑛 ∈ T sont des termes qui ne
contiennent que des symboles de fonctions et de variables, alors 𝑓 𝑡 1 . . . 𝑡𝑛
est un terme qui ne contient que des symboles de fonctions et de variables,
donc appartient à T.
De même, l’ensemble T = TL {𝜀} vérifie les propriétés de la défi-
nition 4.2.2, donc contient TL . Par conséquent, le mot vide n’est pas un
terme.
4.2.3. — On définit par récurrence une suite croissante (TL(ℎ) ) de mots
de la façon suivante : on pose TL(0) = V ∪ F0 et, si TL(ℎ) est défini, on définit
TL(ℎ+1) comme la réunion de TL(ℎ) et de l’ensemble des mots de la forme
𝑓 𝑡 1 . . . 𝑡𝑛 , où 𝑛 ∈ N∗ , 𝑓 ∈ F𝑛 et 𝑡 1, . . . , 𝑡𝑛 ∈ TL(ℎ) . Par récurrence, on a TL(ℎ) ⊆
TL pour tout entier ℎ. On vérifie immédiatement que l’ensemble ℎ∈N TL(ℎ)
Ð
vérifie les propriétés de la définition de TL . Par suite, TL = ℎ∈N TL(ℎ) . La
Ð
hauteur d’un terme 𝑡 est le plus petit entier ℎ tel que 𝑡 ∈ TL(ℎ) .
Remarque (4.2.4). — La définition des termes n’est pas tout à fait
conforme à l’habitude mathématique. Par exemple, si 𝑓 est un symbole de
fonction binaire et 𝑥, 𝑦 sont des variables, on écrit 𝑓 𝑥𝑦 au lieu de 𝑓 (𝑥, 𝑦).
De même, on écrit = 𝑥𝑦 au lieu de 𝑥 = 𝑦. Cette définition formelle s’avère
très pratique, parce qu’elle est concise et inambigüe. Le plus souvent,
nous écrirons cependant les termes sous leur forme classique.
4.2. TERMES 83
4.2.5. — Pour 𝑣 ∈ V, on dit qu’un terme 𝑡 fait intervenir le symbole 𝑣 s’il
existe une occurrence de ce symbole dans 𝑣. Si W est une partie de l’en-
semble V des symboles de variables, on note TL,W l’ensemble des termes
qui ne font intervenir que les symboles de variables appartenant à W. On
vérifie immédiatement que l’ensemble TL,W est l’intersection des parties
de A∗L qui vérifient la définition 4.2.2 où l’on remplace V par W dans la
première propriété.
4.2.6. — On définit le poids 𝑝 (𝑥) d’un symbole 𝑥 de AL de la façon sui-
vante : si 𝑥 ∈ V, on pose 𝑝 (𝑥) = −1 ; si 𝑥 ∈ F𝑛 , on pose 𝑝 (𝑥) = 𝑛 − 1 ; sinon,
on pose 𝑝 (𝑥) = 0.
Soit 𝑚 ∈ A∗L ; on appelle poids du mot 𝑚 la somme des poids des sym-
boles qui le constituent : si 𝑚 = 𝑥 1 . . . 𝑥𝑛 , alors 𝑝 (𝑚) = 𝑝 (𝑥 1 ) + · · · + 𝑝 (𝑥𝑛 ).
Proposition (4.2.7). — Soit 𝑡 ∈ A∗L un mot ne faisant intervenir que des
symboles de variables et de fonctions. Pour que 𝑡 soit un terme il faut et il
suffit que les deux propriétés suivantes soient satisfaites :
(i) On a 𝑝 (𝑡) = −1 ;
(ii) Pour tout segment initial 𝑡 ′ de 𝑡 tel que 𝑡 ′ ≠ 𝑡, on a 𝑝 (𝑡 ′) ⩾ 0.
Démonstration. — Démontrons d’abord que tout terme vérifie ces deux
propriétés. On raisonne par récurrence sur la définition d’un terme. Il y
a deux cas. Supposons d’abord que 𝑡 soit un symbole de variable. Alors
𝑝 (𝑡) = −1 ; de plus, le mot vide est le seul segment initial de 𝑡 qui soit
distinct de 𝑡, et son poids est nul. Supposons alors que 𝑡 soit de la forme
𝑓 𝑡 1 . . . 𝑡𝑛 , où 𝑓 est un symbole de fonction 𝑛-aire et 𝑡 1, . . . , 𝑡𝑛 des termes
vérifiant les propriétés de la proposition. On a
𝑛
∑︁
𝑝 (𝑡) = 𝑝 (𝑓 ) + 𝑝 (𝑡𝑖 ) = 𝑛 − 1 + 𝑛 · (−1) = −1.
𝑖=1
Soit 𝑡 ′un segment initial de 𝑡 distinct de 𝑡. Si 𝑡 ′ = 𝜀, alors 𝑝 (𝑡 ′) = 0. Sinon,
𝑡 ′ est de la forme 𝑓 𝑡 1 · · · 𝑡𝑚−1𝑡𝑚′ , où 𝑚 ∈ {1, . . . , 𝑛} et 𝑡𝑚′ est un segment
initial de 𝑡𝑚 ; on a donc
𝑝 (𝑡 ′) = 𝑛 − 1 + (𝑚 − 1) · (−1) + 𝑝 (𝑡𝑚′ ) = 𝑛 − 𝑚 + 𝑝 (𝑡𝑚′ ).
Si 𝑚 = 𝑛, alors 𝑡𝑛′ est distinct de 𝑡𝑛 , donc 𝑝 (𝑡𝑛′ ) ⩾ 0 par récurrence, d’où
𝑝 (𝑡 ′) ⩾ 0. Sinon, on a 𝑝 (𝑡𝑚′ ) ⩾ 0 si 𝑡𝑚′ est distinct de 𝑡𝑚 et 𝑝 (𝑡𝑚′ ) = −1 si 𝑡𝑚′
sinon, donc 𝑝 (𝑡𝑚′ ) ⩾ −1 ; alors 𝑝 (𝑡 ′) ⩾ 0.
84 CHAPITRE 4. LANGAGES DU PREMIER ORDRE — PARLER
Inversement, soit 𝑡 un mot vérifiant ces propriétés et démontrons par
récurrence sur la longueur de 𝑡 que 𝑡 est un terme. Comme 𝑝 (𝜀) = 0
et 𝑝 (𝑡) = −1, on a ℓ (𝑡) > 0 ; soit donc 𝑓 le premier symbole de 𝑡 ; par
hypothèse, c’est un symbole de variable ou un symbole de fonction. Par
définition, le mot 𝑓 (de longueur 1) est un segment initial de 𝑡.
Si 𝑓 est un symbole de variable, on a 𝑝 (𝑓 ) = −1 ; par suite, le mot 𝑓
n’est pas un segment initial strict de 𝑡, donc 𝑡 = 𝑓 et 𝑡 est un terme.
Sinon, 𝑓 est un symbole de fonction ; soit 𝑛 son arité, c’est-à-dire que 𝑓 ∈
R𝑛 ; on a donc 𝑝 (𝑓 ) = 𝑛 − 1. Si 𝑡 = 𝑓 , alors 𝑛 = 0 et 𝑡 est un terme ; sinon, le
mot 𝑓 est un segment initial strict de 𝑡, la longueur de 𝑓 est au moins égale
à 2 et 𝑛−1 = 𝑝 (𝑓 ) ⩾ 0. Posons 𝑚 = ℓ (𝑡) −1 et écrivons 𝑡 = 𝑓 𝑥 1 . . . 𝑥𝑚 ; pour
𝑖 ∈ {0, . . . , 𝑚}, posons 𝑝𝑖 = 𝑛 + 𝑝 (𝑥 1 . . . 𝑥𝑖 ), de sorte que 𝑝 (𝑓 𝑥 1 · · · 𝑥𝑖 ) =
𝑝𝑖 − 1. Par hypothèse, on a 𝑝 0 = 𝑛, 𝑝𝑖 ⩾ 1 pour 𝑖 ∈ {1, . . . , 𝑚 − 1}, et
𝑝𝑚 = 0. Comme 𝑝𝑖 − 𝑝𝑖−1 = 𝑝 (𝑥𝑖 ) ⩾ −1 pour tout 𝑖, 𝑝𝑖 atteint au moins
une fois chaque valeur entre 0 et 𝑛. Pour 𝑘 ∈ {0, . . . , 𝑛}, soit 𝑗𝑘 le plus petit
entier 𝑗 ⩾ 0 tel que 𝑝 𝑗 = 𝑛 −𝑘. Par le même argument, 𝑝𝑖 atteint 𝑛 −𝑘 avant
d’avoir atteint 𝑛 − 𝑘 − 1, de sorte que l’on a 0 = 𝑗0 < 𝑗1 < · · · < 𝑗𝑛 ⩽ 𝑚.
Posons alors 𝑡 1 = 𝑥 1 . . . 𝑥 𝑗1 , 𝑡 2 = 𝑥 𝑗1 +1 . . . 𝑥 𝑗2 ,..., 𝑡𝑛 = 𝑥 𝑗𝑛−1 +1 . . . 𝑥 𝑗𝑛 . Alors,
𝑓 𝑡 1 . . . 𝑡𝑛 est un segment initial de 𝑡 tel que 𝑝 (𝑓 𝑡 1 . . . 𝑡𝑛 ) = 𝑝 (𝑓 𝑥 1 . . . 𝑥 𝑗𝑛 ) =
𝑝 𝑗𝑛 − 1 = −1. Par hypothèse, 𝑓 𝑡 1 . . . 𝑡𝑛 n’est pas un segment initial strict
de 𝑡, donc 𝑡 = 𝑓 𝑡 1 . . . 𝑡𝑛 et 𝑗𝑛 = 𝑚.
Démontrons que les mots 𝑡 1, . . . , 𝑡𝑛 sont des termes. Soit 𝑘 ∈ {1, . . . , 𝑛}.
On a 𝑝 (𝑡𝑘 ) = 𝑝 𝑗𝑘 − 𝑝 𝑗𝑘 −1 = −1 par construction des entiers 𝑗𝑘 . Soit 𝑡 ′ un
segment initial de 𝑡𝑘 distinct de 𝑡𝑘 , et soit 𝑗 ∈ { 𝑗𝑘−1, . . . , 𝑗𝑘 − 1} l’unique
entier tel que 𝑡 ′ = 𝑥 𝑗𝑘 −1 +1 . . . 𝑥 𝑗 ; par définition de l’entier 𝑗𝑘 , on a 𝑝 (𝑡 ′) =
𝑝 𝑗 − 𝑝 𝑗𝑘 −1 > 𝑝 𝑗𝑘 − 𝑝 𝑗𝑘 −1 = −1, de sorte que 𝑝 (𝑡 ′) ⩾ 0. Comme la longueur
de 𝑡𝑘 est strictement inférieure à 𝑚 + 1 = ℓ (𝑡), l’hypothèse de récurrence
entraîne que 𝑡𝑘 est un terme.
Comme 𝑓 est un symbole de fonction d’arité 𝑛, il en résulte que 𝑡 =
𝑓 𝑡 1 . . . 𝑡𝑛 est un terme, ce qu’il fallait démontrer. □
Corollaire (4.2.8). — Soit 𝑡 ∈ TL . Aucun segment initial de 𝑡, distinct de 𝑡,
n’est un terme.
Démonstration. — Considérons en effet un segment initial 𝑡 ′ de 𝑡 tel que
𝑡 ′ ≠ 𝑡. D’après la proposition, on a 𝑝 (𝑡 ′) ⩾ 0. Comme le poids d’un terme
est égal à −1, donc 𝑡 ′ n’est pas un terme. □
4.2. TERMES 85
Théorème (4.2.9). — Soit 𝑡 ∈ TL un terme. Alors une, et une seule, des
assertions suivantes est vérifiée :
i) 𝑡 est un symbole de variable de L ;
ii) Il existe un unique entier 𝑛 ⩾ 0, un unique symbole de fonction 𝑛-aire
𝑓 , et une unique suite (𝑡 1, . . . , 𝑡𝑛 ) de termes tels que 𝑡 = 𝑓 𝑡 1 . . . 𝑡𝑛 .
Démonstration. — Le fait qu’une des deux assertions soit vraie se vérifie
immédiatement par récurrence sur la définition d’un terme. D’autre part,
ces deux cas s’excluent mutuellement puisque dans le second, le premier
symbole de 𝑡 est un élément de F𝑛 , donc n’appartient pas à V.
Supposons donc que l’on ait 𝑡 = 𝑓 𝑡 1 . . . 𝑡𝑛 = 𝑔𝑢 1 . . . 𝑢𝑚 , pour des sym-
boles de fonction 𝑓 ∈ F𝑛 , 𝑔 ∈ F𝑚 , et des termes 𝑡 1, . . . , 𝑡𝑛 , 𝑢 1, . . . , 𝑢𝑚 . Dé-
montrons que 𝑓 = 𝑔, 𝑛 = 𝑚, et que 𝑡𝑖 = 𝑢𝑖 pour tout 𝑖. En considérant la
première lettre de 𝑡, on voit que 𝑓 = 𝑔 ; en particulier, 𝑛 = 𝑚. Démontrons
par récurrence que 𝑡𝑖 = 𝑢𝑖 pour tout 𝑖. Raisonnons par l’aburde : suppo-
sons 𝑡 1 = 𝑢 1 ,. . ., 𝑡𝑖−1 = 𝑢𝑖−1 et 𝑡𝑖 ≠ 𝑢𝑖 . Puisque 𝑓 𝑡 1 . . . 𝑡𝑖−1 = 𝑔𝑢 1 . . . 𝑢𝑖−1
et 𝑓 𝑡 1 . . . 𝑡𝑛 = 𝑔𝑢 1 . . . 𝑢𝑛 , on a donc 𝑡𝑖 . . . 𝑡𝑛 = 𝑢𝑖 . . . 𝑢𝑛 . Supposons que la
longueur de 𝑡𝑖 est inférieure ou égale à celle de 𝑢𝑖 ; alors 𝑡𝑖 est un segment
initial de 𝑢𝑖 ; comme 𝑡𝑖 est un terme, on a 𝑝 (𝑡𝑖 ) = −1 ; cela entraîne que
𝑡𝑖 = 𝑢𝑖 . □
Corollaire (4.2.10). — Soit 𝑠 : V → TL une application. Il existe une unique
application 𝜎 : TL → TL vérifiant les propriétés suivantes :
a) Si 𝑡 est un symbole de variable, alors 𝜎 (𝑡) = 𝑠 (𝑡) ;
b) Si 𝑓 ∈ F𝑛 , 𝑡 1, . . . , 𝑡𝑛 ∈ TL , alors 𝜎 (𝑓 𝑡 1 . . . 𝑡𝑛 ) = 𝑓 𝜎 (𝑡 1 ) . . . 𝜎 (𝑡𝑛 ).
Le terme 𝜎 (𝑡) est appelé terme déduit de 𝑡 par substitution des
termes 𝑠 (𝑥) aux variables 𝑥.
En pratique, on dispose d’une partie finie {𝑥 1, . . . , 𝑥𝑘 } de variables (deux
à deux distinctes) et de termes 𝑢 1, . . . , 𝑢𝑘 , l’application 𝑠 étant définie par
𝑠 (𝑥𝑖 ) = 𝑢𝑖 pour tout 𝑖, et 𝑠 (𝑥) = 𝑥 pour 𝑥 ∈ V {𝑥 1, . . . , 𝑥𝑘 }. Dans ce cas,
le terme 𝜎 (𝑡) est parfois noté 𝑡𝑢1 /𝑥 1,...,𝑢𝑘 /𝑥𝑘 . Il arrive aussi que le terme 𝑡
soit noté 𝑡 (𝑥 1, . . . , 𝑥𝑘 ) pour mettre en valeur les variables ; dans ce cas, le
terme 𝜎 (𝑡) peut être noté 𝑡 (𝑢 1, . . . , 𝑢𝑘 ).
Démonstration. — Il découle du théorème précédent que ces conditions
définissent une unique application 𝜎 : TL → A∗L . On démontre alors par
86 CHAPITRE 4. LANGAGES DU PREMIER ORDRE — PARLER
récurrence sur la définition d’un terme que 𝜎 (𝑡) est un terme, pour tout
terme 𝑡. □
4.2.11. Sous-termes. — Soit 𝑡 un terme dans le langage L. On définit
par récurrence l’ensemble st(𝑡) des sous-termes de L :
– Si 𝑡 est un symbole de variable 𝑣, alors st(𝑡) = {𝑡 } ;
– Si 𝑡 = 𝑓 𝑡 1 . . . 𝑡𝑛 , où 𝑓 ∈ F𝑛 et 𝑡 1, . . . , 𝑡𝑛 ∈ TL , alors st(𝑡) est la réunion
de {𝑡 } et de l’ensemble somme des ensembles st(𝑡𝑖 ), pour 𝑖 ∈ {1, . . . , 𝑛}.
Cet ensemble est naturellement muni d’une relation d’ordre, elle-même
définie par récurrence : si 𝑡 ′ et 𝑡 ′′ sont des sous-termes de 𝑡, 𝑡 ′ ⪯ 𝑡 ′′ si 𝑡 ′
est un sous-terme de 𝑡 ′′. On voit que st(𝑡) s’organise en un arbre (inversé)
qu’on appelle l’arbre d’évaluation du terme 𝑡 : Le plus grand élément 𝑡 est
au sommet ; si 𝑡 = 𝑓 𝑡 1 . . . 𝑡𝑛 , les fils de 𝑡 sont les termes 𝑡 1, . . . , 𝑡𝑛 , et ainsi
de suite par récurrence.
Donnons l’exemple du terme 𝑡 = −+·𝑥𝑥𝑦1 du langage des anneaux, où
1 est un symbole de constante et 𝑥, 𝑦 des symboles de variables. corres-
pondant au polynôme 𝑥 2 + 𝑦 − 1. Appliquons la définition :
st(𝑡) = {𝑡 } ∪ st(+·𝑥𝑥𝑦) ∪ st(1)
= {−+·𝑥𝑥𝑦1, +·𝑥𝑥𝑦, 1} ∪ st(·𝑥𝑥) ∪ st(𝑦)
= {−+·𝑥𝑥𝑦1, +·𝑥𝑥𝑦, 1, ·𝑥𝑥, 𝑦, 𝑥, 𝑥 }.
Prendre garde que les deux éléments 𝑥 figurant dans la formule précé-
dente sont distincts : ils correspondent aux deux arguments du symbole
de fonction ·. La représentation en arbre est indiquée dans la figure 4.2.1 ;
on a écrit dans chaque nœud un symbole de variable ou de fonction, le
sous-terme correspondant s’en déduit en lisant le sous-arbre qui en est
issu.
𝑥 𝑥
· 𝑦
+ 1
−
Figure 4.2.1. Arbre d’évaluation du terme −+·𝑥𝑥𝑦1
4.3. FORMULES 87
4.3. Formules
On fixe un langage L.
Définition (4.3.1). — Un mot 𝑚 dans l’alphabet AL est appelé formule
atomique s’il existe un entier naturel 𝑛, un symbole de relation 𝑟 ∈ R𝑛 et
une suite (𝑡 1, . . . , 𝑡𝑛 ) de termes du langage L tels que 𝑚 = 𝑟𝑡 1 . . . 𝑡𝑛 .
Proposition (4.3.2). — Soit 𝑚 une formule atomique dans le langage L. Il
existe un unique entier 𝑛, un unique symbole de relation 𝑟 ∈ R𝑛 et une unique
suite (𝑡 1, . . . , 𝑡𝑛 ) de termes du langage L tels que 𝑚 = 𝑟𝑡 1 . . . 𝑡𝑛 .
Démonstration. — Soit 𝑘 un entier, 𝑠 ∈ R𝑘 un symbole de relation 𝑘-aire et
(𝑢 1, . . . , 𝑢𝑘 ) une suite de termes dans le langage L tels que 𝑚 = 𝑠𝑢 1 . . . 𝑢𝑘 .
Démontrons que 𝑘 = 𝑛, 𝑠 = 𝑟 et (𝑢 1, . . . , 𝑢𝑘 ) = (𝑡 1, . . . , 𝑡𝑛 ). Considérons
la variante L′ du langage L dont l’ensemble de symboles de fonctions la
réunion des ensembles de symboles de fonctions et de symboles de rela-
tions de L. Si 𝑡 est un terme dans le langage L, c’est encore un terme dans
le langage L′ ; comme 𝑟 est symbole de fonction du langage L, le mot 𝑚
est un terme du langage L′. D’après le théorème de lecture unique des
termes, il existe on a 𝑘 = 𝑛, 𝑠 = 𝑟 et (𝑢 1, . . . , 𝑢𝑘 ) = (𝑡 1, . . . , 𝑡𝑛 ), ce qu’il
fallait démontrer. □
Définition (4.3.3). — On note FL l’intersection de toutes les parties F de A∗L
vérifiant les propriétés suivantes :
– F contient toutes les formules atomiques ;
– Pour tout mot 𝑚 ∈ F, le mot ¬𝑚 appartient à F ;
– Pour tous mots 𝑚, 𝑚′ ∈ F, les mots (𝑚 ∨ 𝑚′), (𝑚 ∧ 𝑚′), (𝑚 ⇒ 𝑚′) et
(𝑚 ⇔ 𝑚′) appartiennent à F ;
– Pour tout mot 𝑚 ∈ F et tout symbole de variable 𝑣 ∈ V, les mots ∃𝑣𝑚 et
∀𝑣𝑚 appartiennent à F.
On voit immédiatement que FL vérifie les quatre propriétés précé-
dentes ; c’est donc la plus petite partie de A∗L qui les vérifie. On dit qu’un
élément de FL est une formule dans le langage L. Si 𝑚 et 𝑚′ sont des
formules, on dit que ¬𝑚 est la négation de la formule 𝑚, que (𝑚 ∨ 𝑚′) et
(𝑚 ∧ 𝑚′) sont la disjonction et la conjonction des formules 𝑚 et 𝑚′. Soit
F une partie de A∗L . Pour prouver que F contient FL , il suffit d’établir les
88 CHAPITRE 4. LANGAGES DU PREMIER ORDRE — PARLER
propriétés de la définition. Cela donne lieu à une méthode de « raisonne-
ment par récurrence sur la définition d’un terme ». On vérifie par exmple
ainsi que le mot vide n’est pas une formule.
4.3.4. — On définit par récurrence une suite croissante (FL(ℎ) ) d’en-
sembles de mots de la façon suivante : on note FL(0) l’ensemble des
formules atomiques et, si FL(ℎ) est défini, on note FL(ℎ+1) la réunion de
FL(ℎ) et de l’ensemble des mots de la forme ¬𝑚, (𝑚 ∨ 𝑚′), (𝑚 ∧ 𝑚′),
(𝑚 ⇒ 𝑚′), (𝑚 ⇔ 𝑚′), ∃𝑣𝑚 ou ∀𝑣𝑚, où 𝑚, 𝑚′ sont des éléments de FL(ℎ)
et 𝑣 ∈ V est un symbole de variable. On voit par récurrence que pour tout
entier ℎ, FL(ℎ) est contenu dans FL . De plus, la réunion ℎ∈N FL(ℎ) vérifie
Ð
les propriétés de la définition de l’ensemble des termes ; cela entraîne
l’égalité FL = ℎ∈N FL(ℎ) . La hauteurd’une formule 𝑚 est le plus petit
Ð
entier ℎ tel que 𝑚 ∈ FL(ℎ) .
4.3.5. — Si 𝑚 est un mot, on note 𝑝 ′ (𝑚) la différence du nombre de paren-
thèses ouvrantes et du nombre de parenthèses fermantes qui apparaissent
dans 𝑚.
Proposition (4.3.6). — Soit 𝑚 ∈ FL une formule dans le langage L.
a) On a 𝑝 ′ (𝑚) = 0 ;
b) Pour tout segment initial 𝑚′ de 𝑚, on a 𝑝 ′ (𝑚′) ⩾ 0 ;
c) Si le premier symbole de 𝑚 est (, alors 𝑝 ′ (𝑚′) ⩾ 1 pour tout segment
initial 𝑚′ de 𝑚 qui est distinct de 𝜀 et de 𝑚.
Démonstration. — a) Raisonnons par récurrence sur la définition d’une
formule. Si 𝑚 est une formule atomique, alors 𝑚 n’a pas de parenthèse,
donc 𝑝 ′ (𝑚) = 0 ; si 𝑚 est de la forme ¬𝑚 1 , où 𝑚 1 est une formule, alors
𝑝 ′ (𝑚) = 𝑝 ′ (𝑚 1 ) = 0 ; si 𝑚 est de la forme (𝑚 1 • 𝑚 2 ), alors 𝑝 ′ (𝑚) = 1 +
𝑝 ′ (𝑚 1 ) + 𝑝 ′ (𝑚 2 ) − 1 = 0 ; si 𝑚 est de la forme ∃𝑣𝑚 1 ou ∀𝑣𝑚 1 , alors 𝑝 ′ (𝑚) =
𝑝 ′ (𝑚 1 ) = 0. L’assertion en résulte.
b) et c) Raisonnons encore par récurrence sur la définition d’une for-
mule. Soit 𝑚′ un segment initial de 𝑚, que l’on peut supposer distinct de 𝑚.
Si 𝑚 est une formule atomique, alors 𝑚 n’a pas de parenthèses, donc 𝑚′
non plus et 𝑝 ′ (𝑚′) = 0. Supposons 𝑚 de la forme ¬𝑚 1 ; alors il existe un
segment initial 𝑚′1 de 𝑚 tel que 𝑚′ = ¬𝑚′1 ; on a donc 𝑝 ′ (𝑚′) = 𝑝 ′ (𝑚′1 ) ⩾ 0.
4.3. FORMULES 89
Supposons 𝑚 de la forme (𝑚 1 • 𝑚 2 ), où 𝑚 1 et 𝑚 2 sont des formules. Si
ℓ (𝑚′) = 0, alors 𝑝 ′ (𝑚′) = 0 ; si 1 ⩽ ℓ (𝑚′) ⩽ 1 + ℓ (𝑚 1 ), alors il existe un
segment initial 𝑚′1 de 𝑚 1 tel que 𝑚′ = (𝑚′1 , donc 𝑝 ′ (𝑚′) = 1 + 𝑝 ′ (𝑚′1 ) ⩾ 1.
Si 2 + ℓ (𝑚 1 ) ⩽ ℓ (𝑚′) < ℓ (𝑚), il existe un segment initial 𝑚′2 de 𝑚 2 tel que
𝑚′ = (𝑚 1 • 𝑚′2 ; on a donc 𝑝 ′ (𝑚′) = 1 + 𝑝 ′ (𝑚 1 ) + 𝑝 ′ (𝑚′2 ) ⩾ 1. Les deux
assertions b) et c) en résultent.
□
Corollaire (4.3.7). — Soit 𝑚 une formule et soit 𝑚′ un segment initial de 𝑚,
distinct de 𝑚. Alors, 𝑚′ n’est pas une formule.
Démonstration. — Raisonnons par récurrence sur la définition d’une for-
mule. Le mot vide n’est pas une formule ; on suppose dans la suite que
𝑚′ ≠ 𝜀. On raisonne par l’absurde. Il y alors quatre cas à traiter :
a) Supposons que 𝑚 soit une formule atomique. Alors, 𝑚′ commence
par le premier symbole de 𝑚 qui n’est ni une parenthèse, ni le symbole ¬,
ni un symbole de quantificateur. Si 𝑚′ est une formule, c’est donc une
formule atomique. Mais un segment initial strict d’une formule atomique
n’est pas une formule atomique, contradiction.
b) Supposons que 𝑚 commence par le symbole ¬. Il en est de même
de 𝑚′ ; puisque 𝑚′ est une formule, il existe une formule 𝑚′1 telle que 𝑚′ =
¬𝑚′1 ; alors, 𝑚′1 est un segment initial de 𝑚 1 , distinct de 𝑚 1 ; contradiction.
c) Supposons que 𝑚 commence par une parenthèse ouvrante. D’après
le lemme précédent, on a alors 𝑝 ′ (𝑚′) ⩾ 1, ce qui contredit l’hypothèse
que 𝑚′ est une formule.
d) Supposons que le premier symbole de 𝑚 soit un quantificateur, di-
sons ∃ pour fixer les idées. Il en est de même du premier symbole de 𝑚′ ;
par suite, ℓ (𝑚′) ⩾ 2 et il existe une formule 𝑚′1 telle que 𝑚′ = ∃𝑣𝑚′1 , où 𝑣
est le second symbole de 𝑚. On observe que 𝑚′1 est un segment initial de
la formule 𝑚 1 , distinct de 𝑚 1 , ce qui est absurde.
□
Théorème (4.3.8). — Soit 𝑚 ∈ FL une formule dans le langage L. Alors,
une, et une seule, des propositions suivantes est satisfaite :
a) 𝑚 est une formule atomique ;
b) Il existe une unique formule 𝑚′ telle que 𝑚 = ¬𝑚′ ;
90 CHAPITRE 4. LANGAGES DU PREMIER ORDRE — PARLER
c) Il existe un unique couple (𝑚′, 𝑚′′) de formules et un unique élément
• ∈ {∧, ∨, ⇒, ⇔} tel que 𝑚 = (𝑚′ • 𝑚′′) ;
d) Il existe un unique élément 𝑣 ∈ V et une unique formule 𝑚′ tels que
𝑚 = ∃𝑣𝑚′ ;
e) Il existe un unique élément 𝑣 ∈ V et une unique formule 𝑚′ tels que
𝑚 = ∀𝑣𝑚′.
Démonstration. — Le mot vide n’est pas une formule ; par suite, les cinq
cas cités s’excluent mutuellement par la nature du premier symbole : de
relation dans le cas a), ¬ dans le cas b), ( dans le cas c), ∃ dans le cas
d), ∀ dans le cas e). Il résulte aussi de la définition d’une formule que
l’assertion d’existence d’un des cinq cas cités est vérifiée, il s’agit donc
d’établir l’assertion d’unicité dans chacun des cas.
a) L’assertion est vide dans ce cas.
b) Supposons qu’il existe deux formules 𝑚′ et 𝑚′′ telles que 𝑚 = ¬𝑚′ =
¬𝑚′′. Alors, 𝑚′ = 𝑚′′.
c) Supposons que l’on ait 𝑚 = (𝑚′ • 𝑚′′) = (𝑚′1 □𝑚′′1 ), et prouvons
que • = □, 𝑚′ = 𝑚′1 et 𝑚′′ = 𝑚′′1 . Supposons, pour fixer les idées, que
la longueur de 𝑚′1 soit inférieure ou égale à celle de 𝑚′. Alors, 𝑚′1 est un
segment initial de 𝑚′ et est une formule ; on a donc 𝑚′1 = 𝑚′. Considérant
le symbole suivant, on a donc • = □, puis 𝑚′′) = 𝑚′′1 ), d’où 𝑚′′ = 𝑚′′1 en
simplifiant le dernier symbole.
d) Supposons que l’on ait 𝑚′ = ∃𝑣𝑚′ = ∃𝑣 1𝑚′1 . En comparant les
deuxièmes symboles, on a 𝑣 = 𝑣 1 . En simplifiant les deux premiers
symboles, il vient alors 𝑚′ = 𝑚′1 .
e) Ce cas est analogue au précédent. □
4.3.9. — Soit 𝑚 une formule dans le langage L. On définit l’ensemble
sf (𝑚) des sous-formules de 𝑚 par récurrence sur la définition de 𝑚 :
– Si 𝑚 est une formule atomique, alors sf (𝑚) = {𝑚} ;
– Si 𝑚 = ¬𝑚′, alors sf (𝑚) = sf (𝑚′) ∪ {𝑚} ;
– Si 𝑚 = (𝑚′ • 𝑚′′), alors sf (𝑚) = sf (𝑚′) ∪ sf (𝑚′′) ∪ {𝑚} ;
– Si 𝑚 = ∀𝑣𝑚′ ou 𝑚 = ∃𝑣𝑚′, alors sf (𝑚) = sf (𝑚′) ∪ {𝑚}.
L’ensemble sf (𝑚) est fini ; ses éléments de sf (𝑚) sont des formules et
sont aussi des sous-mots du mot 𝑚.
4.4. VARIABLES LIBRES, VARIABLES LIÉES, SUBSTITUTION 91
4.4. Variables libres, variables liées, substitution
4.4.1. — Soit 𝑚 une formule dans le langage L et soit 𝑣 ∈ V un sym-
bole de variable. Les occurrences de 𝑣 dans le mot 𝑚 vont être de nature
très différentes suivant qu’elles sont liées par un symbole de quantifica-
teur ou libres. La définition procède par récurrence sur la définition d’une
formule :
– Si 𝑚 est une formule atomique, toutes les occurrences de 𝑣 sont libres ;
– Si 𝑚 = ¬𝑚′, les occurrences libres de 𝑣 dans 𝑚 sont celles qui sont
libres dans 𝑚′ ;
– Si 𝑚 = (𝑚′ • 𝑚′′), les occurrences libres de 𝑣 dans 𝑚 sont les occur-
rences libres de 𝑣 dans 𝑚′ et les occurrences libres de 𝑣 dans 𝑚′′ ;
– Si 𝑚 = ∃𝑤𝑚′ ou 𝑚 = ∀𝑤𝑚′, où 𝑤 ∈ V est un symbole de variable
distinct de 𝑣, les occurrences libres de 𝑣 dans 𝑚 sont les occurrences libres
de 𝑣 dans 𝑚′ ;
– Si 𝑚 = ∃𝑣𝑚′, aucune occurrence de 𝑣 dans 𝑚 n’est libre ; les occur-
rences de 𝑣 qui sont libres dans 𝑚′, ainsi que celle en seconde position
de 𝑚, sont dites liées par le quantificateur existentiel ∃, ou dans le champ
de ce quantificateur ;
– Si 𝑚 = ∀𝑣𝑚′, aucune occurrence de 𝑣 dans 𝑚 n’est libre ; les occur-
rences de 𝑣 qui sont libres dans 𝑚′, ainsi que celle en seconde position
de 𝑚, sont dites liées par le quantificateur universel ∀, ou dans le champ de
ce quantificateur.
On vérifie par récurrence que toute occurrence d’un symbole de variable
est soit libre, soit liée par une, et une seule, occurrence de quantificateur.
Définition (4.4.2). — Soit 𝑚 une formule dans le langage L et soit 𝑣 ∈ V
un symbole de variable. On dit que 𝑣 est libre dans 𝑚 si ce symbole admet
au moins une occurrence libre.
Soit W une partie de V ; on note FL,W l’ensemble des formules dans le
langage L dont les symboles de variables libres sont contenus dans W.
Remarque (4.4.3). — Soit 𝑚 = 𝑚 1 . . . 𝑚𝑛 un mot et soit 𝑣 ∈ V un symbole
de variable. La définition formelle d’une occurrence de 𝑣 dans 𝑚 est un
indice 𝑖 tel que 𝑣 = 𝑚𝑖 . Si l’on se tient à cette définition, par exemple si
l’on veut programmer il est nécessaire de bien interpréter la définition
précédente. Expliquons par exemple le second cas, lorsque 𝑚 = ¬𝑚′. On
92 CHAPITRE 4. LANGAGES DU PREMIER ORDRE — PARLER
a 𝑚 1 = ¬ et 𝑚′ = 𝑚 2 . . . 𝑚𝑛 = 𝑚′1 . . . 𝑚𝑛−1
′ . Soit 𝑗 une occurrence de 𝑣
dans 𝑚′ ; on a donc 𝑣 = 𝑚′𝑗 = 𝑚 𝑗+1 . Ainsi, c’est l’entier 𝑗 + 1 qui est une
occurrence de 𝑣 dans 𝑚, et non 𝑗.
Définition (4.4.4). — On dit qu’une formule est close si aucune variable
n’y est libre.
Proposition (4.4.5). — Soit 𝑠 : V → TL une application. Pour tout symbole
de variable 𝑣 ∈ V, on note 𝑠𝑣 l’application de V dans TL qui coïncide avec 𝑠
hors de 𝑣 et telle que 𝑠𝑣 (𝑣) = 𝑣.
Il existe une unique application 𝜎 : FL → FL vérifiant les propriétés sui-
vantes :
– L’application 𝜎 coïncide avec celle déjà définie sur les formules ato-
miques ;
– Si 𝑚 = ¬𝑚′, alors 𝜎 (𝑚) = ¬𝜎 (𝑚′) ;
– Si 𝑚 = (𝑚′ • 𝑚′′), alors 𝜎 (𝑚) = (𝜎 (𝑚′) • 𝜎 (𝑚′′) ;
– Si 𝑚 = ∃𝑣𝑚′, alors 𝜎 (𝑚) = ∃𝑣𝜎𝑣 (𝑚′), où 𝜎𝑣 : FL → FL est l’application
définie à partir de l’application 𝑠𝑣 ;
– Si 𝑚 = ∀𝑣𝑚′, alors 𝜎 (𝑚) = ∀𝑣𝜎𝑣 (𝑚′), où 𝜎𝑣 : FL → FL est l’application
définie à partir de l’application 𝑠𝑣
On l’appelle l’application de substitution des occurrences libres des sym-
boles de variables 𝑣 par les termes 𝑠 (𝑣). En effet, si une occurrence de va-
riable 𝑣 se trouve dans le champ d’un quantificateur, elle figure dans une
sous-formule de la forme ∃𝑣𝑚′, ou ∀𝑣𝑚′, qui est transformée en ∃𝑣𝜎𝑣 (𝑚′)
ou ∀𝑣𝜎𝑣 (𝑚′). Cependant, comme 𝑠𝑣 (𝑣) = 𝑣, 𝜎𝑣 ne modifie jamais le sym-
bole de variable 𝑣.
Démonstration. — Il résulte de la définition des formules par récurrence
et du théorème de lecture unique, qu’il existe une unique application
𝜎 : FL → A∗L vérifiant ces propriétés. On vérifie ensuite par récurrence
que 𝜎 (𝑚) est une formule, pour toute formule 𝑚. □
CHAPITRE 5
RÉALISATIONS, MODÈLES — INTERPRÉTER
« D’un fort beau caractère on voit là le modèle, Madame (...) »
— Molière, Le Misanthrope, acte v, scène 4
5.1. Structures
Soit L = ((R𝑛 ), (F𝑛 )) un langage du premier ordre.
Définition (5.1.1). — On appelle réalisation du langage L, ou L-structure,
un ensemble A muni des données suivantes :
– Pour tout entier 𝑛 et tout symbole de relation 𝑟 ∈ R𝑛 , une relation 𝑛-aire
𝑟 dans le produit cartésien A𝑛 ;
A
– Pour tout entier 𝑛 et tout symbole de fonction 𝑓 ∈ F𝑛 , une fonction
A
𝑓 : A𝑛 → A.
On exige aussi que les graphes des relations ⊤A et ⊥A dans A0 soient respec-
tivement A0 et ∅, et que le graphe de la relation =A dans A2 soit la diagonale.
On dit que A est l’univers de la réalisation ; pour tout symbole de rela-
tion 𝑟 on dit que la relation 𝑟 A est l’interprétation du symbole 𝑟 dans A ;
pour tout symbole de fonction 𝑓 , on dit que la fonction 𝑓 A est l’interpré-
tation du symbole 𝑓 dans A. On dira souvent « soit A une réalisation... »
en sous-entendant les interprétations.
Remarque (5.1.2). — Rappelons que A0 désigne l’ensemble des applica-
tions de l’ensemble à 0 éléments, l’ensemble vide, dans A. Il y a donc exac-
tement un élément dans l’ensemble A0 ; notons-le 𝜀.
Puisque se donner une relation dans A0 revient à se donner une partie
de l’ensemble {𝜀}, il y a deux telles relations : {𝜀}, et ∅. La première est
toujours vérifiée et possède la valeur de vérité vrai, ou ⊤ ; la seconde n’est
jamais vérifiée et possède la valeur de vérité faux, ou ⊥.
94 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
De même, les symboles de constantes sont les éléments de F0 . Se donner
une application de A0 dans A revient à se donner l’image dans A de l’élé-
ment 𝜀, autrement dit, à choisir, pour tout symbole de constante 𝑐 ∈ F0 ,
un élément 𝑐 A ∈ A.
5.1.3. — Supposons que le langage L soit celui des anneaux, les symboles
de variables étant représentés par des lettres de l’alphabet. Une réalisation
de ce langage est un ensemble, disons A, muni de deux lois binaires + et ·,
A × A → A, et de deux éléments 0 et 1. En revanche, on ne fait encore
aucune hypothèse sur les relations entre ces lois et les deux éléments 0, 1.
En effet, si les axiomes des anneaux s’expriment comme des formules du
langage L, l’associativité de l’addition s’écrit ∀𝑥∀𝑦∀𝑧 = + + 𝑥𝑦𝑧 + 𝑥 + 𝑦𝑧,
ou, avec une notation plus courante, ∀𝑥∀𝑦∀𝑧 ((𝑥 + 𝑦) + 𝑧 = 𝑥 + (𝑦 + 𝑧)).
Mais pour pouvoir dire si l’addition de A est associative, il faut pouvoir
interpréter les formules et les termes dans A.
5.1.4. — Les deux propositions ci-dessous affirment qu’il y a une unique
façon raisonnable d’interpréter termes et formules dans une réalisation
donnée A du langage L. Elles sont énoncées de façon un peu exotique. En
effet, l’interprétation d’un terme sera une application du produit carté-
sien AV de la structure dans la structure. Rappelons que AV est l’ensemble
des familles (𝑎𝑣 )𝑣 ∈V d’éléments de A, indexées par l’ensemble V des sym-
boles de variables ; comme on l’imagine, seuls les indices 𝑣 apparaissant
dans un terme seront pris en compte dans l’interprétation de ce terme. Il
est cependant plus simple L’interprétation d’une formule est une applica-
tion du produit cartésien AV dans l’ensemble {⊥, ⊤} des valeurs de vérité,
même si seuls les indices 𝑣 correspondant aux variables libres d’une for-
mule donnée interviendront pour l’interprétation de cette formule.
Les symboles logiques ¬, ∨, ∧, ⇒, ⇔ vont avoir l’interprétation usuelle,
donnée par les tables de vérité bien connues suivantes :
∧ ⊤ ⊥ ∨ ⊤ ⊥ ⇒ ⊤ ⊥
¬ ⊤ ⊥
⊤ ⊤ ⊥ ⊤ ⊤ ⊤ ⊤ ⊤ ⊥
⊥ ⊤
⊥ ⊥ ⊥ ⊥ ⊤ ⊥ ⊥ ⊤ ⊤
⇔ ⊤ ⊥
⊤ ⊤ ⊥
⊥ ⊥ ⊤
5.1. STRUCTURES 95
De même, le quantificateur existentiel ∃𝑣 va être interprété comme l’exis-
tence d’un élément dans A, et le quantificateur universel ∀𝑣 va être inter-
prété comme une propriété pour tout élément de A.
Proposition (5.1.5). — Soit W une partie de V. Il existe une unique applica-
tion 𝜏W : TL,W → F (AW, A) de l’ensemble TL,W des termes dont les symboles
de variables appartiennent à W dans l’ensemble des fonctions de AW dans A
vérifiant les propriétés suivantes :
– Pour 𝑣 ∈ W, 𝜏W (𝑣) est l’application de AW dans A donnée par
(𝑎𝑣 )𝑣 ∈W ↦→ 𝑎𝑤 ;
– Pour 𝑛 ∈ N, 𝑓 ∈ F𝑛 et (𝑡 1, . . . , 𝑡𝑛 ) ∈ TL,W , 𝜏W (𝑓 𝑡 1 . . . 𝑡𝑛 ) est l’application
𝑎 ↦→ 𝑓 A (𝜏W (𝑡 1 )(𝑎), . . . , 𝜏W (𝑡𝑛 )(𝑎)).
En pratique, l’application 𝜏W (𝑡) : AW → A est notée 𝑡 A . La formule de
récurrence se récrit ainsi 𝑡 A (𝑎) = 𝑓 A (𝑡 1A (𝑎), . . . , 𝑡𝑛A (𝑎)), ou encore 𝑡 A =
𝑓 A ◦ (𝑡 1A, . . . , 𝑡𝑛A ). L’ensemble des variables apparaissant dans le terme 𝑡
est donc implicite et on verra ci-dessous que les ambiguités permises par
cet abus de langage sons sans danger.
Démonstration. — Cela découle du théorème de lecture unique des
termes. □
Lemme (5.1.6). — Soit W une partie de V.
a) Soit W′ une partie de W. Pour tout terme 𝑡 ∈ TL,W′ et tout 𝑎 ∈ AW , on
a 𝜏W (𝑡) (𝑎) = 𝜏W′ (𝑡)(𝑎′), où 𝑎′ = (𝑎𝑤 )𝑤 ∈W′ . Autrement dit, l’interprétation
d’un terme ne dépend que des variables qui y apparaissent effectivement.
b) Soit W′ une partie de V, soit 𝑠 : W → TL,W′ une application et soit
𝜎 : TL,W → TL,W′ l’application de substitution correspondante. Pour tout
′
terme 𝑡 et tout 𝑎 ∈ AW , on a 𝜎 (𝑡) A (𝑎) = 𝑡 A ((𝑠 (𝑤) A (𝑎))𝑤 ∈W ).
Démonstration. — Cela se prouve par récurrence sur la définition d’un
terme. □
Proposition (5.1.7). — Il existe une unique famille (𝜑 W )W∈P (V) où, pour
toute partie W de V, 𝜑 W : FL,W → R (AW ) est une application de l’en-
semble FL,W des formules du langage L à variables libres dans W dans l’en-
semble R (AW ) des relations sur AW , vérifiant les propriétés suivantes :
96 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
a) Si 𝑚 = 𝑟𝑡 1 . . . 𝑡𝑛 , où 𝑟 ∈ R𝑛 et 𝑡 1, . . . , 𝑡𝑛 ∈ TL,W , alors 𝜑 W (𝑚)(𝑎) =
𝑟 (𝑡 1A (𝑎), . . . , 𝑡𝑛A (𝑎)) pour tout 𝑎 ∈ AW ;
A
b) Si 𝑚 = ¬𝑚′, où 𝑚′ ∈ FL,W , alors 𝜑 W (𝑚)(𝑎) = ¬𝜑 W (𝑚′)(𝑎) pour tout
𝑎 ∈ AW ;
c) Si 𝑚 = (𝑚′ • 𝑚′′), où 𝑚′, 𝑚′′ ∈ FL,W et • ∈ {∨, ∧, ⇒, ⇔}, alors
𝜑 W (𝑚)(𝑎) = 𝜑 W (𝑚′)(𝑎) • 𝜑 W (𝑚′′)(𝑎) pour tout 𝑎 ∈ AL,W ;
d) Si 𝑚 = ∃𝑣𝑚′, avec 𝑣 ∈ V et 𝑚′ ∈ FL,W′ , où W′ = W ∪ {𝑣 }, alors on a
′
𝜑 W (𝑚)(𝑎) si et seulement s’il existe un élément 𝑎′ ∈ AW tel que 𝑎𝑤′ = 𝑎𝑤
pour 𝑤 ≠ 𝑣 tel que 𝜑 W′ (𝑚′)(𝑎′) ;
e) Supposons 𝑚 = ∀𝑣𝑚′, avec 𝑣 ∈ V et 𝑚′ ∈ FL,W′ , où W′ = W ∪ {𝑣 }, alors
′
𝜑 W (𝑚)(𝑎) si et seulement si, pour tout élément 𝑎′ ∈ AW tel que 𝑎𝑤′ = 𝑎𝑤
pour 𝑤 ≠ 𝑣, on a 𝜑 (𝑚′)(𝑎′).
En pratique, la relation 𝜑 W (𝑚) dans AW est notée 𝑚 A , l’ensemble W de
variables libres étant sous-entendu. On verra plus loin que cela ne crée
pas d’ambiguité.
Démonstration. — Cela se démontre par récurrence sur la définition d’une
formule. D’après le théorème de lecture unique, un et un seul des cinq cas
indiqué se produit, mais il faut vérifier que les ensembles de variables
libres qui apparaissent sont bien comme indiqué, ce qui résulte de la défi-
nition par récurrence de l’ensemble des occurrences libres d’un symbole
de variables. Supposons 𝑚 ∈ FL,W .
a) Si 𝑚 = 𝑟𝑡 1 . . . , 𝑡𝑛 est une formule atomique, ses variables libres sont
les symboles variables libres apparaissant dans 𝑡 1, . . . , 𝑡𝑛 ; par suite, alors
𝑡 1, . . . , 𝑡𝑛 ∈ TL,W ;
b) Si 𝑚 = ¬𝑚′, les variables libres de 𝑚 sont celles de 𝑚′ ;
c) Si 𝑚 = (𝑚′ • 𝑚′′), les variables libres de 𝑚 sont celles de 𝑚′ et de 𝑚′′.
Dans ces deux derniers cas, on a donc 𝑚′, 𝑚′′ ∈ FL,W ;
d) Si 𝑚 = ∃𝑣𝑚′ ou 𝑚 = ∀𝑣𝑚′, les variables libres de 𝑚 sont celles de 𝑚′,
privées de 𝑣 ; alors, 𝑚′ ∈ FL,W′ , où W′ = W ∪ {𝑣 }. □
Lemme (5.1.8). — Soit W, W′ des parties de V telles que W′ ⊆ W et soit 𝑚 ∈
FL,W′ , de sorte que 𝑚 ∈ FL,W . Pour tout 𝑎 ∈ AW , on a 𝜑 W (𝑚)(𝑎) = 𝜑 W′ (𝑎′),
où 𝑎′ = (𝑎𝑤 )𝑤 ∈W′ . Autrement dit, la relation 𝑚 A dans AW ne dépend pas des
composantes dont l’indice n’a pas d’occurrence libre dans W.
5.1. STRUCTURES 97
Démonstration. — Cela se prouve par récurrence sur la définition d’une
formule. □
[Link]. — La substitution d’une variable libre par un terme n’est pas tou-
jours compatible à l’interprétation d’une formule. Prenons pour exemple
la formule ∃𝑥 (𝑥 2 = 𝑦). Substituons d’abord à 𝑦 le terme 𝑡 = 𝑦 + 𝑧 ; on
obtient la formule ∃𝑥 (𝑥 2 = 𝑦 + 𝑧) dont l’interprétation en un couple (𝑏, 𝑐)
coïncide avec l’interprétation de la formule initiale en 𝑏 + 𝑐. Substituons
maintenant à 𝑦 le terme 𝑢 = 𝑥+𝑦+𝑧 ; on obtient la formule ∃𝑥 (𝑥 2 = 𝑥+𝑦+𝑧)
dont l’interprétation en un couple (𝑏, 𝑐) est vraie si et seulement si l’équa-
tion 𝑥 2 − 𝑥 = 𝑏 + 𝑐 a une solution, et non l’équation 𝑥 2 = 𝑏 + 𝑐.
On dira qu’une formule 𝑚 est admissible pour une substitution 𝑠 : W →
TL si pour toute sous-formule de 𝑚 de la forme Q𝑣𝑚′ où Q ∈ {∀, ∃} et tout
symbole de variable 𝑤 ∈ W {𝑣 } qui a une occurrence libre dans 𝑚′, le
terme 𝑠 (𝑤) ne fait pas intervenir le symbole 𝑣.
Lemme (5.1.9). — Soit W une partie de V. Soit 𝑠 : W → TL,W′ une appli-
cation et soit 𝜎 : FL,W → FL,W′ l’application de substitution correspondante.
′ ′
Pour tout 𝑎 ∈ AW , notons 𝑠 A (𝑎) = (𝑠 (𝑤) A (𝑎))𝑤 ∈W ; pour tout 𝑎 ∈ AW
et toute formule 𝑚 ∈ FL,W qui est admissible pour la substitution 𝑠, on a
𝜎 (𝑚) A (𝑎) = 𝑚 A (𝑠 A (𝑎))).
Démonstration. — Raisonnons par récurrence sur la définition d’une for-
mule. Pour simplifier, nous poserons 𝑏 = 𝑠 A (𝑎).
a) Supposons que 𝑚 soit une formule atomique, 𝑚 = 𝑟𝑡 1 . . . , 𝑡𝑛 . Alors
𝜎 (𝑚) = 𝑟𝑢 1 . . . 𝑢𝑛 , où 𝑢𝑖 = 𝜎 (𝑡𝑖 ) ∈ TL,W pour tout 𝑖. On a donc 𝜎 (𝑚) A (𝑎) =
𝑟 A (𝑢 1A (𝑎), . . . , 𝑢𝑛A (𝑎)). Pour tout 𝑖 ∈ {1, . . . , 𝑛}, on a 𝑢𝑖A (𝑎) = 𝜎 (𝑡𝑖 ) A (𝑎) =
𝑡𝑖A (𝑠 A (𝑎)) = 𝑡𝑖A (𝑏), d’après le lemme 5.1.6. Par suite, on a
𝜎 (𝑚) A (𝑎) = 𝑟 A (𝑡 1A (𝑏), . . . , 𝑡𝑛A (𝑏)) = 𝑚 A (𝑏) = 𝑚 A (𝑠 A (𝑎)),
ce qu’il fallait démontrer.
b) Supposons que 𝑚 = ¬𝑚′, où 𝑚′ ∈ FL,W . Alors, 𝜎 (𝑚) = ¬𝜎 (𝑚′), donc
𝜎 (𝑚) A (𝑎) = ¬𝜎 (𝑚′) A (𝑎). Par récurrence, 𝜎 (𝑚′) A (𝑎) = (𝑚′) A (𝑏), d’où
𝜎 (𝑚) A (𝑎) = ¬(𝑚′) A (𝑏) = 𝑚 A (𝑏).
c) On raisonne de façon analogue lorsque 𝑚 est de la forme (𝑚′ • 𝑚′′),
avec • ∈ {∨, ∧, ⇒, ⇔}.
d) Supposons que 𝑚 = ∃𝑣𝑚′ ; posons W0 = W {𝑣 }, W1 = W ∪ {𝑣 } =
W0 ∪ {𝑣 }, de sorte que 𝑚′ ∈ FL,W1 et 𝑚 ∈ FL,W0 .
98 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
Posons W′1 = W′ ∪ {𝑣 } et soit 𝑠 1 : W1 → TL,W1′ l’application qui coïn-
cide avec 𝑠 sur W0 {𝑣 } et telle que 𝑠 1 (𝑣) = 𝑣 ; soit 𝜎1 l’application de
substitution correspondante. Par définition, on a 𝜎 (𝑚) = ∃𝑣𝜎1 (𝑚′),
Considérons une sous-formule de 𝑚′ de la forme Q𝑥𝑝, où Q ∈ {∀, ∃}.
Comme c’est une sous-formule de 𝑚, pour tout symbole de variable 𝑤 ∈
W qui a une occurrence libre dans 𝑝, le terme 𝑠 (𝑤) ne fait pas intervenir
le symbole 𝑥. Soit 𝑤 ∈ W1 un symbole de variable qui a une occurrence
libre dans 𝑝 et tel que 𝑤 ≠ 𝑥 ; on a 𝑠 1 (𝑤) = 𝑠 (𝑤), donc 𝑠 1 (𝑤) ne fait
pas intervenir 𝑥. Cela prouve que la formule 𝑚′ est admissible pour la
substitution 𝑠 1 .
′
L’interprétation 𝜎1 (𝑚′) A est une relation dans AW1 ; l’interpréta-
tion (𝑚′) A est une relation dans AW1 . Par récurrence, on a donc
′
𝜎1 (𝑚′) A (𝑎 1 ) = (𝑚′) A ((𝑠 1 (𝑤) A (𝑎 1 ))𝑤 ∈W1 ) pour tout 𝑎 1 ∈ AW1 .
′
Soit 𝑎 ∈ AW . Puisque 𝜎 (𝑚) = ∃𝑣𝜎 (𝑚′), on a 𝜎 (𝑚) A (𝑎) = ⊤ si et seule-
′
ment s’il existe 𝑎 1 ∈ AW1 tel que 𝜎 (𝑚′) A (𝑎 1 ) = ⊤ et tel que toutes les
composantes de 𝑎 1 autres que celle d’indice 𝑣 coïncident avec celles de 𝑎.
(On dira qu’un tel 𝑎 1 est 𝑣-proche de 𝑎.)
Soit 𝑤 ∈ W1 un symbole de variable qui a une occurrence libre
dans 𝑚′ ; par hypothèse, le symbole de variable 𝑣 n’apparaît pas dans
le terme 𝑠 1 (𝑤) = 𝑠 (𝑤) ; on a donc 𝑠 1 (𝑤) A (𝑎 1 ) = 𝑏𝑤 pour tout élément
convenable 𝑎 1 . D’autre part, 𝑠 1 (𝑣) = 𝑣, donc 𝑠 1 (𝑣) A (𝑎 1 ) est la composante
d’indice 𝑣 de 𝑎 1 . Ainsi, l’application 𝑎 1 ↦→ (𝑠 1 (𝑤) A (𝑎 1 ))𝑤 ∈W1 induit une
′
bijection de l’ensemble des éléments 𝑎 1 ∈ AW1 qui sont 𝑣-proches de 𝑎
sur l’ensemble des éléments 𝑏 1 ∈ AW1 qui sont 𝑣-proches de 𝑏.
Cela démontre que 𝜎 (𝑚) A (𝑎) = ⊤ si et seulement s’il existe un élé-
ment 𝑏 1 qui est 𝑣-proche de 𝑏 tel que (𝑚′) A (𝑏) = ⊤, ce qui signifie exac-
tement 𝑚 A (𝑏) = ⊤.
e) Le cas du quantificateur ∀ est analogue.
□
5.1.10. — On a l’habitude, lorsque P est un polynôme à coefficients
dans un anneau commutatif A en des indéterminées T1, . . . , T𝑛 , de noter
P(T1, . . . , T𝑛 ) le polynôme P. On note aussi couramment P(𝑎 1, . . . , 𝑎𝑛 )
l’évaluation du polynôme P en un 𝑛-uplet (𝑎 1, . . . , 𝑎𝑛 ) ∈ A𝑛 .
5.2. ÉQUIVALENCE SÉMANTIQUE 99
Nous allons mettre en place cette notation dans le contexte de l’évalua-
tion des termes et des formules dans un langage L. Soit A une réalisation
de L, soit 𝑡 ∈ TL un terme et soit 𝑚 ∈ TL une formule dans le langage L.
Par analogie avec les polynômes, on notera aussi 𝑡 (𝑥 1, . . . , 𝑥𝑛 ) le terme 𝑡
lorsque (𝑥 1, . . . , 𝑥𝑛 ) une suite de symboles de variables deux à deux dis-
tincts contenant les symboles de variables qui apparaissent dans 𝑡. Si
(𝑎 1, . . . , 𝑎𝑛 ) ∈ A𝑛 , on notera 𝑡 A (𝑎 1, . . . , 𝑎𝑛 ) l’évaluation du terme 𝑡 en
remplaçant 𝑥𝑖 par 𝑎𝑖 .
De même, si 𝑚 est une formule dans le langage L, on écrira 𝑚(𝑥 1, . . . , 𝑥𝑛 )
lorsque (𝑥 1, . . . , 𝑥𝑛 ) est une suite de symboles de variables deux à deux
distincts contenant les symboles de variables libres qui apparaissent dans 𝑡.
Si (𝑎 1, . . . , 𝑎𝑛 ) ∈ A𝑛 , on notera 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ) l’évaluation de la formule 𝑚
en remplaçant 𝑥𝑖 par 𝑎𝑖 .
On notera enfin A |= 𝑚(𝑎 1, . . . , 𝑎𝑛 ) au lieu de 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ) = ⊤.
En particulier, lorsque 𝑚 est une formule close, son interprétation 𝑚 A
est une relation dans l’ensemble à un élément A∅ , c’est-à-dire tout ou rien.
Lorsque 𝑚 A = ⊤, on dira que 𝑚 est satisfaite dans A et on écrira A |= 𝑚.
5.2. Équivalence sémantique
Définition (5.2.1). — Soit L un langage. On dit que deux formules dans le
langage L sont sémantiquement équivalentes si leurs interprétations sont
égales dans toute réalisation du langage L.
Plus explicitement, deux formules 𝑚 et 𝑚′ dans le langage L sont équi-
valentes si pour toute réalisation A de L, les fonctions 𝑚 A et (𝑚′) A de AV
dans {⊥, ⊤} sont égales. C’est bien sûr une relation d’équivalence.
On définit aussi la relation de quasi-équivalence en n’exigeant l’égalité
des interprétations que dans toute réalisation non vide.
Exemple (5.2.2). — Soit 𝑚, 𝑚′, 𝑚′′ des formules et soit 𝑥, 𝑦 des symboles
de variables. Les formules suivantes sont sémantiquement équivalentes :
a) 𝑚 et ¬¬𝑚 ;
b) ¬(𝑚 ∨ 𝑚′) et (¬𝑚 ∧ ¬𝑚′) ;
c) (𝑚 ∨ (𝑚′ ∨ 𝑚′′)) et ((𝑚 ∨ 𝑚′) ∨ 𝑚′′) ;
d) (𝑚 ∧ (𝑚′ ∧ 𝑚′′)) et ((𝑚 ∧ 𝑚′) ∧ 𝑚′′) ;
e) 𝑚 et (𝑚 ∧ 𝑚) ;
100 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
f) 𝑚 et (𝑚 ∨ 𝑚) ;
g) 𝑚 ⇒ 𝑚′ et (¬𝑚 ∨ 𝑚′) ;
h) (𝑚 ∨ ¬𝑚) et ⊤ ;
i) ¬∃𝑥𝑚 et ∀𝑥¬𝑚 ;
j) ∀𝑥 (𝑚 ∧ 𝑚′) et (∀𝑥𝑚 ∧ ∀𝑥𝑚′).
Lemme (5.2.3). — Soit 𝑚, 𝑚′, 𝑝, 𝑝 ′ des formules ; soit 𝑥 un symbole de va-
riable. On suppose que 𝑚 et 𝑚′ d’une part, 𝑝 et 𝑝 ′ d’autre part, sont séman-
tiquement équivalentes. Alors les formules suivantes sont sémantiquement
équivalentes :
a) ¬𝑚 et ¬𝑚′ ;
b) (𝑚 • 𝑝) et (𝑚′ • 𝑝 ′), pour tout symbole • ∈ {∧, ∨, ⇒, ⇔} ;
c) ∃𝑥𝑚 et ∃𝑥𝑚′ ;
d) ∀𝑥𝑚 et ∀𝑥𝑚′.
Exemple (5.2.4). — Soit • un élément de {∨, ∧}, soit Q un élément de
{∀, ∃}. Toute formule est sémantiquement équivalente à une formule où
les seuls symboles logiques apparaissant sont ¬, •, Q.
Cela se démontre par récurrence sur la définition d’une formule. Trai-
tons par exemple le cas où • = ∨ et Q = ∃. On remplace alors (𝑚 ∧ 𝑚′)
par ¬(¬𝑚 ∨ ¬𝑚′), (𝑚 ⇒ 𝑚′) par (¬𝑚 ∨ 𝑚′), (𝑚 ⇔ 𝑚′) par ¬(¬(¬𝑚 ∨
𝑚′) ∨ ¬(¬𝑚′ ∨ 𝑚)), et ∀𝑥𝑚 par ¬∃𝑥¬𝑚.
5.2.5. — On dit qu’une formule 𝑚 est sans quantificateurs si elle n’ad-
met aucune occurrence de quantificateur. On dit qu’elle est en forme pre-
nex s’il existe une formule sans quantificateurs 𝑚′, un entier 𝑛, des sym-
boles de variables 𝑣 1, . . . , 𝑣𝑛 et des quantificateurs Q1, . . . , Q𝑛 tels que 𝑚 =
Q1𝑣 1 . . . Q𝑛 𝑣𝑛𝑚′. Une formule prenex est dite universelle si elle n’admet pas
d’occurrence de quantificateur existentiel (∃) ; elle est dite existentielle si
elle n’admet pas d’occurrence de quantificateur universel (∀).
Proposition (5.2.6). — Toute formule 𝑚 est quasi-équivalente à une for-
mule prenex.
Démonstration. — On commence par se ramener au cas où les seuls sym-
boles logiques qu’elle contient sont ¬ et ∨.
On suppose aussi que chaque symbole de variable liée n’est lié que par
un seul symbole quantificateur, et qu’aucun symbole de variable liée n’a
5.3. MORPHISMES DE STRUCTURES 101
d’occurrence libre. Que cela soit possible se vérifie par récurrence. Par
exemple, si 𝑚 = Q𝑥𝑝, où Q est un symbole de quantificateur et 𝑝 une
formule dans laquelle 𝑥 possède une occurence liée, on substitue les oc-
curences libres de 𝑥 dans 𝑚 par un symbole de variable 𝑦 qui n’apparaît
pas dans 𝑝. De même, si 𝑚 = (𝑝 • 𝑞), on s’est assuré par récurrence que
les symboles de variables qui sont liés dans 𝑝 n’apparaissent pas dans 𝑞,
et inversement.
La démonstration procède ensuite par récurrence sur la définition d’une
formule.
Si Q est un symbole de quantificateur, on notera Q∗ le quantificateur
dual, de sorte que ∀∗ = ∃ et ∃∗ = ∀.
– Si 𝑚 = ¬𝑝, où 𝑝 est une formule prenex, on écrit 𝑝 = Q1𝑣 1 . . . Q𝑛 𝑣𝑛 𝑝 ′,
où 𝑝 ′ est sans quantificateur ; alors, ¬𝑝 est équivalente à Q∗1𝑣 1 . . . Q𝑛 𝑝 ∗
𝑣𝑛 ¬𝑝 ′.
– Supposons 𝑚 = (𝑝 ∨ 𝑞), où 𝑝 et 𝑞 sont des formules prenex ; on
écrit alors 𝑝 = Q1𝑣 1 . . . Q𝑛 𝑣𝑛 𝑝 ′ et 𝑞 = R1𝑤 1 . . . R𝑘 𝑤𝑘 𝑞′, où 𝑝 ′ et 𝑞′ sont
sans quantificateurs ; en outre, 𝑣 1, . . . , 𝑣𝑛 n’apparaissent pas dans 𝑞, et
𝑤 1, . . . , 𝑤𝑘 n’apparaissent pas dans 𝑝. Alors, 𝑚 = (𝑝 ∨ 𝑞) est quasi-
équivalente à Q1𝑣 1 . . . Q𝑛 𝑣𝑛 R1𝑤 1 . . . R𝑘 𝑤𝑘 (𝑝 ′ ∨ 𝑞′). Cela se démontre par
récurrence sur 𝑛 + 𝑘, variable après variable, grâce aux deux remarques :
a) Les formules (∀𝑥𝑝 1 ∨ 𝑞 1 ) et ∀𝑥 (𝑝 1 ∨ 𝑞 1 ) sont sémantiquement
équivalentes ;
b) Les formules (∃𝑥𝑝 1 ∨ 𝑞 1 ) et ∃𝑥 (𝑝 1 ∨ 𝑞 1 ) sont quasi-équivalentes.
Elles ne sont par contre pas forcément équivalentes : dans la structure
vide, l’interprétation de ∃𝑥 (𝑝 1 ∨ 𝑞 1 ) ne prend que la valeur ⊥, tandis
que celle de (∃𝑥𝑝 1 ∨ 𝑞 1 ) coïncide avec celle de 𝑞 1 . □
5.3. Morphismes de structures
Définition (5.3.1). — Soit L un langage, soit A et A′ des réalisations de L
et soit 𝜑 : A′ → A une application.
On dit que 𝜑 est un morphisme de structures si les conditions suivantes
sont satisfaites :
102 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
(i) Pour tout symbole 𝑓 ∈ F𝑛 de fonction 𝑛-aire et tout élément
(𝑎 1, . . . , 𝑎𝑛 ) ∈ (A′)𝑛 , on a
′
𝜑 𝑓 A (𝑎 1, . . . , 𝑎𝑛 ) = 𝑓 A (𝜑 (𝑎 1 ), . . . , 𝜑 (𝑎𝑛 ));
(ii) Pour tout symbole 𝑟 ∈ R𝑛 de relation 𝑛-aire et tout élément
′
(𝑎 1, . . . , 𝑎𝑛 ) ∈ (A′)𝑛 tel que 𝑟 A (𝑎 1, . . . , 𝑎𝑛 ), on a 𝑟 A (𝜑 (𝑎 1 ), . . . , 𝜑 (𝑎𝑛 )).
On dit que 𝜑 est un monomorphisme de structures, ou un plongement, si
l’on a de plus
(ii′) Pour tout symbole 𝑟 ∈ R𝑛 de relation 𝑛-aire et tout élément
(𝑎 1, . . . , 𝑎𝑛 ) ∈ (A′)𝑛 , alors
′
𝑟 A (𝑎 1, . . . , 𝑎𝑛 ) ⇔ 𝑟 A (𝜑 (𝑎 1 ), . . . , 𝜑 (𝑎𝑛 )).
Comme le langage L comporte un symbole de relation binaire qui est
interprété comme l’égalité dans A, un monomorphisme de structures est
injectif.
Exemple (5.3.2). — Le langage des groupes possède deux symboles de
fonctions, 𝑒 ∈ F0 représente l’élément neutre, et · ∈ F2 la loi de compo-
sition, et n’a comme symbole de relation que l’égalité. Une réalisation de
ce langage est un magma « pointé », c’est-à-dire muni d’un élément pri-
vilégié. Un homomorphisme de structures est un morphisme de magmas
pointés ; un monomomorphisme est un morphisme injectif.
5.3.3. — Le composé de deux morphismes (resp. monomorphismes) est
un morphisme (resp. un monomorphisme) ; l’identité IdA est un mono-
morphisme.
On dit qu’un morphisme 𝜑 : A′ → A est un isomorphisme s’il existe un
morphisme 𝜓 : A → A′ tel que 𝜓 ◦ 𝜑 = IdA′ et 𝜑 ◦ 𝜓 = IdA . Cela revient à
dire que 𝜑 est un monomorphisme bijectif.
5.3.4. — Soit A et A′ des réalisations du langage L. Lorsque A′ est une
partie de A et que l’inclusion de A′ dans A est un monomorphisme de
structures, on dit que A′ est une sous-structure de A.
Inversement, soit A une réalisation du langage L et soit A′ une partie
de A vérifiant la propriété suivante : Pour tout symbole 𝑓 ∈ F𝑛 et tout
(𝑎 1, . . . , 𝑎𝑛 ) ∈ (A′)𝑛 , on a 𝑓 A (𝑎 1, . . . , 𝑎𝑛 ) ∈ A′. Alors, il existe une inter-
prétation du langage L dans A′ de sorte que l’inclusion de A′ dans A soit
un plongement de structures.
5.3. MORPHISMES DE STRUCTURES 103
′ ′
En effet, il suffit de poser 𝑓 A (𝑎 1, . . . , 𝑎𝑛 ) = 𝑓 A (𝑎 1, . . . , 𝑎𝑛 ) et 𝑟 A (𝑎 1, . . . , 𝑎𝑛 ) =
𝑟 A (𝑎 1, . . . , 𝑎𝑛 ) pour tout 𝑓 ∈ F𝑛 , tout 𝑟 ∈ R𝑛 et tout (𝑎 1, . . . , 𝑎𝑛 ) ∈ (A′)𝑛 .
5.3.5. — Soit A une réalisation du langage L. L’intersection d’une fa-
mille (A𝑖 ) de sous-structures de A est une sous-structure de A.
Pour toute partie S de A, il existe donc une plus petite sous-structure
de A qui contient S, à savoir l’intersection de toutes d’entre elles ; on dit
que c’est la sous-structure engendrée par A.
Lemme (5.3.6). — Soit L un langage et soit A une réalisation de L. Soit S
une partie de A. La sous-structure de A engendrée par S est l’ensemble des
éléments de A de la forme 𝑡 A (𝑎 1, . . . , 𝑎𝑛 ), où 𝑛 ∈ N, 𝑡 ∈ TL est un terme en
les symboles de variables 𝑥 1, . . . , 𝑥𝑛 , et (𝑎 1, . . . , 𝑎𝑛 ) ∈ S𝑛 .
Démonstration. — Soit A′ l’ensemble des éléments indiqués et soit
B la sous-structure de A engendrée par S. Pour tout 𝑛 ∈ N, tout
terme 𝑡 (𝑥 1, . . . , 𝑥𝑛 ) et tout (𝑎 1, . . . , 𝑎𝑛 ) ∈ S𝑛 , on a donc 𝑡 A (𝑎 1, . . . , 𝑎𝑛 ) =
𝑡 B (𝑎 1, . . . , 𝑎𝑛 ) ∈ B. Cela prouve que A′ ⊆ B. Inversement, nous allons
démontrer que A′ est une sous-structure de A qui contient S. Soit 𝑥 un
symbole de variable et soit 𝑡 le terme 𝑥 ; on a 𝑡 A (𝑎) = 𝑎 pour tout 𝑎 ∈ S,
donc A′ contient S. Soit 𝑛 ∈ N, soit 𝑓 ∈ F𝑛 un symbole de fonction 𝑛-aire
et soit 𝑎 1, . . . , 𝑎𝑛 des éléments de A′ ; démontrons que 𝑓 A (𝑎 1, . . . , 𝑎𝑛 )
appartient à A′. Pour 𝑖 ∈ {1, . . . , 𝑛}, soit 𝑡𝑖 un terme en des symboles de
variables 𝑥𝑖,𝑗 (pour 1 ⩽ 𝑗 ⩽ 𝑚𝑖 ) et soit (𝑎𝑖,𝑗 )1⩽ 𝑗⩽𝑚𝑖 un élément de A𝑚𝑖 tel
que 𝑎𝑖 = 𝑡𝑖A (𝑎𝑖,1, . . . , 𝑎𝑖,𝑚𝑖 ). Comme l’ensemble de symboles de variables
est infini, on se ramène d’abord au cas où les symboles 𝑥𝑖,𝑗 sont deux à
deux distincts : choisir une famille (𝑦𝑖,𝑗 ) de symboles deux à deux dis-
tincts, puis, pour tout 𝑖, et substituer 𝑦𝑖,𝑗 à 𝑥𝑖,𝑗 dans 𝑡𝑖 . Soit aussi 𝑥 1, . . . , 𝑥𝑛
des symboles de variables deux à deux distincts et soit 𝑡 le terme obtenu
en substituant dans le terme 𝑓 𝑥 1 . . . 𝑥𝑛 le symbole de variable 𝑥𝑖 par le
terme 𝑡𝑖 . On a
𝑓 A (𝑎 1, . . . , 𝑎𝑛 ) = 𝑓 A (𝑡 1A (𝑎 1,1, . . . , 𝑎 1,𝑚1 ), . . . , 𝑡𝑛A (𝑎𝑛,1, . . . )) = 𝑡 A ((𝑎𝑖,𝑗 )),
ce qui prouve que 𝑓 A (𝑎 1, . . . , 𝑎𝑛 ) appartient à A′. Cela conclut la démons-
tration du lemme. □
104 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
5.4. Extension de langages
5.4.1. — Soit L = ((R𝑛 ), (F𝑛 )) et L′ = ((R𝑛′ ), (F𝑛′ )) des langages. On dit que
le langage L′ étend le langage L, ou que le langage L réduit le langage L′
si pour tout entier 𝑛, on a R𝑛 ⊆ R𝑛′ et F𝑛 ⊆ F𝑛′ .
Dans ce cas, toute réalisation A′ du langage L′ donne lieu à une réalisa-
tion A du langage L : on conserve l’univers en posant A = A′, et on choisit
pour interprétations 𝑓 A et 𝑟 A des symboles de fonctions 𝑓 ∈ F𝑛 et de re-
lations 𝑟 ∈ R𝑛 les interprétations de ces symboles dans la réalisation A′.
Exemple (5.4.2). — Soit L un langage, soit A une réalisation de L. Soit S
une partie de A. On définit un langage LS en ajoutant aux symboles de
constantes de L un symbole 𝑐𝑠 pour chaque élément 𝑠 ∈ S. Un terme ou
une formule du langage LS est aussi appelé un terme ou une formule du
langage L à paramètres dans S.
Le langage LS possède une réalisation naturelle dans l’univers A, où,
pour tout 𝑠 ∈ S, l’interprétation 𝑐𝑠A du symbole de constante 𝑐𝑠 est prise
égale à 𝑠.
Soit 𝑚(𝑥 1, . . . , 𝑥𝑛 ) ∈ FL une formule dans le langage L en des variables
libres 𝑥 1, . . . , 𝑥𝑛 . Supposons qu’il existe (𝑎 1, . . . , 𝑎𝑛 ) ∈ S𝑛 tel que A |=
𝑚(𝑎 1, . . . , 𝑎𝑛 ), c’est-à-dire 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ) = ⊤. Dans la formule 𝑚, sub-
stituons simultanément le symbole de variable libre 𝑥𝑖 par le symbole de
constante 𝑐 𝑎𝑖 , considéré comme un terme du langage LS ; la formule obte-
nue, naturellement notée 𝑚(𝑐 𝑎1 , . . . , 𝑐 𝑎𝑛 ), est une formule close de LS . Elle
est satisfaite dans la réalisation A.
Exemple (5.4.3). — Soit L un langage et soit A une réalisation de L. Soit
𝑥, 𝑦 deux symboles de variables (distincts) et soit 𝑚 une formule dont les
symboles de variables libres appartiennent à {𝑥, 𝑦}. Soit aussi L′ le langage
obtenu en adjoignant à L un (nouveau) symbole de fonction 1-aire que l’on
note 𝑓𝑚 .
Supposons que la formule close ∀𝑥∃𝑦𝑚(𝑥, 𝑦) soit satisfaite dans A. Cela
signifie que pour tout 𝑎 ∈ A, il existe un élément 𝑏 ∈ A tel que 𝑚 A (𝑎, 𝑏).
Pour tout 𝑎 ∈ A, choisissons un tel élément et notons-le 𝑓𝑚A (𝑎).
On a ainsi promu l’ensemble A de réalisation de L en une réalisation
de L′. Pour tout ensemble de symboles de variables W, les formules de L
ne changent pas d’interprétation en tant que formule de L′. De plus, le
5.5. THÉORIES, MODÈLES 105
mot ∀𝑥𝑚(𝑥, 𝑓𝑚 (𝑥)) est une formule close du langage L′ qui est satisfaite
dans A.
Inversement, soit A′ une réalisation de L′ dans laquelle la formule
∀𝑥𝑚(𝑥, 𝑓𝑚 (𝑥)) est satisfaite. En oubliant l’interprétation du symbole de
fonction 𝑓𝑚 , l’ensemble A est une réalisation de L dans laquelle la formule
close ∀𝑥∃𝑦𝑚(𝑥, 𝑦) est satisfaite.
Ce procédé est appelé skolemisation. Il se généralise évidemment d’une
formule à un ensemble arbitraire de formules.
5.5. Théories, modèles
5.5.1. — Soit L un langage. On appelle théorie un ensemble de formules
closes dans le langage L.
Soit T une théorie dans le langage L. On dit qu’une réalisation A du
langage L est un modèle de la théorie T si toute formule appartenant à T
est satisfaite dans A. On dit que la théorie T est consistante si elle possède
un modèle.
Exemple (5.5.2). — Soit L un langage et soit A une réalisation de L. La
théorie de A dans le langage L, notée ThL (A), est l’ensemble de toutes les
formules closes de L qui sont réalisées dans L. Une théorie de cette forme
est consistante ; on dit qu’elle est complète.
Si A est un modèle d’une théorie T, on a T ⊆ ThL (A). Toute théorie
consistante T est donc contenue dans une théorie complète.
Remarque (5.5.3). — Pour qu’une théorie consistante T soit complète, il
faut et il suffit qu’elle soit maximale.
Supposons d’abord que T est complète et soit A un modèle de T telle
que T = ThL (A). Soit 𝑚 une formule de L qui n’appartient pas à T, c’est-
à-dire 𝑚 A = ⊥ ; alors, (¬𝑚) A = ⊤, donc ¬𝑚 ∈ T. Si B est un modèle de T,
on a (¬𝑚) B = ⊤, donc 𝑚 B = ⊥, d’où 𝑚 ∉ ThL (B). Cela prouve que T ∪ {𝑚}
n’est pas consistant, si bien que T est une théorie maximale.
Soit T une théorie consistante maximale et soit A un modèle de T. On
a T ⊆ ThL (A). Puisque T est maximale, on a T = ThL (A) : la théorie T est
complète.
106 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
5.5.4. — Soit T une théorie dans le langage L. On dit qu’une formule
close 𝑚 est conséquence sémantique de T si 𝑚 satsisfaite dans tout mo-
dèle de T. On dit qu’une théorie T′ est conséquence sémantique de T si
tout modèle de T est modèle de T′.
On dit qu’une théorie est finiment axiomatisable si elle est conséquence
sémantique d’un ensemble fini de formules closes.
5.6. Extensions élémentaires, théorème de Löwenheim–Skolem
Définition (5.6.1). — Soit L un langage, soit A une réalisation de L et soit
B une sous-structure de A. On dit que B est une sous-structure élémentaire
de A, ou que A est une extension élémentaire de B, si pour tout entier 𝑛, toute
formule 𝑚(𝑥 1, . . . , 𝑥𝑛 ) dans le langage L et tout élément (𝑏 1, . . . , 𝑏𝑛 ) ∈ B𝑛 ,
on a 𝑚 A (𝑏 1, . . . , 𝑏𝑛 ) = 𝑚 B (𝑏 1, . . . , 𝑏𝑛 ).
On note B ≺ A.
Remarque (5.6.2). — En appliquant la définition à une formule close, on
observe que ThL (A) = ThL (B) si B est une sous-structure élémentaire
de A.
Plus généralement, soit LB le langage du premier ordre obtenu en ad-
joignant à L un symbole de constante 𝑐𝑏 pour chaque élément 𝑏 de B.
Considérons A comme une réalisation de LB , chaque symbole 𝑐𝑏 étant in-
terprété comme l’élément 𝑏 de B, de sorte que B est une sous-structure.
Les formules closes de LB sont de la forme 𝑚(𝑐𝑏 1 , . . . , 𝑐𝑏𝑛 ), où 𝑚(𝑥 1, . . . , 𝑥𝑛 )
est une formule de L en les variables libres 𝑥 1, . . . , 𝑥𝑛 .
Cela montre que A est extension élémentaire de B si et seulement si
ThLB (A) = ThLB (B).
Théorème (5.6.3) (Test de Tarski-Vaught). — Soit A une réalisa-
tion de L, soit B une partie de A. On suppose que pour tout entier 𝑛,
toute formule 𝑚(𝑥 1, . . . , 𝑥𝑛 , 𝑦) de L et tout élément (𝑎 1, . . . , 𝑎𝑛 ) ∈ B𝑛
tel que A |= ∃𝑦𝑚(𝑎 1, . . . , 𝑎𝑛 , 𝑦), il existe un élément 𝑏 ∈ B tel que
A |= 𝑚(𝑎 1, . . . , 𝑎𝑛 , 𝑏). Alors, B est une sous-structure élémentaire de A.
Le point important de l’énoncé est de ne faire intervenir la satisfaction
que dans la structure A.
5.6. EXTENSIONS ÉLÉMENTAIRES, THÉORÈME DE LÖWENHEIM–SKOLEM 107
Démonstration. — Démontrons que B est une sous-structure de A. Soit
𝑛 ∈ N et soit 𝑓 ∈ F𝑛 un symbole de fonction 𝑛-aire, soit (𝑏 1, . . . , 𝑏𝑛 ) ∈ B𝑛 .
En appliquant la définition à la formule ∃𝑦 (𝑦 = 𝑓 (𝑥 1, . . . , 𝑥𝑛 )), on constate
que 𝑓 A (𝑏 1, . . . , 𝑏𝑛 ) ∈ B. Cela prouve que B est une sous-structure de A.
Prouvons que c’est une sous-structure élémentaire. Il s’agit de démon-
trer que pour toute formule 𝑚(𝑥 1, . . . , 𝑥𝑛 ) et tout élément (𝑎 1, . . . , 𝑎𝑛 ) ∈
B𝑛 , alors A |= 𝑚(𝑎 1, . . . , 𝑎𝑛 ) si et seulement si B |= 𝑚(𝑎 1, . . . , 𝑎𝑛 ).
Si un symbole de variable 𝑥𝑖 n’a pas d’occurrence libre dans 𝑚, les fonc-
tions 𝑚 A : A𝑛 → {⊤, ⊥} et 𝑚 B : B𝑛 → {⊤, ⊥} ne dépendent pas de la co-
ordonnée 𝑎𝑖 ; en raisonnant par récurrence sur 𝑛, on suppose que tous les
symboles de variables 𝑥 1, . . . , 𝑥𝑛 ont une occurrence libre dans 𝑚.
On raisonne alors par récurrence sur la définition d’une formule :
a) Si 𝑚 est une formule atomique, cela résulte de la définition d’une
sous-structure ;
b) Supposons qu’il existe une formule 𝑚′ telle que 𝑚 = ¬𝑚′. Par récur-
rence, on a (𝑚′) B (𝑎 1, . . . , 𝑎𝑛 ) = (𝑚′) A (𝑎 1, . . . , 𝑎𝑛 ) ; par suite,
𝑚 B (𝑎 1, . . . , 𝑎𝑛 ) = ¬(𝑚′) B (𝑎 1, . . . , 𝑎𝑛 ) = ¬(𝑚′) A (𝑎 1, . . . , 𝑎𝑛 ) = 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ).
c) Supposons qu’il existe des formules 𝑚′ et 𝑚′′ et un élément
• ∈ {∨, ∧, ⇒, ⇔} tels que 𝑚 = (𝑚′ • 𝑚′′). Par récurrence, on a
(𝑚′) B (𝑎 1, . . . , 𝑎𝑛 ) = (𝑚′) A (𝑎 1, . . . , 𝑎𝑛 ) et (𝑚′′) B (𝑎 1, . . . , 𝑎𝑛 ) = (𝑚′′) A (𝑎 1, . . . , 𝑎𝑛 ) ;
par suite,
𝑚 B (𝑎 1, . . . , 𝑎𝑛 ) = ((𝑚′) B (𝑎 1, . . . , 𝑎𝑛 ) • (𝑚′′) B (𝑎 1, . . . , 𝑎𝑛 ))
= ((𝑚′) A (𝑎 1, . . . , 𝑎𝑛 ) • (𝑚′′) A (𝑎 1, . . . , 𝑎𝑛 ))
= 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ).
d) Supposons qu’il existe une formule 𝑚′ et un symbole de variable 𝑦
tel que 𝑚 = ∃𝑦𝑚′. Par définition d’une occurrence libre, 𝑦 n’est pas une
variable libre de 𝑚, si bien que 𝑦 ∉ {𝑥 1, . . . , 𝑥𝑛 }, de sorte que 𝑚′ est une
formule en les variables libres 𝑥 1, . . . , 𝑥𝑛 , 𝑦.
Supposons 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ) = ⊤. Par définition, il existe 𝑏 ∈ A tel
que (𝑚′) A (𝑎 1, . . . , 𝑎𝑛 , 𝑏). Par hypothèse, il existe alors un tel élément 𝑏
qui appartient à B. Par récurrence, on a alors (𝑚′) B (𝑎 1, . . . , 𝑎𝑛 , 𝑏) =
(𝑚′) A (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = ⊤. Il en résulte que 𝑚 B (𝑎 1, . . . , 𝑎𝑛 ) = ⊤.
108 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
Supposons inversement que 𝑚 B (𝑎 1, . . . , 𝑎𝑛 ) = ⊤. Il existe donc
𝑏 ∈ B tel que (𝑚′) B (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = ⊤. Par récurrence, on a donc
(𝑚′) A (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = ⊤, ce qui entraîne que 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ) = ⊤.
e) Supposons enfin qu’il existe une formule 𝑚′ et un symbole de va-
riable 𝑦 tel que 𝑚 = ∀𝑦𝑚′. Par définition d’une occurrence libre, 𝑦 n’est
pas une variable libre de 𝑚, si bien que 𝑦 ∉ {𝑥 1, . . . , 𝑥𝑛 }, de sorte que 𝑚′
est une formule en les variables libres 𝑥 1, . . . , 𝑥𝑛 , 𝑦.
Supposons 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ) = ⊤. Par définition, pour tout 𝑏 ∈ A,
on a (𝑚′) A (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = ⊤. Pour tout 𝑏 ∈ B, on a on a alors
(𝑚′) B (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = (𝑚′) A (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = ⊤, par récurrence. Il en
résulte que 𝑚 B (𝑎 1, . . . , 𝑎𝑛 ) = ⊤.
Supposons que 𝑚 A (𝑎 1, . . . , 𝑎𝑛 ) = ⊥. Par définition, il existe 𝑏 ∈ A tel que
(𝑚′) A (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = ⊤. L’hypothèse du théorème, appliquée à la formule
¬𝑚′ entraîne qu’il existe un élément 𝑏 ∈ B tel que (𝑚′) A (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = ⊥.
Par récurrence, on a alors (𝑚′) B (𝑎 1, . . . , 𝑎𝑛 , 𝑏) = ⊥, ce qui entraîne que
𝑚 B (𝑎 1, . . . , 𝑎𝑛 ) = ⊥.
□
5.6.4. — Soit T une théorie (consistante) dans un langage L, soit A un
modèle de T et soit S une partie de A.
Nous allons construire par récurrence une suite croissante Ð (B𝑝 ) de sous-
structures de A contenant S dont la réunion B = 𝑝 B𝑝 sera un modèle
de T.
On définit B0 comme la sous-structure de A engendrée par S. Suppo-
sons B𝑝 définie.
Pour tout entier 𝑛, toute formule 𝑚(𝑥 1, . . . , 𝑥𝑛 , 𝑦) et tout élément
(𝑎 1, . . . , 𝑎𝑛 ) ∈ (B𝑝 )𝑛 tel que ∃𝑦𝑚 A (𝑎 1, . . . , 𝑎𝑛 , 𝑦), choisissons un élé-
ment 𝑏 ∈ A tel que 𝑚 A (𝑎 1, . . . , 𝑎𝑛 , 𝑏). Soit B𝑝+1 la sous-structure de A
engendrée par Ð B𝑝 et tous ces éléments 𝑏.
Soit B = 𝑝∈N B𝑝 . C’est une sous-structure de A. Soit en effet 𝑛 ∈ N,
𝑓 ∈ F𝑛 et (𝑎 1, . . . , 𝑎𝑛 ) ∈ B𝑛 ; soit 𝑝 ∈ N tel que 𝑎 1, . . . , 𝑎𝑛 appartiennent
à B𝑝 ; par définition d’une sous-structure, alors 𝑓 A (𝑎 1, . . . , 𝑎𝑛 ) ∈ B𝑝 , si
bien que 𝑓 A (𝑎 1, . . . , 𝑎𝑛 ) ∈ B.
Démontrons alors que B est un modèle de T en appliquant le test
de Tarski–Vaught (théorème 5.6.3). Soit 𝑚 une formule en les variables
libres 𝑥 1, . . . , 𝑥𝑛 , 𝑦 et soit (𝑎 1, . . . , 𝑎𝑛 ) ∈ B𝑛 ; supposons qu’il existe 𝑎 ∈ A tel
5.7. FILTRES ET ULTRAFILTRES 109
que A |= 𝑚(𝑎 1, . . . , 𝑎𝑛 , 𝑎). Soit 𝑝 ∈ N tel que 𝑎 1, . . . , 𝑎𝑛 ∈ B𝑝 . Par construc-
tion de B𝑝+1 , il existe donc un élément 𝑏 ∈ B𝑝+1 tel que 𝑚(𝑎 1, . . . , 𝑎𝑛 , 𝑏) ;
en particulier, 𝑏 ∈ B. Cela prouve que B est un modèle de T.
Proposition (5.6.5). — Si Card(S) ⩾ Card(L), alors Card(B) = Card(S).
Démonstration. — Posons 𝛼 = Card(S) ; par hypothèse, 𝛼 est un cardinal
infini. On peut supposer que l’ensemble V des symboles de variables est
égal à {𝑦, 𝑥 1, 𝑥 2, . . . , }, en particulier, dénombrable.
L’ensemble des termes de L est alors de cardinal Card(L) ; pour tout
entier 𝑛, on a Card(S𝑛 ) = Card(S) = 𝛼 ; le cardinal de la sous-structure B0
engendrée par S est alors égal à 𝛼.
Supposons par récurrence que Card(B𝑝 ) = 𝛼. L’ensemble des formules
en les variables libres 𝑥 1, . . . , 𝑥𝑛 , 𝑦 est de cardinal Card(L), et Card(B𝑛𝑝 ) =
𝛼. Par construction, B𝑝+1 est la sous-structure engendrée par B𝑝 et un en-
semble d’éléments 𝑏 en cardinal au plus ℵ0𝛼 = 𝛼. On a donc Card(B𝑝+1 ) =
𝛼.
Par récurrence, Card(B𝑝 ) = 𝛼 pour tout entier 𝑝 ; par suite, Card(B) =
𝛼. □
Théorème (5.6.6) (Löwenheim–Skolem). — Soit A une réalisation de L
telle que Card(A) ⩾ Card(L). Pour toute partie S de A, il existe une sous-
structure élémentaire B de A telle que Card(B) = sup(Card(L), Card(S)).
En particulier, si une théorie possède un modèle de cardinal 𝛼 ⩾
Card(L), elle possède un modèle de tout cardinal 𝛽 tel que Card(L) ⩽
𝛽 ⩽ 𝛼.
Démonstration. — Quitte à agrandir l’ensemble S, on suppose que
Card(S) ⩾ Card(L). D’après la proposition précédente, la sous-
structure B construite est de cardinal Card(S). □
5.7. Filtres et ultrafiltres
Définition (5.7.1). — Soit X un ensemble et soit F un ensemble de parties
de X. On dit que F est un filtre si les propriétés suivantes sont satisfaites :
(i) L’ensemble X appartient à F ;
(ii) Si A et B sont des parties de X appartenant à F , alors A ∩ B appartient
àF;
110 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
(iii) Si A est une partie de X appartenant à F , alors toute partie de X
contenant A appartient à F .
L’ensemble =𝔓(𝔓(X)) de toutes les parties de X est un filtre, que l’on
appelle le filtre trivial. Pour qu’un filtre soit non trivial, il faut et il suffit
qu’il ne contienne pas la partie vide.
On dit qu’un filtre F est un ultrafiltre s’il est non trivial et si tout filtre
non trivial F ′ contenant F est égal à F . Autrement dit, un ultrafiltre est
un élément maximal de l’ensemble des filtres non triviaux.
Exemple (5.7.2). — Soit X un ensemble. L’ensemble F des parties A de X
telles que X A est fini est un filtre sur X ; on l’appelle le filtre de Fréchet.
Il est non trivial si et seulement si l’ensemble X est infini.
Exemple (5.7.3). — Soit X un ensemble et soit A une partie de X. L’en-
semble PA des parties de X qui contiennent A est un filtre sur X — on
l’appelle le filtre principal associé à A.
Il est trivial si et seulement si l’ensemble A est vide.
C’est un ultrafiltre si et seulement si l’ensemble A est réduit à un élé-
ment.
Exemple (5.7.4). — La topologie générale fournit de nombreux exemples
de filtres.
a) Soit X un espace topologique et soit A une partie non vide de X.
L’ensemble des voisinages de A est un filtre non trivial sur X.
b) Supposons X = R et soit 𝑎 ∈ X. Une partie de R est un « voisinage
à droite » de 𝑎 si elle contient un intervalle de la forme ]𝑎, 𝑏 [, où 𝑏 > 𝑎.
L’ensemble des voisinages à droite de 𝑎 est un filtre non trivial sur X
c) Supposons encore X = R et prenons 𝑎 = +∞. Une partie de R est
un « voisinage de +∞ » si elle contient un intervalle de la forme ]𝑎, +∞[.
L’ensemble des voisinages de +∞ est un filtre non trivial sur X.
Exemple (5.7.5). — Soit X un ensemble ordonné. On suppose que X est
filtrant, c’est-à-dire que toute partie finie de X est majorée ; autrement
dit, X n’est pas vide et pour tout couple (𝑥, 𝑦) d’éléments de X, il existe
𝑧 ∈ X tel que 𝑥 ⪯ 𝑧 et 𝑦 ⪯ 𝑧. Pour tout 𝑥 ∈ X, on note A𝑥 l’ensemble des
𝑦 ∈ X tels que 𝑥 ⪯ 𝑦. Soit F l’ensemble des parties A de X contenant un
ensemble de la forme A𝑥 .
5.7. FILTRES ET ULTRAFILTRES 111
Comme 𝑥 ∈ A𝑥 , aucun élément de F n’est vide. Soit 𝑥 ∈ X ; alors X
contient A𝑥 , donc X ∈ F . Soit A et B deux éléments de F ; soit 𝑥, 𝑦 ∈ X
tels que A ⊃ A𝑥 et B ⊃ A𝑦 ; soit 𝑧 ∈ X un majorant de 𝑥 et 𝑦 ; alors,
A𝑧 ⊆ A𝑥 ∩ A𝑦 ⊆ A ∩ B, donc A ∩ B appartient à F . Enfin, toute partie
contenant une partie de F appartient à F , par construction. Cela prouve
que F est un filtre sur X.
Lorsque X = R, on retrouve le filtre des voisinages de +∞.
Nous utiliserons cette construction lorsque X est l’ensemble des parties
finies d’un ensemble T, muni de la relation d’inclusion. Il est bien filtrant
puique si 𝑥 et 𝑦 sont deux parties finies de T, 𝑥 ∪𝑦 est une partie finie de T
contenant à la fois 𝑥 et 𝑦.
Théorème (5.7.6). — Soit X un ensemble. Tout filtre non trivial sur X est
contenu dans un ultrafiltre.
Démonstration. — L’assertion est vide si X est vide ; on suppose donc que
X n’est pas vide. Munissons l’ensemble des filtres non triviaux sur X de
la relation d’ordre définie par l’inclusion et démontrons que cet ensemble
ordonné est inductif. Soit Φ une partie totalement ordonnée de l’ensemble
des filtres non triviaux sur X ; soit F la réunion du filtre principal PX et
des éléments de Φ. Démontrons que F est un filtre non trivial sur X.
L’ensemble vide n’appartenant à aucun filtre non trivial, et X n’est pas
vide, donc l’ensemble vide n’appartient pas à F .
L’ensemble X appartient à F par construction.
Soit A et B des éléments de F ; soit F ′ et F ′′ des filtres appartenant à Φ
tels que A ∈ F ′ et B ∈ F ′′. Puisque Φ est totalement ordonné, on a F ′ ⊆
F ′′, ou F ′′ ⊆ F ′. Supposons, pour fixer les idées, que F ′ ⊆ F ′′ ; alors,
A, B ∈ F ′′, donc A ∩ B ∈ F ′′ puisque F ′′ est un filtre ; ainsi, A ∩ B ∈ F .
Soit A un élément de F et soit B une partie de X qui contient A ; soit
F un filtre appartenant à Φ tel que A ∈ F ′ ; alors B ∈ F ′, car F ′ est un
′
filtre, donc B ∈ F .
D’après le théorème de Zorn, tout filtre non trivial est contenu dans un
élément maximal de l’ensemble des filtres non triviaux, c’est-à-dire dans
un ultrafiltre. □
Proposition (5.7.7). — Soit X un ensemble et soit F un filtre non trivial
sur X. Les propriétés suivantes sont équivalentes :
112 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
(i) Le filtre F est un ultrafiltre ;
(ii) Si A et B sont des parties de X telles que A ∪ B ∈ F , alors A ∈ F ou
B∈F;
(iii) Si A est une partie de X, alors A ∈ F ou X A ∈ F .
Dans l’assertion (iii), on remarque que les conditions A ∈ F et X A ∈
F s’excluent, car A ∩ (X A) = ∅ et la partie vide n’appartient pas à F .
Démonstration. — (i)→(ii). Supposons que F est un ultrafiltre sur X. Soit
A et B des parties de X telles que A∪B ∈ F ; supposons que B n’appartient
pas à F .
Soit alors F ′ l’ensemble des parties de X qui contiennent une partie
de X de la forme A ∩ F, où F ∈ F . Démontrons que c’est un filtre non
trivial.
Comme X ∈ F et X contient A ∩ X, on a X ∈ F ′.
Soit V, V′ des parties de X appartenant à F ′. Il existe donc des ensembles
F, F′ ∈ F tels que V = A ∩ F et V′ = A ∩ F′ ; alors, F ∩ F′ ∈ F et V ∩ V′ =
A ∩ (F ∩ F′) ∈ F ′.
Enfin, soit V une partie de X appartenant à F ′ et soit V′ une partie de X
contenant V ; soit F une partie appartenant à F tel que V = A ∩ F ; on a
alors F ∪ V′ ∈ F et V′ = A ∩ (F ∪ B′), donc V′ ∈ F ′.
Cela démontre que F ′ est un filtre sur X. On a ∅ ∉ F ′ ; en effet, dans le
cas contraire, il existerait une partie F ∈ F telle que A ∩ F = ∅. Comme
A ∪ B ∈ F , on a alors (A ∪ B) ∩ F ∈ F , c’est-à-dire B ∩ F ∈ F ; comme
B ∩ F ⊆ B, on en déduit que B ∈ F , ce qui contredit l’hypothèse faite.
Ainsi, le filtre F ′ n’est pas trivial.
Par construction, F ′ contient F . Puisque F est un ultrafiltre, on a F ′ =
F . Comme A ∈ F ′, on a A ∈ F , ce qu’il fallait démontrer.
(ii)⇒(iii). Soit A une partie de X. Comme A ∪ (X A) = X ∈ F , l’as-
sertion (ii) appliquée aux parties A et X A entraîne l’assertion voulue.
(iii)⇒(i). Supposons maintenant que pour toute partie A de X, le filtre F
contient A ou X A. Soit F ′ un filtre non trivial contenant F . Soit A une
partie de X appartenant à F ′. Si A n’appartient pas à F , alors X A ∈ F ,
donc X A ∈ F ′ ; alors, ∅ = A ∩ (X A) ∈ F ′, contradiction. Cela
prouve que A ∈ F , d’où F = F ′. Ainsi, F est un ultrafiltre. Ceci conclut
la démonstration de la proposition. □
5.8. ULTRAPRODUITS, THÉORÈME DE ŁOS 113
Remarque (5.7.8). — Le langage des filtres est très utile en topologie gé-
nérale. Soit X un espace topologique. On dit qu’un filtre F sur X converge
vers un point 𝑥 ∈ X, ou que 𝑥 est point limite de F , si F contient le filtre
des voisinages de 𝑥.
Supposons X séparé. Alors, deux points distincts possèdent des voi-
sinages disjoints, si bien qu’un filtre ne peut avoir qu’au plus un point
limite.
Supposons que X est compact et démontrons que tout ultrafiltre sur X
converge. Raisonnons par l’absurde et considérons un ultrafiltre F qui
n’a pas de point limite. Soit 𝑥 ∈ X ; puisque 𝑥 n’est pas point limite de F ,
il existe un voisinage ouvert V𝑥 de 𝑥 qui n’appartient pas à F ; son com-
plémentaire appartient donc à F , car F est un ultrafiltre.ÐPuisque X est
compact,
Ñ il existe une partie finie S de X telle que X = 𝑥 ∈S V𝑥 ; alors,
∅ = 𝑥 ∈S (X V𝑥 ), ce qui contredit la définition d’un filtre.
Inversement, supposons que tout ultrafiltre sur X converge et démon-
trons que X est compact. Considérons une famille (F𝑖 ) de parties fermées
de X dont aucune intersection finie n’est vide ; démontrons que l’intersec-
tion des F𝑖 n’est pas vide. L’ensemble F des parties de X qui contiennent
une intersection finie F𝑖 1 ∩ · · · ∩ F𝑖𝑛 est un filtre sur X. En effet, on a ∅ ∉ F ,
X ∈ F ; si A et B sont deuxÑ ensembles Ñ de F , contenant respectivement
des intersections
Ñ finies 𝑖∈J F𝑖 et 𝑖∈K F𝑖 , alors A ∩ B contient l’intersec-
tion finie 𝑖∈J∪K F𝑖 , donc appartient à F ; enfin, toute partie contenant un
élément de F appartient à F , par construction de F .
Soit U un ultrafiltre contenant F et soit 𝑥 un point limite de U. Soit
𝑖 ∈ I. Soit V un voisinage ouvert de 𝑥 ; l’ensemble V appartient à U, de
même que F𝑖 , puisque F𝑖 ∈ F , de sorte que V ∩ F𝑖 appartient à U ; en
particulier, V ∩ F𝑖 n’est pas vide. Cela prouve que 𝑥 est adhérent à F𝑖 , donc
𝑥 ∈ F𝑖 puisque F𝑖 est fermé. Par suite, 𝑥 appartient à tous les V𝑖 , ce qui
prouve que l’intersection des F𝑖 n’est pas vide.
5.8. Ultraproduits, théorème de Łos
5.8.1. — Soit I un ensemble et soit (A𝑖 )𝑖∈I une famille d’ensembles in-
dexée par I. Soit F un ultrafiltre sur I ; nous allons définir l’ultraproduit
ÎF
𝑖∈I A𝑖 des ensembles A𝑖 le long de F . ÎF
Soit J l’ensemble des 𝑖 ∈ I tels que A𝑖 ≠ ∅. Si J ∉ F , on pose 𝑖∈I A𝑖 = ∅.
114 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
Î
Supposons maintenant que J ∈ F . Soit A = 𝑖∈J A𝑖 . Soit ∼ la relation
dans A définie par (𝑎𝑖 )𝑖∈J ∼ (𝑎𝑖′)𝑖∈J si l’ensemble des 𝑖 ∈ J tels que 𝑎𝑖 = 𝑎𝑖′
appartient à F . Démontrons que c’est une relation d’équivalence. Pour
tout (𝑎𝑖 )𝑖∈J ∈ A, on a (𝑎𝑖 ) ∼ (𝑎𝑖 ) car l’ensemble J appartient à F ; cela
démontre que la relation est réflexive. Elle est évidemment symétrique.
Démontrons enfin qu’elle est transitive ; soit (𝑎𝑖 ), (𝑎𝑖′) et (𝑎𝑖′′) des éléments
de A tels que (𝑎𝑖 ) ∼ (𝑎𝑖′) et (𝑎𝑖′) ∼ (𝑎𝑖′′). Soit J′ l’ensemble des 𝑖 ∈ J tels que
𝑎𝑖 = 𝑎𝑖′ ; soit J′′ l’ensemble des 𝑖 ∈ J tels que 𝑎𝑖′ = 𝑎𝑖′′ ; pour tout 𝑖 ∈ J′ ∩J′′, on
a 𝑎𝑖 = 𝑎𝑖′ = 𝑎𝑖′′ ; de plus, J′, J′′ ∈ F , donc J′ ∩ J′′ ∈ F ; par suite, (𝑎𝑖 ) ∼ (𝑎𝑖′′).
ÎF
On définit alors 𝑖∈I A𝑖 comme l’ensemble quotient A/∼. On dit que
c’est l’ultraproduit de la famille (A𝑖 )𝑖∈I le long de F .
ÎF
5.8.2. — Observons que 𝑖∈I A𝑖 est vide si et seulement si l’ensemble I
J des 𝑖 ∈ I tels que A𝑖 = ∅ appartient à l’ultrafiltre F . Dans un sens,
c’est la définition de l’ultraproduit, car il revient au même de dire que
I J ∉ F que de dire Î que J ∈ F , puisque F est un ultrafiltre. Dans l’autre
sens, l’ensemble 𝑗 ∈J A 𝑗 n’est pas vide (c’est l’axiome du choix !), donc
l’ensemble quotient par la relation d’équivalence ∼ n’est pas vide.
5.8.3. — Soit I un ensemble et soit F un ultrafiltre sur I. Soit (A𝑖 )𝑖∈I, (B𝑖 )𝑖∈I
des familles d’ensembles indexées par I ; soit AF , BF leurs ultraproduits
le long de l’ultrafiltre F . Pour tout 𝑖, posons C𝑖 = A𝑖 × B𝑖 . Nous allons
identifier l’ultraproduit CF de la famille (C𝑖 ) avec le produit AF × BF .
Soit
ÎJ, resp. K l’ensemble
Î des 𝑖 ∈ I tels que A𝑖 ≠ ∅, resp. B 𝑗 ≠ ∅. Posons
A = 𝑖∈J A𝑖 et B = 𝑖∈K B𝑖 .
Supposons AF = ∅, de sorte que J ∉ F . Alors C𝑖 = A𝑖 × B𝑖 = ∅ pour
tout 𝑖 ∉ J, donc CF = ∅.
On prouve de même que CF = ∅ si AF = ∅.
Supposons maintenant que AF et BF ne sont pas vides, de sorte que J
et L appartiennent à F . Soit L l’ensemble
Î des 𝑖 ∈ I tels que C𝑖 ≠ ∅ ; on a
L = J ∩ K, donc L ∈ F . Soit C = 𝑖∈L P𝑖 et soit 𝑓 : A × B → C l’application
donnée par
𝑓 ((𝑎𝑖 )𝑖∈J, (𝑏𝑖 )𝑖∈K ) = ((𝑎𝑖 , 𝑏𝑖 ))𝑖∈L .
Soit (𝑎𝑖 , 𝑏𝑖 )𝑖∈L un élément de C. Pour tout 𝑖 ∈ J L, choisissons un
élément 𝑎𝑖 arbitraire de A𝑖 ; pour tout 𝑖 ∈ K L, choisissons un élément 𝑏𝑖
arbitraire de B𝑖 . Alors, 𝑓 ((𝑎𝑖 )𝑖∈J, (𝑏𝑖 )𝑖∈K ) = (𝑎𝑖 , 𝑏𝑖 )𝑖∈L . Cela démontre que
l’application 𝑓 est surjective.
5.8. ULTRAPRODUITS, THÉORÈME DE ŁOS 115
Soit (𝑎𝑖 ), (𝑎𝑖′) ∈ A, (𝑏𝑖 ), (𝑏𝑖′) ∈ B tels que (𝑎𝑖 ) ∼ (𝑎𝑖′) et (𝑏𝑖 ) ∼ (𝑏𝑖′). Soit
J′ l’ensemble des 𝑖 ∈ J tels que 𝑎𝑖 = 𝑎𝑖′, soit K′ l’ensemble des 𝑖 ∈ K tels
que 𝑏𝑖 = 𝑏𝑖′ ; ce sont des éléments de F par hypothèse. Comme l’ensemble
des 𝑖 ∈ L tels que (𝑎𝑖 , 𝑏𝑖 ) = (𝑎𝑖′, 𝑏𝑖′) contient J′ ∩ K′, on a (𝑎𝑖 , 𝑏𝑖 )𝑖∈L ∼
(𝑎𝑖′, 𝑏𝑖′)𝑖∈L . Cela démontre que l’application 𝑓 est compatible aux relations
d’équivalence définies par l’ultrafiltre F dans les ensembles A, B, C. Elle
induit donc, par passage aux quotients, une application 𝜑 de AF × AF sur
CF .
Comme l’application 𝑓 est surjective, il en est de même de l’applica-
tion 𝜑.
Soit (𝑎𝑖 ), (𝑎𝑖′) ∈ A, (𝑏𝑖 ), (𝑏𝑖′) ∈ B tels que 𝑓 ((𝑎𝑖 ), (𝑏𝑖 )) ∼ 𝑓 ((𝑎𝑖′), (𝑏𝑖′)).
Soit J′ l’ensemble des 𝑖 ∈ J tels que 𝑎𝑖 = 𝑎𝑖′, soit K′ l’ensemble des 𝑖 ∈ K tels
que 𝑏𝑖 = 𝑏𝑖′. Alors, J′ ∩ K′ est l’ensemble des 𝑖 ∈ L tels que (𝑎𝑖 , 𝑏𝑖 ) = (𝑎𝑖′, 𝑏𝑖′),
donc J′ ∩K′ appartient à F . Par suite, J′ ∈ F et K′ ∈ F , ce qui entraîne que
(𝑎𝑖 ) ∼ (𝑎𝑖′) et (𝑏𝑖 ) ∼ (𝑏𝑖′). Cela prouve que l’application 𝜑 est injective.
5.8.4. — Soit I un ensemble et soit F un ultrafiltre sur I. Soit (A𝑖 )𝑖∈I, (B𝑖 )𝑖∈I
des familles d’ensembles indexées par I ; soit AF , BF leurs ultraproduits
le long de l’ultrafiltre F . Pour tout 𝑖 ∈ I, soit 𝑓𝑖 une application de A𝑖
dans B𝑖 .
On déduit de la famille (𝑓𝑖 ) une application 𝑓 F de AF dans BF . Elle
associe à la classe d’une famille (𝑎𝑖 ) la classe de la famille (𝑓𝑖 (𝑎𝑖 )).
5.8.5. — Soit L un langage, soit (A𝑖 )𝑖∈I une famille de réalisations de L
indexée par un ensemble I et soit F un ultrafiltre sur I. Soit AF l’ultrapro-
duit de la famille (A𝑖 )𝑖∈I le long de l’ultrafiltre F .
Soit 𝑛 un entier et soit 𝑓 ∈ F𝑛 un symbole de fonction 𝑛-aire. Par un
raisonnement similaire à celui du paragraphe précédent, on déduit de la
F
famille (𝑓 A𝑖 ) une fonction 𝑓 A . de (AF )𝑛 dans AF .
Soit 𝑛 un entier et soit 𝑟 ∈ R𝑛 un symbole de relation 𝑛-aire. On déduit
F
de la famille (𝑟 A𝑖 ) uneÎrelation 𝑛-aire 𝑟 A dans l’ensemble AF : la classe
d’une famille (𝑎𝑖 )𝑖∈J ∈ 𝑖∈J A𝑛𝑖 appartient au graphe de cette relation si et
seulement si l’ensemble des 𝑖 ∈ J tels que 𝑟𝑖 (𝑎𝑖 ) = ⊤ appartient à F .
Ainsi, l’ultraproduit AF est naturellement muni d’une structure de réa-
lisation du langage L.
116 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
Proposition (5.8.6). — a) Soit 𝑡 ∈ TL un terme et soit V un ensemble de
symboles de variables contenant ceux qui apparaissent dans 𝑡. L’interpré-
F
tation 𝑡 A de 𝑡 dans la structure AF est l’application de (AF ) V dans AF
déduite des applications 𝑡 A𝑖 : A𝑖V → A𝑖 .
b) Soit 𝑚 ∈ FL une formule et soit V un ensemble des symboles de va-
F
riables contenant l’ensemble des variables libres de 𝑚. L’interprétation 𝑚 A
de 𝑚 dans la structure AF est l’application de (AF ) V dans {⊥, ⊤} déduite
des applications 𝑚 A𝑖 : A𝑖V → {⊥, ⊤}.
Démonstration. — a) Démontrons l’assertion par récurrence sur la
construction du terme 𝑡. L’assertion est évidente si 𝑡 est un symbole de
variable 𝑥𝑣 , l’application 𝑡 A𝑖 étant alors la projection d’indice 𝑣. Sup-
posons alors que 𝑡 = 𝑓 𝑡 1 . . . 𝑡𝑛 , où 𝑓 est un symbole de fonction 𝑛-aire
et 𝑡 1, . . . , 𝑡𝑛 des termes pour lesquels la proposition est vérifiée. Soit
𝛼 = (𝛼𝑣 )𝑣 ∈V ∈ (AF ) V , classes de familles (𝑎𝑣,𝑖 )𝑖∈J , où J = {𝑖 ∈ I ; A𝑖 ≠ ∅}.
Par définition de l’évaluation des termes, on a
F F F F
𝑡 A (𝛼) = 𝑓 A (𝑡 1A (𝛼), . . . , 𝑡𝑛A (𝛼)).
F
Par récurrence, pour tout 𝑘 ∈ {1, . . . , 𝑛}, l’élément 𝑡𝑘A est la classe de
F F
la famille (𝑡𝑘A𝑖 ((𝑎𝑣,𝑖 )𝑣 ))𝑖∈J . Par définition de l’application 𝑓 A , 𝑡 A (𝛼) est
donc la classe de la famille (𝑓 A𝑖 (𝑡𝑘A𝑖 ((𝑎𝑣,𝑖 )𝑣 )))𝑖∈J . Comme 𝑓 A𝑖 (𝑡𝑘A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) =
𝑡 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) pour tout 𝑖, l’assertion voulue est démontrée.
b) Démontrons l’assertion par récurrence sur la construction de la for-
mule 𝑚. Comme toute formule est sémantiquement équivalente à une for-
mule qui ne fait intervenir que les symboles logiques ⊤, ⊥, ∨, ¬ et le quan-
tificateur ∃, on peut supposer que 𝑚 ne fait pas intervenir les symboles
logiques ∧, ⇒ et ⇔, ni le quantificateur ∀.
L’assertion est évidente si 𝑚 = ⊥ ou 𝑚 = ⊤ : comme I ∈ F , l’évaluation
A F
𝑚 vaut respectivement ⊥ et ⊤.
Supposons maintenant que 𝑚 est une formule atomique, de la forme
𝑟𝑡 1 . . . 𝑡𝑛 où 𝑟 est un symbole de relation 𝑛-aire et 𝑡 1, . . . , 𝑡𝑛 sont des
termes. Par définition de l’ensemble des variables libres d’une formule,
les symboles de variables qui apparaissent dans les 𝑡𝑖 sont contenus
dans V. Soit 𝛼 = (𝛼𝑣 )𝑣 ∈V ∈ (AF ) V ; pour tout 𝑣, soit (𝑎𝑣,𝑖 )𝑖∈J une
F
famille d’éléments de 𝑖∈J A𝑖 de classe 𝛼𝑣 . Par définition de 𝑚 A ,
Î
F F F F
on a 𝑚 A (𝛼) = 𝑟 A (𝑡 1A (𝛼), . . . , 𝑡𝑛A (𝛼)). Pour tout 𝑘 ∈ {1, . . . , 𝑚},
5.8. ULTRAPRODUITS, THÉORÈME DE ŁOS 117
F
posons 𝛽𝑘 = 𝑡𝑘A (𝛼) ; pour tout 𝑘 ∈ {1, . . . , 𝑚} et tout 𝑖 ∈ J, po-
sons 𝑏𝑘,𝑖 = 𝑡𝑘A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) ; d’après l’assertion a), l’élément 𝛽𝑘 est la
F
classe de la famille (𝑏𝑘,𝑖 )𝑖∈J . Par définition de l’application 𝑟 A , on a
F
𝑟 A (𝛽 1, . . . , 𝛽𝑛 ) = ⊤ si et seulement si l’ensemble des 𝑖 ∈ J tels que
𝑟 A𝑖 (𝑏 1,𝑖 , . . . , 𝑏𝑛,𝑖 ) appartient à F . Par définition de l’évaluation 𝑚 A𝑖 , on a
F
𝑟 A𝑖 (𝑏 1,𝑖 , . . . , 𝑏𝑛,𝑖 ) = 𝑚 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) pour tout 𝑖 ∈ J, de sorte que 𝑚 A (𝛼) = ⊤
si et seulement si l’ensemble des 𝑖 ∈ J tels que 𝑚 A𝑖 (𝑎𝑖 ) appartient à U.
Cela démontre l’assertion voulue dans ce cas.
Supposons maintenant que la formule 𝑚 est de la forme ¬𝑝, où 𝑝 vérifie
la proposition ; l’ensemble des variables libres de 𝑚 est égal à celui de 𝑝.
Soit 𝛼 = (𝛼𝑣 )𝑣 ∈V ∈ (AF ) V ; pour tout 𝑣, soit (𝑎𝑣,𝑖 )𝑖∈J une famille d’éléments
F F
de 𝑖∈J A𝑖 de classe 𝛼𝑣 . Par définition de l’application 𝑚 A , on a 𝑚 A = ⊤
Î
F
si et seulement si 𝑝 A = ⊥, c’est-à-dire, vu l’hypothèse de récurrence,
l’ensemble des 𝑖 ∈ J tels que 𝑝 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤ n’appartient pas à F . Comme
J ∈ F et F est un ultrafiltre, cela revient à dire que l’ensemble des 𝑖 ∈ J
tels que 𝑝 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊥ appartient à F (proposition 5.7.7), soit encore à
dire que l’ensemble des 𝑖 ∈ J tels que 𝑚 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤ appartient à F .
Cela prouve la propriété dans ce cas.
Supposons que 𝑚 est de la forme 𝑝 ∨ 𝑞, où 𝑝 et 𝑞 sont des formules qui
vérifient l’assertion. L’ensemble des variables libres de 𝑚 est la réunion
de l’ensemble des variables libres de 𝑝 et de 𝑞. Soit 𝛼Î = (𝛼𝑣 )𝑣 ∈V ∈ (AF ) V ;
pour tout 𝑣, soit (𝑎𝑣,𝑖 )𝑖∈J une famille d’éléments de 𝑖∈J A𝑖 de classe 𝛼𝑣 .
F F F
Alors 𝑚 A (𝛼) = ⊤ si et seulement si 𝑝 A (𝛼) = ⊤ ou 𝑞 A (𝛼) = ⊤ ; par ré-
currence, la première propriété équivaut à ce que l’ensemble des 𝑖 ∈ J tels
que 𝑝 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤ appartient à F , et la seconde à ce que l’ensemble des
𝑖 ∈ J tels que 𝑞 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤ appartient à F . D’après la proposition 5.7.7,
F
𝑚 A (𝛼) = ⊤ équivaut à ce que la réunion de ces deux ensembles appar-
tient à F , c’est-à-dire à ce que l’ensemble des 𝑖 ∈ J tels que 𝑝 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤
ou 𝑞 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤ appartienne à J ; mais c’est exactement l’ensemble des
𝑖 ∈ J tels que 𝑚 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤, d’où l’assertion dans ce cas.
Supposons enfin que 𝑚 est de la forme ∃𝑥𝑝, où 𝑥 est un symbole de
variable et la formule 𝑝 vérifie l’assertion à démontrer. L’ensemble des
variables libres de 𝑚 est celui de 𝑝 privé du symbole de variable 𝑥 ; on va
appliquer l’hypothèse de récurrence à 𝑝 et à l’ensemble de symboles de
variables V ∪ {𝑥 }. Soit 𝛼 = (𝛼𝑣 )𝑣 ∈V ∈ (AF ) V ; pour tout 𝑣, soit (𝑎𝑣,𝑖 )𝑖∈J une
118 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
F
famille d’éléments de 𝑖∈J A𝑖 de classe 𝛼𝑣 . Par définition, on a 𝑚 A (𝛼) = ⊤
Î
F
si et seulement s’il existe 𝛽 ∈ AF tel que 𝑝 A (𝛽; 𝛼) = ⊤. Supposons Î
d’abord que ce soit le cas et notons (𝑏𝑖 )𝑖∈J une famille dans 𝑖∈J A𝑖 de
classe 𝛽. Par l’hypothèse de récurrence, l’ensemble des 𝑖 ∈ J tels que
𝑝 A𝑖 (𝑏𝑖 , (𝑎𝑣,𝑖 )𝑣 ) = ⊤ appartient à F . Pour chacun de ces 𝑖, on a donc 𝑥 = 𝑏𝑖
est un témoin que 𝑝 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤, si bien que l’ensemble des 𝑖 ∈ J tels
que 𝑚 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤ appartient à F , ce qui prouve l’assertion voulue
dans ce cas. Supposons inversement que l’ensemble J′ des 𝑖 ∈ J tels que
F
𝑚 A𝑖 ((𝑎𝑣,𝑖 )𝑣 ) = ⊤ appartienne à F et démontrons que 𝑚 A (𝛼) = ⊤. Par
hypothèse, pour tout 𝑖 ∈ J′, il existe 𝑏𝑖 ∈ A𝑖 tel que 𝑝 A𝑖 (𝑏𝑖 , (𝑎𝑣,𝑖 )𝑣 ) = ⊤.
Puisque A𝑖 ≠ ∅ pour 𝑖 ∈ J, on peut compléter la famille (𝑏𝑖 )𝑖∈J′ en une
famille (𝑏𝑖 )𝑖∈J (axiome du choix !) ; soit 𝛽 la classe de cette famille. L’en-
semble des 𝑖 ∈ J tel que 𝑝 A𝑖 (𝑏𝑖 , (𝑎𝑣,𝑖 )𝑣 ) = ⊤ contient donc J′ (en fait, il est
F
égal à J′), donc appartient à F , si bien que 𝑝 A (𝛽, 𝛼) = ⊤. Ainsi, 𝑥 = 𝛽 est
témoin que 𝑚(𝛼) = ⊤, comme il fallait démontrer.
Cela conclut la démonstration de l’assertion b) par récurrence sur la
construction de la formule 𝑚. □
Théorème (5.8.7) (Łos). — Soit L un langage, soit (A𝑖 )𝑖∈I une famille de
réalisations de L et soit F un ultrafiltre sur l’ensemble I. Soit AF = 𝑖∈I
ÎF
A𝑖
l’ultraproduit de la famille (A𝑖 ) selon l’ultrafiltre F .
Soit 𝑚 ∈ FL une formule close dans le langage L. Pour que la formule 𝑚
soit réalisée dans l’ultraproduit AF , il faut et il suffit que l’ensemble des 𝑖 ∈ I
tels que 𝑚 est réalisée dans A𝑖 appartienne à F .
Démonstration. — C’est exactement ce qu’affirme la proposition précé-
dente dans le cas d’une formule close. □
5.9. Théorème de compacité et théorème de Tarski
Théorème (5.9.1) (Théorème de compacité, Gödel)
Soit L un langage et soit T une théorie. Pour que T soit consistante, il faut
et il suffit que toute partie finie de T soit consistante.
Démonstration. — Toute partie d’une théorie consistante est consistante ;
il faut donc démontrer que si toute partie finie de T est consistante, alors
T est consistant. L’assertion est évidente si T est finie ; supposons donc
5.9. THÉORÈME DE COMPACITÉ ET THÉORÈME DE TARSKI 119
que T soit infinie. Soit I l’ensemble (infini) des parties finies de T ; pour
𝑖 ∈ I, on notera T𝑖 la théorie 𝑖. D’après l’exemple 5.7.5, il existe un filtre F
sur I tel que pour tout 𝑖 ∈ I, l’ensemble des parties finies de T contenant 𝑖
appartient à F . D’après le théorème 5.7.6, il existe un tel filtre qui est un
ultrafiltre. ÎF
Pour tout 𝑖 ∈ I, soit A𝑖 un modèle de la théorie T𝑖 . Soit A = 𝑖∈I A𝑖 l’ul-
traproduit de la famille (A𝑖 ) le long de l’ultrafiltre F . C’est une réalisation
du langage L. Démontrons que c’est un modèle de T.
Soit 𝑚 ∈ T. Démontrons que 𝑚 est réalisée dans A. Par définition des
structures A𝑖 , la formule 𝑚 est réalisée dans A𝑖 dès que 𝑚 ∈ T𝑖 . Par
construction de l’ultrafiltre F , l’ensemble des parties finies de T conte-
nant 𝑚 appartient à F . D’après le théorème de Łos, la formule 𝑚 est donc
réalisée dans A. □
5.9.2. — Soit TL l’ensemble des théories complètes dans le langage L ;
c’est une partie de P (FL,∅ ).
Pour tout formule close 𝑚, notons V𝑚 l’ensemble des théories complètes
qui contiennent 𝑚. Pour toute ensemble S de formules closes, notons VS =
Ñ
𝑚∈S V𝑚 ; c’est l’ensemble des théories complètes qui contiennent S.
On a V⊤ = TL et V⊥ = ∅.
Si 𝑚 et 𝑛 sont des formules closes, alors V𝑚 ∩ V𝑛 = V (𝑚∧𝑛) ; en effet, si
𝑚, 𝑛 appartiennent à une théorie complète T et si A est un modèle de T,
alors 𝑚 A = 𝑛 A = ⊤, donc (𝑚 ∧ 𝑛) A = ⊤, ce qui prouve que (𝑚 ∧ 𝑛)
appartient à ThL (A) = T.
Par suite, les ensembles de la forme V𝑚 forment une base d’ouverts
d’une unique topologie sur TL : une partie de TL est ouverte si et seulement
si c’est une réunion de parties de la forme V𝑚 .
Observons que V𝑚 ∩ V¬𝑚 = ∅ et que V𝑚 ∪ V¬𝑚 = TL , pour toute formule
close 𝑚. En effet, si A est une réalisation de L, alors soit 𝑚 est satisfaite
dans A, soit ¬𝑚 est satisfaite dans A, mais pas les deux. Par suite, les
ensembles V𝑚 sont ouverts et fermés dans TL .
Comme une intersection de parties fermées est fermée, VS est fermé,
pour tout ensemble S de formules closes. Inversement, soit F une partie
fermée de TL ; soit U son complémentaire et soit S un ensemble de formules
120 CHAPITRE 5. RÉALISATIONS, MODÈLES — INTERPRÉTER
Ð
closes tel que U = 𝑚∈S V𝑚 ; alors,
Ù Ù
F= (TL V𝑚 ) = V¬𝑚 = VS′ ,
𝑚∈S 𝑚∈S
où S′ = {¬𝑚 ; 𝑚 ∈ S}.
Corollaire (5.9.3). — L’espace topologique TL est compact et totalement dis-
continu.
Démonstration. — Considérons enfin une famille (F𝑖 )𝑖∈I de parties fer-
mées de TL dont l’intersection est vide et démontrons qu’il existe une
sous-famille finie d’intersection vide. Pour tout Ð𝑖, soit S𝑖 un ensemble
Ñ de
formules
Ñ closes tel que F𝑖 = VS𝑖 ; posons S = 𝑖 S𝑖 . On a VS = 𝑖 VS𝑖 =
𝑖 F𝑖 = ∅, ce qui signifie que l’ensemble S n’est pas consistant. D’après
le théorème de compacité, il existe une partie finie S′ de S qui est incon-
sistante. Pour toute formule 𝑚 ∈ S′, choisissons un élément 𝑖𝑚 tel que
𝑚 ∈ S𝑖 ; soit ′
Ñ I l’ensemble, fini, de ces 𝑖𝑚 . Si une théorie consistante T′ap-
partient à 𝑖∈I′ F𝑖 , alors T appartient à F𝑖 pour tout 𝑖, donc T contient S , ce
qui
Ñ contredit la définition pour une théorie d’être consistante. Par suite,
𝑖∈I′ F𝑖 = ∅.
Soit T et T′ des théories complètes telles que T ≠ T′. Il existe donc
𝑚 ∈ T tel que 𝑚 ∉ T′ ; on a donc ¬𝑚 ∈ T′. Alors, V𝑚 et V¬𝑚 sont des
voisinages ouverts de T et T′ respectivement, disjoints. Cela entraîne que
TL est séparé.
L’espace topologique TL vérifie l’axiome de Borel–Lebesgue et est sé-
paré ; il est donc compact.
Démontrons enfin que TL est totalement discontinu, c’est-à-dire que ses
composantes connexes sont réduites à des points. Soit T une théorie com-
plète soit U sa composante connexe dans TL ; démontrons que U = {T}.
Pour toute formule close 𝑚 appartenant à T, l’ensemble U ∩ V𝑚 est ouvert
et fermé dans U, et contient T, donc est égal à U ; on a donc U ⊆ V𝑚 . L’in-
tersection, pour 𝑚 ∈ T, des ensembles V𝑚 est l’ensemble des théories com-
plètes contenant T, donc est égale à {T}. Cela prouve que U ⊆ {T}. □
Théorème (5.9.4) (Tarski). — Soit A une réalisation infinie de L. Pour tout
cardinal 𝛼 ⩾ sup(Card(A), Card(L)), il existe une extension élémentaire B
de A de cardinal 𝛼.
5.9. THÉORÈME DE COMPACITÉ ET THÉORÈME DE TARSKI 121
Démonstration. — Soit L′ le langage obtenu en adjoignant à L une famille
de symboles de constantes (𝑐𝑖 ) indexée par un ensemble I de cardinal 𝛼.
Soit T′ l’ensemble de formules closes du langage L′ obtenu en adjoi-
gnant à T les formules 𝑐𝑖 ≠ 𝑐 𝑗 pour tout couple (𝑖, 𝑗) d’éléments de I tels
que 𝑖 ≠ 𝑗.
Démontrons que T′ est consistant. D’après le théorème de compacité,
il suffit de prouver que toute partie finie de T′ est consistante ; une telle
partie finie est contenue dans la réunion T′J de T et de l’ensemble de for-
mules 𝑐𝑖 ≠ 𝑐 𝑗 , pour 𝑖 ≠ 𝑗 dans un ensemble fini J. Comme A est infini, il
existe une famille (𝑎𝑖 )𝑖∈J telle que 𝑎𝑖 ≠ 𝑎 𝑗 pour 𝑖 ≠ 𝑗. On observe alors que
A, muni des interprétations 𝑐𝑖A = 𝑎𝑖 , pour 𝑖 ∈ J, est un modèle de T′J . Par
suite, T′ est consistant, donc possède un modèle.
Soit B un modèle de T′. C’est une réalisation B de L munie d’une famille
(𝑏𝑖 )𝑖∈I dans laquelle les formules de T d’une part, les formules 𝑏𝑖 ≠ 𝑏 𝑗
pour 𝑖 ≠ 𝑗 d’autre part, sont satisfaites. Par suite, B est un modèle de T et
Card(B) ⩾ Card(I) = 𝛼.
En choisissant une partie S de B de cardinal 𝛼, on déduit du théorème
de Löwenheim–Skolem qu’il existe un modèle B′ de B contenant S et dont
le cardinal est égal à 𝛼. □
CHAPITRE 6
THÉORIE DE LA DÉMONSTRATION —
RAISONNER
« Pour de l’esprit, j’en ai, sans doute ; et du bon goût,
À juger sans étude et raisonner de tout. »
— Molière, Le Misanthrope, acte iii, scène 1
Ce chapitre est consacré aux aspects syntaxiques de la logique du pre-
mier ordre, c’est-à-dire à la définition d’une démonstration formelle et à
l’étude des formules qui en possèdent une.
Soit L un langage du premier ordre et soit T une théorie de L. Par défi-
nition, on dira qu’une formule close 𝑚 se déduit de T s’il existe une suite
finie (𝑚 1, . . . , 𝑚𝑛 ) de formules closes telles que pour tout 𝑖, soit 𝑚𝑖 ∈ T,
soit 𝑚𝑖 se déduit de (𝑚 1, . . . , 𝑚𝑖−1 ) par application d’une règle de déduc-
tion, et si 𝑚𝑛 = 𝑚. Une telle suite est appelée démonstration de 𝑚 dans T.
Ces règles de déduction sont soumises à deux tensions opposées :
– Être « raisonnables », au sens où une démonstration formelle doit
conduire, une fois convenablement interprétée, à un énoncé vrai ;
– Être « complètes », c’est-à-dire prouver tout ce qui peut l’être.
La première contrainte sera vérifiée dans le paragraphe 6.2 : on démontre
que si une formule 𝑚 possède une démonstration formelle dans une théo-
rie T, alors 𝑚 est vraie dans tout modèle de T. La seconde contrainte est
Le théorème de complétude de Gödel (théorème 6.5.3). vérifie la seconde
contrainte : si 𝑚 est vraie dans tout modèle de T, alors 𝑚 possède une
démonstration dans T.
Les règles de déduction sont de deux types : deux d’entre elles, mo-
dus ponens et généralisation, disent comment écrire de nouvelles for-
mules à partir de précédentes ; les autres sont des axiomes, parfois ap-
pelés axiomes logiques : tautologies, syntaxe des quantificateurs, égalité.
Comme nous avons autorisé la réalisation vide, les règles que nous don-
nons ci-dessous diffèrent légèrement de celles proposées dans la plupart
des ouvrages, notamment par Cori et Lascar (2003a). Ces auteurs intro-
duisent par exemple la règle de particularisation ([Link]) (∀𝑣𝑚 ⇒ 𝑚(𝑡),
124 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
où 𝑚 est une formule et 𝑡 un terme) même lorsque le symbole de variable 𝑣
n’a pas d’occurrence libre dans 𝑚. L’exemple de la formule 𝜑 = ∀𝑥⊥, qui
est satisfaite uniquement dans la structure vide, nous force à quelques
précautions supplémentaires.
6.1. Démonstrations formelles
6.1.1. Modus ponens. — Soit 𝑚, 𝑛 deux formules. On fait l’hypothèse
que toute variable libre de 𝑚 admet au moins une occurrence libre dans 𝑛.
Alors, la règle modus ponens (1) déduit 𝑛 des deux formules 𝑚 et (𝑚 ⇒ 𝑛).
6.1.2. Règle de généralisation. — Soit 𝑚 une formule et 𝑣 un symbole
de variable. La règle de généralisation permet de déduire ∀𝑣𝑚 de 𝑚.
6.1.3. Tautologies. — Soit 𝑡 (𝑞 1, . . . , 𝑞𝑛 ) un terme du calcul des prédicats
en 𝑛 variables 𝑥 1, . . . , 𝑥𝑛 . Supposons que 𝑡 soit une tautologie, c’est-à-dire
que l’on a 𝑡 (𝑎 1, . . . , 𝑎𝑛 ) = ⊤ pour tout (𝑎 1, . . . , 𝑎𝑛 ) ∈ {⊥, ⊤}𝑛 .
Alors, pour toute suite (𝑚 1, . . . , 𝑚𝑛 ) de formules de L, la règle
([Link]) 𝑡 (𝑚 1, . . . , 𝑚𝑛 )
affirme la formule (tautologique) déduite de 𝑡 dans laquelle la formule 𝑚𝑖
est substituée à la variable 𝑥𝑖 .
6.1.4. Axiomes des quantificateurs. — Soit 𝑣 un symbole de variable
et soit 𝑚, 𝑛 des formules. On dispose des trois règles de déduction sui-
vantes, aussi appelées axiomes des quantificateurs.
La règle
([Link]) (∃𝑣𝑚 ⇔ ¬∀𝑣¬𝑚)
exprime la relation entre quantificateur existentiel et quantificateur uni-
versel.
La règle suivante
([Link]) (∀𝑣 (𝑚 ⇒ 𝑛) ⇒ (∀𝑣𝑚 ⇒ ∀𝑣𝑛))
permet de distribuer le quantificateur universel dans une implication.
(1) Dérivée de l’expression latin modus ponendo ponens qui signifie « manière d’affirmer en affir-
mant ».
6.1. DÉMONSTRATIONS FORMELLES 125
Soit 𝑡 (𝑥 1, . . . , 𝑥𝑛 ) est un terme en les variables libres 𝑥 1, . . . , 𝑥𝑛 et soit
𝜏 : FL,{𝑣 } → FL l’application de substitution correspondante. Supposons
que le symbole 𝑣 possède une occurrence libre dans 𝑚 et que 𝑚 soit ad-
missible pour la substitution {𝑣 } → TL d’image 𝑡. Alors, la règle de parti-
cularisation
([Link]) (∀𝑣𝑚 ⇒ 𝜏 (𝑚))
permet de déduire de ∀𝑣𝑚 la formule 𝜏 (𝑚) dans laquelle les occurrences
libres de la variable 𝑣 ont été remplacées par le terme 𝑡.
6.1.5. Axiomes de l’égalité. — Enfin, on ajoute les axiomes suivants
qui régissent l’égalité :
([Link]) 𝑥 =𝑥
([Link]) ((𝑥 = 𝑦) ⇒ (𝑦 = 𝑥))
([Link]) ((𝑥 = 𝑦) ∧ (𝑦 = 𝑧)) ⇒ (𝑥 = 𝑧)
Û
([Link]) (( 𝑥𝑖 = 𝑦𝑖 ) ⇒ (𝑓 𝑥 1 . . . 𝑥𝑛 = 𝑓 𝑦1 . . . 𝑦𝑛 ))
1⩽𝑖⩽𝑛
Û
([Link]) (( 𝑥𝑖 = 𝑦𝑖 ) ⇒ (𝑟𝑥 1 . . . 𝑥𝑛 ⇒ 𝑟𝑦1 . . . 𝑦𝑛 )),
1⩽𝑖⩽𝑛
où 𝑥, 𝑦, 𝑧, 𝑥 1, . . . , 𝑥𝑛 , 𝑦1, . . . , 𝑦𝑛 sont des symboles de variables deux à deux
distincts, 𝑓 un symbole de fonction 𝑛-aire et 𝑟 un symbole de relation
𝑛-aire.
Définition (6.1.6). — Soit T une théorie et soit 𝑚 une formule de L. Une
démonstration formelle de 𝑚 dans T est une suite finie (𝑚 1, . . . , 𝑚𝑛 ) de
formules de L telle que 𝑚𝑛 = 𝑚 et telle que pour tout 𝑖 ∈ {1, . . . , 𝑛}, l’une
des propriétés suivantes soit satisfaite :
a) On a 𝑚𝑖 ∈ T ;
b) Il existe un symbole de variable 𝑣 et un entier 𝑗 tel que 1 ⩽ 𝑗 < 𝑖 de
sorte que 𝑚𝑖 = ∀𝑣𝑚 𝑗 ;
c) La formule 𝑚𝑖 est une tautologie ou un axiome de quantificateur ;
d) Il existe deux entiers 𝑗, 𝑘 tels que 1 ⩽ 𝑗, 𝑘 < 𝑖 et 𝑚𝑘 = (𝑚 𝑗 ⇒ 𝑚𝑖 ), où
toute variable libre dans 𝑚 𝑗 est libre dans 𝑚𝑖 , de sorte que la formule 𝑚𝑖 se
déduise des formules 𝑚 𝑗 et 𝑚𝑘 par application de modus ponens.
126 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
Si 𝑚 possède une démonstration formelle dans T, on dit aussi qu’elle
est démontrable dans T, qu’elle est conséquence syntaxique de T, ou que
c’est un théorème de T ; on écrit T ⊢ 𝑚. Lorsque T est vide, on dit que 𝑚
est démontrable et l’on écrit ⊢ 𝑚.
Exemple (6.1.7). — Soit 𝑚, 𝑛 deux formules closes et soit T = {𝑚, 𝑛}. La
suite de formules suivante constitue une démonstration formelle de 𝑚 ∧𝑛
dans T :
(1) 𝑚 — on a 𝑚 ∈ T ;
(2) 𝑛 — on a 𝑛 ∈ T ;
(3) (𝑚 ⇒ (𝑛 ⇒ (𝑚 ∧ 𝑛))) — c’est une tautologie ;
(4) (𝑛 ⇒ (𝑚 ∧ 𝑛)) — modus ponens, (1) et (3) ;
(5) (𝑚 ∧ 𝑛) — modus ponens, (2) et (4).
Exemple (6.1.8). — Soit T, T′ des théories et soit 𝑚 une formule telle que
T ∪ T′ ⊢ 𝑚. Supposons que T ⊢ 𝑛 pour toute formule 𝑛 ∈ T′ ; alors, T ⊢ 𝑚.
En effet, considérons une démonstration (𝑚 1, . . . , 𝑚𝑘 ) de 𝑚 dans T ∪ T′.
Pour tout 𝑖 ∈ {1, . . . , 𝑘 } tel que 𝑚𝑖 ∈ T′, on remplace 𝑚𝑖 par une démons-
tration (𝑚𝑖1, . . . , 𝑚𝑘𝑖 𝑖 ) de 𝑚𝑖 dans T. On obtient ainsi une démonstration
de 𝑚 dans T.
Exemple (6.1.9). — Soit 𝑚 et 𝑛 deux formules. Supposons que le symbole
de variable 𝑣 n’ait pas d’occurence libre dans 𝑚 et démontrons la variante
suivante de l’axiome de quantificateur ([Link]) :
([Link]) (∀𝑣 (𝑚 ⇒ 𝑛) ⇒ (𝑚 ⇒ ∀𝑣𝑛)).
En voici une démonstration formelle :
(1) (𝑚 ⇒ ∀𝑣𝑚) — règle de généralisation
(2) (∀𝑣 (𝑚 ⇒ 𝑛) ⇒ (∀𝑣𝑚 ⇒ ∀𝑣𝑛)) — axiome ([Link]) ;
(3) ((𝑎 ⇒ (𝑏 ⇒ 𝑐)) ⇒ ((𝑏 ′ ⇒ 𝑏) ⇒ (𝑎 ⇒ (𝑏 ′ ⇒ 𝑐)))) — tautologie,
appliquée avec 𝑎 = ∀𝑣 (𝑚 ⇒ 𝑛), 𝑏 ′ = 𝑚, 𝑏 = ∀𝑣𝑚, 𝑐 = (𝑚 ⇒ ∀𝑣𝑛) ;
(4) ((𝑚 ⇒ ∀𝑣𝑚) ⇒ (∀𝑣 (𝑚 ⇒ 𝑛) ⇒ (𝑚 ⇒ ∀𝑣𝑛))) — modus ponens,
(2) et (3) toute variable libre de (3) ayant au moins une occcurence libre
dans (4) ;
(5) (∀𝑣 (𝑚 ⇒ 𝑛) ⇒ (𝑚 ⇒ ∀𝑣𝑛))) — modus ponens, (1) et (4), toute
variable libre de (1) a bien une occurrence libre dans (5).
6.1. DÉMONSTRATIONS FORMELLES 127
Exemple (6.1.10). — Soit 𝑚, 𝑛, 𝑝 des formules telles que (𝑚 ⇒ 𝑛) et
(𝑛 ⇒ 𝑝) soient démontrables dans une théorie T. Prouvons que si toute
variable libre de 𝑛 possède au moins une occurrence libre dans 𝑚 ou
dans 𝑝, alors (𝑚 ⇒ 𝑝) est démontrable dans T. En effet, on concatène
des démonstrations formelles de (𝑚 ⇒ 𝑛) et de (𝑛 ⇒ 𝑝) et on ajoute les
formules suivantes :
(1) (𝑚 ⇒ 𝑛) ;
(2) (𝑛 ⇒ 𝑝) ;
(3) ((𝑚 ⇒ 𝑛) ⇒ ((𝑛 ⇒ 𝑝) ⇒ (𝑚 ⇒ 𝑝))) — tautologie ;
(4) ((𝑛 ⇒ 𝑝) ⇒ (𝑚 ⇒ 𝑝)) — modus ponens à partir de (3), toute
variable libre de (1) ayant une occurence libre dans (4) ;
(5) (𝑚 ⇒ 𝑝) — modus ponens à partir de (4), toute variable libre de (2)
ayant au moins une occurrence libre dans (5), par hypothèse.
Remarque (6.1.11). — Soit 𝑚 une formule, soit 𝑣 un symbole de variable
et soit 𝑡 un terme. La règle de particularisation ([Link]), (∀𝑣𝑚 ⇒ 𝑚(𝑡)),
n’est admise que lorsque 𝑣 admit une occurrence libre dans 𝑚. Lorsque
𝑣 n’a pas d’occurrence libre dans 𝑚, 𝑚(𝑡) = 𝑚 et cette règle s’écrirait
(∀𝑣𝑚 ⇒ 𝑚). Alors, la formule 𝜑 = ∀𝑥⊥, vraie dans la réalisation vide, et
fausse sinon, nous permettrait de déduire ⊥ de 𝜑, ce qui est déraisonnable :
si l’ensemble vide est d’un intérêt limité en mathématiques, il ne s’agit
tout de même pas qu’il conduise à des contradictions !
Bien sûr, un langage qui possède des symboles de constantes n’a pas
de réalisation vide. Démontrons ainsi que si le langage contient une sym-
bole de constante 𝑐, alors la formule (∀𝑣𝑚 ⇒ 𝑚) est démontrable pour
toute formule 𝑚 où le symbole de variable 𝑣 n’a pas d’occurrence libre.
Les formules suivantes sont en effet démontrables :
(1) (𝑣 = 𝑣) ⇔ ⊤ — aviome de l’égalité ;
(2) ((𝑝 ⇔ ⊤) ⇒ (𝑚 ⇒ (𝑚 ∧ 𝑝))) — tautologie, qu’on va appliquer
avec 𝑝 = (𝑣 = 𝑣) ;
(3) (𝑚 ⇒ (𝑚 ∧ (𝑣 = 𝑣)), modus ponens, car 𝑣 est la seule varible libre
de (1) et a une occurrence libre dans (3) ;
(4) ∀𝑣 (𝑚 ⇒ (𝑚 ∧ (𝑣 = 𝑣))) — généralisation de (3) ;
(5) (∀𝑣 (𝑚 ⇒ (𝑚 ∧ (𝑣 = 𝑣))) ⇒ (∀𝑣𝑚 ⇒ ∀𝑣 (𝑚 ∧ (𝑣 = 𝑣))) — aviome
logique ([Link]) ;
(6) (∀𝑣𝑚 ⇒ ∀𝑣 (𝑚 ∧ (𝑣 = 𝑣))) ;
128 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
(7) (∀𝑣 (𝑚 ∧ (𝑣 = 𝑣)) ⇒ (𝑚 ∧ (𝑐 = 𝑐))) — particularisation ;
(8) ((𝑚 ∧ (𝑐 = 𝑐)) ⇒ 𝑚) — tautologie.
On est dans la situation 𝑝 ⇒ 𝑞, 𝑞 ⇒ 𝑟 , 𝑟 ⇒ 𝑠, où les variables libres
de 𝑝 = ∀𝑣𝑚, 𝑞 = ∀𝑣 (𝑚 ∧ (𝑣 = 𝑣)), 𝑟 = (𝑚 ∧ (𝑐 = 𝑐)), 𝑠 = 𝑚, sont
celles de 𝑚. D’après l’exemple 6.1.10, la formule (∀𝑣𝑚 ⇒ 𝑚) est donc
démontrable dans T.
6.2. Démonstration et satisfaction
Définition (6.2.1). — Soit 𝑚 une formule d’un langage L. Une quantifi-
cation universelle de 𝑚 est une formule close de la forme ∀𝑥 1 . . . ∀𝑥𝑛𝑚, où
𝑥 1, . . . , 𝑥𝑛 sont des symboles de variables.
La condition que 𝑚 est une formule close revient à dire que l’ensemble
des variables libres de 𝑚 est contenu dans l’ensemble {𝑥 1, . . . , 𝑥𝑛 }. En effet,
si un symbole de variable ayant une occurrence libre dans 𝑚 n’appartenait
pas à {𝑥 1, . . . , 𝑥𝑛 }, il serait encore libre dans la formule ∀𝑥 1 . . . ∀𝑥𝑛𝑚.
Soit W un ensemble de symboles de variables. On dira qu’une for-
mule 𝑚 ∈ FL,W est satisfaite dans une structure A si la fonction
𝑚 A : AW → {⊤, ⊥} ne prend que la valeur ⊤. Cela revient à dire
que toute quantification universelle de 𝑚 est satisfaite dans A. On notera
cela par abus 𝑚 A = ⊤.
C’est un abus à cause des possibles structures vides. En effet, si A est
vide et que W n’est pas vide, l’ensemble AW est vide, donc il est vrai qu’une
fonction de AW dans {⊤, ⊥} ne prend que la valeur ⊤ — mais il est aussi
vrai qu’elle ne prend que la valeur ⊥.
D’autre part, soit 𝑚 une formule close telle que 𝑚 A = ⊥ dans la structure
vide A. Pour tout symbole de variable 𝑥, 𝑚′ = ∀𝑥𝑚 est une formule close,
mais on a (𝑚′) A = ⊤.
Théorème (6.2.2). — Soit L un langage, soit T une théorie et soit 𝑚 une
formule de L qui est démontrable dans T. Alors 𝑚 est satisfaite dans tout
modèle de T.
Ce théorème garantit donc que la définition d’une démonstration for-
melle est « saine » : dans un modèle donné, à partir d’énoncés vrais, elle ne
peut pas conduire à des énoncés faux. Modulo un argument de récurrence
élémentaire, la preuve se déduit des lemmes suivants.
6.2. DÉMONSTRATION ET SATISFACTION 129
Lemme (6.2.3). — Soit A une réalisation de L et soit 𝑚, 𝑛 des formules dans
le langage L telle que toute variable libre de 𝑚 possède au moins une occur-
rence libre dans 𝑛. Si 𝑚 A = ⊤ et (𝑚 ⇒ 𝑛) A = ⊤, alors 𝑛 A = ⊤.
Démonstration. — Soit W un ensemble de symboles de variables conte-
nant les variables libres de 𝑛. Démontrons que la fonction 𝑛 A : AW →
{⊤, ⊥} ne prend que la valeur ⊤.
Soit 𝑎 ∈ AW . Par hypothèse, tout symbole de variable qui a une oc-
currence libre dans 𝑚 a aussi une occurrence libre dans 𝑛. La formule 𝑚
appartient ainsi à FL,W , et les variables libres de la formule (𝑚 ⇒ 𝑛)
sont aussi contenues dans W. Par hypothèse, on a 𝑚 A (𝑎) = ⊤ et (𝑚 ⇒
𝑛) A (𝑎) = ⊤. Par définition de l’évaluation des formules, on a donc 𝑛 A (𝑎) =
⊤. □
Lemme (6.2.4). — Les tautologies (formules ([Link])) et les axiomes lo-
giques (formules ([Link]), ([Link]) et ([Link])) sont satisfaites dans toute
réalisation.
Démonstration. — Il s’agit de démontrer que l’évaluation de ces formules
dans toute réalisation de L ne prend que la valeur ⊤. Soit donc A une
réalisation de L.
Traitons d’abord le cas des tautologies. Posons 𝑝 = 𝑡 (𝑚 1, . . . , 𝑚𝑛 ) et soit
W un ensemble de symboles de variables contenant les variables libres
de 𝑝. Alors, W contient les variables libres de 𝑚𝑖 , pour tout 𝑖. L’évalua-
tion des formules étant compatible aux règles logiques, on a 𝑝 A (𝑎) =
𝑡 A (𝑚 A A W
1 (𝑎), . . . , 𝑚𝑛 (𝑎)) = ⊤ pour tout 𝑎 ∈ A , ce qu’il fallait démontrer.
Traitons maintenant les axiomes logiques.
Commençons par la règle ([Link]) : (∃𝑣𝑚 ⇔ ¬∀𝑣¬𝑚). Notons 𝑝 1 cette
formule, soit W un ensemble de symboles de variables contenant ses va-
riables libres et posons W′ = W∪ {𝑣 }. Soit 𝑎 ∈ AW . Par définition de l’éva-
luation, on a 𝑝 1A (𝑎) = ⊤ si et seulement si (∃𝑣𝑚) A (𝑎) = (¬∀𝑣¬𝑚) A (𝑎),
c’est-à-dire si et seulement si (∃𝑣𝑚) A (𝑎) ≠ (∀𝑣¬𝑚) A (𝑎), La première for-
′
mule vaut ⊤ si et seulement s’il existe 𝑎′ ∈ AW ne différant de 𝑎 qu’en 𝑣 tel
′
que 𝑚 A (𝑎′) = ⊤ ; la seconde vaut ⊤ si et seulement si pour tout 𝑎′ ∈ AW
ne différant de 𝑎 qu’en 𝑣, on a ¬𝑚 A (𝑎′) = ⊤, c’est-à-dire 𝑚 A (𝑎′) = ⊥. On
a donc 𝑝 1A (𝑎) = ⊤, comme il fallait démontrer.
Posons 𝑝 2 = (∀𝑣 (𝑚 ⇒ 𝑛)) ⇒ (∀𝑣𝑚 ⇒ ∀𝑣𝑛)) (formule ([Link])). Soit W
un ensemble de symboles de variables contenant les variables libres de 𝑝 2
130 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
et soit W′ = W ∪ {𝑣 }. Soit 𝑎 ∈ AW . On a (𝑝 2 ) A (𝑎) = ⊤ si et seulement
si (∀𝑣 (𝑚 ⇒ 𝑛)) A (𝑎) = ⊥ ou (∀𝑣𝑚 ⇒ ∀𝑣𝑛) A (𝑎) = ⊤, c’est-à-dire si et
seulement si (∀𝑣 (𝑚 ⇒ 𝑛)) A (𝑎) = ⊥, (∀𝑣𝑚) A (𝑎) = ⊥ ou (∀𝑣𝑛) A (𝑎) = ⊤.
SUpposons donc que (∀𝑣 (𝑚 ⇒ 𝑛)) A (𝑎) = (∀𝑣𝑚) A (𝑎) = ⊤ et prouvons
′
que (∀𝑣𝑛) A (𝑎) = ⊤. Soit 𝑎′ ∈ AW ne différant de 𝑎 qu’en 𝑣 ; nous devons
démontrer que 𝑛 A (𝑎′) = ⊤. Par hypothèse, on a (𝑚 ⇒ 𝑛) A (𝑎′) = 𝑚 A (𝑎′) =
⊤, d’où 𝑛 A (𝑎′) = ⊤, comme il fallait démontrer.
Reprenons les notations de la formule ([Link]), posons 𝑝 3 = (∀𝑣𝑚 ⇒
𝜏 (𝑚)). Les variables libres de 𝑝 3 sont celles de 𝑚 privées de 𝑣, ainsi que
celles apparaissant dans le terme 𝑡, car 𝑣 a une occurrence libre dans 𝑚.
Soit W un ensemble de symboles de variables contenant les variables
′
libres de 𝑝 3 . Posons aussi W′ = W ∪ {𝑣 } et notons 𝜑 : AW → AW l’appli-
cation telle que 𝜑𝑣 (𝑎) = 𝑡 A (𝑎), et 𝜑𝑤 (𝑎) = 𝑎𝑤 pour 𝑤 ∈ W {𝑣 } et tout
𝑎 ∈ AW .
Soit 𝑎 ∈ AW et démontrons que 𝑝 3A (𝑎) = ⊤. Par définition, on peut
supposer que (∀𝑣𝑚) A (𝑎) = ⊤ et il s’agit de prouver que (𝜏 (𝑚)) A (𝑎) = ⊤.
Puisque 𝜑 (𝑎) ne diffère de 𝑎 qu’en 𝑣, la formule (∀𝑣𝑚) A (𝑎) = ⊤ entraîne
que 𝑚 A (𝜑 (𝑎)) = ⊤. Par compatibilité de l’évaluation à la substitution
(lemme 5.1.9), on a donc (𝜏 (𝑚)) A (𝑎) = (𝑚 A )(𝜑 (𝑎)) = ⊤, comme il fallait
démontrer. □
Démonstration du théorème 6.2.2. — Soit A un modèle de T. Soit 𝑚 une
formule dans le langage L qui est démontrable dans T. Soit (𝑚 1, . . . , 𝑚𝑛 )
une démonstration formelle de 𝑚. Prouvons par récurrence sur 𝑖 que 𝑚𝑖A =
⊤, c’est-à-dire que pour tout ensemble de symboles de variables W𝑖 conte-
nant les variables libres de 𝑚𝑖 , on a 𝑚𝑖A (𝑎) = ⊤ pour tout 𝑎 ∈ AW𝑖 . Il y a
quatre cas :
a) Si 𝑚𝑖 ∈ T, alors 𝑚𝑖A = ⊤, par définition d’un modèle ;
b) Supposons que 𝑚𝑖 se déduise d’une formule 𝑚 𝑗 (où 𝑗 < 𝑖) par la
règle de généralisation, c’est-à-dire que 𝑚𝑖 = ∀𝑣𝑚 𝑗 , où 𝑣 est un symbole
de variable. Soit W𝑖 un ensemble de symboles de variables contenant les
variables libres de 𝑚𝑖 et soit 𝑎 ∈ AW𝑖 ; posons W𝑖′ = W𝑖 ∪{𝑣 }. Par définition,
′
𝑚𝑖A (𝑎) = ⊤ si et seulement si pour tout élément 𝑎′ ∈ AW𝑖 qui ne diffère
de 𝑎 qu’en 𝑣, 𝑚 A𝑗 (𝑎′) = ⊤. Puisque W𝑖′ contient les symboles de variables
qui sont libres dans 𝑚 𝑗 , cela résuite de l’hypothèse de récurrence 𝑚 A𝑗 = ⊤ ;
c) Si 𝑚𝑖 est une tautologie ou un axiome de quantificateur, alors 𝑚𝑖A = ⊤
en vertu du lemme 6.2.4 ;
6.3. THÉORIES COHÉRENTES 131
d) Si 𝑚𝑖 se déduit de formules 𝑚 𝑗 et 𝑚𝑘 (où 1 ⩽ 𝑗, 𝑘 < 𝑖) par la règle
modus ponens, on a 𝑚𝑖A = ⊤ d’après le lemme 6.2.3.
Par récurrence, on a donc 𝑚 A = 𝑚𝑛A = ⊤, ainsi qu’il fallait démontrer. □
6.3. Théories cohérentes
Définition (6.3.1). — On dit qu’une théorie T est cohérente si la formule
close ⊥ n’est pas un théorème de T.
Toute partie d’une théorie cohérente est cohérente.
D’après le théorème 6.2.2, toute théorie consistante est cohérente. Le
théorème de complétude affirmera la réciproque.
Remarque (6.3.2). — Soit T une théorie. Supposons qu’il existe une for-
mule close 𝑚 telle que T ⊢ 𝑚 et T ⊢ ¬𝑚 ; alors, T n’est pas cohérente.
En effet, puisque T prouve 𝑚 et ¬𝑚, la tautologie
(𝑚 ⇒ (¬𝑚 ⇒ ⊥))
et la règle modus ponens entraînent (𝑚 est close) qu’elle démontre (¬𝑚 ⇒
⊥), puis ⊥.
Inversement, supposons que T ne soit pas cohérente et soit 𝑚 une for-
mule close de L. Comme (⊥ ⇒ 𝑚) est une tautologie, la théorie T dé-
montre 𝑚.
En revanche, si 𝑚 n’est pas close, il est possible qu’une théorie cohé-
rente T prouve 𝑚 et ¬𝑚. Ce n’est pas absurde car la satisfaction de 𝑚
signifie la satisfaction de ses quantifications universelles. Supposant par
exemple que 𝑚 possède un seul symbole de variable libre, 𝑥, la satisfac-
tion de 𝑚 équivaut à celle de ∀𝑥𝑚, et la satisfaction de ¬𝑚 équivaut à celle
de ∀𝑥¬𝑚. Ces deux formules ∀𝑥𝑚 et ∀𝑥¬𝑚 ne sont pas contradictoires,
mais elles impliquent la formule 𝜑 = ∀𝑥⊥. En particulier, la théorie T n’a
pas de modèle non vide.
Exemple (6.3.3). — La théorie vide est consistante, donc cohérente.
Proposition (6.3.4) (Finitude). — Soit T une théorie. Pour toute formule 𝑚
telle que T ⊢ 𝑚, il existe une partie finie T0 de T telle que T0 ⊢ 𝑚.
132 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
Démonstration. — Soit (𝑚 1, . . . , 𝑚𝑛 ) une démonstration formelle de 𝑚
dans T. Soit T0 l’ensemble des formules closes de T qui sont égales à l’une
des 𝑚𝑖 . Alors, (𝑚 1, . . . , 𝑚𝑛 ) est une démonstration formelle de 𝑚 dans T0 ,
ce qui prouve que T0 ⊢ 𝑚. □
Corollaire (6.3.5). — Soit T une théorie. Pour que T soit cohérente, il faut
et il suffit que toute partie finie de T soit cohérente.
Corollaire (6.3.6). — Soit (T𝑖 )𝑖∈IÐune famille de théories cohérentes, fil-
trante pour l’inclusion. Alors, T = 𝑖∈I T𝑖 est une théorie cohérente.
Démonstration. — L’assertion est évidente si I = ∅, car la théorie vide est
cohérente. Supposons donc I ≠ ∅ et considérons une partie finie S de T.
Il existe un élément 𝑖 ∈ I tel que S ⊆ T𝑖 . Comme T𝑖 est cohérente, il en
est de même de S. D’après la proposition 6.3.4, cela démontre que T est
cohérente. □
Corollaire (6.3.7). — Pour toute théorie cohérente T, il existe une théorie
cohérente maximale T′ telle que T ⊆ T′.
Démonstration. — Soit C l’ensemble des théories cohérentes, ordonné par
l’inclusion. Démontrons que C est inductif. Soit (T𝑖 )𝑖∈I une famille tota-
lement
Ð ordonnée de théories cohérentes ; d’après le corollaire précédent,
T = 𝑖∈I T𝑖 est une théorie cohérente qui contient chaque T𝑖 . Cela prouve
que toute partie totalement ordonnée de C est majorée ; l’ensemble or-
donné C est donc ordonné. Le corollaire résulte ainsi du théorème de Zorn
(théorème 3.2.17). □
Proposition (6.3.8) (Déduction). — Soit T une théorie, soit 𝑚 une formule
close et soit 𝑛 une formule close. Les deux assertions suivantes sont équiva-
lentes :
(i) La formule 𝑛 possède une démonstration formelle dans T ∪ {𝑚} ;
(ii) La formule (𝑚 ⇒ 𝑛) possède une démonstration formelle dans T.
En particulier, pour démontrer la formule (𝑚 ⇒ 𝑛), on peut démon-
trer 𝑛 en supposant 𝑚.
6.3. THÉORIES COHÉRENTES 133
Démonstration. — L’implication (ii)⇒(i) est banale. Considérons une dé-
monstration formelle (𝑚 1, . . . , 𝑚𝑠 ) de (𝑚 ⇒ 𝑛) dans T et adjoignons-lui
les deux formules 𝑚 et 𝑛. La suite (𝑚 1, . . . , 𝑚𝑠 , 𝑚, 𝑛) de formules de T∪{𝑚}
est bien une démonstration formelle de 𝑛 dans T∪{𝑛} puisque 𝑚 ∈ T∪{𝑚}
et que 𝑛 se déduit de (𝑚 ⇒ 𝑛) et 𝑚 par modus ponens.
Supposons maintenant que T ∪ {𝑚} ⊢ 𝑛 et considérons une démonstra-
tion formelle (𝑚 1, . . . , 𝑚𝑠 ) de 𝑛 dans T ∪ {𝑚}. Démontrons que T ⊢ (𝑚 ⇒
𝑛) en transformant la suite (𝑚 ⇒ 𝑚 1, . . . , 𝑚 ⇒ 𝑚𝑠 ) en une démonstration
formelle par insertion d’arguments supplémentaires. Soit 𝑖 ∈ {1, . . . , 𝑠} et
analysons les divers cas possibles.
a) Supposons que 𝑚𝑖 ∈ T ∪ {𝑚}. Si 𝑚𝑖 = 𝑚, la formule (𝑚 ⇒ 𝑚) est une
tautologie, Sinon, on a 𝑚𝑖 ∈ T et on insère avant (𝑚 ⇒ 𝑚𝑖 ) la formule 𝑚𝑖
de T et la tautologie (𝑚𝑖 ⇒ (𝑚 ⇒ 𝑚𝑖 )), dont la formule (𝑚 ⇒ 𝑚𝑖 ) se
déduit par modus ponens ;
b) Supposons qu’il existe un symbole de variable 𝑣 et un entier 𝑗 véri-
fiant que 1 ⩽ 𝑗 < 𝑖 tels que 𝑚𝑖 = ∀𝑣𝑚 𝑗 ; alors la suite construite contient,
avant la formule 𝑚 ⇒ 𝑚𝑖 , la formule 𝑚 ⇒ 𝑚 𝑗 et il s’agit d’en déduire
𝑚 ⇒ ∀𝑣𝑚 𝑗 .
c) Supposons que 𝑚𝑖 soit un axiome logique du langage L. On insère
alors avant (𝑚 ⇒ 𝑚𝑖 ) l’axiome logique 𝑚𝑖 et la tautologie (𝑚𝑖 ⇒ (𝑚 ⇒
𝑚𝑖 )), de sorte que (𝑚 ⇒ 𝑚𝑖 ) est démontré par modus ponens.
d) Supposons enfin que 𝑚𝑖 se déduise par modus ponens des formules 𝑚 𝑗
et 𝑚𝑘 , où 1 ⩽ 𝑗, 𝑘 < 𝑖. Quitte à échanger 𝑗 et 𝑘, on a donc 𝑚𝑘 = (𝑚 𝑗 ⇒ 𝑚𝑖 ) ;
on insère alors avant la formule (𝑚 ⇒ 𝑚𝑖 ) la tautologie
((𝑚 ⇒ 𝑚 𝑗 ) ⇒ ((𝑚 ⇒ (𝑚 𝑗 ⇒ 𝑚𝑖 )) ⇒ (𝑚 ⇒ 𝑚𝑖 ))),
la formule ((𝑚 ⇒ (𝑚 𝑗 ⇒ 𝑚𝑖 )) ⇒ (𝑚 ⇒ 𝑚𝑖 )) qui s’en déduit par modus
ponens avec (𝑚 ⇒ 𝑚 𝑗 ), de sorte que la formule (𝑚 ⇒ 𝑚𝑖 ) se déduit par
modus ponens de la précédente et de (𝑚 ⇒ (𝑚 𝑗 ⇒ 𝑚𝑖 )) = (𝑚 ⇒ 𝑚𝑘 ).
La suite de formules ainsi obtenue est une démonstration formelle de
(𝑚 ⇒ 𝑚𝑠 ) = (𝑚 ⇒ 𝑛), d’où la proposition. □
Corollaire (6.3.9). — Soit T une théorie et soit 𝑚 une formule close de T.
Pour que 𝑚 soit un théorème de T, il faut et il suffit que la théorie T ∪ {¬𝑚}
ne soit pas cohérente.
134 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
Ce corollaire justifie le principe du raisonnement par l’absurde : pour
démontrer 𝑚, on suppose ¬𝑚 et on obtient une contradiction.
Démonstration. — Supposons que 𝑚 est un théorème de T. Alors, 𝑚 est
un théorème de T ∪ {¬𝑚}, de même que ¬𝑚. Cela prouve que 𝑚 n’est pas
cohérente.
Supposons maintenant que T∪{¬𝑚} ne soit pas cohérente, de sorte que
⊥ est un théorème de T ∪ {¬𝑚}. D’après la proposition 6.3.8, (¬𝑚 ⇒ ⊥)
est un théorème de T. En appliquant la règle modus ponens à ce théorème
et à la tautologie ((¬𝑚 ⇒ ⊥) ⇒ 𝑚), on en déduit que 𝑚 est un théorème
de T. □
Exemple (6.3.10). — Soit 𝑥 un symbole de variable, soit 𝑝 une formule
n’ayant que 𝑥 comme variable libre et soit 𝑞 une formule close. Démon-
trons que si T ⊢ ∃𝑥𝑝 et T ⊢ ∀𝑥 (𝑝 ⇒ 𝑞), alors T ⊢ 𝑞. La suite de formules
ci-dessous démontre que les formules closes ∀𝑥¬𝑝 et sa négation sont
toutes deux démontrables dans la théorie
T′ = T ∪ {∃𝑥𝑝, ∀𝑥 (𝑝 ⇒ 𝑞), ¬𝑞} :
(1) ∀𝑥 (𝑝 ⇒ 𝑞) ;
(2) ¬𝑞 ;
(3) (𝑝 ⇒ 𝑞) ⇒ (¬𝑞 ⇒ ¬𝑝) — tautologie ;
(4) ∀𝑥 (𝑝 ⇒ 𝑞) ⇒ ∀𝑥 (¬𝑞 ⇒ ¬𝑝) — application de l’axiome de quanti-
ficateur ([Link]) ;
(5) ∀𝑥 (¬𝑞 ⇒ ¬𝑝) ;
(6) ¬𝑞 ⇒ ∀𝑥¬𝑝 — application de la variante ([Link]) de l’axiome de
quantificateur ([Link]) ;
(7) ∀𝑥¬𝑝 — application de modus ponens ;
(8) ¬∀𝑥¬𝑝 — équivalent de ∃𝑥𝑝.
Si une théorie démontre une formule close et sa négation, elle n’est pas
cohérente, donc la théorie T′ n’est pas cohérente, ce qu’il fallait démontrer.
6.4. Théories henkiniennes
Définition (6.4.1). — On dit qu’une théorie T est syntaxiquement com-
plète si elle est cohérente et si pour toute formule close 𝑚, on a ou bien T ⊢ 𝑚,
ou bien T ⊢ ¬𝑚.
6.4. THÉORIES HENKINIENNES 135
Une théorie complète est syntaxiquement complète.
Une théorie cohérente maximale est syntaxiquement complète. En effet,
si T est cohérente et maximale, et si 𝑚 est une formule close telle que
𝑚 ∉ T, alors T ∪ {𝑚} n’est pas cohérente, donc T ⊢ ¬𝑚. Par conséquent, il
découle du corollaire 6.3.7 que toute théorie cohérente est contenue dans
une théorie syntaxiquement complète.
Définition (6.4.2). — Soit T une théorie dans un langage L. On dit que T
est henkinienne si les deux propriétés suivantes sont satisfaites :
a) La théorie T est syntaxiquement complète.
b) Pour toute formule 𝑚(𝑥) en une seule variable libre 𝑥 telle que T ⊢
∃𝑥𝑚, il existe un terme clos 𝑡 dans L tel que T ⊢ 𝑚(𝑡).
En pratique, l’existence de tels termes clos sera garantie par l’existence,
pour toute formule 𝑚 telle que T ⊢ ∃𝑥𝑚, d’un symbole de constante 𝑐 tel
que 𝑚(𝑐) appartienne à T.
6.4.3. — Soit T une théorie henkinienne. On considère la relation sui-
vante dans l’ensemble TL,∅ des termes clos dans L : pour 𝑎, 𝑏 ∈ TL,∅ , on
pose 𝑎 ≡ 𝑏 si et seulement si T ⊢ (𝑎 = 𝑏). Les axiomes de l’égalité en-
traînent que c’est une relation d’équivalence. On pose alors A = TL,∅ /≡ ;
on note [𝑎] la classe dans A d’un élément 𝑎 ∈ TL,∅ .
Lemme (6.4.4). — a) Soit 𝑛 un entier, soit 𝑓 un symbole de fonction 𝑛-
aire, soit 𝑡 1, . . . , 𝑡𝑛 , 𝑢 1, . . . , 𝑢𝑛 des termes clos. Supposons que T ⊢ 𝑡𝑖 = 𝑢𝑖 pour
tout 𝑖 ∈ {1, . . . , 𝑛} ; alors T ⊢ 𝑓 𝑡 1 . . . 𝑡𝑛 = 𝑓 𝑢 1 . . . 𝑢𝑛 .
b) Soit 𝑛 un entier, soit 𝑟 un symbole de relation 𝑛-aire, soit 𝑡 1, . . . , 𝑡𝑛 , 𝑢 1, . . . , 𝑢𝑛
des termes clos. Supposons que T ⊢ 𝑡𝑖 = 𝑢𝑖 pour tout 𝑖 ∈ {1, . . . , 𝑛}. Alors
T ⊢ (𝑟𝑡 1 . . . 𝑡𝑛 ⇔ 𝑟𝑢 1 . . . 𝑢𝑛 ).
Démonstration. — Cela découle des axiomes de l’égalité. Traitons par
exemple le cas des fonctions unaire. Soit 𝑡, 𝑢 des termes clos. Remarquons
que la suite de formules suivante est une démonstration de 𝑓 𝑡 = 𝑓 𝑢 dans
la théorie T ∪ {𝑡 = 𝑢} :
a) 𝑡 = 𝑢 ;
b) (𝑥 = 𝑦) ⇒ (𝑓 𝑥 = 𝑓 𝑦) — axiome de l’égalité ;
c) (𝑡 = 𝑦) ⇒ (𝑓 𝑡 = 𝑓 𝑦) — substitution de 𝑥 par 𝑡 dans (2) ;
d) (𝑡 = 𝑢) ⇒ (𝑓 𝑡 = 𝑓 𝑢) — substitution de 𝑦 par 𝑢 dans (3) ;
136 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
e) 𝑓 𝑡 = 𝑓 𝑢 — modus ponens, (1) et (4).
D’après le théorème de déduction si l’on a T ⊢ 𝑡 = 𝑢, alors on a T ⊢ 𝑓 𝑡 =
𝑓 𝑢. Les autres cas sont analogues. □
[Link]. — Soit 𝑛 un entier et soit 𝑓 un symbole de fonction 𝑛-aire.
D’après le lemme précédent, il existe une unique application 𝑓 A : A𝑛 → A
telle que
𝑓 A ([𝑡 1 ], . . . , [𝑡𝑛 ]) = [𝑓 𝑡 1 . . . 𝑡𝑛 ] A
pour tous 𝑡 1, . . . , 𝑡𝑛 ∈ TL,∅ .
De même, soit 𝑛 un entier et soit 𝑟 un symbole de relation 𝑛-aire. D’après
le lemme précédent, il existe une unique relation 𝑛-aire 𝑟 A : A𝑛 → {⊤, ⊥}
dans A𝑛 telle que
𝑟 A ([𝑡 1 ], . . . , [𝑡𝑛 ]) = ⊤ si et seulement siT ⊢ 𝑟𝑡 1 . . . 𝑡𝑛 .
Nous avons ainsi fait l’ensemble A une réalisation du langage L. On dit
que c’est la réalisation canonique associée à la théorie henkinienne T.
Lemme (6.4.5). — Pour tout terme 𝑡 ∈ TL,∅ , on a 𝑡 A = [𝑡].
Démonstration. — On raisonne par récurrence sur la définition d’un
terme. Puisque 𝑡 est clos, il existe un entier 𝑛 ⩾ 0, un symbole de
fonction 𝑛-aire, 𝑓 , et des termes 𝑡 1, . . . , 𝑡𝑛 tels que 𝑡 = 𝑓 𝑡 1 . . . 𝑡𝑛 . Comme
𝑡 est clos, les termes 𝑡𝑖 sont clos. Par définition de l’évaluation, on a
𝑡 A = 𝑓 A (𝑡 1A, . . . , 𝑡𝑛A ). Par récurrence, on a 𝑡𝑖A = [𝑡𝑖 ] pour tout 𝑖. Par
suite, on a 𝑡 A = 𝑓 A ([𝑡 1 ], . . . , [𝑡𝑛 ]) = [𝑓 𝑡 1 . . . 𝑡𝑛 ] = [𝑡], ce qu’il fallait
démontrer. □
Théorème (6.4.6) (Henkin). — La réalisation canonique associée à une
théorie henkinienne est un modèle de cette théorie.
Démonstration. — Soit T une théorie henkinienne et soit A la réalisation
canonique qui lui est associée. Soit 𝑚 ∈ FL une formule close de L ; dé-
montrons que l’on a T ⊢ 𝑚 si et seulement si A |= 𝑚.
On raisonne par récurrence sur la définition de 𝑚. Précisément, on sup-
pose que la propriété est vraie pour toute formule close qui, soit pos-
sède strictement moins de quantificateurs que 𝑚, soit soit strictement plus
courte que 𝑚.
6.4. THÉORIES HENKINIENNES 137
a) Supposons d’abord que 𝑚 soit une formule atomique. Il existe donc
un entier 𝑛, un symbole de relation 𝑛-aire, 𝑟 , et des termes 𝑡 1, . . . , 𝑡𝑛 tels
que 𝑚 = 𝑟𝑡 1 . . . 𝑡𝑛 . Puisque 𝑚 est une formule close, les termes 𝑡𝑖 sont
clos. Par définition de l’évaluation de 𝑚 dans la structure A, on a 𝑚 A =
𝑟 A (𝑡 1A, . . . , 𝑡𝑛A ). D’après le lemme précédent, on a 𝑡𝑖A = [𝑡𝑖 ] pour tout 𝑖 ; par
suite, 𝑚 A = 𝑟 A ([𝑡 1 ], . . . , [𝑡𝑛 ]). Cela prouve que 𝑚 A = ⊤ si et seulement si
T ⊢ 𝑟𝑡 1 . . . 𝑡𝑛 , c’est-à-dire si et seulement si T ⊢ 𝑚.
b) Supposons maintenant que 𝑚 soit de la forme ¬𝑚′, où 𝑚′ est une
formule. Puisque T est cohérente, T ⊢ 𝑚 équivaut à T ⊬ 𝑚′. Par récurrence,
T ⊢ 𝑚′ si et seulement si (𝑚′) A = ⊤, donc T ⊬ 𝑚′ équivaut à (𝑚′) A = ⊥,
donc à 𝑚 A = ⊤ par définition de l’évaluation. ce que 𝑚 = ¬𝑚′ ne soit pas
démontrable
c) Supposons maintenant que 𝑚 soit de la forme (𝑚′ ∧ 𝑚′′), où 𝑚′ et
𝑚′′ sont des formules ; comme 𝑚 est une formule close, 𝑚′ et 𝑚′′ sont
closes. Par définition de l’évaluation, 𝑚 A = ⊤ si et seulement si (𝑚′) A =
(𝑚′′) A = ⊤ ; par récurrence, 𝑚 A = ⊤ équivaut donc à ce que 𝑚′ et 𝑚′′
soient démontrables dans T.
Pour conclure, on observe que (𝑚′ ∧ 𝑚′′) est démontrable dans T si et
seulement si 𝑚′ et 𝑚′′ le sont. En effet, la suite
(1) (𝑚′ ∧ 𝑚′′) ;
(2) ((𝑚′ ∧ 𝑚′′) ⇒ 𝑚′) — tautologie ;
(3) 𝑚′ — modus ponens
est une démonstration de 𝑚′ dans la théorie T ∪ {(𝑚′ ∧ 𝑚′′)}. D’après
l’exemple 6.1.8, 𝑚′ est un théorème de T si (𝑚′ ∧𝑚′′) l’est ; on raisonne de
même pour 𝑚′′. Inversement, la suite
(1) 𝑚′ ;
(2) 𝑚′′ ;
(3) (𝑚′ ⇒ (𝑚′′ ⇒ (𝑚′ ∧ 𝑚′′))) — tautologie ;
(4) (𝑚′′ ⇒ (𝑚′ ∧ 𝑚′′)) — modus ponens (1) et (3) ;
(5) (𝑚′ ∧ 𝑚′′) — modus ponens (2) et (4)
est une démonstration de (𝑚′ ∧ 𝑚′′) dans T ∪ {𝑚′, 𝑚′′ }. Ainsi, (𝑚′ ∧ 𝑚′′)
est démontrable dans T si 𝑚′ et 𝑚′′ le sont.
d) Supposons que 𝑚 = (𝑚′ ∨ 𝑚′′), où 𝑚′ et 𝑚′′ sont des formules ; elles
sont closes, car 𝑚 est une formule close. Par définition de l’évaluation et
par récurrence, 𝑚 A = ⊤ si et seulement si au moins une des deux formules
𝑚′ et 𝑚′′ est démontrable dans T.
138 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
Pour conclure, on observe que 𝑚 est démontrable dans T si et seulement
si au moins l’une des deux formules 𝑚′ et 𝑚′′ l’est. La suite
(1) 𝑚′ ;
(2) (𝑚′ ⇒ (𝑚′ ∨ 𝑚′′)) — tautologie ;
(3) (𝑚′ ∨ 𝑚′′) — modus ponens (1) et (2)
est une démonstration de 𝑚 dans T ∪ {𝑚′ }, si bien que T ⊢ 𝑚 si T ⊢ 𝑚′.
On démontre de même que T ⊢ 𝑚 si T ⊢ 𝑚′′.
Supposons inversement que ni 𝑚′, ni 𝑚′′ ne soient démontrables dans T.
Comme T est syntaxiquement complète, les formules ¬𝑚′ et ¬𝑚′′ sont des
théorèmes de T. Comme la suite
(1) ¬𝑚′ ;
(2) ¬𝑚′′ ;
(3) (¬𝑚′ ⇒ (¬𝑚′′ ⇒ ¬(𝑚′ ∨ 𝑚′′))) — tautologie ;
(4) (¬𝑚′′ ⇒ ¬(𝑚′ ∨ 𝑚′′)) — modus ponens (1) et (3) ;
(5) ¬(𝑚′ ∨ 𝑚′′) — modus ponens (2) et (4)
est une démonstration de ¬𝑚 dans T ∪ {¬𝑚′, ¬𝑚′′ }, la formule ¬𝑚 est un
théorème de T.
e) Les deux cas 𝑚 = (𝑚′ ⇒ 𝑚′′) et 𝑚 = (𝑚′ ⇔ 𝑚′′) sont laissés au
lecteur.
f) Supposons maintenant qu’il existe une formule 𝑚′ et un symbole de
variable 𝑥 tels que 𝑚 = ∃𝑥𝑚′. Comme 𝑚 est une formule close, l’ensemble
des variables libres de 𝑚′ est contenu dans {𝑥 }.
Supposons que T ⊢ 𝑚. Par définition d’une théorie henkinienne, il existe
un terme clos 𝑡 ∈ TL,∅ tel que T ⊢ 𝑚′ (𝑡). La formule 𝑚′ (𝑡) ayant un
quantificateur de moins que la formule 𝑚, l’hypothèse de récurrence af-
firme que (𝑚′ (𝑡)) A = ⊤. Puisque le terme 𝑡 est clos, la substitution de 𝑥
par 𝑡 est admissible dans 𝑚′, et l’on a (𝑚′) A (𝑡 A ) = ⊤. Cela prouve que
𝑚 A = (∃𝑥𝑚) A = ⊤.
Supposons inversement que T ⊬ 𝑚. Puisque T est syntaxiquement com-
plète, la formule ¬𝑚 = ¬∃𝑥𝑚′ est un théorème de T. La suite
(1) (∃𝑥𝑚′ ⇔ ¬∀𝑥¬𝑚′) — axiome de quantificateur ([Link]) ;
(2) (¬∃𝑥𝑚′) ;
(3) (¬𝑝 ⇒ ((𝑝 ⇔ ¬𝑞) ⇒ 𝑞)) — tautologie, appliquée avec 𝑝 =
∃𝑥𝑚′ et 𝑞 = ∀𝑥¬𝑚′ ;
(4) ((𝑝 ⇔ ¬𝑞) ⇒ 𝑞), où 𝑝 = ∃𝑥𝑚′ et 𝑞 = ∀𝑥¬𝑚′ — modus ponens,
(2) et (3) ;
6.5. LE THÉORÈME DE COMPLÉTUDE DE GÖDEL 139
(5) ∀𝑥¬𝑚′ — modus ponens, (1) et (4)
est une démonstration formelle de ∀𝑥¬𝑚′ dans T∪ {¬𝑚}, ce qui démontre
que ∀𝑥¬𝑚′ est un théorème de T. Démontrons maintenant que 𝑚 A = ⊥ ; il
s’agit de prouver que (𝑚′) A (𝑎) = ⊥ pour tout 𝑎 ∈ A. Soit donc 𝑎 ∈ A ; par
définition de A, il existe un terme clos 𝑡 tel que 𝑎 = [𝑡] = 𝑡 A . Par applica-
tion de l’axiome de quantificateur ([Link]), la formule ¬𝑚′ (𝑡) est encore
un théorème de T, donc (¬𝑚′ (𝑡)) A = ⊤ par récurrence, et donc (𝑚′ (𝑡)) A =
⊥. Par suite, (𝑚′) A (𝑎) = (𝑚′) A (𝑡 A ) = (𝑚′ (𝑡)) A = ¬(¬𝑚′ (𝑡)) A = ⊥,
comme il fallait démontrer.
g) Supposons enfin qu’il existe une formule 𝑚′ et un symbole de va-
riable 𝑥 tels que 𝑚 = ∀𝑥𝑚′. Comme 𝑚 est une formule close, l’ensemble
des variables libres de 𝑚′ est contenu dans {𝑥 }.
Supposons que 𝑚 est un théorème de T. Pour tout terme clos 𝑡, la for-
mule 𝑚′ (𝑡) déduite de 𝑚′ par substitution de 𝑥 par 𝑡 est donc un théorème
de T ; par récurrence, (𝑚′ (𝑡)) A = ⊤. Puisque le terme 𝑡 est clos, la for-
mule 𝑚′ est admissible pour la substitution qui applique 𝑥 sur 𝑡 et l’on a
(𝑚′) A (𝑡 A ) = (𝑚′ (𝑡)) A = ⊤. Comme tout élément de A est la classe d’un
tel terme, on a (𝑚′) A (𝑎) = ⊤ pour tout 𝑎 ∈ A, ce qui prouve que 𝑚 A = ⊤.
Supposons inversement que 𝑚 = ∀𝑥𝑚′ n’est pas un théorème de T.
Puisque (¬¬𝑚′ ⇒ 𝑚′) est une tautologie et que T est cohérente, la for-
mule ∀𝑥¬¬𝑚′ n’est pas un théorème de T (axiome ([Link])). Puisque T
est cohérente, la formule ¬∀𝑥¬¬𝑚′ est donc un théorème de T. Par appli-
cation de l’axiome de quantificateur ([Link]), il en est de même de la for-
mule ∃𝑥¬𝑚′. On applique alors à la formule ¬𝑚′ l’argument développé ci-
dessus. Comme T est henkinienne, il existe un terme clos 𝑡 tel que ¬𝑚′ (𝑡)
soit un théorème de T. Par récurrence, on a donc (¬𝑚′ (𝑡)) A = ⊤, d’où
(𝑚′) A (𝑡 A ) = (𝑚′ (𝑡)) A = ¬(¬𝑚′ (𝑡)) 2 = ⊥. L’élément 𝑎 = 𝑡 A de A vérifie
donc (𝑚′) A (𝑎) = ⊥, si bien que 𝑚 A = (∀𝑥𝑚′) A = ⊥. □
Corollaire (6.4.7). — Toute théorie henkinienne a un modèle.
6.5. Le théorème de complétude de Gödel
Lemme (6.5.1). — Soit T une théorie dans un langage L, soit 𝑥 un symbole
de variable, soit 𝑚 une formule de L dont la seule variable libre est 𝑥. Soit 𝑐
140 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
un symbole de constante n’appartenant pas à L. On suppose que T ⊢ 𝑚(𝑐)
dans le langage L ∪ {𝑐}. Alors, T ⊢ ∀𝑥𝑚 dans le langage L.
Autrement dit, si l’on sait prouver 𝑚(𝑐) sans rien savoir de 𝑐, c’est qu’on
sait prouver 𝑚(𝑥) pour tout 𝑥, sans faire intervenir 𝑐.
Démonstration. — Prouvons T ⊢ ∀𝑥𝑚. Soit (𝑚 1, . . . , 𝑚𝑛 ) une démonstra-
tion formelle de 𝑚. Choisissons un symbole de variable auxiliaire 𝑧 qui
n’apparaît dans aucune des formules 𝑚 1, . . . , 𝑚𝑛 . Quitte à changer les va-
riables, on se ramène au cas où 𝑧 = 𝑥.
Si 𝑝 est une formule de L, on notera 𝑝 ′ la formule déduite de 𝑝 en rem-
plaçant chaque occurrence du symbole de constante 𝑐 par 𝑥.
Si 𝑝 est un axiome de quantificateur, une tautologie, ou un des axiomes
de l’égalité, il en est de même de 𝑝 ′. Par généralisation, ∀𝑥𝑝 ′ est démon-
trable dans T.
Si 𝑝 est un axiome de généralisation 𝑚 ⇒ ∀𝑣𝑚, alors 𝑝 ′ = (𝑚′ ⇒ ∀𝑣𝑚′)
en est un également.
Supposons que 𝑝 se déduise par modus ponens de formules 𝑞 et (𝑞 ⇒ 𝑝)
telles que ∀𝑥𝑞′ et ∀𝑥 (𝑞 ⇒ 𝑝) ′ = ∀𝑥 (𝑞′ ⇒ 𝑝 ′) soient démontrables dans T.
Alors ∀𝑥𝑞′ ⇒ ∀𝑥𝑝 ′ est démontrable dans T. Par hypothèse, toute variable
libre de 𝑞 a au moins une occurrence libre dans 𝑝. Les variables libres de 𝑝 ′
sont celles de 𝑝, ainsi que 𝑥 si 𝑐 apparaît dans 𝑝, donc celles de ∀𝑥𝑝 ′ sont
celles de 𝑝 ; de même pour ∀𝑥𝑞′. On peut donc appliquer la règle modus
ponens et on en déduit que ∀𝑥𝑝 ′ est démontrable dans T.
En appliquant le raisonnement précédent par récurrence à 𝑚 1, . . . , 𝑚𝑛 ,
on en déduit que ∀𝑥𝑚𝑖′ est démontrable dans T, pour tout T. Par suite,
T ⊢ ∀𝑥𝑚. □
Proposition (6.5.2). — Soit T une théorie dans un langage L. Soit 𝑥 un
symbole de variable et soit E un ensemble de formules de 𝑚 n’ayant que 𝑥
comme variable libre ; supposons que pour tout 𝑝 ∈ E, la formule close ∃𝑥𝑝
soit un théorème de T.
Soit L′ le langage obtenu en adjoignant à L, pour toute formule 𝑝 ∈ E,
un symbole de constante 𝑐 𝑝 . Soit T′ la théorie dans le langage L′ obtenue en
adjoignant à T les formules 𝑝 (𝑐 𝑝 ), pour 𝑝 parcourant E.
La théorie T est cohérente si et seulement si la théorie T′ est cohérente.
Démonstration. — Si la théorie T′ est cohérente, alors la théorie T l’est
également puisque T ⊆ T′. Supposons donc que T soit cohérente et que T′
6.5. LE THÉORÈME DE COMPLÉTUDE DE GÖDEL 141
soit incohérente. Il existe donc une démonstration formelle de ⊥ dans T′.
Comme une démonstration formelle de T′ ne fait intervenir qu’un nombre
fini de formules, on peut supposer que l’ensemble E est fini, puis raison-
ner par récurrence sur Card(E). On est ainsi ramené au cas où E = {𝑝}.
Par hypothèse, T ∪ {𝑝 (𝑐)} ⊢ ⊥ (dans le langage L′). D’après le théorème
de déduction, T ⊢ (𝑝 (𝑐) ⇒ ⊥). D’après le lemme 6.5.1, il existe une dé-
monstration formelle de ∀𝑥 (𝑝 ⇒ ⊥) dans la théorie T et le langage L.
Il reste à observer que si T ⊢ ∃𝑥𝑝 et T ⊢ ∀𝑥 (𝑝 ⇒ ⊥), alors T ⊢ ⊥, ce qui
est un cas particulier de l’exemple 6.3.10. □
Théorème (6.5.3) (Gödel). — Toute théorie cohérente possède un modèle.
C’est le théorème de complétude de Gödel (1930). Il signifie en effet que
les règles de déduction qui interviennent dans une démonstration for-
melle sont complètes, au sens où elles permettent de déduire tout ce qui
peut l’être.
Démonstration. — Soit T une théorie cohérente. On définit de la façon sui-
vante une suite (L𝑛 ) de langages et une suite (T𝑛 ) de théories syntaxique-
ment complètes où, pour tout 𝑛 ⩾ 1, L𝑛+1 est une extension du langage L𝑛
et T𝑛+1 est une théorie dans le langage L𝑛+1 qui contient T𝑛 . On choisit
pour T0 une complétion syntaxique de T. Supposons T𝑛 définie. Notons
alors E𝑛 l’ensemble des formules 𝑝 de L𝑛 en une seule variable libre 𝑥 telles
que T𝑛 ⊢ ∃𝑥𝑝. Soit L𝑛+1 le langage obtenu en adjoignant à L𝑛 des symboles
′
de constantes 𝑐 𝑝 , pour 𝑝 ∈ E𝑛 . Soit T𝑛+1 la théorie obtenue en adjoignant
à T𝑛 les formules 𝑝 (𝑐 𝑝 ), pour 𝑝 ∈ E𝑛 . D’après la proposition 6.5.2, la théo-
′
rie T𝑛+1 est cohérente. Soit T𝑛+1 une complétion syntaxique de T𝑛+1 ′ .
Soit L′ le langage réunion des langages L𝑛 et soit T′ la théorie réunion
des théories T dans le langage L′. Démontrons que T′ est une théorie hen-
kinienne :
– C’est une réunion croissante de théories cohérentes, donc elle est co-
hérente.
– Prouvons qu’elle est syntaxiquement complète. Soit 𝑚 une formule
close dans le langage L′. Il existe un entier 𝑛 tel que 𝑚 soit une formule du
langage L𝑛 . Puisque T𝑛 est syntaxiquement clos, on a T𝑛 ⊢ 𝑚 ou T𝑛 ⊢ ¬𝑚.
Par suite, T′ ⊢ 𝑚 ou T′ ⊢ ¬𝑚.
– Démontrons enfin que pour toute formule 𝑝 du langage L′ en une
seule variable libre 𝑥 telle que T′ ⊢ ∃𝑥𝑝, il existe un terme clos 𝑡 de L′ tel
142 CHAPITRE 6. THÉORIE DE LA DÉMONSTRATION — RAISONNER
que 𝑝 (𝑡). Il existe un entier 𝑛 tel que 𝑝 soit une formule du langage L𝑛 .
Alors, 𝑐 𝑝 est un symbole de constante de L𝑛+1 et la formule close 𝑝 (𝑐 𝑝 )
′ , donc à T
appartient à T𝑛+1 ′
𝑛+1 , donc à T .
D’après le théorème de Henkin (théorème 6.4.6), la théorie T′ possède un
modèle.
Soit A un modèle de T′. Comme le langage L′ contient L, on déduit
de A une réalisation du langage L en oubliant les symboles de constantes
ajoutés. Soit 𝑚 une formule close du langage L qui appartient à T. C’est
une formule close de L′ appartenant à T′, donc elle est satisfaite dans A.
Par suite, A est un modèle de T. □
Corollaire (6.5.4). — Soit T une théorie et soit 𝑚 une formule close. Si 𝑚
est satisfaite dans tout modèle de T, alors 𝑚 est démontrable dans T.
Démonstration. — Supposons que 𝑚 ne soit pas démontrable dans T.
D’après le corollaire 6.3.9, la théorie T ∪ {¬𝑚} est cohérente. D’après
le théorème de complétude, elle possède un modèle. Dans ce modèle, la
formule 𝑚 n’est pas satisfaite. □
Corollaire (6.5.5) (Compacité). — Soit T une théorie. Pour que T soit
consistante, il faut et il suffit que toute partie finie de T soit consistante.
Démonstration. — En effet, consistance et cohérence coïncident, en vertu
du théorème de complétude. Le corollaire découle donc du théorème de
finitude. □
BIBLIOGRAPHIE
Cori, René et Daniel Lascar (2003a). Logique mathématique, tome 1. Cal-
cul propositionnel, algèbre de Boole, calcul des prédicats. Dunod. isbn :
210005452X.
– (2003b). Logique mathématique, tome 2. Fonctions récursives, théorie des
modèles. Dunod. isbn : 2100054538.
Doxiadis, Apostolos et Christos H. Papadimitriou (2009). Logicomix—
An epic search for truth. Character design and drawings by Alecos Papa-
datos, color by Annie Di Donna. Bloomsbury Press, New York, p. 347.
isbn : 978-1-59691-452-0.
Poizat, Bruno (2000). A course in model theory. An introduction to contem-
porary mathematical logic. Universitext. Translated from the French
by Moses Klein and revised by the author. Springer-Verlag, New York,
p. xxxii+443. isbn : 0-387-98655-3. doi : 10.1007/ 978-1-4419-8622-1.
INDEX