La gravitation selon Einstein : théorie et principes
La gravitation selon Einstein : théorie et principes
2
cité par J. Eisenstaedt in Avant Einstein, Seuil 2005.
3
“Est-il concevable que le principe de relativité vale aussi pour des systèmes qui sont accélérés les uns par rapport aux
autres ?”Jahrb. Rad. Elektr., 4 (1907), 411, cité par A. Pais in Subtle is the Lord, p. 179.
1
Cette idée comporte plusieurs facettes. La première, dite de covariance générale,4 consiste à écrire les
lois de la dynamique de sorte qu’elles préservent leur forme (soient “invariantes”) dans un changement général
de coordonnées. Ainsi par exemple (comme nous l’avons vu au chapitre précédent), dans tout repère, inertiel
ou non, l’équation du mouvement d’une particule de masse m, de quadri-vecteur vitesse u de composantes
i
ui = dx i i i
dτ dans le système de coordonnées x (x = x (τ ) étant sa ligne d’univers, τ son temps propre) s’écrit
sous la forme
D̃ui dui 1
m D̃u u = F ⇐⇒ m = F i ⇐⇒ + Γ̃ijk uj uk = F i (1.1)
dτ dτ m
où les symboles de Christoffel Γ̃ijk caractérisant la dérivée covariante D̃ sont déterminés par le système de
coordonnées choisi et où F est un vecteur contravariant décrivant la force (de composantes F i dans le système
de coordonnées xi ) à laquelle la particule est soumise.
Bien que mathématiquement élémentaire dans le cadre de la relativité restreinte où coordonnées de
temps et d’espace ont même statut, cette formulation covariante de la loi de la dynamique a néanmoins pour
intéressant corollaire (comme nous l’avons souligné au chapitre précédent) de montrer de manière explicite
l’origine géométrique des forces d’inertie. Ainsi le caractère non-inertiel du repère se manifeste dans les
symboles de Christoffel Γ̃ijk , c.-à-d. dans la métrique, grandeur géométrique.
Une seconde facette du principe de relativité générale, beaucoup plus riche de contenu, fut de chercher
à assigner une origine géométrique à toutes les forces, d’inertie et réelles—d’absorber en quelque sorte le
vecteur F dans un opérateur D. Ainsi toutes les forces seraient des manifestations de la géométrie, tout
mouvement serait libre, mais s’effectuerait dans un espace-temps géométriquement plus complexe que ceux
jusqu’alors considérés. On sait qu’Einstein réussit en 1916 à réduire ainsi la force de gravitation ; les autres
résistent encore...
2. Le principe d’équivalence5
Le “pied de biche” qu’Einstein utilisa pour “fracturer l’espace-temps absolu” (Thibault Damour), et en
extraire la gravitation, fut le fait curieux que tous les corps tombent de la même façon dans un champ de
gravitation.6
La mécanique newtonienne “explique” ce fait par une égalité fortuite des masses grave et inerte. Mais
cette égalité, comme Einstein le dévoila, n’est pas anodine. En effet l’accélération à laquelle une particule
libre est soumise du fait que son mouvement est rapporté à un système de référence non-inertiel ne dépend
que du mouvement du référentiel, et non des propriétés intrinsèques de la particule, comme sa masse inerte.
Dans un champ d’inertie donc, comme dans un champ de gravitation, tous les corps “tombent” de la même
façon.
Cette similarité conduisit Einstein à ériger en postulat l’égalité des masses inerte et grave et à identifier
forces d’inertie et de gravitation. C’est le principe d’équivalence.
Ce principe, lui-aussi, a plusieurs facettes. La première est que, les forces d’inertie étant d’essence
géométrique, la gravitation doit l’être également (et donc “encodable” dans les symboles de Christoffel d’une
dérivation covariante). Il implique par ailleurs qu’une accélération peut simuler un champ de gravitation :
ainsi un observateur accéléré (comme celui de Rindler, voir chapitre précédent) peut légitimement mettre ses
observations (un décalage de fréquence par exemple) sur le compte d’un champ de gravitation plutôt que sur
celui d’effets cinématiques liés au mouvement de son référentiel—comment créer un tel champ n’est pas ici
4
ou d’indifférence, cf T. Damour in “Einstein aujourd’hui”, CNRS edts, 2005 et in “Si Einstein m’était conté”, Cherche-Midi
Edt, 2005.
5
“Der glücklichste Gedanke meines Lebens”, Einstein (1920).
6
Cette idée lui vint à l’esprit un jour où “j’étais assis à mon bureau de l’office des brevets de Berne ; soudain je pensai
que si quelqu’un tombait en chute libre, il ne sentirait pas son propre poids. Je fus surpris. Cette simple pensée fit une forte
impression sur moi (...) Car pour un observateur tombant d’un toit, il n’existe pas de champ de gravitation. S’il laisse tomber
des objets, ils resteront au repos par rapport à lui, ou en mouvement uniforme (...) Il est donc en droit de se trouver au repos”.
(Cité par A. Pais, op. cit. pp. 178–179.)
2
la question. Réciproquement, un champ de gravitation réel (par exemple celui de la terre ou du soleil) peut
être effacé par une accélération : un observateur en co-mouvement, c’est-à-dire qui tombe en chute libre,
dans un nuage de particules en chute libre elles aussi, peut légitimement ignorer le champ de gravitation
dans lequel il tombe et considérer comme libres les particules qui l’entourent et tombent avec lui, voir Note
6.
Un intéressant corollaire de ce principe est la claire reconnaissance que la notion de particule libre (du
moins au regard de la gravitation) n’a pas grand sens : une particule libre est, pour un observateur accéléré,
soumise à un champ (le champ d’accélération de son repère) ; quant aux particules attirées par le soleil par
exemple, elles sont libres pour un observateur en co-mouvement. Or la définition des repères inertiels repose
sur la notion de particule libre. Si aucune ne l’est ou si elles le sont toutes, c’est toute la classe des repères
inertiels qui disparaı̂t à son tour dans les limbes.
3. Une mosaı̈que de M4
Le principe d’équivalence stipule que tout champ gravitationnel peut être gommé. Voyons plus précisé-
ment dans quel sens.
Le champ de forces d’inertie subi par des particules libres que mesure un observateur accéléré peut
être entièrement effacé par un changement de système de référence i.e. par un changement du mouvement
de l’observateur ; l’effacement est global dans le sens où, dans le nouveau référentiel, inertiel, toutes les
particules ont in aeternum un simple mouvement rectiligne uniforme.
En revanche, pour un observateur qui se met en chute libre, le champ de gravitation ne s’évanouit pas
complètement : dans son référentiel en co-mouvement, deux particules initialement au repos y demeurent,
leur distance reste invariable, mais pendant un certain temps seulement, d’autant plus court que la précision
des mesures est grande ; en effet la distance entre les particules diminue en fait peu à peu car la force de
Newton fait converger leurs trajectoires vers le centre de gravité du corps qui les attirent. Ainsi la propriété
d’effacement n’est que locale : à tout moment, en tout lieu, il existe un système de référence “en chute libre”
où le champ de gravitation s’évanouit, où les particules peuvent être au repos, mais le système dépend du
lieu et du moment.
On est ainsi conduit à se représenter le cadre spatio-temporel où se formuleront les lois de la gravitation
comme une “mosaı̈que de petits éclats de l’espace-temps de Minkowski” (Thibault Damour). Dans chaque
éclat, c’est-à-dire localement, l’espace-temps est quasi-minkowskien, la gravitation peut être ignorée, et on
postule que tous les résultats de la relativité restreinte y sont valables. C’est le principe de relativité locale.7
4. Le “mollusque” de référence
La mécanique newtonienne postule l’existence de trièdres matériels solides dont les distances spatiales
entre les constituants (mesurées à l’aide de règles rigides) sont constantes et dont les axes restent orthornormés
au cours du mouvement. De tels trièdres peuvent (en principe) servir de systèmes de référence globaux
quadrillant tout l’espace, où tester les lois de la mécanique écrites dans tout repère accéléré, déduit du repère
absolu par déplacement rigide. (Et si les lois de la mécanique n’y sont pas vérifiées c’est a priori que le solide
se disloque sous l’effet des forces d’inertie qu’il subit.)
En relativité restreinte en revanche, les corps solides, référentiels globaux quadrillant tout l’espace, ne
matérialisent de facto que les repères inertiels. La raison en est simple : le passage à un repère accéléré
s’effectue par un changement non linéaire des coordonnées impliquant le temps, transformation dont il serait
inutilement restrictif d’exiger qu’elle préserve l’orthogonalité des axes spatiaux, cf chapitre 2. Comme de
plus le principe d’équivalence fait perdre aux repères inertiels leur statut privilégié, la notion de corps rigide
de référence fut en fin de compte abandonnée par Einstein.8
En relativité générale l’espace-temps devient ainsi un simple continuum, un ensemble d’événements
différenciés par leur étiquetage dans un repérage quelconque. On peut si l’on veut se figurer ce continuum
et son “mollusque” de référence comme un océan peuplé de bathyscaphes reliés par de lâches filins, dont les
7
Mathématiquement cela signifie (voir plus bas) que les bases orthonormées de l’espace tangent sont quasi-holonomes.
8
“Dans les champs gravitationnels il n’y a pas ce qu’on appelle de corps rigides aux propriétés euclidiennes : ainsi le corps
rigide fictif de référence n’est-il d’aucune utilité dans la théorie générale de la relativité”, in Relativity, The Special and General
Theory, Methuen, 1954.
3
mouvements relatifs sont mesurés au temps d’une horloge arbitraire.9 Au voisinage de tout point on peut
cependant passer de ce “mollusque” à un “quadrillage” local de coordonnées minkowskiennes c’est-à-dire
passer à un repère momentanément inertiel, en chute libre.10
5. Un espace-temps pseudo-riemannien
L’espace est représenté en physique newtonienne par un espace “absolu” euclidien ; en relativité générale,
l’espace et le temps sont représentés par une variété, continuum de points p repérés par quatre coordonnées
xi qui localement se réduit à l’espace-temps de Minkowski, ainsi que nous venons de le voir.
Une variété est beaucoup moins structurée qu’un espace euclidien car si on peut y définir localement (i.e.
sur l’espace tangent du point considéré) des grandeurs géométriques, vecteurs, tenseurs etc, les notions de
parallélisme et de distance n’y sont pas a priori définies. Pour pouvoir comparer des grandeurs en des points
différents, et connecter entre eux les différents éclats de M4 (i.e. les espaces tangents), il faut lui adjoindre une
structure supplémentaire. Le rôle d’une connexion est de définir le transport parallèle des tenseurs (voir plus
bas) ; plus particulièrement, elle permet de construire les courbes auto-parallèles (c.-à-d. les plus “droites”
possible) d’une variété, de la façon suivante : si leurs lignes d’univers sont p = p(λ) (⇔ xi = xi (λ)), et si
dp i
u = dλ (⇔ ui = dx dλ ) sont leurs vecteurs tangents, alors leur équation est
dui
Du u = 0 ⇐⇒ + Γjki uj uk = 0, (5.1)
dλ
où les 64 coefficients de connexion Γjki sont des fonctions a priori arbitraires des coordonnées. Si par simple
changement de coordonnées ils peuvent être annulés en tous points (ce qui implique qu’ils peuvent être
exprimés en termes de 4 fonctions des coordonnées seulement, cf livre ND-JPU ou chapitre précédent), alors
la variété n’est autre que M4 lui-même ; dans le cas contraire la variété est dite courbe.
Afin maintenant qu’un observateur en co-mouvement puisse comparer à deux instants notablement
différents les distances entre deux particules et en inférer par exemple l’existence d’une masse centrale qui
l’attire, une structure métrique définissant la notion de distance doit être également introduite. C’est le rôle
du tenseur métrique
g = gij dxi dxj (5.2)
où les 10 fonctions gij sont a priori arbitraires. La donnée d’une métrique permet de définir les courbes
géodésiques, c’est-à-dire des courbes de longueur extrémale. Au voisinage de chaque point les coefficients gij
peuvent être réduits par changement de coordonnées aux coefficients ηij de la métrique de Minkowski mais il
n’est pas possible en général de le faire globalement (cela n’est possible que s’ils peuvent s’exprimer à l’aide
de 4 fonctions seulement, cf livre ND-JPU ou chapitre précédent).
Les notions de parallélisme et de distance sont conceptuellement distinctes mais toute métrique peut
définir une de connexion de Levi-Civita (symétrique). Dans ce cas les 64 coefficients de connexion prennent
le nom de symboles de Christoffel et s’expriment en fonction des 10 composantes de la métrique sous la forme
(cf livre ND-JPU ou chapitre précédent)
i 1 il ∂gkl ∂glj ∂gjk
Γjk = g + − . (5.3)
2 ∂xj ∂xk ∂xl
Auto-parallèles et géodésiques deviennent alors un seul et même objet. Une variété ainsi munie d’une
métrique et de sa connexion de Levi-Civita associée est une variété (pseudo)-riemannienne (“pseudo” car la
9
“Des corps de référence non-rigides sont utilisés, qui de manière générale non seulement se meuvent de n’importe quelle
façon mais subissent également des modifications de forme ad libitum pendant leur mouvement (...) Ce corps de référence
non-rigide, qui peut de manière appropriée être qualifié de “mollusque de référence”, est en gros équivalent à un système de
coordonnées gaussiennes choisi arbitrairement”, A. Einstein, ibidem.
10
Mathématiquement cela signifie que l’on peut passer, dans l’espace tangent d’un point donné, de la base naturelle associée
aux coordonnées gaussiennes utilisées à un repère orthonormé, quasi-holonome au voisinage du point. Voir par exemple au
chapitre précédent un exemple explicite de construction d’un tel repère inertiel tangent (repère de Rindler).
4
métrique doit se ramener localement à ηij plutôt que δij ). Ce sont de telles variétés pseudo-riemanniennes
qui représentent l’espace et le temps en relativité générale.
Un tel espace est courbe dans le sens qu’en général les auto-parallèles s’y coupent (cf les trajectoires
des particules “libres” dans un repère en co-mouvement, qui se rejoignent au centre de gravité). Dans le
cas exceptionnel où il est plat, il existe alors un système de référence minkowskien global (tous les “éclats”
peuvent être “recollés”).
En relativité générale tout comme en relativité restreinte, la métrique est une structure conférée à
l’espace-temps. Mais alors qu’en relativité restreinte cette structure, qui peut se ramener à ηij , est donnée
a priori, elle est en relativité générale une grandeur physique conditionnée par la distribution de masse.
L’espace-temps de la relativité générale n’est donc pas un réceptacle passif de la matière.
C’est-là la mise en forme par Einstein d’un complexe d’idées promues par Ernst Mach dont les aspects
les plus saillants sont que (a) l’inertie d’une particule doit être due à une interaction avec toutes les masses
de l’univers, (b) l’espace n’a pas d’existence en soi, indépendamment de la matière.
On voit que si la relativité générale incorpore d’une certaine manière la première idée (puisque forces
d’inertie et de gravitation ne sont plus distinguées), elle ne traduit en revanche pas la seconde. En effet, en
l’absence de matière, l’espace-temps ne se réduit pas à “rien”, mais à l’espace-temps de Minkowski. Einstein
ne réalisa donc pas complètement son ambition.11
6. Décalage spectral gravitationnel
Einstein illustra dès 1907 (puis en 1911) la richesse des concepts de la relativité générale par des
expériences de pensée (“Gedankenexperimente”) restées célèbres. En voici une, qui utilise les repères inertiels
tangents de façon typiquement einsteinienne (et qui n’est qu’une autre version des calculs faits au chapitre
précédent) : considérons dans un repère inertiel S loin de toute masse une “tour” de longueur h accélérée
le long de l’axe z (on prendra l’accélération constante, égale à g dans le sens des z positifs). A l’instant du
départ (quand sa vitesse est nulle) un signal (bref) de durée ∆T est émis de z = 0 (il n’y a pas de confusion
possible sur cette durée : observateur en z = 0 dans la tour et observateur inertiel “tangent” sont au repos
dans S). Le signal atteint z = h environ h/c secondes plus tard et la tour a alors la vitesse v ≈ gh/c—si
v 2
c (≈ gh/c ) est suffisamment petit. Le signal est alors observé à cet endroit par un observateur inertiel tan-
gent ayant la vitesse v qui mesure, au premier ordre en v/c (effet Doppler), une durée ∆T 0 ≈ ∆T (1 + gh/c2 )
(en négligeant la dilatation du temps qui est un effet du second ordre).
Les observateurs de la tour subissent le champ d’accélération g. Or le principe d’équivalence stipule
qu’un tel champ est (localement) indiscernable d’un champ de gravitation et le même phénomène doit donc
se produire dans un champ de gravitation, par exemple celui de la terre. Alors ∆T est le temps mesuré en
bas de la tour et ∆T 0 le temps mesuré en haut ; un signal de fréquence ν, émis du bas d’une tour de hauteur
h sera ainsi observé au sommet avec une fréquence inférieure donnée par
gh Uhaut Ubas
νhaut ≈ ν 1 − 2 ≈ ν 1 − + 2 (6.1)
c c2 c
2
où l’on a introduit le potentiel de gravitation terrestre U = −GM⊕ /(R⊕ + h), g ≡ GM⊕ /R⊕ .
Einstein poursuivit son raisonnement de la façon suivante : la différence des fréquences prédite signifie
que l’horloge au sol retarde par rapport à celle en h (le même processus prend moins de temps au sol qu’en h).
Ainsi la lumière parcourt les mêmes distances plus vite au sol qu’en h ; sa vitesse au sol est donc plus grande
qu’en h, et l’on a : c(0) ≈ c(h)[1 + (Uem − Urec )/c2 ]. Prenons pour sol la surface du soleil, posons c(0) = c0 ,
et faisons tendre h vers l’infini. On a alors c0 ≈ c(1 + GM /c2 R ). C’est là l’expression, obtenue en théorie
newtonienne, de la vitesse d’un corpuscule lumineux près du soleil (cf livre ND-JPU). En reprenant le calcul
11
“J’espérais montrer que l’espace-temps n’était pas nécessairement quelque chose à quoi on puisse assigner une existence
séparée, indépendamment des objets concrets de la réalité physique. Les objets physiques ne sont pas dans l’espace, ils ont
une extension spatiale. En ce sens le concept d’“espace vide” perd son sens (...) Il n’existe pas d’espace vide, c’est-à-dire
d’espace sans champ. L’espace-temps ne prétend pas à une existence propre, mais n’est qu’une propriété structurelle du champ.
Ainsi Descartes n’était pas si loin de la vérité lorsqu’il pensait qu’il fallait refuser l’existence à l’espace vide”, A. Einstein, in
Relativity, Methuen 1954.
5
newtonien Einstein en déduisit (en 1907) que la lumière devait être défléchie par le soleil, d’un angle égal à
l’angle newtonien, soit 0.9”. Ce résultat malheureusement est faux (et montre que l’intuition peut parfois
être mauvaise conseillère...). En effet Einstein ignora dans son raisonnement, qui ne fait intervenir que le
temps, la courbure de l’espace, dont l’effet sera, comme nous le verrons, de doubler la valeur de l’angle.
Reprenons l’expérience de pensée ci-dessus en faisant les calculs dans le repère accéléré qu’est la tour.
Les coefficients de la métrique gij sont différents de ηij . Comme nous l’avons vu au chapitre précédent
fréquences d’émission (le bas de la tour) et de réception (le haut) sont alors liées par
s
g00 (bas) Ubas Uhaut GM GM
νhaut = ν ≈ν 1+ 2 − = ν 1 − + ,
g00 (haut) c c2 c2 Rbas c2 Rhaut
7. Variété riemanienne
N.B. : Pour plus de rigueur mathématique on se reportera avec profit à tout traité de géométrie différentielle.
Considérons un espace topologique M , c.-à-d. un ensemble de points m pour lequel la notion de voisinage est
définie.
Une carte φ de M est un homéomorphisme (i.e. une application bijective bi-continue) d’un ouvert U de M dans Rn
(le produit cartésien itéré n fois de l’ensemble des réels R avec lui-même); n est la dimension de la variété et de la carte.
φ associe ainsi à tout m de U un n-uple de nombres réels xi , i = 1, 2, ..., n—les coordonnées de m dans la carte φ.
On peut donc considérer φ comme un ensemble de n applications X i associant les nombres xi à m: X i (m) = xi . Par
abus de langage on appelle aussi coordonnées les X i et la carte φ un système de coordonnées. N.B.: ces coordonnées
ne sont rien d’autre qu’un étiquetage différentiant les points de U .
Considérons maintenant deux voisinages U et U 0 de M s’intersectant. Leurs cartes φ et φ0 sont dites C k -reliées si
la transformation entre leurs coordonnées est de classe C k .
6
Un atlas est une famille de cartes φi dont les domaines Ui recouvrent M .
Une variété différentiable de classe C k est un espace topologique (“de Haussdorf, séparable”) muni d’atlas dont
les cartes sont C k -reliées.
Exemples de variétés:
- Rn , avec comme carte l’application identité,
- S 1 (le cercle), les produits cartésiens R × R (le plan), R × S 1 (cylindre), S 1 × S 1 (tore), etc,
- Les surfaces lisses à deux dimensions, par exemple la sphère S 2 dont un atlas contient au moins deux cartes.
N.B.1 : Dans la suite on fera souvent comme si l’atlas ne contenait qu’une seule carte. Mais il faut garder présent à
l’esprit que dans le cas général il faut plusieurs cartes pour couvrir la variété.
N.B.2 : Etant donné que toute variété de dimension n est localement homéomorphe à Rn , deux variétés de même
dimension et de même classe de différentiabilité ne peuvent, localement, être distinguées (leurs structures globales, en
revanche, peuvent différer—cf R2 versus S 2 ). Par la suite nous identifierons donc le plus souvent M à Rn .
8. Espaces tangent12 et cotangent13
Soit Fm l’ensemble des fonctions f , C ∞ , de U (ouvert de M contenant m) dans R. Une tangente, ou vecteur
tangent, ou dérivation en m à M est une application v de Fm dans R telle que, pour tout f, g ∈ Fm , a, b ∈ R :
v est linéaire : v(af + bg) = av(f ) + bv(g)
v satisfait à la règle de Leibniz : v(f g) = f v(g) + gv(f ).
N.B. : une tangente est définie “en m” car elle agit sur des fonctions F (ou f ) prenant leurs valeurs en m (ou xi ).
L’ensemble des tangentes en m forment l’espace tangent, Vm , en m à M . C’est un espace vectoriel (on peut y
définir une addition et la multiplication par un réel) de même dimension, n, que la variété. On notera hi , i = 1, 2...n une
base générique de Vm . N.B : les espaces Vm et Vp associés à deux points m et p différents, sont différents (cf l’exemple
des plans tangents à la sphère).
Un champ de vecteurs est une application qui, en chaque point m de M , sélectionne de façon continue un vecteur
de l’espace tangent correspondant.
Considérons les fonctions gi = ∂f /∂xi . On peut les considérer comme le résultat de l’action sur f (en xi ) des
opérateurs ∂/∂xi , notés aussi ∂i lorsqu’il n’y a pas de confusion possible sur le système de coordonnées xi choisi. Ce sont
des tangentes (ils satisfont aux axiomes de définition) et forment une base de l’espace tangent, la base naturelle associée
aux coordonnées xi . Toute tangente t se décompose donc selon : t = ti ∂i où les nombres réels ti sont les composantes
de t dans la base ∂i ou, par abus de langage, dans les coordonnées xi .14
Considérons l’espace tangent en m(xi ) à M , Vm . Les applications linéaires, ω , de Vm dans R sont les 1-formes
∗ ∗
et leur ensemble constitue l’espace dual ou cotangent, Vm , de Vm . Vm est, tout comme Vm , un espace vectoriel, de
même dimension, n. On appelle base associée (ou conjuguée) de la base hi de Vm les 1-formes θ i , i = 1, 2...n telles
j
que θ j (hi ) = δi .
Une 1-forme ω associe un nombre a à une tangente v . De manière équivalente on peut dire qu’à la paire (v, ω ) on
associe a. On peut donc inverser le point de vue et introduire une application, ṽ , qui à ω associe a. Cette application
∗∗ ∗
appartient au dual Vm de Vm qui est isomorphe à Vm . On peut donc identifier ṽ à la tangente v .
Considérons la fonction f (x1 , ..., xi , ...xn ) = xi de Rn dans R. L’ensemble (i = 1, 2...n) des 1-formes dxi définies
j
par : dxj (∂i ) = δi constitue la base naturelle de l’espace cotangent en m associée aux coordonnées xi . Toute forme λ
se décompose donc selon λ = λi dxi où les nombres λi sont les composantes de λ dans les coordonnées xi .15
j
Remarque : par dualité, on a aussi : ∂i (dxj ) = δi .
12
La notion d’espace tangent a déjà été introduite lors de la description des espaces plats (euclidiens ou minkowskiens) E ,
cf livre ND-JPU et chapitre 2. Ils n’étaient alors que des “copies” de l’espace vectoriel E sous-jacent, attachées à chaque point
p, isomorphes entre elles et à E . On se place maintenant dans le cas où ces identifications ne sont plus possibles a priori, cf par
exemple la sphère et ses plans tangents.
13
On généralise ici les définitions données en espace plat dans le cadre linéaire des coordonnées cartésiennes, et lorsque
l’espace est repéré par des coordonnées curvilignes, cf livre ND-JPU et chapitre 2.
14
La loi de transformation de cette base dans un changement de coordonnées a été donnée au chapitre précédent.
15
La loi de transformation de cette base dans un changement de coordonnées a été donnée au chapitre précédent.
7
9. Tenseurs16
∗
sont les espaces tangent et dual en m à la variété M , un tenseur T de type pq est une application
Si Vm et Vm
∗
multilinéaire du produit cartésien de p Vm et de q Vm dans R. C’est donc une opération qui associe un nombre réel a à
p 1-formes ω(i) et à q vecteurs v(j) : T (ω(1) , ..., ω(p) , v(1) , ..., v(q) ) = a. p est le degré de contravariance, q le degré
de covariance.
Cas particuliers : un tenseur de type 00 est un scalaire (un réel) ; un tenseur de type 0
1 , une fois covariant, est une
1-forme ; un tenseur de type 10 , une fois contravariant, est un vecteur tangent.
Le produit tensoriel (ou direct) ⊗ d’un vecteur de la base naturelle et d’une 1-forme de base de l’espace cotangent,
∂i ⊗ dxj , agit sur des couples de 1-formes et de tangentes pour donner un réel et est défini par : (∂i ⊗ dxj )(dxk , ∂l ) =
δik δjl . L’opération se généralise aisément à des tenseurs de type quelconque et permet de construire une base sur laquelle
i ...i i ...i
décomposer un tenseur de type pq selon T = Tj11...jqp ∂i1 ⊗ ... ⊗ ∂ip ⊗ dxj1 ⊗ ... ⊗ dxjq . Les nombres Tj11...jqp sont les
où (a, b) = (1, 2) et qui se déduisent l’un de l’autre par la transformation : x1 = R sin θ cos φ et x2 =
R sin θ sin φ. On peut les considérer comme la restriction, sur la surface r = R, de l’élément de longueur
euclidien tri-dimensionnel dS 2 = dr2 + r2 (dθ2 + sin2 θdφ2 ). Ils donnent donc l’élément de longueur sur une
sphère de rayon R.
Une sphère (ou une portion de sphère) se distingue d’un plan. Pour le montrer de manière intrinsèque,
c.-à-d. sans plonger l’espace considéré (ici la sphère) dans un espace euclidien de dimension supérieure,
plusieurs méthodes (développées par Gauss) sont possibles. Par exemple, sur une sphère, et contrairement
à ce qui se passe dans un plan :
- un vecteur transporté parallèlement à lui-même le long d’un circuit fermé ne retrouve pas son orien-
tation initiale ;
16
On généralise ici les définitions données en espace plat dans le cadre linéaire des coordonnées cartésiennes, et lorsque
l’espace est repéré par des coordonnées curvilignes, cf livre ND-JPU et chapitre précédent.
17
La loi de transformation des tenseurs dans un changement de coordonnées a été donnée au chapitre précédent.
8
- la somme des angles d’un triangle délimité par des géodésiques est supérieure à 180◦ ; (on raconte que
Gauss essaya, sans succès !, de vérifier cela sur le terrain ;)
- la circonférence C d’un cercle de rayon r n’y est pas égale à 2πr mais à 2πR sin(r/R) ; [on en déduit
−2
que π3 2πr−C
r 3 → R quand r → 0 ;]
- la distance η entre deux grands cercles (des géodésiques) n’est pas proportionnelle à la distance s
parcourue depuis le pôle; (on montre qu’elle satisfait à l’équation de “déviation géodésique” : d2 η/ds2 =
−η/R2 .)
Tous ces écarts à la géométrie euclidienne disparaissent lorsque R → ∞. Ainsi R ne mesure pas seulement
la courbure “extrinsèque” d’une sphère, c.-à-d. son rayon dans l’espace euclidien à trois dimensions dans
lequel on peut la plonger; il mesure aussi sa courbure “intrinsèque”, dite aussi de Gauss.
11. Dérivation covariante, transport parallèle et courbure
j ...j
La dérivée covariante d’un champ de tenseurs de type pq par rapport à xi , Di Tk11...kpq , est définie “en
où les coefficients de connexion Γkij définissent la dérivation. On peut voir cette opération comme associant
p
au tenseur T un tenseur de type q+1 . De manière équivalente on peut la définir intrinsèquement par (cf
livre ND-JPU ou chapitre précédent)
j ...j
D∂i T ≡ Di T = Di Tk11...kpq ∂j1 ⊗ ... ⊗ ∂jp ⊗ dxk1 ⊗ ... ⊗ dxkq (11.2)
auquel cas elle associe au tenseur T un tenseur de même type. Enfin, plus généralement
Dv T = v i D∂i T ≡ v i Di T (11.3)
i
définit la dérivée covariante de T le long du vecteur v = v ∂i .
La dérivation covariante associe à un tenseur un autre tenseur défini au même point m. Mais c’est
également (tout comme la dérivation ordinaire) une opération qui, par “développement de Taylor”, permet
de transporter le tenseur T parallèlement à lui-même du point m à un point proche p, et ainsi de connecter
les espaces tangents de p et q (d’où le nom de connexion donné à l’opérateur D). On pourra ainsi par exemple
comparer T , défini en p, à un autre tenseur défini en q ou voir comment le champ de tenseur T (xi ) varie de
point en point.
Le transport parallèle d’un vecteur ti le long d’un courbe xj (λ) de vecteur tangent uj = dxj /dλ est
défini “en composantes” par :
Dti dti
≡ uj Dj ti = + Γijk uj tk = 0 (11.4)
dλ dλ
ou, de manière intrinsèque et équivalente, par
i
dt
Du t = Du (ti ∂i ) = uj (∂j ti + tk Γijk )∂i = + Γijk uj tk ∂i = 0 (11.5)
dλ
Si les composantes ti sont connues en λ = λ0 , l’équation ci-dessus les détermine uniquement pour tout λ ; en
effet on a, en notant tipar (xl + dxl ) le résultat du transport parallèle de ti de xl à xl + dxl , (avec dxl = ul dλ) :
1
tipar (xl + dxl ) = ti (xl ) − Γijk tk dxj − (∂l Γijm − Γijk Γklm )tm dxj dxl + O[(dx)3 ] (11.6)
2
(En espace plat et coordonnées cartésiennes où tous les coefficients de connexion sont nuls on retrouve le
résultat bien connu : tipar (xl + dxl ) = ti (xl ).)17
i
17
De manière analogue une auto-parallèle est une courbe telle que : Du u = 0 ⇔ du dλ
+ Γijk uj uk = 0. En espace
plat et coordonnées cartésiennes les Γ sont nuls et c’est là l’équation d’une droite. En physique newtonienne c’est l’équation
du mouvement d’une particule libre en coordonnées curvilignes. En relativité restreinte c’est l’équation du mouvement d’une
particule libre dans un repère accéléré. N.B. : Une définition plus large d’une auto-parallèle est Dt (t) = Cte t. On peut
cependant montrer qu’une reparamétrisation de la courbe γ ramène à la définition précédente. Le paramètre τ est alors dit
affine.
9
Transportons parallèlement à lui-même le vecteur ti le long d’un trajet infinitésimal d1 xj = uj1 dλ. Sa
variation d1 ti est donnée par (6). Transportons-le ensuite le long de d2 xj = uj2 dλ. Sa variation totale δ12 ti
s’obtient en itérant (6). Si maintenant nous avions transporté ti le long de d2 xj d’abord puis de d1 xj sa
variation aurait été obtenue de même, en intervertissant les rôles de ‘1’ et ‘2’. La différence entre les deux
résultats se trouve facilement : (δ21 − δ12 )ti = tj d2 xl d1 xk Rjkl
i
où :
est le tenseur de courbure (ou encore de Riemann-Christoffel), de type 13 . (C’est un tenseur car (δ21 −δ12 )ti ,
différence de deux vecteurs au même point, est un vecteur.) On voit donc que ce n’est que si le tenseur de
Riemann est nul que le transport parallèle d’un vecteur (ou de tout autre tenseur) ne dépend pas du chemin.
12. Commutation des dérivées covariantes, torsion et courbure
La dérivée covariante par rapport à la coordonnée xi d’une fonction f , qui s’identifie à sa dérivée
ordinaire (Dj f = ∂j f ), peut être vue comme la i-ème composante de la forme : Di f dxi . Sa dérivée seconde
est donc (voir livre ND-JPU et chapitre précédent) : Di Dj f = ∂ij f − Γkij ∂k f , grandeur qui peut être vue
comme un tenseur deux fois covariant (cf ibidem). Intervertissant les indices i et j, on a donc :
De façon un peu plus intrinsèque et équivalente, on peut regarder l’action de la dérivée covariante par rapport
à la coordonnée xi (c.-à-d. par rapport au vecteur de base ∂i ) sur le vecteur de base ∂j ; le résultat cette
fois-ci est un vecteur :
Les quantités Tijk mesurent l’antisymétrie de la connexion. Ce sont les composantes d’un tenseur T de type
1
2 , appelé la torsion.
Appliquons maintenant l’opérateur Di Dj au vecteur ∂k . Le résultat sera un vecteur :
Di Dj ∂k = Di (Γljk ∂l ) = (∂i Γm l m
jk + Γjk Γil )∂m =⇒ (Di Dj − Dj Di )∂k = Rmkij ∂m (12.3)
où les composantes du tenseur de Riemann ont été données plus haut. Ainsi le tenseur de Riemann mesure
la non-commutativité des dérivées covariantes. On obtient de manière analogue l’action de l’opérateur
(Di Dj − Dj Di ) sur la 1-forme de base dxk :
et, par la règle de Leibniz, son action sur tout tenseur. Par exemple
Concluons par une approche “en composantes”, similaire à celle qui a conduit à (1.12) et calculons Di Dj v k .
1 1
k k k
v est vu comme un vecteur, Dj v comme une tenseur 1 et Di Dj v est un tenseur 2 . On a donc
Di Dj v k = ∂i (Dj v k ) − Γlij Dl v k + Γkil Dj v l , ce qui conduit à
L’approche intrinsèque qui mène à (6) est la suivante : v k correspond au vecteur v k ∂k ; Dj v k = ∂j v k + Γkjl v l
correspond au tenseur 11 Dj v k ∂k ⊗ dxj ; Di (Dj v k ∂k ⊗ dxj ) est aussi un tenseur 11 dont les composantes
Di (Dj v k ∂k ⊗ dxj ) ⊗ dxi − Dj (Di v k ∂k ⊗ dxj ) ⊗ dxi = (Di Dj − Dj Di )v k ∂k ⊗ dxj ⊗ dxi . (12.7)
10
13. “Déviation géodésique” et courbure
N.B. : par simplicité on se place dans ce paragraphe dans le cas où la torsion est nulle.
Considérons une famille d’auto-parallèles xip (λ) où λ est le paramètre le long des courbes et p l’indice les
étiquetant. Si ui = dxi /dλ est le vecteur tangent aux courbes, on a : Dui /dλ(≡ uj Dj ui ) = 0. Si par ailleurs
ni = ∂xi /∂p est le vecteur mesurant l’écartement des courbes, on montre facilement que (si la torsion est
nulle) : Dui /dp(≡ nj Dj ui ) = Dni /dλ(≡ uj Dj ni ). On peut ainsi calculer l’“accélération” relative de deux
géodésiques voisines :
D 2 ni D Dni D Dui
ai ≡ = = = uj Dj (nk Dk ui )
dλ2 dλ dλ dλ dp
(13.1)
= (uj Dj nk )Dk ui + uj nk Djk ui
= (uj Dj nk )Dk ui + uj nk (Dkj ui + Rmjk
i
um ).
En utilisant le fait que :
D Dui
0= = nj Dj (uk Dk ui ) = nj uk Djk ui + (nj Dj uk )Dk ui
dp dλ (13.2)
= (uj Dj nk )Dk ui + uj nk Dkj ui ,
on obtient l’équation souvent dite de déviation géodésique (bien qu’elle ne fasse pas intervenir de métrique) :
ai = Rmjk
i
u m u j nk . (13.3)
Ainsi, si le tenseur de Riemann n’est pas nul, les parallèles ont-elles tendance à ce “couper”.
14. Propriétés du tenseur de courbure
Nous donnerons ici sans démonstration les propriétés :
- Rklji = −Rklij (qui suit de la définition),
- si la torsion est nulle : Rklji + Rkjil + Rkilj = 0 (première identité de Bianchi,
i i i
- si la torsion est nulle : Dm Rjnp + Dn Rjpm + Dp Rjmn = 0 (seconde identité de Bianchi)
[v, w] ≡ v ◦ w − w ◦ v ≡ ∂v ◦ ∂w − ∂w ◦ ∂v
(15.1)
= v i ∂i ◦ wj ∂j − wi ∂i ◦ v j ∂j = (v i ∂i wj − wi ∂i v j )∂j .
On note que le crochet de Lie de deux vecteurs de base est nul ([∂i , ∂j ] = 0) et on montre facilement l’identité de
Jacobi
[u, [v, w]] + [v, [w, u]] + [w, [u, v]] = 0 . (15.2)
(Le crochet de Lie est un vecteur : il définit donc une opération de dérivation, la dérivee de Lie, cf chapitre suivant.)
16. Torsion et courbure
1
La torsion T D d’une dérivation covariante D est un tenseur de type 2 qui agit sur des couples de vecteurs (v, w)
pour donner un autre vecteur selon
T D (v, w) ≡ Dv w − Dw v − [v, w] . (16.1)
Il n’est pas évident a priori que (1) définit un vecteur. Pour le montrer et faire le lien avec la définition donnée plus haut
il suffit de décomposer v et w sur une base (ainsi par exemple Dv w = v i Di (wj ∂j ) et de se rappeler la définition des
coefficients de connexion (Di ∂j = Γkij ∂k ) pour obtenir
11
De manière analogue on définit la courbure de Riemann Christoffel RD d’une dérivation covariante D comme le
1
tenseur 3 qui, lorsqu’il agit sur le triplet de vecteurs (u, v, w) donne le vecteur défini par
D
Ru,v w ≡ [Du , Dv ]w − D[u,v] w . (16.3)
où [Du , Dv ]w ≡ Du (Dv w) − Dv (Du w). On montre comme précédemment que (3) définit effectivement un vecteur en
décomposant u, v et w sur une base. Pour faire le lien avec la définition donnée plus haut il suffit de prendre pour u, v et
w les vecteurs de base ∂i , ∂j et ∂k et on obtient immédiatement
Si l’on choisit pour les vecteurs v et w des vecteurs d’une base non nécessairement holonome (i.e. v = hi et w = hj ,
où hi = ∂i seulement si la base est naturelle) et si l’on choisit pour ω un vecteur de la base duale associée : ω = θ k
(avec θ k (hi ) = δik ), alors la formule (1) devient
(le membre de droite est un vecteur, le coefficient de hk dans le membre de gauche est un scalaire.)
Soit hi une base de l’espace tangent et θj la base duale associée (θ k (hi ) = δik ). On munit la variété d’une connexion
affine D définie par
k
Dhi hj = γij hk (17.3)
k
où les fonctions γij sont les coefficients de rotation de Ricci (si la base hi est une base naturelle (hi = ∂i ) les
coefficients de rotation deviennent les coefficients de connexion Γkij ).
k
Suivant Cartan, on considère les γij comme le résultat de l’action de 1-formes ωjk , appelées formes de connexion,20
sur les vecteurs hi :
k
γij = ωjk (hi ) ⇐⇒ ωjk = γij
k i
θ . (17.4)
Armés de ces définitions on peut exprimer la torsion, définie en plus haut, en fonction des formes de connexion. On
obtient la première équation de structure 21
définition du crochet de Lie. Les termes en dérivées des composantes des vecteurs s’éliminent et on arrive à la formule (1)
20
Il ne faut pas confondre
les indices i et k qui numérotent ces 1-formes avec les indices qui distinguent les composantes
1
d’une tenseur de type 1 !
21
En effet, on a, en applicant la définition et en utilisant (4) et (2) :
T D (hi , hj ) = Dhi hj − Dhj hi − [hi , hj ] = {ωjk (hi ) − ωik (hj ) + dθk (hi , hj )} hk .
Le scalaire ωjk (hi ) peut être vu comme la 2-forme (ωlk ⊗ θ l ) agissant sur le couple de vecteurs (hi , hj ) : ωjk (hi ) = (ωlk ⊗
θl )(hi , hj ) ; de même : ωik (hj ) = (θl ⊗ ωlk )(hi , hj ) ; ainsi T (hi , hj ) se réécrit : T D (hi , hj ) = {(ωlk ∧ θl + dθk )(hi , hj )} hk
d’où (5) suit.
12
où les Ωk sont les 2-formes différentielles (i.e. des tenseurs covariants anti-symétriques) de torsion.
(En base naturelle où θ k = dxk on a : ωjk = Γkij dxi et Ωk = Γkij dxi ∧dxj = (Γkij −Γkji )dxi ⊗dxj = Tij
k
dxi ⊗dxj .
D k i j
Enfin : T = Tij dx ⊗ dx ⊗ ∂k .)
Si l’on choisit maintenant pour ω dans la relation (1) les 1-formes de connexion ωji , alors, par un calcul analogue à
celui qui a conduit à (5), on obtient que la courbure définie pus haut se réécrit
RD = Ωm
k ⊗ hm ⊗ θ
k
avec Ωm m m l
k ≡ dωk + ωl ∧ ωk (17.7)
C’est là la deuxième équation de structure d’Elie Cartan où les grandeurs Ωij sont les 2-formes de courbure.
Variétés métriques
Une connexion permet de définir le transport parallèle de quantités géométriques d’un point à un autre
d’une variété, voir plus haut. Afin de pouvoir également définir une géodésique ou courbe de longueur
extrémale entre deux points, la notion de distance doit maintenant être introduite.22
18. Le tenseur métrique
0
Un tenseur métrique, g, est un champ tensoriel sur M , deux fois covariant (i.e. de type 2 ), symétrique
et non dégénéré. Dans un système de coordonnées xi il s’écrit :
Les n(n + 1)/2 fonctions gij (xk ) symétriques (gij = gji ) et inversibles (g ik gkj = δji ) le définissent.23
Comme nous l’avons déjà vu dans le contexte des espaces euclidiens en coordonnées cartésiennes ou
curvilignes, le tenseur métrique permet de définir une correspondance biunivoque entre vecteurs et 1-formes.
En effet, si v = v i hi est un vecteur, alors vi θi où vi ≡ gij v j est une 1-forme isomorphe à v (et souvent notée
v également.) Réciproquement, si λ = λi θi est une 1-forme, alors λi hi où λi ≡ g ij λj est un vecteur. De
manière plus générale, à tout tenseur de type pq on associe ainsi des tenseurs de type p−1 q+1 ou p+1
q−1 .
Etant donné g on peut toujours trouver en un point une base de vecteurs hi orthonormés de l’espace
tangent, tels que :
g(hi , hj ) = 0 si i 6= j g(hi , hi ) = ±1. (18.2)
Si n = 4 les hi s’appellent tétrades, ou vierbein et, plus généralement, champ de repère (et, parfois, repère
mobile). Si tous les signes sont positifs la métrique est riemannienne, si un signe est négatif, elle est
lorentzienne.24
Enfin, une métrique définit le produit scalaire de deux vecteurs v et v 0 par : hv, v 0 i ≡ g(v, v 0 ) = gij v i v 0j .
Dans le cas d’une métrique lorentzienne, si la norme hv, vi de v est positive, v est dit du genre espace ; si
elle est négative, v est du genre temps ; si elle est nulle, v est isotrope.
22
Dans le livre ND-JPU et au chapitre précédent toutes les propriétés géométriques des espaces-temps, en particulier la
notion de transport parallèle, ont été déduites de l’existence d’une métrique (euclidienne ou minkowskienne). Nous considérons
ici le cas plus général où métrique et connexion sont des structures a priori indépendantes.
23
En effet, connaissant ses composantes dans les coordonnées xi on les connait dans tout autre système via la loi de
transformation des tenseurs 2 fois covariants, cf plus haut.
24
N.B. : il suffit que la variété soit “para-compacte” pour qu’on puisse y définir une métrique riemannienne. En revanche
une métrique lorentzienne ne peut être définie que si la “caractéristique d’Euler” de la variété est nulle ; ainsi une 2-sphère dont
la caractéristique d’Euler vaut deux n’admet pas de métrique lorentzienne. Voir tout traité de géométrie différentielle pour
définitions et démonstrations.
13
19. Equation géodésique
La notion de norme associée au tenseur métrique permet de définir la longueur d’une courbe du genre
temps (et similairement du genre espace), p = p(λ), soit encore xi = xi (λ), de vecteur tangent u = ui ∂i où
ui ≡ dxi /dλ, entre les points p1 et p2 , par :
λ2 λ2 λ2 12
dxi dxj
Z Z q Z
p
L[p(λ)] = dλ −g(u, u) = i j
dλ −gij u u = dλ − gij . (19.1)
λ1 λ1 λ1 dλ dλ
On remarque que L est invariant par reparamétrisation, c.-à-d. dans le changement λ 7→ λ(τ ).
Considérons maintenant un ensemble de courbes ps (λ) indéxées par s, toutes issues de p1 et aboutissant
en p2 , et calculons la variation δL de la longueur de ces courbes quand on varie s :
λ2
dδxis dxjs dxi dxj
Z
1
δL = q −2gij − ∂k gij δxks s s dλ (19.2)
dλ dλ dλ dλ
λ1 2 −gij uis ujs
On peut, à ce stade (pas avant !), choisir la paramétrisation, par exemple gij uis ujs = −1. En notant alors τ
le paramètre, on a (en omettant l’indice s)
τ2
dδxi j 1
Z
k i j
δL = −gij u − ∂k gij δx u u dτ
τ1 dτ 2
Z τ2
d j i d j i 1 k i j
= − (gij u δx ) + (gij u )δx − ∂k gij δxs u u dτ (19.3)
τ1 dτ dτ 2
Z τ2 j
du 1
= δxk dτ gkj + ∂i gkj ui uj − ∂k gij ui uj .
τ1 dτ 2
La courbe est extrémale si δL = 0, ce que l’on peut écrire sous la forme de l’équation géodésique :
dui i i 1 il
+ jk uj uk = 0 avec g(u, u) = −1 où les jk
= g (∂j gkl + ∂k glj − ∂l gjk ) (19.4)
dτ 2
sont les symboles de Christoffel.
20. Connexion de Levi-Civita
On voit ainsi que pour que la notion d’auto-parallèle définie dans l’introduction comme la courbe “la plus
droite possible” se confonde avec celle ici définie de géodésique ou courbe “la plus courte (ou longue) possible”,
il faut identifier les coefficients de connexion de la dérivation covariante et les symboles de Christoffel, la
connexion prenant alors le nom de connexion de Levi-Civita ou de connexion riemannienne. Métrique et
connexion sont donc compatibles si
i 1 il
Γijk = jk
= g (∂j gkl + ∂k glj − ∂l gjk ) . (20.1)
2
Les symboles de Christoffel étant symétriques, la connexion de Levi-Civita l’est aussi, c.-à-d. qu’elle est sans
torsion.
Il est une autre façon, équivalente, d’imposer la compatibilité d’une métrique et d’une connexion, à
savoir qu’elle soit sans torsion et que, pour tout vecteur v :
14
21. Propriétés métriques du tenseur de Riemann et ses dérivés
Lorsque la connexion, symétrique, est compatible avec un tenseur métrique, le tenseur de courbure
possède la propriété supplémentaire :
p
Rijkl = −Rjikl où Rijkl ≡ gip Rjkl . (21.1)
Le tenseur de Riemann étant de type 13 on peut par contraction en déduire des tenseurs de type 02 .
A cause de l’antisymétrie métrique ci-dessus, la contraction Ri ijk ≡ 0 et ne reste que le tenseur de Ricci
Rij :
l l
Rij ≡ Rilj = −Rijl (21.2)
La courbure scalaire est, elle, définie par
R ≡ g ij Rij . (21.3)
On montre facilement, à partir des secondes identités de Bianchi et de la nullité de la dérivée covariante de
g, l’importante propriété :
1
Di Gij = 0 où Gij ≡ Rij − gij R (21.4)
2
est le tenseur d’Einstein.
Enfin on peut isoler dans le tenseur de Riemann les termes qui dépendent du tenseur de Ricci et de la
courbure scalaire ; le terme restant, C am sq s’appelle tenseur de Weyl. Plus précisément, n étant la dimension
de la variété :
1 1
Ram sq = C am sq + g a Rm + gqm Rsa − gsm Rqa − gqa Rsm − g a g m − gqa gsm R.
(21.5)
n−2 s q (n − 1)(n − 2) s q
Le tenseur de Weyl possède toutes les symétries du tenseur de Riemann et est de plus sans trace : C am aq = 0.
Par ailleurs deux espaces de Riemann, de métrique ḡ et g conformément reliés, c.-à-d. tels que ḡ = F (xa )g,
ont même tenseur de Weyl.
22. Repères localement inertiels
Soit gij (xk ) les composantes du tenseur métrique g dans le système de coordonnées xk . Dans un autre
∂xk ∂xl
système X l = X l (xk ) les composantes de g sont fij (X k ) = ∂X i ∂X j gkl . Effectuons un développement de
La question est : existe-t-il un changement de coordonnées tel que fij = ηij + O(X m − X0m )2 ? La
réponse est oui : au point p0 les données sont les n(n + 1)/2 composantes gkl |0 de la métrique (soit 10
en quatre dimensions), les n2 (n + 1)/2 = 40 composantes ∂m gkl |0 de sa dérivée, les [n(n + 1)/2]2 = 100
k
∂x
composantes de sa dérivée seconde etc ; les paramètres libres sont les n2 = 16 nombres ∂X 2
i |0 , les n (n +
2
1)/2 = 40 valeurs des dérivées secondes, les n (n + 1)(n + 2)/3! = 80 valeurs des dérivées troisièmes
∂xk ∂xl
etc ; par conséquent le système fij (X0k ) ≡ ∂X i ∂X j gkl |0 = ηij , de 10 équations pour 16 inconnues, a une
infinité de solutions ∂m gkl |0 à 6 paramètres, les 6 paramètres du groupe de Lorentz ; quant au système
2 k
∂xl ∂ 2 xk ∂xl ∂xk ∂xl ∂gkl
gkl ∂X∂mx∂X i ∂X j + gkl ∂X m ∂X j ∂X i + ∂X i ∂X j ∂X m = 0 de 40 équations pour 40 inconnues il a une solution
|0
unique, cqfd.
En revanche on ne peut pas en général annuler le terme d’ordre 2 car le système à résoudre comporte
100 équations pour 80 paramètres libres seulement. La différence, 20, est le nombre de composantes du
tenseur de Riemann. En développant à l’ordre suivant on trouve en effet (théorème de Riemann-Cartan)
1
fij (X k ) = ηij − (X m − X0m )(X n − X0n )(Rimjn |0 + Rinjm |0 ) + ... (22.1)
6
15
où Rimjn |0 sont les composantes, dans le système de coordonnées X k , du tenseur de Riemann ; quant aux
termes suivants ils s’expriment en fonction des dérivées covariantes du tenseur de Riemann. En effet les
composantes du tenseur de Riemann se réduisent à
1 2
Rijkl = (∂ gil + ∂il2 gjk − ∂ik
2 2
gjl − ∂jl gik ) (22.2)
2 jk
de sorte que
2 1 1
∂mn gij = (Rimjn + Rinjm ) et Γijk = − (X m − X0m )(Ri jkm + Ri kjm ) . (22.3)
3 3
Dans ces coordonnées dites “normales” l’équation géodésique s’écrit donc
dui 2
= Ri jkm ui uj (X m − X0m ) + ... (22.4)
dτ 3
On voit ainsi que, en accord avec les exigences physiques exposées dans la première partie, on peut en
tout point bâtir un système de coordonnées quasi-minkowskiennes, c.-à-d. un repère quasi-inertiel (défini
aux transformations de Lorentz près). Ce n’est que si le tenseur de Riemann est nul que ce système peut
être étendu à tout l’espace-temps, qui n’est alors autre que l’espace-temps plat de Minkowski.
Les lois du mouvement peuvent s’obtenir à partir d’un principe de moindre action qui stipule qu’il
existe, associé à tout système physique, une quantité scalaire (donc invariante), l’action, fonctionnelle des
états possibles du système, dont le minimum (ou extremum) entre deux états donnés détermine l’évolution
effectivement suivie par le système.
23. Action d’un point matériel en présence de gravitation
Plaçons-nous dans un repère inertiel en coordonnées minkowskiennes ; la ligne d’univers d’une particule
matérielle (de masse non nulle) est du genre temps et donnée par X i = X i (τ ). Si la particule n’est soumise
à aucune force, le scalaire le plus simple, fonctionnelle de chemin, que l’on puisse lui associer est :
Z b Z bq Z tb p
2
Sl = −mc dτ = −mc i i
−ηij dX dX = dt L avec L = −mc2 1 − v 2 /c2 (23.1)
a a ta
Dans un système de coordonnées curvilignes où les coefficients de la métrique sont gij cette action devient
r
b b Z b
dxi dxj
Z Z q
2 i j
Sl = −mc dτ = −mc −gij dx dx ≡ dλ L avec L = −mc −gij , (23.2)
a a a dλ dλ
duk
+ Γklj ul uj = 0, avec ui ui = −1 (23.3)
dτ
qui décrit le mouvement d’une particule libre rapporté à un repère accéléré. Ainsi donc l’observateur observe
que dans le référentiel où il est au repos les trajectoires des particules libres ne sont pas linéaires dans
le temps. Il note aussi que leurs accélérations sont indépendantes de leur masse inertielle. Il fait donc
l’hypothèse que les “forces” auxquelles elles sont soumises sont de “fictives forces d’inertie” et que son repère
n’est pas inertiel. Il cherche un nouveau repère dans lequel le mouvement des particules libres soit rectiligne
16
uniforme. S’il le trouve, c-à-d s’il existe une transformation de coordonnées qui réduit la métrique à celle de
Minkowski, il en déduit que son repère était tout simplement accéléré.
Dans le cas général où la courbure de l’espace-temps n’est pas nulle, il n’existe pas de changement
de référentiel qui puisse, globalement, réduire la métrique à sa forme minkowskienne. Par le principe
d’équivalence, c’est qu’il existe alors un champ gravitationnel et les coefficients de la métrique gij , décrivent
à la fois le champ d’inertie, c-à-d le référentiel choisi, et le champ de gravitation présents.
En mécanique newtonienne, et dans un repère inertiel, l’action d’une particule dans un champ de
gravitation est : Z
1
Sl(n) = −mc2 + mv 2 − mU dt (23.4)
2
où U est le potentiel newtonien (et où la constante −mc2 est ajoutée afin que Sl et Sl(n) coı̈ncident en
absence de champ et quand c → ∞). Il faut donc qu’à la limite newtonienne l’élément de longueur dτ se
réduise à :
v2
U 2U
dτ ∼ dt 1 − 2 + 2 soit ds ∼ −c dt 1 + 2 + d~r 2 .
2 2 2
(23.5)
2c c c
On retrouve ainsi de manière générale l’expression de la composante g00 de la métrique en fonction du
potentiel newtonien sont reliés par la relation dans la limite des champ et vitesses faibles.
où la charge e est le paramètre de couplage au champ et où Ai est un vecteur (de sorte que Si soit un
scalaire), le vecteur potentiel, dont on postule qu’il décritRcomplètement l’interaction. Si l’on introduit une
densité de charge % en lieu et place de e, telle que e = %dV où la somme est prise sur tout l’espace et
dV ≡ dx1 dx2 dx3 , on peut réécrire (1) sous la forme :
1 b √
Z
% ds i
Si = Ai j i −g dΩ avec j i = √ u. (24.2)
c a −g dt
√
Ici −g dΩ, où dΩ ≡ dx0 dx1 dx2 dx3 et g est le déterminant de la métrique gij , est l’élément de volume
invariant par transformation de coordonnées. Quant à j i , où ui ≡ dxi /dτ , c’est un vecteur—le vecteur
courant.
Les équations de Maxwell du champ électromagnétique dérivent aussi d’une action, fonctionnelle du
potentiel, décrivant le champ lui-même. Là encore son choix est justifié plus par ses conséquences que par
des principes premiers. On prend :
√
Z
1
Sc = − Fij F ij −g dΩ (24.3)
4µ0 c
où µ0 la “perméabilité du vide”, où l’intégrale est prise sur tout l’espace et entre deux instants donnés et
où :
Fij ≡ ∂i Aj − ∂j Ai (24.4)
est le tenseur du champ électromagnétique (cf chapitre précédent).
Lorsque la particule chargée se trouve dans un champ électromagétique, l’action totale est la somme des
expressions (23.2) et (1). La variation de (1) est :
Z b Z b
δSi = e (Ai dδxi + δAi dxi ) = eAi δxi |ba − e (dAi δxi − δAj dxj )
a a
Z b Z b (24.5)
dxj i
= −e (∂j Ai − ∂i Aj ) δx dτ = e Fij uj δxi dτ.
a dτ a
17
Quant à la variation de (23.2), elle est donnée par (23.3). Par conséquent les équations du mouvement
s’écrivent :
Dui
mc = eF ij uj . (24.6)
dτ
C’est-là la forme manifestement invariante dans tout repère de l’équation de Lorentz. C’est aussi son ex-
pression en présence d’un champ de gravitation.
Quant aux équations du champ électromagnétique, elles s’obtiennent en variant la somme de (2) et (3)
par rapport au potentiel Ai , ce qui donne (exercice : expliciter le calcul) :
Dj F ij = µ0 j i (24.7)
√ √
où on a utilisé le fait que l’antisymétrie de F ij implique que −gDj F ij = ∂j ( −gF ij ). L’équation (7) est
la forme manifestement invariante du “deuxième groupe” des équations de Maxwell.
où V (Φ) est le potentiel d’auto-interaction [V (Φ) = 12 m2 Φ2 pour un champ libre massif].
De manière générale, la variation de l’intégrale fonctionnelle (1) est :
Z t2 t2
δL δL δL
δS = dt − ∂0 δΦ + δΦ . (25.2)
t1 δΦ δ∂0 Φ δ∂0 Φ t1
Le dernier terme est nul car la configuration du champ est fixée aux bornes. Par ailleurs :
√ √ √
∂L −g ∂L −g ∂L −g
Z Z
δL = c d3 x − ∂α δΦ + c d3 x ∂α δΦ . (25.3)
∂Φ ∂∂α Φ ∂α Φ
Le dernier terme est nul si le champ s’évanouit à l’infini spatial. Par conséquent :
Z t2 √ √ √
∂L −g ∂L −g δL −g
Z
δS = c dt d3 x − ∂α − ∂0 δΦ. (25.4)
t1 ∂Φ ∂∂α Φ δ∂0 Φ
Remarque : La distinction faite entre espace et temps s’impose. En effet un champ Φ(xi ) est déterminé par
sa configuration Φ(~x) à chaque instant. L’action est donc une fonctionnelle de Φt (~x) et ∂0 Φ|t et le principe
de moindre action permet de déterminer l’évolution de cette configuration entre deux instants donnés.
On obtient ainsi l’équation de Klein-Gordon du mouvement du champ Φ :
dV 1 √
Φ ≡ Di Di Φ = √ ∂i −g∂ i Φ .
Φ− =0 avec (25.7)
dΦ −g
i j√ i j √
√
Z Z Z
1 1 1
Di T i j ξ j −g dΩ = 0.
δSc = − Tij D ξ −g dΩ = Di T j ξ −g dΩ − (26.5)
c c c
√
Le premier terme est l’intégrale de ∂i T i j ξ j −g et s’annule en vertu du théorème de Gauss. Le second
doit être nul ∀ξ i et par conséquent :
Di T i j = 0, (26.7)
ce qui est la généralisation à tout repère de la loi de conservation (26.2). Ainsi donc le tenseur Tij défini
par (4) est-il bien le tenseur énergie-impulsion. D’ailleurs lorsque l’action est celle d’un champ scalaire ou
électromagnétique on trouve :
1 1 1 1
Tij = ∂i Φ∂j Φ − gij g kl ∂k Φ∂l Φ + V (Φ) et Tij = −Fil F l j − Flm F lm gij , (26.6)
c 2 µ0 4
19
qui sont les versions manifestement covariantes des expressions trouvées plus haut.
Lorsque la matière maintenant est décrite comme un essaim de particules sans interaction plutôt que
comme un champ, son action est la somme des actions individuelles :
Z Z
X
2
X 1/2
S=− ma c dτa = L dt avec L = − ma c2 −g00 − 2g0α vaα /c − gαβ vaα vaβ /c2
a a
(26.7)
√
Z Z
dτ X µ dτ
=− µ dΩ = −c µ0 −g dΩ avec µ= ma δ(xα − xα
a) et µ0 = √
dt a
−g c dt
où l’on a introduit la densité de masse µ, la distribution de Dirac δ étant telle que δ(xα )dV = 1. Quant à
R
µ0 , c’est la densité propre de masse, c-à-d la masse des particules, plus précisément des baryons, par unité
de volume dans le repère inertiel où l’essaim est (momentanément) au repos. On peut de même définir le
courant de masse j i = cµ0 ui . La conservation de la masse totale se traduit par Di j i = 0.
√ 1/2
La densité lagrangienne du système est : −g L = −µdτ /dt = −µ −gij dxi dxj /dt2 . On peut donc
lui associer, par la formule un tenseur énergie-impulsion T ij covariantement conservé lorsque les équations
du mouvement sont satisfaites :
µ dτ
T ij = c √ ui uj = c2 µ0 ui uj tel que Di T ij = 0. (26.8)
−g dt
où ui est la quadri-vitesse de l’élément considéré et 0 la densité d’énergie propre totale (incluant la masse au
repos et l’énergie thermodynamique interne) ; q i , perpendiculaire à ui (qi ui = 0), est la densité d’impulsion
(appelée aussi courant de chaleur) ; Πij est le tenseur des contraintes que l’on peut décomposer plus avant
selon :
Πij = π ij + p0 hij (26.10)
où hij est le tenseur de projection : hij = η ij + ui uj (⇒ hij uj = 0) ; p0 est la pression isotropique ; enfin
π ij , tel que π i i = 0 et π ij uj = 0 est la partie sans trace et anisotropique du tenseur des contraintes.
Un fluide est parfait si q i = 0 et π ij = 0. Son tenseur énergie-impulsion se réduit alors à :
Dans le repère où l’élément considéré est au repos (ui = 1, ~0) ses composantes non nulles sont T 00 = 0 et
T αα = p0 . Ainsi p0 est la pression (isotrope) du fluide dans le repère où il est au repos. Lorqu’enfin pression
et énergie interne peuvent être négligées, le tenseur énergie impulsion d’un fluide parfait se réduit à celui
d’un essaim de particules.
Le tenseur énergie-impulsion doit être conservé : Di T ij = 0. En formant le produit scalaire de cette
équation avec uk uj + gkj on obtient l’équation d’Euler relativiste en présence d’un champ de gravitation
(encodé dans la dérivée covariante) :
Duk dp
(0 + p0 ) + uk + ∂k p = 0. (26.12)
dτ dτ
20
Les équations du champ de gravitation
27. Récapitulation
La relativité restreinte géométrise les forces d’inertie en les incorporant dans la dérivée covariante associée
à l’espace-temps plat de Minkowski décrit dans un repère accéléré.
Le principe d’équivalence stipule qu’inertie=gravitation.
La gravitation est par ce principe incorporée dans une dérivation covariante associée à un espace plus
général que celui de Minkowski, courbe. Einstein, aidé par le mathématicien Marcel Grossmann, choisit
de représenter l’espace-temps “relatif, apparent et vulgaire” par une variété riemannienne munie d’une
connexion de Levi-Civita, c.-à-d. dont les propriétés géométriques, dont sa courbure, se déduisent toutes de
la donnée d’une métrique.
En l’absence de matière il n’y a pas de champ de gravitation et l’espace-temps qui représente cet univers
vide est l’espace-temps plat de Minkowski. C’est la matière qui courbe l’espace-temps. Les équations de la
gravitation doivent par conséquent relier géométrie et matière, i.e. le tenseur de Riemann (ou ses dérivés) à
un objet géométrique décrivant la “gravité” de la matière.
L’objet tensoriel qui, en relativité restreinte, décrit complètement la matière est son tenseur énergie-
impulsion, Tij , deux fois covarian. Ses composantes dans un repère accéléré se déduisent de leurs expressions
dans un repère inertiel par la transformation ηij → `ij et ∂i → D̃i où `ij sont les composantes de la métrique
de Minkowski dans les coordonnées xi et D̃i la dérivée covariante associée. En relativité générale, la métrique
gij et la dérivée covariante de Levi-Civita associée Di caractérisent à la fois le repère choisi et le champ de
gravitation, i.e. la courbure de l’espace-temps. On est donc amené à décrire la matière par un tenseur énergie-
impulsion Tij déduit de son expression en relativité restreinte par le remplacement `ij → gij et D̃i → Di , qui
respecte l’exigence du principe de relativité locale, remplacement parfois appelé “principe de correspondance”
(par analogie au passage des crochets de Poisson au commutateurs en Mécanique Quantique).27
où la constante d’Einstein κ doit être reliée à la constante de Newton. Le terme proportionnel à la métrique
peut être ajouté puisque Di gjk = 0. Λ est la constante cosmologique, au statut fluctuant (“la plus grande
erreur de ma vie” disait Einstein, mais à la base de scénarios cosmologiques récents).
A la limite newtonienne28 et en repère quasi-inertiel : −g00 ∼ 1+2U/c2 , où U est le potentiel newtonien.
Quant aux autres composantes de la métrique, elles sont du même ordre au moins. Les Γ sont donc d’ordre
27
Il faut cependant noter que rien n’interdit, sauf le “principe de simplicité”, d’ajouter à la définition de Tij des termes
proportionnels à la courbure, comme Rgij , Rij , voire Dij R..., voir plus haut.
28
Il ne s’agit pas ici de retrouver toute la physique newtonienne, dans une limite de “champs faibles” et de “petites vitesses”
à définir : les deux théories étant bâties sur des bases différentes, l’une ne saurait inclure l’autre. Il s’agit seulement de trouver,
de la façon aussi intuitive et heuristique que l’on veut, la valeur numérique du coefficient de couplage κ.
21
1/c2 , et leurs dérivées temporelles d’ordre 1/c3 . Par conséquent on a au plus bas ordre :
1 1 ∂U 1
∂α Γα ∼ − ∂α g αβ ∂β g00 ∼ 2 ∂ α
R00 ∼ 00 ∼ ∆U. (28.2)
2 c ∂xα c2
Le tenseur énergie-impulsion d’un fluide se réduit quant à lui à : T 00 ∼ %c2 où % est la densité propre de
masse. Ce sont là les seuls termes des tenseurs de Ricci et d’énergie-impulsion que nous ayons à calculer
si l’on réécrit les équations d’Einstein, sans constante cosmologique, sous la forme : Rij = κ(Tij − 21 gij T ).
Elles redonnent alors, à la limite des champs et vitesses faibles, l’équation de Poisson : ∆U = 4πG% si
8πG
κ= . (28.3)
c4
c3 √
Z
Sg = (R − 2Λ) −g dΩ. (19.1)
16πG V
L’intégrale est prise sur une portion V de l’espace-temps, délimitée par une 3-surface ∂V. G est une constante
de couplage que l’on identifiera à la constante de Newton et Λ est la constante cosmologique. R est la courbure
scalaire :
R = g ij Rij , Rij = Rilj l
= ∂l Γlij − ∂j Γlil + Γlkl Γkij − Γlkj Γkil . (29.2)
Bien que R contienne des dérivées secondes des gij , elles n’apparaissent que linéairement et se regroupent
en une divergence. On montre en effet (en utilisant les relations : dg = −ggik dg ik et ∂l g ik = −Γiml g mk −
Γkml g im ) que :
√ √
−gwi ,
R −g = Ĝ + ∂i (29.3)
avec (cf e.g. Landau et Lifchitz pour le détail de la démonstration) :
√
−gg ik Γm l l m
Ĝ = il Γkm − Γik Γlm . (29.4)
Enfin :
wi = g jk Γijk − g ij Γljl . (29.5)
L’intégrale de la divergence se transforme en vertu du théorème de Gauss en une intégrale de surface. Si
les variations des gij et de leurs dérivées sont prises nulles aux frontières ∂V du domaine d’intégration, on
R √ R
aura que δ R −g dΩ = δ Ĝ dΩ et les équations de champ seront du second ordre comme voulu. (On
22
remarquera que la relativité générale se démarque ici des théories de champ ordinaires où seules les variations
des champs et non de leurs dérivées sont prises nulles aux bornes.)
√ √ √ √
Z Z Z Z
ij 1
δ R −g dΩ = δ −gRij g dΩ = −g Rij − Rgij δg ij dΩ + −gg ij δRij dΩ. (30.1)
2
Pour calculer ensuite g ij δRij on se place dans un repère où les Γijk sont nuls et, vu (29.3), on l’écrit sous forme
d’une divergence : g ij δRij = ∂l k l . Cette égalité vectorielle se généralise à tout repère en : g ij δRij = Dl k l ,
soit encore : √ √
−gg ij δRij = ∂l k̂ l avec k̂ l = −g g jk δΓljk − g il δΓjij . (30.2)
Ainsi donc le dernier terme de (1) s’évanouit en vertu du théorème de Gauss si les variations des ∂l gij sont
prises nulles aux frontières ∂V du domaine d’intégration, et l’on obtient en fin de compte :
c3 √
Z
1
δSg = −g Rij − Rgij δg ij dΩ. (30.3)
16πG 2
R √ R
Comme δ R −g dΩ = δ Ĝ dΩ, on déduit de (3) les utiles égalités :
!
√
Z Z
ij ∂ Ĝ ∂ Ĝ
−gGij δg dΩ = ij
− ∂k δg ij dΩ (30.4)
∂g ∂∂k g ij
!
√
Z Z
ij ∂ Ĝ ∂ Ĝ
−gG δgij dΩ = − − ∂k δgij dΩ, (30.5)
∂gij ∂∂k gij
√ √
Z Z
1 1
δSm = − Tij δg ij −g dΩ = T ij δgij −g dΩ (30.6)
2c 2c
avec : √ √ √ √
1√ ∂ −gL ∂ −gL 1√ ∂ −gL ∂ −gL
− −g Tij ≡ − ∂l et −g T ij ≡ − ∂l . (30.7)
2c ∂g ij ∂∂l g ij 2c ∂gij ∂∂l gij
Tij (= gik gjl T kl ) est le tenseur d’énergie-impulsion du champ. Ce tenseur possède, nous l’avons vu, la
propriété d’être conservé, c-à-d Di T ij = 0, si les équations d’évolution, e.g. de Klein-Gordon, de Maxwell
(en dehors des charges) ou d’Euler sont satisfaites.
L’extrémisation de l’intégrale d’action Sg + Sm conduit donc ainsi aussi aux équations d’Einstein pour
le champ de gravitation :
1 8πG
Rij − gij (R − 2Λ) = 4 Tij (30.7)
2 c
qui égalent le tenseur d’Einstein, décrivant la courbure de l’espace-temps, au tenseur d’énergie-impulsion de
la matière (qui lui-même dépend du champ gravitationnel gij .
23
Problème de Cauchy∗
31. Introduction29
Les équations d’Einstein forment un ensemble de 10 équations du second ordre aux dérivées partielles,
non linéaires. Le système de coordonnées peut être choisi arbitrairement. En transformant les quatre xi on
peut ainsi assigner n’importe quelle valeur à quatre des gij . Le tenseur métrique a donc six composantes
indépendantes. Quant à la matière (cf e.g. un fluide parfait) elle est déterminée par sa quadri-vitesse ui
sujette à ui ui = −1 et par sa densité d’énergie (ou pression). Ainsi donc nous avons 10 équations pour
10 inconnues. Dans le vide il n’y a que 6 gij à déterminer ; mais il n’y a alors que 6 équations d’Einstein
indépendantes, en vertu des identités de Bianchi (Di Gij = 0). Il y a donc autant d’équations que d’inconnues.
En vertu des identités de Bianchi et comme Di gjk = 0, le tenseur T ij doit donc aussi être conservé.
Les équations du mouvement de la matière (e.g. les équations de Maxwell dans le vide, de Klein-Gordon
ou d’Euler) sont par conséquent incluses dans les équations d’Einstein. En cela la relativité générale se
démarque de l’électromagnétisme par exemple où l’équation de Lorentz qui détermine le mouvement des
charges n’est pas incluse dans les équations de Maxwell.
La structure mathématique des équations d’Einstein est donc complexe, même dans le vide. Quelques
solutions exactes sont connues—Schwarzschild, Kerr, Robertson-Walker,...—mais elles sont très particulières.
La solution exacte du problème à deux corps par exemple, version relativiste du problème de Kepler, n’est
pas connue. On ne sait pas même si elle existe, car on ignore si les algorithmes d’approximation proposés
donnent des séries asymptotiques à la solution.
Résoudre le problème de Cauchy, un point crucial pour la relativité numérique, est de décider si la
donnée du champ gij et de ses dérivées sur une hypersurface du genre espace suffit à déterminer uniquement
son évolution ultérieure. (Lorsque la surface est du genre lumière le problème s’appelle caractéristique : nous
ne l’aborderons pas ici et renvoyons à e.g. J. Stewart Advanced General Relativity.)
32. Un théorème de Leray
Soit un champ φ(xi ) satisfaisant à une équation d’évolution. Prenons l’exemple d’un champ scalaire dans
l’espace-temps de Minkowski, satisfaisant à l’équation de Klein-Gordon η ij ∂i ∂j φ − m2 φ = 0. Considérons
l’hypersurface Σ définie par t = 0 et donnons-nous sur Σ les données de Cauchy C ∞ φ(0, ~x) et ∂t φ(0, ~x).
L’équation de KLein-Gordon nous donne alors la valeur de la dérivée seconde de φ sur Σ :
∂2
φ(0, ~x) = 4φ(0, ~x) − m2 φ(0, ~x). (32.1)
∂t2
Par itération nous obtiendrons toutes les dérivées de φ en t = 0 et pourrons ainsi construire φ(t, ~x) par
sommation de la série de Taylor, à condition que cette série converge. Cauchy et Kowaleskaya montrèrent
que c’était le cas, et que la solution était unique, quand, de manière plus générale, l’équation d’évolution
était analytique dans ses variables et si f (~x) = φ(0, ~x) et g(~x) = ∂t φ(0~x) étaient des fonctions analytiques.
(On trouvera la démonstration de ce théorème dans e.g. Courant et Hilbert, 1962, Methods of Mathematical
Physics, II Chap.1,7.)
La restriction à des données de Cauchy analytiques est trop forte. Par ailleurs ce théorème ne dit
rien sur la stabilité des solutions à savoir : les solutions issues de conditions initiales “proches” sont-elles
proches ? Enfin il ne permet pas de déterminer si le champ se propage causalement, une question que l’on
peut formuler ainsi : soient deux ensembles de données de Cauchy ne différant que dans un volume fini S de
Σ ; les deux solutions qui en sont issues sont-elles les mêmes en dehors du cône futur issu de S ?
Pour se libérer des conditions d’analyticité, et assurer la stabilité et la propagation causale des solutions,
il faut introduire les notions de norme et d’espaces de Sobolev (cf e.g. le Wald) et surtout utiliser la linéarité
ainsi que le caractère hyperbolique de l’équation de Klein-Gordon. (Une équation du second ordre est
hyperbolique si les dérivées secondes se regroupent en un terme de la forme : g ij Di Dj φ où g ij est une
métrique lorentzienne et Di la dérivée covariante associée.) On peut montrer alors que le problème de
29
Les parties ou sections marquées d’une étoile ne sont que des introductions aux sujets évoqués, ni rigoureuses ni complètes.
24
Cauchy pour tout système d’équations aux dérivées partielles du second ordre, linéaire et hyperbolique du
type :
g ij Di Dj φ + Ai Di φ + Bφ + C = 0, (32.2)
où Ai , B et C sont un vecteur et deux fonctions arbitraires, est bien posé, c-à-d que, étant données des
données de Cauchy lisses, la solution est unique, dépend de façon continue des données de Cauchy et est
causale au sens indiqué ci-dessus. (On trouvera la démonstration de ce théorème dans e.g. le Hawking and
Ellis.)
La condition de linéarité est trop forte. Les systèmes d’équations aux dérivées partielles complètement
non-linéaires sont mal connus, mais si le système est du second ordre, hyperbolique et quasi-linéaire, c-à-d
de la forme :
g ij (xk , φ, ∂k φ)Di Dj φ = F (x, φ, ∂k φ), (32.3)
il existe un théorème dû à Leray (1952) qui dit que si φ̃ est une solution de (3) pour certaines données de
Cauchy alors le problème de Cauchy est bien posé pour toutes données de Cauchy “suffisamment” proches des
précédentes. (On trouvera la démonstration de ce théorème ainsi que la signification précise de “suffisamment
proche” dans e.g. le Hawking and Ellis.)
Remarque : nous verrons que l’on peut réduire les équations d’Einstein à un système du type (3). Il
sera donc possible d’affirmer l’existence de solutions “suffisamment proches” de l’espace-temps plat, mais
le problème de Cauchy, dans le cas général, n’est pas résolu : on ignore si des données de Cauchy lisses
arbitraires (satisfaisant éventuellement à des contraintes—cf plus bas) déterminent une solution des équations
d’Einstein globale, unique, dépendant de façon continue des données initiale et causale (voir cependant les
travaux récents de Christodoulou, Klainerman et al.).
33. Invariance de jauge et contraintes
Considérons, dans M4 , les équations de Maxwell du vide pour le potentiel électromagnétique Ai :
∂i ∂j (η ij Ak − η ik Aj ) = 0. Elles ne sont pas du type (32.3) et donc le problème de Cauchy est a priori mal
posé en électromagnétisme. La raison en est qu’on peut les réécrire sous la forme :
∂ ~ ~
∇ · A = 4A0 (33.1)
∂t
∂2 ~ ~+∇
~ ∂0 A0 − ∇
~ ·A
~ .
A = 4A (33.2)
∂t2
On voit ainsi que les équations de Maxwell ne déterminent pas la composante A0 du potentiel qui peut être
choisie arbitrairement. Mais une fois A0 choisi, ∇ ~ ·A~ est alors contraint par (1). En électromagnétisme,
le problème de Cauchy se scinde donc en deux : celui des conditions initiales, i.e. trouver des données de
Cauchy qui satisfassent à la contrainte, équation (1) ; et celui de l’évolution, i.e. intégrer (2) avec comme
conditions initiales la solution du problème précédent. Ayant ainsi obtenu la solution sur l’hypersurface t,
on a que la contrainte y est automatiquement satisfaites (en effet la dérivée temporelle de (1) est (2)) ; ceci
permet par exemple de vérifier la convergence des algorithmes d’intégration numérique. Réciproquement si
la contrainte est satisfaite pour tout t alors l’équation d’évolution est automatiquement satisfaite.
Pour s’assurer maintenant que le problème de Cauchy est bien posé on décompose les équations de
Maxwell en une condition de jauge (qui ne la fixe pas nécessairement complètement) et une équation
d’évolution. Par exemple, on a, dans la jauge de Lorentz :
∂i Ai = 0 et η ij ∂i ∂j Ak = 0. (33.3)
où l’équation dévolution est du type (32.3) pour lesquelles le problème de Cauchy est bien posé.
Le lien entre invariance de jauge et contrainte est transparent lorsqu’on décompose le 3-vecteur Aα en
une partie “scalaire” A et une partie sans divergence Āα : Aα = ∂α A + Āα (avec ∂α Āα = 0). Les équations
de Maxwell du vide se réécrivent alors sous la forme :
∂2
4Φ = 0 et Āα = 4Āα (33.4)
∂t2
25
où Φ ≡ A0 − ∂t A et Āα sont des grandeurs invariantes dans les transformations de jauge : Ai → Ai − ∂i f ,
f étant une fonction quelconque des coordonnées, qui laissent les équations de Maxwell inchangées. On voit
donc ainsi que si les équations de Maxwell forment a priori un système de 4 équations pour les 4 composantes
Ai , leur invariance de jauge implique d’une part qu’elles peuvent se réécrire comme un jeu de 3 équations
pour 3 grandeurs invariantes, et d’autre part qu’une de ces trois équations est une contrainte, de sorte que
le problème de Cauchy ne se pose que pour les deux degrés de liberté dynamique restant (il se pose alors
“bien”).
Dans le cas de la relativité générale le problème se pose de façon analogue (cf e.g. le Lichnérowicz).
Considérons dans la variété à bâtir une hypersurface “t = 0”. On notera Cij (0) toute combinaison des
données de Cauchy gij (0) et ∂k gij (0). Les équations d’Einstein du vide en t = 0 s’écrivent alors :
1
Rαβ = − g 00 ∂00 gαβ + Cαβ = 0
2
1
Rα0 = + g β0 ∂00 gαβ + Cα0 = 0 (33.5)
2
1
R00 = − g αβ ∂00 gαβ + C00 = 0.
2
0
On voit que ni ∂00 g00 ni ∂00 g0α n’apparaissent, et que les composantes du tenseur d’Einstein : Gα =
0β 00 0 1 00 αβ
g Rαβ + g Rα0 et G0 = 2 g R00 − g Rαβ ne dépendent que des données de Cauchy—tout comme
l’équation (1). On peut donc se donner arbitrairement g00 et g0α mais il existe 4 équations de contraintes
sur les données de Cauchy. Comme en électromagnétisme donc le problème se scinde en deux : trouver des
données de Cauchy qui satisfassent aux contraintes puis résoudre les équations d’évolution. On peut montrer
de même, à l’aide des identités de Bianchi, que si les contraintes sont satisfaites initialement, elles le sont
toujours.
Pour voir maintenant si le problème de Cauchy est bien posé, on procède comme en électromagnétisme,
en décomposant les équations d’Einstein en des conditions de jauge et des équations d’évolution (Y. Choquet-
√
Bruhat, 1962). Dans la jauge harmonique : Di Di xj = 0, qui implique ∂i −gg ij = 0, les équations
d’Einstein se réduisent à un système d’équations du type (4). Ainsi donc le problème de Cauchy est-il bien
posé, du moins localement.
En électromagnétisme, nous avions franchi une ultime étape en écrivant les équations de Maxwell comme
1 équation de contrainte plus 2 équations d’évolution pour 3 grandeurs invariantes de jauge. Une opération
analogue en relativité générale devrait nous permettre d’identifier 6 grandeurs indépendantes du sytème de
coordonnées et d’écrire les équations d’Einstein sous la forme de 4 équations de contraintes plus 2 équations
d’évolution. Mais une différence essentielle entre les deux théories est que les équations de contraintes sont
non-linéaires en relativité. On ne sait pas les résoudre dans le cas général ce qui interdit d’isoler les vrais
degrés de liberté (cf cependant l’approche d’Ashtekar). C’est là un des obstacles à la quantification du champ
gravitationnel.
26
Rijkl Rijkl , y divergent est peut-être suffisant mais pas nécessaire. Ainsi les solutions du vide des équations
d’Einstein ont-elles toutes une courbure scalaire et un tenseur de Ricci identiquement nuls : elles peuvent
cependant être singulières, si, par exemple Rijkl Rijkl diverge (cas de l’espace-temps de Schwarzschild). Mais
la divergence de Rijkl Rijkl n’est pas nécessaire ; il existe en effet des solutions (du type onde gravitationnelle)
pour lesquelles Rijkl Rijkl ≡ 0 alors que le tenseur de Riemann lui-même diverge. Une telle approche s’avère
donc infructueuse.
La ligne d’attaque adoptée par Roger Penrose et Stephen Hawking (1965-1970) a consisté à définir
une variété singulière par le fait qu’il y existe au moins une géodésique du genre temps ou nulle qui soit
incomplète, c-à-d dont la longueur propre est finie, et ne peut être prolongée.
Nota : cette définition n’est cependant pas entièrement satisfaisante. En effet on peut construire des
espaces-temps où toutes les géodésiques du genre temps ou nul sont complètes mais où il existe des géodésiques
du genre espace incomplètes ou des trajectoires accélérées du genre temps de longueur propre finie.
35. Congruences géodésiques
La détermination de la (non)-singularité d’un espace-temps au sens de Penrose et Hawking passe par
l’étude du comportement des géodésiques.
Une congruence est un ensemble de courbes tel qu’en chaque point de la variété il passe une et une seule
courbe de l’ensemble. Considérons une congruence de géodésiques de genre temps, de vecteurs tangents
ξ i , (ξi ξ i = −1). Définissons le tenseur :
Bij = Dj ξi . (35.1)
Comme la congruence est géodésique et ξ i est unitaire, il satisfait à : ξ i Bij = ξ i Bji = 0. On peut alors le
décomposer selon :
Bij = 31 θhij + σij + ωij (35.2)
où hij ≡ gij + ξi ξj (ainsi hi j = g ik hkj est l’opérateur qui projette tout tenseur sur le sous-espace de l’espace
tangent perpendiculaire à ξ i ; θ ≡ B ij hij est l’expansion de la congruence, σij ≡ B(ij) − 13 θhij en est le
cisaillement et ωij ≡ B[ij] la rotation.
Remarque : se donner une congruence n’implique pas nécessairement qu’il existe une famille d’hyper-
surfaces qui lui soit orthogonale. On peut montrer qu’une condition nécessaire et suffisante pour qu’une
congruence géodésique soit perpendiculaire à une famille de surfaces est qu’elle soit sans rotation : ωij = 0,
ce que nous supposerons par la suite. (C’est là une version restreinte du théorème de Frobenius qui donne la
CNS pour qu’un champ de vecteur soit orthogonal à une hypersurface : ξ[i Dj ξk] = 0.) Le tenseur Bij s’appelle
alors la courbure extrinsèque de la surface. On note souvent Bij = Kij et K = g ij Kij ≡ θ. (Exemple : la
courbure extrinsèque des surfaces t = const d’un univers de Friedmann est K00 = K0α = 0; Kαβ = −aȧδαβ .)
La variation de Bij le long d’une géodésique est donnée par :
ξ k Dk Bij = ξ k Dk Dj ξi = ξ k Dj Dk ξi − Rl ikj ξl ξ k
= Dj ξ k Dk ξ i − Dj ξ k Dk ξi − Rl ikj ξl ξ k
(35.3)
k l k
= −B j Bik − R ikj ξl ξ .
Prenons-en la trace :
dθ
ξ k Dk θ ≡ = − 13 θ2 − σij σ ij + ωij ω ij − Rij ξ i ξ j . (35.4)
dτ
C’est l’équation de Raychaudhuri. Les deux premiers termes du membre de droite sont manifestement non
positifs : le troisième est nul si la congruence est orthogonale à des surfaces. Quant au dernier il se réécrit,
en utilisant les équations d’Einstein :
8πG
Rij ξ i ξ j = Tij ξ i ξ j + 12 T ,
(35.5)
c4
27
Supposons que la matière soit un fluide parfait (les cas plus généraux se traitent de manière analogue) :
Tij = (% + p)ui uj + pgij . Alors la condition : Tij ξ i ξ j ≥ 0, dite condition faible sur l’énergie, est équivalente
à : % ≥ 0 et % + p ≥ 0 : quant à la condition : Rij ξ i ξ j ≥ 0, dite condition forte sur l’énergie, elle équivaut à :
% + 3p ≥ 0 , % + p ≥ 0. (35.6)
Toute matière “standard” de laboratoire satisfait à la condition forte sur l’énergie. On déduit donc de
l’équation de Raychauduri que :
dθ 1 1
+ 13 θ2 ≤ 0 ⇒ ≥ + 13 τ. (35.7)
dτ θ(τ ) θ0
Supposons maintenant que θ0 < 0, c-à-d que la congruence soit initialement convergente. Alors nécessai-
rement, en un temps propre τ ≤ 3/|θ0 |, 1/θ doit passer par zéro, i.e. θ doit diverger. (Nota : on démontre
un résultat analogue pour les congruences de géodésiques nulles.)
Une divergence de θ n’indique cependant qu’une pathologie de la congruence, qui peut être l’apparition
d’une simple caustique, et non nécessairement une singularité dans la structure de l’espace-temps. Afin de
démontrer les théorèmes sur les singularités des notions supplémentaires doivent donc être introduites.
36. Théorèmes intermédiaires
Soit γ une géodésique de vecteur tangent v i ; une solution η i de l’équation de déviation géodésique :
i j k k j l i
v Di v Dj η = −R lij η v v est appelée un champ de Jacobi ; et deux points p et q de γ sont dits conjugués
s’il existe un champ de Jacobi qui s’annulle en p et q (un exemple de tels points sont les pôles nord et sud
de la sphère). On peut alors démontrer le théorème suivant :
(1) Si (M, gij ) est un espace-temps satisfaisant à la condition Rij ξ i ξ j ≥ 0 pour tout vecteur ξ i du genre
temps, si Σ est une hypersurface du genre espace telle que K = θ < 0 en q ∈ Σ ; alors à une distance
τ ≤ 3/|K| il existe un point p conjugué de Σ le long de la géodésique orthogonale à Σ passant par q—à
condition cependant que γ puisse être prolongée jusque là.
Il faut à ce stade introduire la notion d’espace globalement hyperbolique. Par définition c’est un espace-
temps qui possède une surface de Cauchy—dont une définition restreinte est d’être une hypersurface du
genre espace telle que tous les cônes de lumière futurs et passés qui en sont issus couvrent l’ensemble de la
variété. Remarque : la définition donnée ici d’un espace-temps globalement hyperbolique est celle donnée
par R. Wald ; elle diffère de la définition originelle de Leray (1952) et de celle de Hawking & Ellis (1973)
mais on peut montrer qu’elle leur est équivalente.
Enfin on appelle C(Σ, p) l’ensemble des courbes λ causales (du genre temps ou nul) issues de Σ et
1/2
aboutissant en p. Si λ est continue (C 1 ), on définit sa longueur par τ = −Ti T i
R
dt où T = ∂/∂t est le
vecteur tangent à λ.
On peut alors démontrer les théorèmes (2) et (3) suivants :
(2) Soit (M, gij ) un espace-temps globalement hyperbolique, soit p ∈ M et Σ une surface de Cauchy ;
pour que γ ∈ C(Σ, p) soit de longueur τ maximale il est nécessaire qu’elle soit une géodésique orthogonale
à Σ sans point conjugué entre Σ et p. Remarque : ce théorème ne dit pas que τ doit atteindre cette valeur
maximale.
(3) Soit (M, gij ) un espace-temps globalement hyperbolique. Soit p ∈ M et Σ une surface de Cauchy.
Alors il existe une courbe γ de C(Σ, p) pour laquelle τ atteint sa valeur maximale sur C(Σ, p).
37. Exemples de théorèmes sur les singularités
En admettant les théorèmes (1), (2) et (3) énoncés ci-dessus on peut démontrer le théorème suivant :
Soit (M, gij ) un espace-temps globalement hyperbolique tel que Rij ξ i ξ j ≥ 0 pour tout ξ i du genre
temps. Supposons qu’il contienne une hypersurface de Cauchy Σ dont la trace K de la courbure extrinsèque,
pour la congruence des géodésiques normales dirigées vers le passé, est telle que K ≤ C < O partout, où C
est une constante. Alors il n’existe pas de courbe du genre temps orientée vers le passé issue de Σ qui ait
une longueur supérieure à 3/|C|. En particulier toutes les géodésiques du genre temps orientées vers le passé
sont incomplètes.
28
Preuve : supposons en effet qu’il existe une courbe λ du genre temps orientée vers le passé dont la
longueur soit supérieure à 3/|C|. Soit alors p un point au-delà de 3/|C| sur λ. Par le théorème (3) il existe
une courbe de longueur maximale γ de Σ à p dont la longueur doit être supérieure à 3/|C|. Par le théorème
(2) ce doit être une géodésique sans point conjugué entre Σ et p. Mais cela contredit le théorème (1) qui dit
que γ doit avoir un point conjugué entre Σ et p. Par conséquernt la courbe γ n’existe pas.
Ce théorème, le plus facile à démontrer, est assez faible. Non seulement la condition forte sur l’énergie
doit être satisfaite partout mais l’espace-temps doit être globalement hyperbolique. Ce fut l’œuvre de Penrose
et Hawking de démontrer l’apparition de singularités sous des hypothèses moins fortes. Nous ne citerons ici
que le théorème final (Hawking-Penrose 1970), qui élimine quasiment toutes les hypothèse mal-venues :
Supposons qu’un espace-temps (M, gij ) satisfasse aux quatre conditions suivantes :
(1) Rij v i v j ≥ 0 pour tout vecteur du genre espace ou nul ;
(2) la condition dite générique est satisfaite, i.e., toute géodésique du genre temps ou nul possède au
moins un point où Rijkl ξ k ξ l 6= 0 ;
(3) il n’y pas de courbe du genre temps fermée. (Remarque : c’est là une condition beaucoup moins
forte que celle d’hyperbolicité globale.)
(4) enfin l’une des trois propriétés suivantes est vraie :
– (M, gij ) est une variété fermée,
– (M, gij ) possède une surface “piégée”, c-à-d une surface bi-dimensionnelle dont l’expansion θ est
négative pour les géodésiques du genre temps et nul dirigées à la fois vers le passé et le futur. (Un exemple
de telle surface est l’horizon d’un trou noir.)
– il existe un point p ∈ M tel que l’expansion θ de la congruence de géodésiques nulles dirigées vers
le futur (ou le passé) issues de p devienne négative ;
Alors (M, gij ) doit contenir au moins une géodésique du genre temps ou nulle incomplète.
29
Tables des matières
LA THEORIE D’EINSTEIN DE LA GRAVITATION
Relativité générale, gravitation et courbure
Forces d’inertie et de gravitation
1. Une relativité générale
2. Le principe d’équivalence
3. Une mosaı̈que de M4
4. Le “mollusque” de référence
5. Un espace-temps pseudo-riemannien
6. Décalage spectral gravitationnel
Définition générale d’une variété
7. Variété riemanienne
8. Espaces tangent et cotangent
9. Tenseurs
Introduction au tenseur de Riemann-Christoffel
10. L’exemple de la sphère
11. Dérivation covariante, transport parallèle et courbure
12. Commutation des dérivées covariante, torsion et courbure
13. “Déviation géodésique” et courbure
14. Propriétés du tenseur de courbure
30