Introduction aux probabilités finies
Introduction aux probabilités finies
1.1 Introduction
Contrairement à d’autres branches des mathématiques, la géométrie euclidienne ou l’algèbre par
exemple, les probabilités sont nées beaucoup plus tardivement. Quelques considérations élémentaires
furent abordées par Jérôme Cardan au début du XVI-ième siècle et par Galilée au début du XVII-
ième siècle mais le véritable début de cette théorie date de la correspondance entre Pierre de Fermat
et Blaise Pascal, en 1654.
Il fallut attendre la deuxième moitié du XVII-ième siècle, à la suite des travaux de Blaise
Pascal et Pierre de Fermat, pour que le terme « probabilité » prenne peu à peu son sens actuel, grâce
aux études menées par Jakob Bernoulli.
A la fin du XVIII-ième siècle, cette nouvelle théorie fera son apparition dans l’encyclopédie
de Diderot. Cependant, il fallut patienter jusqu’au début du XX-ième siècle pour que la théorie
des probabilités un nouvel essor. Celui-ci est du à la mise en place, en 1933, par le
mathématicien russe Kolmogorov, d’une axiomatisation mathématique (que nous utilisons toujours
actuellement) permettant de traiter la théorie des probabilités avec une véritable rigueur. Il fut
d’ailleurs à l’origine de travaux révolutionnaires dans cette branche et résolu un grand nombre de
problèmes qui avait dérouté de nombreux mathématiciens de l’époque.
1.2.1 Vocabulaire
Définition 1.2.1. • Une expérience aléatoire est une expérience dont les résultats possibles
sont connu sans pour autant que nous puissions prédire lequel d’entre eux va se réaliser.
• L’ensemble des issues d’une expérience aléatoire s’appelle l’univers et sera désigné par Ω.
Il est possible de proposer de nombreuses expérience aléatoire apparaissant dans la vie commune,
voici quelques exemples.
Exemple 1.2.1. 1. Lancer un dé (à six faces) et observer son résultat est une expérience
aléatoire. « six » est une issue de cette expérience et Ω = {1, 2, 3, 4, 5, 6} l’univers associé.
2. Tirer une carte (dans un paquet de 32 cartes). « As de pique » est une issue possible et
Ω = {as de pique, roi de pique, dame de pique,. . . } l’univers associé.
Remarque. Bien entendu, il existe de nombreuses expériences aléatoires beaucoup plus complexes
dont la description dépasse largement le cadre de ce cours. A titre d’exemple, voici un phénomène
qu’il est possible de visualiser chez soi : imaginons que nous observions un grain de poivre dans une
casserole d’eau bouillante. Les molécules d’eau, agitées, vont venir frapper et déplacer le grain de
poivre. La trajectoire du grain de poivre devient alors erratique, imprévisible et correspond à un objet
probabiliste très célèbre : le mouvement Brownien. Celui-ci a été découvert par le botaniste Brown
(en 1827) et fut étudié par Einstein (en 1905), cet objet est notamment utilisé, entre autre, en finance
pour décrire l’évolution de la bourse. Il est également possible de visualiser ceci en ligne, sur le site
http : //[Link]/Brownian − Motion/.
La plupart du temps nous allons étudier des sous-ensembles de l’univers, il s’agit de la notion
d’évènement.
Exemple 1.2.2. Lors de l’étude du lancer de dés (à six faces), il est possible de considérer
l’évènement : A = {obtenir un nombre pair}. Il est évident que l’ensemble A se décrit de manière
équivalente comme A = {2; 4; 6}.
Quelques mots sur la terminologie : si jamais nous avions obtenu le nombre 4 après avoir lancer
le dés, nous dirions que « l’issue 4 réalise l’évènement A » ; au contraire, l’issue 1 (par exemple)
ne réalise pas l’évènement A.
1.3. LOI DE PROBABILITÉ SUR UN ENSEMBLE FINI 9
∩
Définition 1.2.3. 1. L’intersection de A et B, notée A B correspond à l’ensembles des issues
appartenant à A et à B. Si jamais cet ensemble est vide, A B ∩= , nous ∅ dirons que les
évènements A et B sont incompatibles (les deux évènements ne peuvent se réaliser en même
temps) ou disjoints.
Voici des diagrammes, inventés par le mathématicien Venn (1834− 1923), permettant d’illustrer
graphiquement les définitions ci dessus.
Exemple 1.3.1. Considérons un jeu de pile ou face. L’univers associé est Ω = {P, F}. Si nous
souhaitons décrire l’aléa associé, il est donc nécessaire de préciser avec quelle probabilité les issues P
et F sont obtenues. Cela revient à attribuer des nombres p1 et 2, compris entre 0 et 1, correspondant à
ces probabilités. Ainsi, si la pièce est équilibrée nous aurions
1 1
P(F ) = = p et P(P ) = =p .
1 2
2 2
Si jamais la pièce n’était pas équilibrée, nous pourrions obtenir plus souvent P que F , par exemple
1 2
P(F ) = = p et P(P ) = =p .
1 2
3 3
Dans les deux cas présentés ci-dessus, les nombres p1 et p2 (décrivant l’aléa) correspondent à
une loi de probabilité sur l’ensemble P, F {. Pour} traiter le cas général, il est nécessaire de considérer
un univers comportant plus de deux issues possibles.
Dans cette section nous considérons donc un univers fini Ω = {ω1, . . . , ωd} composé de d ∈ N
issues distinctes ω1, . . . , ωd. Il est à noter que le nombre d sera toujours déterminer par les données
de l’énoncé d’un exercice. Lors du pile ou face, nous avions
d=2 , ω1 = P et ω 2 = F.
Si nous avions procédé à un lancer de dé (à 6 faces) nous aurions eu
Définition 1.3.1. 1. Définir une loi de probabilité sur cet univers Ω correspond à associer à
chaque issues ωi, i = 1, . . . , d un nombre réel pi ∈ [0, 1] tel que
p1 + . . . + p d = 1
Le nombre pi, i = 1, . . . , d correspond à la probabilité que l’évènement {ωi} se réalise.
Autrement dit P {ωi} = pi pour tout i = 1, . . . , d. L’ensemble des nombres (pi)i=1,...,d,
décrivant le comportement de l’aléa, est une loi de probabilité sur l’ensemble Ω.
Remarque. Il est important de noter que, pour tout évènement A ⊂ Ω, nous avons
0 ≤ P(A) ≤ 1
De plus, l’évènement certain Ω se réalise avec une probabilité 1 : P(Ω) = 1. Tandis que l’évènement
impossible de réalise avec une probabilité nulle : P(∅) = 0.
1.3. LOI DE PROBABILITÉ SUR UN ENSEMBLE FINI 11
Exemple 1.3.2. Supposons que nous ayons à disposition un sac contenant six boules (indiscer- nables
au touché) dont une rouge, deux vertes et trois bleues. Si nous mettons en place l’expérience aléatoire
suivante : « tirer une boule du sac, au hasard » il est possible d’associer une loi de probabilité à
l’univers Ω = {rouge, vert, bleue}.
Pour alléger les notations, nous désignerons ces évènements élémentaires par R, V, B. Voici la
loi de probabilité que nous obtiendrons :
Issue ωi R V B
probabilité pi 1 1 1
6 3 2
Ainsi, si nous voulions calculer la probabilité de l’évènement A = {ne pas obtenir une rouge}
nous aurions : A = {B, V } donc P(A) = P(B) + P(V )3= 12 + 16 = 5 .
Fréquence et probabilité
Souvent, nous pouvons avoir accès à la fréquence d’un évènement. Cette fréquence est reliée à la
probabilité de cet évènement par le Théorème de la loi forte des grands nombres (du à Kolmogorov
en 1929) dont nous donnons un énoncé simplifié ci-dessous.
Théorème 1 (Loi forte des grands nombres). • Lorsque nous répétons, dans les mêmes
conditions, n fois une expérience aléatoire. La fréquence d’un évènement se rapproche de la
probabilité de cet évènement lorsque n devient de plus en plus grand.
Remarque. Typiquement, cela signifie qu’après avoir effectuer un certain nombre de lancer d’une
pièce équilibrée, nous obtiendrons autant de pile que de face.
Equiprobabilité
Dans de nombreux exemples (lancer de dés, pile ou face, etc. . . ) les probabilités pi, i = 1, ....... , d
des évènements élémentaires sont toutes égales : il s’agit d’une situation d’équiprobabilité.
p1 + . . . + p d = 1
En outre, puisque nous sommes dans une situation d’équiprobabilité, nous avons p1 = . . . = pd.
Donc
dpd = 1
d’où le résultat.
2. Si A est composé de k issues (évènements élémentaires), nous avons alors
1 1 k
P(A) = + ...+ = .
d d d
Exemple 1.3.3. Supposons que Sofiane ait un C.D. de dix morceaux proposant une compilation de
• trois morceaux de musique classique,
• trois morceaux de jazz,
• deux morceaux de death metal,
• deux morceaux d’électro.
Il place le C.D. en mode « shuffle » dans sa chaine hi-fi : laquelle choisit donc, au hasard, l’un des
titres de la compilation. Nous sommes en situation d’équiprobabilité (toutes les pistes ont la même
chance d’être choisie) et obtenons les probabilités suivantes :
Issue ωi C J DM E
probabilité pi 3 3 2 1
10 10 = 1 5
10 5
Il suffit alors de substituer cette nouvelle expression de P(A1) dans l’équation (1.4.1) pour
conclure.
P(Ac ) = 1 − P(A)
Traitons à présent un exemple permettant de manipuler les deux formules précédemment intro-
duites.
Exemple 1.4.1. Considérons trois évènements A, B et C issus d’une expérience aléatoire. Nous supposons
que A et B sont des évènements incompatibles et que
• Déterminer un univers ainsi que les issues d’une expérience aléatoire. Etre capable de déterminer
une loi de probabilité associé à une expérience aléatoire.
• Modéliser, à l’aide d’un arbre ou d’un tableau à double entrée, une expérience aléatoire.
2. Lorsque le triangle OIJ est rectangle en O, le repère (O, J, I) est dit orthogonal et les axes
du repère sont perpendiculaires.
3. Lorsque le triangle OIJ est rectangle-isocèle en O, le repère (O, J, I) est dit orthonormée. Les
axes du repère sont perpendiculaires et l’unité de mesure est la même sur chaque axe.
Voyons à présent de quelle manière attribuer des coordonnées à un point du plan une fois qu’un repère
ait été choisi.
Définition 3.2.2. Soit (O, I, J) un repère du plan et M un point quelconque.
• En traçant la parallèle à (OJ) passant par M, nous obtenons l’abscisse xM du point M sur
l’axe (OI).
• Le couple de réels (xM , yM ) est le couple de coordonnées du point M dans le repère (O; I; J).
Comme nous le verrons par la suite, l’introduction d’un repère dans une figure fournit un outil
supplémentaire pour faire de la géométrie. Nous reverrons, en exercice, de quelle manière procéder et
comment les coordonnées cartésiennes permettent de revisiter certains résultats vu au collège.
Proposition 6. Considérons le plan muni d’un repère (O; I; J) ainsi que des points A(x A; y A) et
B(xB; yB). Le milieu M du segment [AB] a pour coordonnée
xA + x B yA + yB
M ;
2 2
Remarque. Les coordonnées du point M correspondent à la moyenne arithmétique des coordonnées
des points A et B.
Voyons ceci sur un exemple.
xA + xB 1 −3 yA + y B −2 + 0
xK = = = −1 et yK = = = −1.
2 2 2 2
Autrement dit, K(−1; −1).
2. Le symétrique de B′ de B par rapport au point C, est tel que C est le milieu du segment
[BB′]. Ses coordonnées vérifient donc :
yB′ + yB
et =y .
D’où xB′ = 2xC − xB = −2 − (−3) = 1 et yB′ = 2yC − yB = 4. C’est à dire, B′(1; 4).
x2 = 4
x2 − 4 = 0 ⇐⇒ x2 − 22 = 0 ⇐⇒ (x + 2)(x − 2) = 0
où nous avons utilisé l’identité remarquable a2−b2 = (a + b)(a −b). Il convient alors d’utiliser
la règle du produit nul pour trouver l’ensemble des solutions suivant S : = {−2; 2} qui
vérifient l’équation x2 = 4. Il est important procéder ainsi pour ne pas oublier l’une des deux
solutions. En pratique, lorsque nous ferrons de la géométrie et calculerons des distances, la
racine négative sera régulièrement exclue car une telle valeur ne peut correspondre à une
longueur.
Pour conclure ces brefs rappels, voici une propriété importante permettant de simplifier des
racines carrées.
√ √ √
Propriétés 2. Soient a, b ≥ 0 alors ab = a b √
Remarque. Attention, la propriété suivante n’est jamais vraie : √ √ b. Pour s’en
a + b /= a +
c√onva inc r e√
, il suffit de choisir a√= 1√
6 et b = 9. Avec un tel choix, nous avons bien d’un part
a + b = 25 = ±5 tandis que a + b = ±4 ± 3.
Voici un exemple d’application de ce qui précède.
√ √ √ √ √
Exemple 3.4.2. 1. 12 = 4 × 3 = 4 × 3 = 2 3.
√ √ √ √ √
2. 18 = 9 × 2 = 9 × 2 = 3 2.
Cette propriété est notamment utile pour résoudre des équations lorsqu’il n’y a pas de carré
parfait. Par exemple, avec ce qui précède,
√ √ √
x2 − 12 = 0 ⇐⇒ (x + 2 3)(x − 2 3) = 0 ⇐⇒ x = ±2 3
Nous reviendrons sur tout ceci plus en détails dans une leçon ultérieure.
Remarque. Sans grande surprise, la présence du carré dans la formule permet de constater que
AB = BA.
Démonstration. Le fait que le repère soit orthonormé est essentiel et permet d’appliquer le Théo-
rème de Pythagore. Sans perdre en généralité, nous pouvons supposer que xA < xB et yA > yB
(essentiellement, les autres cas de figures sont similaires). Soit E le point du plan ayant même abs-
cisse que le point A et la même ordonnée que le point B. Les axes du repère étant orthogonaux, le
triangle AEB est donc rectangle en E. Il est alors possible d’appliquer le Théorème de Pythagore,
qui nous assure que
Proposition 8. Soient A, B et C trois points du plan. Ces points sont alignés si et seulement si
AB + BC = AC.
Théorème 9 (Pythagore). Soit ABC un triangle (non aplati). L’équivalence suivante est vérifiée :
3. ABCD est un parallélogramme si et seulement si ses côtés opposés sont deux à deux de
même longueur.
2. ABCD est un rectangle si et seulement si ses diagonales ont même longueur et se coupent
en leur milieu.
3. Si ABCD est un parallélogramme admettant un angle droit alors il s’agit d’un rectangle.
Enfin, observons qu’un carré combine les propriétés des losanges et des rectangles. En consé-
quence, pour démontrer qu’un quadrilatère ABCD est un carré il suffit de prouver qu’il s’agit à la
fois d’un losange et d’un rectangle.
Bien que notre intuition soit un peu gênée par des espaces de dimension supérieurs à trois, ces
ensembles interviennent très rapidement lors de l’étude de certains problèmes. En effet, grossière -
ment, ajouter une dimension revient à considérer un paramètre supplémentaire. Par exemple, pour
décrire le mouvement d’un oiseau nous avons besoin de connaître sa position dans l’espace. En
revanche, il est possible que nous ayons également besoin de connaitre la durée de son mouvement, la
pression atmosphérique, la température, etc . . . la considération de ceci force à introduire plus de
dimensions pour prendre en compte ces nouveaux paramètres. En statistiques, certains problèmes de
modélisation comme la météorologie met en jeu plusieurs milliers de paramètres.
L’un des intérêts majeur des coordonnées cartésiennes est que nous pouvons étudier des choses
qui dépasse notre imagination. En effet, pour ajouter une dimension il suffit d’ajouter une coordonnée
à notre vecteur. Il devient donc possible de faire des calculs sur des choses que nous ne pouvons
visualiser. Cela va parfois à l’encontre de notre intuition. Voyons ceci au travers d’un exemple.
Débutons dans le plan et considérons un carré de côté 2 dont le centre est placé en (0, 0).
27
Plaçons des disques de rayon 1 dans les zones suivantes : un premier disque centré au point (1; 1), un
deuxième en (1; 1), − un autre en ( 1;− 1) et un dernier en ( − 1; − 1). Il est alors possible de
placer un dernier diqque en (0; 0) puis de l’agrandir jusqu’à ce qu’il touche les quatre disques que
nous avons disposer. dans le carré au préablable.
Bien sûr, il est possible de procéder de manière similaire dans l’espace. Cette fois -ci nous avons
un cube de côté 2, 8 boules de rayon 1 centrées aux points ± ( 1;±1; ±1) et enfin une dernière boule
placée en (0; 0; 0 dont le rayon est plus grand possible (avec pour condition que cette nouvelle boule
ne puisse empiéter sur les autres).
A vrai dire, pourquoi s’arrêter en si bon chemin ? Il n’est plus possible de faire de dessin mais
nous pouvons imaginer un hypercube de côté 2 (que nous noterions [ 2; 2]−d) en dimension d et placer
des boules aux points ( 1; . . . ,± 1) comme
± auparavant pour enfin placer une dernière boule au centre
avec les mêmes restrictions qu’auparavant.
A partir de quelle dimension cette dernière boule dépasse du cube [−2; 2]d?
De manière intuitive, nous serions tenter de répondre : jamais ! Voyons ce que nous disent les
calculs. Nous avons vu que la distance d’un point M = (x1; x 2) à l’origine valait
q
d(O, M ) = x12 + x22
Or, dans le problème que nous co nsidér√ ons les points M , centres des boules, ont des coordonnées de
la forme (±1; . . . ; ±1 donc d(O, M ) = d. Ainsi, puisque ces b o√u le s sont de rayon 1, cela entraine
que le plus grand rayon possible pour la boule centrale vaut d − 1. En conséquence, la boule
centrale déborde du cube si
√
d−1 > 2 ⇐⇒ d>9
ce qui n’était pas du tout intuitif. En fait, il est même possible de préciser ce résultat. Il s’agit d’un
domaine des mathématiques qui s’appelle la concentration de la mesure. L’un des résultats de cette
théorie permet d’affirmer que le volume de la boule centrale restant dans le cube s’approche très vite
(exponentiellement vite) de zéro lorsque la dimension devient de plus en plus grande.
3.8.1 Distance
La distance que nous venons de voir s’appelle la distance euclidienne. Il existe d’autre façon
de mesurer la distance entre deux points, l’une d’elle s’appelle la distance de « Manhattan » (en
rapport avec le quartier de New-York). La raison derrière cette terminologie est la suivante : la
plupart des villes américaines sont construites sur la forme d’un quadrillage. Ainsi, pour rejoindre
un point A à un point B de la ville, nous sommes forcés de suivre ce quadrillage et d’arpenter les
côtés des carrés de ce quadrillage. Ainsi, la distance calculée correspond à celle qui est effectivement
parcouru à pied plutôt que celle obtenue « à vol d’oiseau ».
d2(A, M ) ≤ r
et nous obtiendrons la figure classique que vous avez pu rencontré au collège. En revanche, si
nous remplaçons d2 par d1 dans le formule précédente, notre cercle prendra alors la forme d’un carré !
Il existe d’innombrables distances en mathématiques, chacune ayant une utilité, les quelques mots
précédents ne font qu’effleurer la surface de cette notion.
3.8.2 Pythagore
Durant votre scolarité du collège, le théorème de Pythagore fut, sans doute, l’un des résultats qui
a occupé une grande partie du programme. Il est même fort possible que votre professeur ait proposé
une démonstration permettant de vous assurer que l’énoncé de ce théorème était vrai. Néanmoins,
votre professeur, a sûrement du omettre une chose fondamentale à son propos. Ma question est donc
la suivante :
Cette question peut sembler incongrue, pourtant elle mérite quelques mots. Votre professeur du
collège a du présenter le théorème de Pythagore et dessiner des triangles sur le tableau noir de la salle
de cours. Implicitement, cela signifie que ses dessins sont fait sur une surface plane ! A votre avis, le
théorème de Pythagore est-il encore vrai si nous dessinions nos triangles sur un ballon ? ou à
l’intérieur d’un bol ?
La réponse à ces questions est négative ! D’ailleurs, il est même possible de construire, sur un
un ballon, un triangle possédant 3 angles droits ! En d’autres termes, cette remarque signifie qu’il
existe d’autre géométrie que celle d’Euclide (étudiée au collège, puis au lycée). Grossièrement, il y
a aussi la géométrie sphérique (celle-ci pouvant être visible à l’échelle de la Terre, permettant aux
avions d’effectuer des vols optimaux entre Paris et Tokyo) et la géométrie hyperbolique. Bien sûr, il
existe d’autres géométries que celles que nous venons d’énoncer (bien qu’il s’agisse des principales).
Par exemple, la géométrie qui a permis au physicien Albert Einstein de formaliser sa théorie de la
relativité repose sur une géométrie dite « pseudo-riemannienne ».
5.1 Notion de fonction
Considérons un sous-ensemble I de R (pas nécessairement un intervalle). Définir une fonction sur
l’ensemble I revient à fournir une formule précisant les calculs à effectuer à partir d’un nombre x ∈
I. Comme nous le verrons, la calculatrice est un outil très pratique pour étudier des fonctions.
Un peu comme une recette de cuisine, il faut suivre les étapes dans l’ordre pour arriver au résultat.
Définition 5.2.1. Une fonction f est définie sur l’ensemble I lorsque à tout point x ∈ I nous
associons un unique nombre noté f (x). Nous emploierons fréquemment la notation f : x '→ f (x).
Remarque (Vocabulaire). 1. L’ensemble des réels I pour lesquels il est possible de déterminer
f (x) est appelée l’ensemble de définition de f .
1. Si pour un nombre réel donné y, il est possible de trouver un autre réel x tel que y = f (x)
nous dirons que x est l’antécédent de y par f .
Voici quelques exemples pour illustrer cette définition afin de la rendre plus concrète.
Exemple 5.2.1. 1. Il est possible de définir la fonction qui à un nombre lui associe le double de
sa valeur. C’est-à-dire, f : x '→ 2x. Pour ce choix de fonction, l’image du point x = 2 vaut f
(2) = 2 × 2 = 4. Tout nombre réel ad met un antécédent par la fonction f , par exemple
17
y = 17 admet pour antécédent 17 2 car f 2 = 2 × 17
2 = 17.
2. Il est aussi possible de définir la fonction carrée qui à tout nombre associe son carré. C’est-
à-dire : f : x '→ x2. Observons que les nombres négatifs n’admettent pas d’antécédent. En
effet, si y = −1 il n’est pas possible de trouver x ∈ R tel que f (x) = x2 = −1 car x2 ≥ 0 et −1
< 0.
3. Bien entendu, il est possible de regarder des fonctions beaucoup plus compliquées en précisant les
opérations que doit subir un nombre réel x pour obtenir la valeur de f (x).
6x − 1 3x2 − (x + 2)(x3− π)
f (x) = − 3x + 12 ou f (x) = ,x= 1 ou f (x)
...
x2 = / − x2 + 1
x+1
Ces fonctions existent mais nous ne les étudierons que plus tard dans l’année.
Remarque. L’axe des abscisses permet de trouver les antécédents d’un point y tandis que l’axe des
ordonnées permet de trouver l’image d’un point x.
Ces manipulations doivent êtres sues : en cas de doute, aller voir les tutoriels d’Y. Monka sur
le site maths et tiques.
1. Sur la calculatrice, il suffit d’utiliser la touche f (x) pour entrer la formule y1 = f (x)
définissant la fonction puis d’appuyer sur la touche graphique pour obtenir une figure.
2. Attention, il faut parfois ajuster la fenêtre de visualisation pour voir la courbe en entière.
Pour cela, il faut cliquer sur la touche fenêtre pour ensuite modifier les abscisses avec Xmin
et Xmax ; ainsi que les ordonnées avec Y min et Y max.
3. Xgrad et Y grad permettent de définir la taille des graduations sur les axes des abscisses et
des ordonnées.
4. La touche zoom peut également être utile pour choisir judicieusement la fenêtre de visualisa-
tion du graphique.
Il est important de savoir utiliser ce graphique pour trouver l’image d’un point, déterminer des
antécédents, l’ensemble de définition.
La calculatrice est de nouveau utile pour résoudre, de manière approximative, ce genre d’équa-
tion. Pour cela, il suffit :
1. d’aller dans l’onglet f (x) de la calculatrice pour définir y1 = f (x) et y2 = k.
f (a) ≤ f (b)
Une fonction croissante préserve l’ordre : c’est-à-dire, les réels de l’intervalle I et leurs images par
f sont rangés dans le même ordre.
Remarque. Une fonction est dite strictement croissante si a ≤ b entraine que f (a) < f (b).
Par exemple, si f est croissante nous aurions 2 < 3 entraine que f (2) < f (3).
Exemple 5.4.1. 1. La fonction f (x) = 2x est croissante sur R.
f (a) ≥ f (b)
Une fonction décroissante renverse l’ordre : c’est-à-dire, les réels de l’intervalle I et leurs
images par f sont rangés dans un ordre contraire.
Remarque. Une fonction est dite strictement décroissante si a ≤ b entraine que f (a) > f (b). Par
exemple, si f est croissante nous aurions 2 < 3 entraine que f (2) > f (3).
x −2 0 +2
f (x) = x2 44 44
00
Ce tableau signifie que la fonction est décroissante sur l’intervalle [−2; 0], puis croissante sur
[0; 2]. Le tableau annonce aussi que f (−2) = 4, f (0) = 0 et f (2) = 4.
2. Voici ce que nous aurions obtenu avec la fonction x '→ −2x.
x −3 +2
f (x) = 6
−2x -4 Il est important de maîtriser les compétences exposées
page 21 de votre livre : construire un tableau de variation à partir d’un graphique, comparer des
images à partir d’un tableau de variation.
1
Nous étudierons la fonction x '→ x 2 (et ses généralisations) ainsi que la fonction x '→ plus
x
précisément dans un chapitre ultérieur.
5.3.3 Extremum
Il est parfois utile de déterminer, lorsqu’elles existent, la plus grande ou la plus petite valeur
atteinte par une fonction f donnée.
Définition 5.4.3. 1. Le maximum d’une fonction f sur un intervalle I est, s’il existe, la plus grande
valeur possible des images, atteinte pour un réel b I. Ainsi,
∈ pour tout réel x I nous∈avons
f (x) ≤ f (b).
2. Le minimum d’une fonction f sur un intervalle I est, s’il existe, la plus petite valeur
possible des images, atteinte pour un réel a ∈ I. Ainsi, pour tout réel x ∈ I nous avons
f (a) ≤ f (x).
Remarque. Le mot extremum désigne sans distinction le minimum ou le maximum d’une fonction.
5.3.4 Fonctions affines et sens de variations
Il est possible de compliquer légèrement la situation à partir d’une fonction linéaire, il s’agit des
fonctions affines.
Définition 5.5.2. Etant donnés des nombres réels a et b, une fonction affine est définie sur R par la
formule suivante
f (x) = ax + b
Remarque. 1. Lorsque b = 0 nous retrouvons le cas des fonctions linéaires. Les fonctions affines
sont une généralisation des fonctions linéaires.
2. Le nombre b est souvent désigné sous le nom de « ordonnée à l’origine ». En effet, lorsque x
= 0 une fonction affine vaut donc f (x) = a × 0 + b = b. Ceci signifie que la courbe Cf d’une
telle fonction passe par le point (0, b). Graphiquement, lorsque b = 0, la droite représentant la
courbe d’une fonction affine ne passe pas par l’origine du repère. En revanche, cette droite coupe
l’axe des ordonnées au point b.
Théorème 13. Soit f (x) = ax + b, avec a, b ∈ R, une fonction affine définie sur R. Alors
1. Si a > 0, la fonction affine est croissante sur R.
Démonstration. Montrons le premier point, la deuxième assertion est laissée en exercice. Soit f (x) =
ax + b une fonction affine avec (a, b)∈ R 2. Soient x et y deux réels tels que x≤ y, montrons alors
que f (x) ≤f (y) à condition que a > 0. Le point important est que la multiplication d’une inégalité
par un nombre strictement positif ne change pas le sens de celle-ci ; l’ajout d’un nombre réel dans
chaque membre non plus.
•
• Savoir lire et établir le tableau de variations d’une fonction (notion de fonction croissante,
décroissante, . . . ).
• Savoir déterminer les extremums d’une fonction à l’aide d’un tableau de variations ou d’une
représentation graphique.
Nous allons poursuivre notre étude des repères du plan, qui nous ont permis d’associer des
coordonnées à un point, en introduisant la notion de vecteurs.
Remarque. 1. De manière plus pratique, étant donné deux points distincts A et B du plan, il est
possible de tracer le vecteur permettant de les relier (en dessinant une flèche). Cette flèche
est alors déterminé par plusieurs choses
• sa direction qui est définie par l’unique droite passant par les points A et B ;
• son sens qui précise si nous allons du point A vers le point B ou le contraire ;
• sa norme qui correspond à la distance entre les points A(xa; yA) et B(xB; yB).
ces caractéristiques coïncident avec la définition d’un vecteur proposée en Physique. Ainsi,
−→
étant donné un vecteur A B et un point N , il est facile de construire le point M , translaté
−→
du point N , en « déplaçant la flèche A B »(tout en s’assurant que le parallélisme
est conservé) afin de l’apposé au point M pour obtenir le point N à l’extrémité de cette flèche.
CHAPITRE 6. VECTEURS
−→
2. Lorsque les points A et B sont confondus, le vecteur que nous obtenons AA est communément
−
→
appelé vecteur nul et noté 0 .
−−→ −→
3. Bien entendu, une fois construit le vecteur MN à partir du vecteur AB, ces deux vecteurs
sont égaux. En effet, ils conduisent tout les deux à la même translation.
−
→ x
u
y
x
Remarque. D’un point de vu pratique, signifie que pour obtenir le M à partir du point O il
y la droite et y fois vers le haut ».
faut se déplacer (dans le repère) « x fois vers
L’introduction d’un repère et l’utilisation de coordonnées pour repérer un vecteur simplifie
beaucoup de choses.
Propriétés 5. 1. Egalité entre deux vecteurs : deux vecteurs sont égaux si et seulement si, leurs
coordonnées sont égales. C’est-à-dire
−u x = −
→ → x′
v ⇐⇒ x = x′ et y = y′.
y y′
x x
2. Somme de vecteurs : soient −
→u et −
→v alors
y y
−u + −
→ → x + x′
v = .
y + y′
6.3.2 Coordonnées d’un vecteur
−→
Poursuivons notre étude, voyons comment déterminer les coordonnées du vecteur AB à partir des
coordonnées des points A(xA; yA− et B(xB; yB).
Proposition 14. Soient A(xA, yA) et B(xB; yB) deux points du plan. Nous avons alors les coor-
−→ x − xA
données suivantes AB B .
yB − yA
Remarque. Il faut être prudent dans cette relation et observer qu’il faut faire la différence des
coordonnées du point B (l’extrémité) avec celles du points A (le point de départ du vecteur).
Démonstration. Notons par M (x; y) le point obtenu en effectuant la translation de l’origine O par
−→ −→ x
le vecteur AB. Par définition, cela signifie aussi AB . Déterminons une expression de x et de y
y
en fonction des coordonnées des points A et B. Pour cela, notons que par construction, nous avons
−−→ −→
O M = AB. Ainsi, en utilisant la propriété (3), les segments [AM ] et [OB] ont le même milieu. Nous
pouvons donc calculer les coordonnées de celui-ci à partir des coordonnées des points impliqués.
C’est-à-dire,
xA + x 0 + xB yA + y 0 + yB
= et =
2 2 2 2
D’où, x = xB − xA et y = yB − yA. Ce qui est bien le résultat attendu.
−→ 3 − 2 1
Exemple 6.3.1. Soient A(2; 1) et B(3; −1) alors AB = .
−1 − 1 −2
−4 4
2. 4 − 3x < 0 ⇐⇒ −3x < −4 ⇐⇒ x > = .
−3 3
x b
−∞ −a +∞
signe de 0 −
+
ax + b
2. Si a > 0 alors
x b
−∞ −a +∞
signe de − 0 +
ax + b
Ces résultats, combinés à une règle de signe évidente, permet de résoudre des inéquations produit ou
quotient. Voyons plutôt sur des exemples.
où nous avons utilisé l’identité remarquable a2− b2 = (a + b)(a− b) pour factoriser le membre
de gauche.
x −∞ −3 3 +∞
signe de 6 − 2x + + 0 −
signe de 6 + 2x − 0 + +
(6 − 2x)(6 + 2x) − 0 + 0 −
36 − 4x2 ≥ 0 ⇐⇒ x ∈ [−3; 3]
signe de x + 4 − 0 + +
signe de x − 2 − − 0 +
x+4 + 0 − +
x−2
x+4
⇐⇒ x ∈] − ∞; −4]∪]2; +∞[
x −2
Pour résoudre ce genre de problème, il est important de placer sur le graphique la droite hori-
zontale Ðd’équation y = k (les points d’intersection de cette droite avec la courbe Cf sont solutions
de l’équation f (x) = k).
Proposition 16. Les solutions de l’inéquation f (x) > k sont les abscisses des points de la courbes
Cf situés au-dessus de la droite Ð.
Remarque. 1. Autrement dit, après avoir identifier la partie de la courbe se situant au dessous de
la droite , il Ð
ne reste plus qu’à déterminer les antécédents de ces points sur l’axe des abscisses
afin d’obtenir un intervalle ou une réunion d’intervalles.
2. La méthode de résolution pour une inéquation de la forme f (x) < k s’effectue de la même
manière en considérant les points de la courbe situés en dessous de la droite Ð.
Exemple 7.3.1. insérer un graphique
Proposition 17. 1. Les solutions de l’équation f (x) = g(x) sont les abscisses des points
d’intersections des courbes Cf et C g.
2. Les solutions de l’inéquation f (x) > g(x) sont les abscisses des points de la courbes Cf
situés au-dessus de la courbe Cg.
3.
4. Les solutions de l’inéquation f (x) < g(x) sont les abscisses des points de la courbes Cf
situés en-dessous de la courbe Cg.
Remarque. En particulier, si Cg est une droite horizontale d’équation y = k nous retrouvons l’étude
faite à la section précédente.
Vecteurs et colinéarité
Dans ce chapitre nous allons poursuivre l’étude initié dans le chapitre introduisant les vecteurs et
leurs coordonnées. Nous allons voir de quelle manière il est possible de traduire des notions de
géométrie rencontrées au collège à l’aide de vecteurs. Ici nous allons étudié la notion de parallélisme
Remarque. Géométriquement, cela signifie que ces vecteurs possèdent la même direction (pas né -
cessairement le même sens). La définition précédente est symétrique : − →u est colinéaire à −→v si et
→
− −
→ −
→ →
−
seulement si v est colinéaire à u . En effet, si u est colinéaire à v , il existe k ∈ R non nul tel que
−u = k × −
→ →v
−
→ −
→
/ 0 ceci peut aussi s’écrire v = k × u . Si nous posons k′ =
Puisque k = 1 1
∈ R∗, nous avons donc
k
→
− →
−
v = k′ × u . Autrement dit, v est colinéaire à u.
Exemple 8.1.1. 1. Les vecteurs −
→u = (1; 2) et →
−v = (−2; −4) sont colinéaires car →
−v = −2 × −
→u.
2. Les vecteurs −
→u = (6; −3) et −
→v = (4; −2) sont colinéaires car −
→v = 2
×−
→u.
3
Lorsqu’un repère du plan (O; I; J) est disponible, la notion de colinéarité entre deux vecteurs
correspond à une relation de proportionnalité entre les coordonnées de ces vecteurs. Nous avons le
critère suivant permettant d’établir la colinéarité entre deux vecteurs à partir de leurs coordonnées.
x x′
Proposition 18 (Critère de colinéarité). Soient −→ u et −
→v deux vecteurs. Ces vecteurs
y y′
sont colinéaires si et seulement si la quantité suivante est nulle :
xy′ − xy = 0
de t (−
→u ;−
→v ) = 6 × (−2) − (−3) × 4 = 0.
Les vecteurs sont donc colinéaires.
f (x) = x2
00
Remarque. 1. Deux réels positifs et leurs carrés sont rangés dans le même ordre.
2. Deux réels négatis et leurs carrés sont rangés dans l’ordre contraire.
Proposition 24 (Forme canonique). Tout polynôme du second degré f (x) = ax2 + bx + c peut
s’écrire sous la forme
f (x) β
Ainsi, f admet pour mininum β atteint en x = α.
• si a < 0 alors
x −∞ α +∞
f (x) β
Ainsi, f admet pour maximum
β atteint en x = α.
2. Si a > 0 la parabole est tournée vers le bas tandis que si a < 0 la parabole est tournée vers le
haut.
3. Dans un repère orthogonal, la parabole admet pour axe de symétrie la droite parallèle à l’axe
des ordonnées passant par le sommet. Autrement dit, la droite d’équation x = α.
Exemple 11.3.1. 1. Si f (x) = 2x2 − 4x − 1, la parabole est tournée vers le bas et son sommet a
pour coordonnées S(1; −3).
2. Si f (x) = −x2 +4x −3, la parabole est tournée vers le haut et son sommet a pour coordonnées
S(2; 1).
12.1 Introduction
La Statistique (l’étude de données statistique) est relativement récente (bien qu’il existe de
nombreuse traces, dans l’Histoire, de listes d’objets ou de nombres) et fait partie des mathématiques
traitant les évènements aléatoires.
12.2 Vocabulaire
Dans ce chapitre, nous considèrerons une série de n observations ordonnées, notées x1, . . . , xn,
avec n N. Par exemple, pour fixer les idées, on peut penser à aux notes obtenues par une classe lors
∈ surveillé.
d’un devoir
Voici quelques mots de vocabulaire à connaitre .
Définition 12.2.1. Une série d’observations, ou série statistique, se définit à partir de deux para -
mètres :
1. Une population qui est l’ensemble des individus (ou objets) observés.
2. Un caractère qui est la qualité étudiée dans la population.
Exemple 12.2.1. Supposons que nous ayons un sondage à disposition. Celui-ci a été réalisé auprès de
n personnes (composant la population étudiée) pour connaître leur intention de vote au second
tour d’une élection (il s’agit du caractère étudié). Les réponses possibles de ce sondage sont : « Oui »,
« Non » et « Ne se prononce pas »(il s’agit caractère qualitatif).
Exemple 12.2.2. Un professeur reporte les notes de son dernier contrôle sur son ordinateur. Pour
chaque copie (l’ensemble des copies correspond à la population), il a attribué une note (correspon -
dant au caractère étudié) pouvant aller de 0 à 20 avec un pas de 0, 25 (il s’agit donc d’un caractère
quantitatif discret).
effectif de la valeur
fréquence d’une valeur =
effectif total
Remarque. Cette formule est similaire à ce que nous faisions en probabilité dans une situation
d’équiprobabilité avec le quotient « nombre de cas favorables / nombre de cas total ».
Exemple 12.3.1. Sur un parking, nous étudions la couleur des voitures. Le caractère étudié est dit
qualitatif (les valeurs ne sont pas numériques). La distribution des effectifs est donnée dans le
tableau ci-dessous :
Dans les exercices, il vous sera parfois demander de compléter un tableau en calculant des
effectifs cumulés croissant ou des fréquences cumulées croisantes. Illustrons ceci par un exemple.
Exemple 12.3.2. Dans un village, nous avons dénombré les foyers selon leur nombre d’enfants. Voici
les données obtenues
12.4 Moyenne
Dans cette section, nous présentons une valeur numérique qu’il est possible d’associer à une série
statistiques.
Définition 12.5.1. La moyenne de la série statistique x 1, . . . , Xn est le nombre x¯ défini par :
x1 + x2 + . . . + xn 1 nΣ
x̄ = = xi
n n i=1
Il est important de savoir calculer des moyennes pondérées. Cela signifie que les valeurs x1, . . . , xp
sont respectivement affectées de coefficients n1, . . . , np dans ce cas
x1 + x2 + . . . + xp
x̄ =
n1 + . . . + np
Exemple 12.5.1. Imaginons qu’un élève ait obtenu les notes suivantes durant un trimestre 6; 12;
7; 14; 10. La moyenne de celui-ci vaut alors
6 + 12 + 7 + 14 + 10 49
x̄ = = = 9, 8
5 5
Si jamais les sont affectées, de manière respective, des coefficients 2; 5; 3; 6; 4, la moyenne pon-
dérée de ses notes vaut alors
2 × 6 + 5 × 12 + 3 × 7 + 6 × 14 + 4 × 10
x̄ =
2+5+3+6+4
Voici un autre exemple dans lequel nous calculons une moyenne pondérée.
12.5. MOYENNE 65
Exemple 12.5.2.
Don (en euros) 10 15 20 30 50 Total
Effectif 12 17 10 11 5 55
12×10+17×15+10×20+11×30+5×50
C’est pourquoi, le don moyen x̄ est de 21 = 55
euros.
La moyenne seule n’est qu’un outil limité ne tenant pas compte de la dispersion des valeurs de la
série statistique. Pour palier ce manque, nous définissons les quantités suivantes.
Définition 12.5.2. . La variance de la série statistique (x k; nk ), pour 1 ≤ k ≤ l, est notée V est
définie par
l l
1 Σ i i Σ i i
V= N n ( x¯ − x )2 = f ( x¯ − x )2
i=1 i=1
Remarque. Pour fixer les idées, l’écart type permet de quantifier de quelle manière les valeurs se
répartissent autour de la moyenne. Prenons l’exemple suivant pour illustrer ceci.
Imaginons qu’une classe ait obtenu une moyenne de 11 à un devoir. L’enseignant décide alors de
calculer l’écart-type (associé à la série statistique des notes du devoir) pour obtenir plus
d’information. Si σ est grand (σ = 6 par exemple), grossièrement cela signifie que certains élèves ont
au 6 points de plus par rapport à la moyenne tandis que d’autres ont eu 6 points de moins par
rapport à la moyenne. Il est possible de montrer qu’une large partie de la classe a donc ses notes
comprises entre [x̄ − σ ; x̄ + σ ] = [5; 17]. Cela signifie que la classe a un niveau plutôt hétérogène.
Au contraire, si σ est petit (σ = 1, 5 par exemple). La majorité des notes sera comprise entre
[9, 5; 12, 5] attestant que la classe a un niveau homogène.
σ peut aussi s’interpréter comme une mesure de précision, plus celui-ci est petit plus les valeurs de
la série vont rester proche de la moyenne. Cela peut notamment s’utiliser en sport si nous décidions
de faire des statistiques sur les tirs réussi d’un joueur de basket. Plus σ sera petit, plus le sportif sera
régulier et obtiendra des scores proches de son score moyen.
Exemple 12.5.3. Comme nous allons le voir sur l’exemple suivant, la variance permet d’en apprendre
plus sur une série statistique et complète l’information apportée par la moyenne.
Définition 12.6.1. Soit (x 1, . . . , x n) une série statistique à caractère quantitatif. Voici la définition de
certains quantiles.
• La médiane est une valeur telle que :
1. 50% des valeurs de la série sont inférieures ou égales à Med ;
• Le premier quartile Q 1 est la plus petite valeur de la série telle que 25% des valeurs de
la série lui soient inférieures ou égales.
• Le troisième quartile Q 3 est la plus petite valeur de la série telle que 75% des valeurs de
la série lui soient inférieures ou égales.
Remarque. 1. Rappelons que « l’étendue » d’une série statistiques est la différence entre la plus
grande valeur de la série ( son maximum) et la plus petite (son minimum). Nous la noterons e.
2. En pratique, lorsque les valeurs sont rangées par ordre croissant, si l’effectif total n est impair la
médiane est la n+1 valeur ; si n est pair la médiane est la moyenne de la n -ième valeur et
2 2
n+1
de la 2 valeur.
Longueur (en m) 37 39 40 41 42 43 44 48
Effectif 4 3 4 2 2 4 5 2
Effectif cumulés 4 7 11 13 15 19 24 26
1. La longueur médiane des lancers de javelot présentés dans ce tableau est Med = 41, 5m. En
effet, l’effectif total est pair (ici N = 26) donc la médiane est la moyenne des 13ème et 14ème
longueurs ; lesquelles sont égales à 41m et 42m.
26
2. Il est facile de déterminer le 1er quartile, puisque 4 = 6, 5, Q1 est la 7ème longueur, à
savoir : Q1 = 39m.
Chapitre 13
Fonction inverse
Définition 13.0.1. La fonction inverse est la fonction f qui a tout réel non nul associe son inverse.
f (x) = pour x ∈ R∗
1x
Remarque. La fonction inverse n’est pas définie en 0, il est usuel de dire que 0 est une valeur interdite
pour la fonction inverse.
Voici le tableau de variation de la fonction inverse.
x −∞ 0 +∞
1
x
Remarque. Autrement dit, la fonction x '→ 1 x est décroissante sur ] − ∞; 0[ et sur ]0; +∞[. En
conséquence, deux réels (non nuls) de même signe et leurs inverses sont rangés dans des ordres
contraires.
Exemple 13.0.1.
Puisque 2 ≤ 4 nous avons 1
≤ 1 .2
4
Remarque. 1. Par exemple, ce genre de fonction apparait naturellement lorsque nous étudions
2
une fonction comme f (x) = −3 + x+5 . En effet, en regroupant les termes définissant f au
même dénominateur, nous trouvon
2. L’ensemble de définition d’une fonction homographique est R\{− d } puisque le réel − d annule
c c
le dénominateur.
Dans ce chapitre nous allons revoir comment résoudre une inéquation impliquant une fonction
homographique.
x
Exemple 13.1.1. Supposons que nous soyons amené à résoudre l’inégalité suivante < 1. Nous
x+1
devons alors nous ramener à une étude de signe.
x x x x+1 −1
<1 ⇐⇒ −1 < 0 ⇐⇒ − < 0 ⇐⇒ <0
x+1 x+1 x+1 x+1 x+1
1
Il ne reste plus qu’à établir, en prenant garde aux valeurs interdites, le signe de x '→ − pour
x+1
conclure et résoudre l’inéquation de départ.
Nous allons voir que les équations réduites de droites permettent de traiter facilement, de manière
algébrique, des problèmes géométriques impliquant des droites.
Ð//Ð′ ⇐⇒ m = m′
2. Observons que des droites de la forme x = c et x = c′ sont parallèles à l’axe des ordonnées,
donc entre elles.
Démonstration. Soient Ð//Ð′ de telles droites. Considérons alors A et B deux points distincts de
la droite Ð. Les droites parallèles à l’axe des ordonnées passant par A et par B coupent la droite
Ð′ en deux points notés A′ et B′. Par construction,
xA′ = xA et xB′ = xb
où, dans l’avant dernière équivalence, nous avons utilisé la relation fournie par l’équation (14.0.1).
Proposition 28. Soient Ð: y = mx + p et ′Ð: y = m′x + p′ deux droites du plan telles que m
= /m′. Dans ce cas, les coordonnées du point d’intersection des droites Ð et Ð′ est l’unique
solution du système
y = mx + p
y = m′x + p′
d : y = 2x − 3 et d : y = −x + 3
Puisque les coefficients directeurs sont différents, ces droites sont sécantes. Notons par A(x; y) le
point d’intersection de celles-ci. Pour déterminer les coordonnées de A, il faut et il suffit de résoudre
le système suivant :
y = 2x − 3
⇐⇒
y = 2x − 3 y = 2x − 3 y = 2× 2 − 3 = 1
y = −x + 3 2x − 3 = −x + 3 ⇐⇒ 3x = 6 x=2
Ainsi A(2; 1).
Comme nous allons le voir, les équations cartésiennes englobent les deux cas de figures de la
Proposition ??.
Proposition 29. A toute droite (d) il est possible d’associer une équation cartésienne où le couple
(a, b) /= (0, 0) et réciproquement.
Démonstration. 1. Considérons une équation cartésienne (E) pour laquelle (a, b) /= (0, 0).
• Si b = 0, alors a /= 0 et l’équation (E) s’écrit x = − a cce qui correspond bien à une
c
équation de droite de la forme x = k avec k = −a ∈ R.
1 a c
• Si b /= 0, alors l’équation (E) s’écrit y = b (−ax − c) = − b − b ce qui correspond à une
équation de droite de la forme y = mx + p avec m = − a b∈ R et p = − c ∈ b R.
2. Réciproquement, considérons une droite (d) du plan. Deux cas de figures s’offrent à nous.
• Si (d) a pour équation x = k, k ∈ R, alors elle admet pour équation cartésienne x − k = 0
correspondant aux paramètres (a, b, c) = (1, 0, −k).
• Si (d) a pour équation y = mx+ p, (m, p) ∈ R2, alors elle admet pour équation cartésienne
−mx + y − p = 0 ce qui correspond au triplet (a, b, c) = (−m, 1, −p).
−2x + y + 3 = 0
Il s’agit bien d’une équation cartésienne avec a = −2, b = 1 et c = 3.
x −3 = 0
i.e. a = 1, b = 0 et c = −3.
Définition 14.2.1. Un vecteur directeur d’une droite (d) est un vecteur dont la direction est pa-
rallèle à celle de (d).
−→
Remarque. En particulier, pour tout couple (A, B) de points appartenant à la droite (d), le vecteur AB
−
→
est un vecteur directeur de cette même droite. Aussi, si u est un vecteur directeur de (d) alors k u −
→
avec k ∈ R∗ l’est également.
76 CHAPITRE 14. POSITION RELATIVE DE DROITE
Voyons à présent de quelle manière il est possible d’obtenir un vecteur directeur à partir d’une
équation cartésienne de droite.
Proposition 30. Soit (d) une droite du plan. Si (d) a pour équation cartésienne ax + by + c = 0,
avec (a, b, c) ∈ R 3, alors −
→u (−b; a) est un vecteur directeur de (d).
Démonstration. Soit (d) une droite admettant pour équation cartésienne ax + by + c = 0 ainsi que
−−→
A(x a; ya) ∈ (d) et M (x; y) ∈ (d) deux points de cette droite. Le vecteur A M (x − xa; y − ya) est un
vecteur directeur de la droite (d). Vérifions que ce vecteur est bien colinéaire au vecteur u − →
= (−b; a).
−−
→
Pour cela calculons le déterminant entre − →
u AM et utilisons le fait que les coordonnées des points
M et A satisfont l’équation cartésienne de (d).
−− → →
det(AM , − u ) = (x − xa) × a − (y − ya) × (−b) = ax + by − axa − bya = c − c = 0 Donc
les vecteurs sont bien colinéaires et − →u est un vecteur directeur de (d).
La proposition suivante nous affirme qu’une droite (d) peut être caractérisée par la donnée d’un
point A ∈ (d) et d’un vecteur directeur −
→u.
−→
Proposition 31. Soient (d) une droite, A ∈ (d) et u un vecteur directeur de cette droite. Nous
avons la caractérisation suivante des points M appartenant à la droite (d).
−
→ −−→
M ∈ (d) ⇐⇒ u et A M sont colinéaires.
Exemple 14.2.1. Dans un repère, déterminons une équation cartésienne des droites suivantes :
1. (d) passant par le point A(−1; 1) et de vecteur directeur −
→u (3; 2).
−→
• Puisque u est un vecteur directeur de (d), cela signifie que cette droite admet une équation
cartésienne de la forme (E) : 2x− 3y+c = 0 pour un certain c ∈R. De plus, le point A ∈ (d)
dont ses coordonnées vérifient l’équation (E). Autrement dit, 2× (− 1)− 3 × (−3) + c = 0
d’où c = 5.
Enfin, voici une condition de parallélisme entre deux droites à partir de leurs vecteurs directeurs.
Proposition 32 (Condition de parallèlisme). Deux droites sont parallèles si et seulement si leurs
vecteurs directeurs sont colinéaires.
Remarque. Cette condition peut se vérifier à l’aide du déterminant. En particulier, lorsque les
vecteurs directeurs ne sont pas colinéaires, les droites sont donc sécantes.
Pour conclure ce chapitre, traitons un dernier exemple
Exemple 14.2.2. Considérons les droites suivantes :
d : 2x − y − 3 = 0 et d : −x − y + 3 = 0
Alors −→u = (1; 2) dirige d et −→v = (1; ′ −→ −→
− 1) dirige d . De plus, D e t ( u ; v −) =− 1 2−= / 3 = 0, ainsi
les vecteurs ne sont pas colinéaires et les droites sont donc sécantes. Soit A(x; y) le point
d’intersection de celles-ci, déterminons ces coordonnées en résolvant le système suivant
2x − y − 3 = 0 2x − y − 3 = 0 2x − y − 3 = 0 : L1
⇐⇒ ⇐⇒
−x − y + 3 = 0 2 × (−x − y + 3) = 2 × 0 −2x − 2y + 6 = 0 : L2
Observons à présent que l’addition (membre à membre) de la ligne L1 avec la ligne L2 supprime
la variable x de l’équation et permet de trouver la valeur de y. En effet,
2x − 1 − 3 = 0 ⇐⇒ x = 2.
Cette méthode, portant le nom de « pivot de Gauss », nous permet de retrouver un résultat obtenu plus
tôt. L’avantage de cette façon de faire est quelle est robuste et se généralise à autant des systèmes
plus complexes (3 inconnues, trois equations par exemple).