Cours-Python Chapitre 1
Cours-Python Chapitre 1
Avant-propos 8
Quelques mots sur l’origine de ce cours . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
Remerciements . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
Le livre . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
1 Introduction 10
1.1 Qu’est-ce que Python ? . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 10
1.2 Conseils pour l’apprentissage de Python . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 11
1.3 Conseils pour installer et configurer Python . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 11
1.4 Notations utilisées . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 11
1.5 Introduction au shell . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 12
1.6 Premier contact avec Python . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 12
1.7 Premier programme . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 13
1.8 Commentaires . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 14
1.9 Notion de bloc d’instructions et d’indentation . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 14
1.10 Autres ressources . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 15
2 Variables 16
2.1 Définition et création . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 16
2.2 Les types de variables . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 17
2.3 Nommage . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 18
2.4 Écriture scientifique . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 18
2.5 Opérations . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 19
2.6 La fonction type() . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 21
2.7 Conversion de types . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 21
2.8 Note sur le vocabulaire et la syntaxe . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 22
2.9 Minimum et maximum . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 22
2.10 Exercices . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 22
3 Affichage 24
3.1 La fonction print() . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 24
3.2 Messages d’erreur . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 25
3.3 Écriture formatée et f-strings . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 26
2
Table des matières Table des matières
4 Listes 32
4.1 Définition . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 32
4.2 Utilisation . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 32
4.3 Opération sur les listes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 33
4.4 Indiçage négatif . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 34
4.5 Tranches . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 34
4.6 Fonction len() . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 35
4.7 Les fonctions range() et list() . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 35
4.8 Listes de listes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 36
4.9 Minimum, maximum et somme d’une liste . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 36
4.10 Problème avec les copies de listes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 36
4.11 Note sur le vocabulaire et la syntaxe . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 37
4.12 Exercices . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 37
5 Boucles et comparaisons 39
5.1 Boucles for . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 39
5.2 Comparaisons . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 42
5.3 Boucles while . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 43
5.4 Exercices . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 44
6 Tests 49
6.1 Définition . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 49
6.2 Tests à plusieurs cas . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 49
6.3 Importance de l’indentation . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 50
6.4 Tests multiples . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 51
6.5 Instructions break et continue . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 52
6.6 Tests de valeur sur des floats . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 52
6.7 Exercices . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 53
7 Fichiers 58
7.1 Lecture dans un fichier . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 58
7.2 Écriture dans un fichier . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 61
7.3 Ouvrir deux fichiers avec l’instruction with . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 62
7.4 Note sur les retours à la ligne sous Unix et sous Windows . . . . . . . . . . . . . . . . . . . . . . . . . . 62
7.5 Importance des conversions de types avec les fichiers . . . . . . . . . . . . . . . . . . . . . . . . . . . . 63
7.6 Du respect des formats de données et de fichiers . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 63
7.7 Exercices . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 63
8 Dictionnaires et tuples 66
8.1 Dictionnaires . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 66
8.2 Tuples . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 70
8.3 Exercices . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 73
9 Modules 76
9.1 Définition . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 76
9.2 Importation de modules . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 76
9.3 Obtenir de l’aide sur les modules importés . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 78
9.4 Quelques modules courants . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 79
9.5 Module random : génération de nombres aléatoires . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 80
9.6 Module sys : passage d’arguments . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 81
9.7 Module pathlib : gestion des fichiers et des répertoires . . . . . . . . . . . . . . . . . . . . . . . . . . . 83
Remerciements
Merci à tous les contributeurs, occasionnels ou réguliers, entre autre : Jennifer Becq, Benoist Laurent, Hubert Santuz,
Virginie Martiny, Romain Laurent, Benjamin Boyer, Jonathan Barnoud, Amélie Bâcle, Thibault Tubiana, Romain Retu-
reau, Catherine Lesourd, Philippe Label, Rémi Cuchillo, Cédric Gageat, Philibert Malbranche, Mikaël Naveau, Alexandra
Moine-Franel, Dominique Tinel, et plus généralement les promotions des masters de biologie informatique et in silico
drug design, ainsi que du diplôme universitaire en bioinformatique intégrative.
Nous remercions tout particulièrement Sander Nabuurs pour la première version de ce cours remontant à 2003, Denis
Mestivier pour les idées de certains exercices et Philip Guo pour son site Python Tutor 4 .
Enfin, merci à vous tous, les curieux de Python, qui avez été nombreux à nous envoyer des retours sur ce cours, à nous
suggérer des améliorations et à nous signaler des coquilles. Cela rend le cours vivant et dynamique, continuez comme ça !
De nombreuses personnes nous ont aussi demandé les corrections des exercices. Nous ne les mettons pas sur le site
afin d’éviter la tentation de les regarder trop vite, mais vous pouvez nous écrire et nous vous les enverrons.
Le livre
Ce cours est également publié aux éditions Dunod sous le titre « Programmation en Python pour les sciences de la
vie 5 ». Le livre en est à sa 2e édition, vous pouvez vous le procurer dans toutes les bonnes librairies.
Afin de promouvoir le partage des connaissances et le logiciel libre, nos droits d’auteurs provenant de la vente de cet
ouvrage sont reversés à deux associations : Wikimédia France 6 qui s’occupe notamment de l’encyclopédie libre Wikipédia
1. [Link]
2. [Link]
3. [Link]
4. [Link]
5. [Link]
6. [Link]
8
Table des matières Table des matières
et NumFOCUS 7 qui soutient le développement de logiciels libres scientifiques et notamment l’écosystème scientifique
autour de Python.
7. [Link]
Introduction
1. [Link]
2. Nous sommes d’accord, cette notion est très relative.
3. [Link]
4. [Link]
10
1.2. Conseils pour l’apprentissage de Python Chapitre 1. Introduction
1.3.2 Miniconda
Nous vous conseillons d’installer Miniconda 5 , logiciel gratuit, disponible pour Windows, Mac OS X et Linux, et qui
installera pour vous Python 3.
Avec le gestionnaire de paquets conda, fourni avec Miniconda, vous pourrez installer des modules supplémentaires
qui sont très utiles en bioinformatique (NumPy, scipy, matplotlib, pandas, Biopython), mais également Jupyter Lab qui
vous permettra d’éditer des notebooks Jupyter. Vous trouverez en ligne 6 une documentation pas-à-pas pour installer
Miniconda, Python 3 et les modules supplémentaires qui seront utilisés dans ce cours.
Pour ces derniers, le numéro à gauche indique le numéro de la ligne et sera utilisé pour faire référence à une instruction
particulière. Ce numéro n’est bien sûr là qu’à titre indicatif.
Par ailleurs, dans le cas de programmes, de contenus de fichiers ou de résultats trop longs pour être inclus dans leur
intégralité, la notation [...] indique une coupure arbitraire de plusieurs caractères ou lignes.
5. [Link]
6. [Link]
pour Mac OS X :
iMac-de-pierre:Downloads$ python
Python 3.12.2 | packaged by Anaconda, Inc. | (main, Feb 27 2024, 12:57:28) [Clang 14.0.6 ] on darwin
Type "help", "copyright", "credits" or "license" for more information.
>>>
ou pour Linux :
pierre@jeera:~$ python
Python 3.12.2 | packaged by conda-forge | (main, Feb 16 2024, 20:50:58) [GCC 12.3.0] on linux
Type "help", "copyright", "credits" or "license" for more information.
>>>
Les blocs
• PS C:\Users\pierre> pour Windows,
• iMac-de-pierre:Downloads$ pour Mac OS X,
• pierre@jeera:~$ pour Linux.
représentent l’invite de commande de votre shell. Il se peut que vous ayez aussi le mot (base) qui indique que vous
avez un environnement conda activé. Par la suite, cette invite de commande sera représentée simplement par le caractère
$, que vous soyez sous Windows, Mac OS X ou Linux.
Le triple chevron >>> est l’invite de commande (prompt en anglais) de l’interpréteur Python. Ici, Python attend une
commande que vous devez saisir au clavier. Tapez par exemple l’instruction :
print("Hello world!")
puis, validez cette commande en appuyant sur la touche Entrée.
Python a exécuté la commande directement et a affiché le texte Hello world!. Il attend ensuite une nouvelle
instruction en affichant l’invite de l’interpréteur Python (>>>). En résumé, voici ce qui a dû apparaître sur votre écran :
7. [Link]
8. [Link]
Vous pouvez refaire un nouvel essai en vous servant cette fois de l’interpréteur comme d’une calculatrice :
1 >>> 1+1
2 2
3 >>> 6*3
4 18
À ce stade, vous pouvez entrer une autre commande ou bien quitter l’interpréteur Python, soit en tapant la commande
exit() puis en validant en appuyant sur la touche Entrée, soit en pressant simultanément les touches Ctrl et D sous
Linux et Mac OS X ou Ctrl et Z puis Entrée sous Windows.
En résumant, l’interpréteur fonctionne sur le modèle :
1 >>> instruction python
2 résultat
où le triple chevron correspond à l’entrée (input) que l’utilisateur tape au clavier, et l’absence de chevron en début
de ligne correspond à la sortie (output) générée par Python. Une exception se présente toutefois : lorsqu’on a une longue
ligne de code, on peut la couper en deux avec le caractère \ (backslash) pour des raisons de lisibilité :
1 >>> Voici une longue ligne de code \
2 ... décrite sur deux lignes
3 résultat
En ligne 1 on a rentré la première partie de la ligne de code. On termine par un \, ainsi Python sait que la ligne de
code n’est pas finie. L’interpréteur nous l’indique avec les trois points .... En ligne 2, on rentre la fin de la ligne de code
puis on appuie sur Entrée. À ce moment, Python nous génère le résultat. Si la ligne de code est vraiment très longue, il
est même possible de la découper en trois voire plus :
1 >>> Voici une ligne de code qui \
2 ... est vraiment très longue car \
3 ... elle est découpée sur trois lignes
4 résultat
L’interpréteur Python est donc un système interactif dans lequel vous pouvez entrer des commandes, que Python
exécutera sous vos yeux (au moment où vous validerez la commande en appuyant sur la touche Entrée).
Il existe de nombreux autres langages interprétés comme Perl 9 ou R 10 . Le gros avantage de ce type de langage est
qu’on peut immédiatement tester une commande à l’aide de l’interpréteur, ce qui est très utile pour débugger (c’est-à-dire
trouver et corriger les éventuelles erreurs d’un programme). Gardez bien en mémoire cette propriété de Python qui pourra
parfois vous faire gagner un temps précieux !
Remarque
L’extension de fichier standard des scripts Python est .py.
9. [Link]
10. [Link]
11. [Link]
Pour exécuter votre script, ouvrez un shell et entrez la commande : python [Link]
Vous devriez obtenir un résultat similaire à ceci :
$ python [Link]
Hello world!
Si c’est bien le cas, bravo ! Vous avez exécuté votre premier programme Python.
1.8 Commentaires
Dans un script, tout ce qui suit le caractère # est ignoré par Python jusqu’à la fin de la ligne et est considéré comme
un commentaire.
Les commentaires doivent expliquer votre code dans un langage humain. L’utilisation des commentaires est discutée
en détail dans le chapitre 16 Bonnes pratiques en programmation Python.
Voici un exemple :
1 # Votre premier commentaire en Python.
2 print("Hello world!")
3
4 # D'autres commandes plus utiles pourraient suivre.
Remarque
On appelle souvent à tort le caractère # « dièse ». On devrait plutôt parler de « croisillon 12 ».
Pour chaque base de la séquence ATCCGACTG, nous souhaitons effectuer deux actions : d’abord afficher la base
puis compter une base de plus. Pour indiquer cela, on décalera vers la droite ces deux instructions par rapport à la
ligne précédente (pour chaque base [...]). Ce décalage est appelé indentation et l’ensemble des lignes indentées
constitue un bloc d’instructions.
Une fois qu’on aura réalisé ces deux actions sur chaque base, on pourra passer à la suite, c’est-à-dire afficher la taille
de la séquence. Pour bien préciser que cet affichage se fait à la fin, donc une fois l’affichage puis le comptage de chaque
base terminés, la ligne correspondante n’est pas indentée (c’est-à-dire qu’elle n’est pas décalée vers la droite).
12. [Link]
Pratiquement, l’indentation en Python doit être homogène (soit des espaces, soit des tabulations, mais pas un mélange
des deux). Une indentation avec 4 espaces est le style d’indentation recommandé (voir le chapitre 16 Bonnes pratiques
en programmation Python).
Si tout cela semble un peu complexe, ne vous inquiétez pas. Vous allez comprendre tous ces détails chapitre après
chapitre.
13. [Link]
14. [Link]
15. [Link]
16. [Link]
17. [Link]
Variables
Définition
Une variable est une zone de la mémoire de l’ordinateur dans laquelle une valeur est stockée. Aux yeux du program-
meur, cette variable est définie par un nom, alors que pour l’ordinateur, il s’agit en fait d’une adresse, c’est-à-dire d’une
zone particulière de la mémoire.
En Python, la déclaration d’une variable et son initialisation (c’est-à-dire la première valeur que l’on va stocker
dedans) se font en même temps. Pour vous en convaincre, testez les instructions suivantes après avoir lancé l’interpréteur :
1 >>> x = 2
2 >>> x
3 2
Ligne 1. Dans cet exemple, nous avons déclaré, puis initialisé la variable x avec la valeur 2. Notez bien qu’en réalité,
il s’est passé plusieurs choses :
• Python a « deviné » que la variable était un entier. On dit que Python est un langage au typage dynamique.
• Python a alloué (réservé) l’espace en mémoire pour y accueillir un entier. Chaque type de variable prend plus ou
moins d’espace en mémoire. Python a aussi fait en sorte qu’on puisse retrouver la variable sous le nom x.
• Enfin, Python a assigné la valeur 2 à la variable x.
Dans d’autres langages (en C par exemple), il faut coder ces différentes étapes une par une. Python étant un langage
dit de haut niveau, la simple instruction x = 2 a suffi à réaliser les trois étapes en une fois !
Lignes 2 et 3. L’interpréteur nous a permis de connaître le contenu de la variable juste en tapant son nom. Retenez
ceci, car c’est une spécificité de l’interpréteur Python, très pratique pour chasser (debugger) les erreurs dans un
programme. En revanche, la ligne d’un script Python qui contient seulement le nom d’une variable (sans aucune autre
indication) n’affichera pas la valeur de la variable à l’écran lors de l’exécution (pour autant, cette instruction reste valide
et ne générera pas d’erreur).
Depuis la version 3.10, l’interpréteur Python a amélioré ses messages d’erreur. Il est ainsi capable de suggérer des
noms de variables existants lorsqu’on fait une faute de frappe :
16
2.2. Les types de variables Chapitre 2. Variables
Si le mot qu’on tape n’est pas très éloigné, cela fonctionne également lorsqu’on se trompe à différents endroits du
mot !
1 pharmacie = "vente de médicaments"
2 >>> farmacia
3 Traceback (most recent call last):
4 File "<stdin>", line 1, in <module>
5 NameError: name 'farmacia' is not defined. Did you mean: 'pharmacie'?
Définition
Le symbole = est appelé opérateur d’affectation. Il permet d’assigner une valeur à une variable en Python. Cet
opérateur s’utilise toujours de la droite vers la gauche. Par exemple, dans l’instruction x = 2 ci-dessus, Python attribue
la valeur située à droite (ici, 2) à la variable située à gauche (ici, x). D’autres langages de programmation comme R
utilisent les symboles <- pour rendre l’affectation d’une variable plus explicite, par exemple x <- 2.
Ligne 2. Ici on a un nom de variable à gauche et à droite de l’opérateur =. Dans ce cas, on garde la règle d’aller
toujours de la droite vers la gauche. C’est donc le contenu de la variable y qui est affecté à la variable x.
Ligne 5. Comme on le verra plus bas, si on a à droite de l’opérateur = une expression, ici la soustraction 4 - 2, celle-ci
est d’abord évaluée et c’est le résultat de cette opération qui sera affecté à la variable x. On pourra noter également que
la valeur de x précédente (2) a été écrasée.
Attention
L’opérateur d’affectation = écrase systématiquement la valeur de la variable située à sa gauche si celle-ci existe déjà.
Définition
Le type d’une variable correspond à la nature de celle-ci. Les trois principaux types dont nous aurons besoin dans
un premier temps sont les entiers (integer ou int), les nombres décimaux que nous appellerons floats et les chaînes de
caractères (string ou str).
Bien sûr, il existe de nombreux autres types (par exemple, les booléens, les nombres complexes, etc.). Si vous n’êtes
pas effrayés, vous pouvez vous en rendre compte ici 1 .
1. [Link]
Dans l’exemple précédent, nous avons stocké un nombre entier (int) dans la variable x, mais il est tout à fait possible
de stocker des floats, des chaînes de caractères (string ou str) ou de nombreux autres types de variables que nous verrons
par la suite :
1 >>> y = 3.14
2 >>> y
3 3.14
4 >>> a = "bonjour"
5 >>> a
6 'bonjour'
7 >>> b = 'salut'
8 >>> b
9 'salut'
10 >>> c = """girafe"""
11 >>> c
12 'girafe'
13 >>> d = '''lion'''
14 >>> d
15 'lion'
Remarque
Python reconnaît certains types de variables automatiquement (entier, float). Par contre, pour une chaîne de carac-
tères, il faut l’entourer de guillemets (doubles, simples, voire trois guillemets successifs doubles ou simples) afin d’indiquer
à Python le début et la fin de la chaîne de caractères.
Dans l’interpréteur, l’affichage direct du contenu d’une chaîne de caractères se fait avec des guillemets simples, quel
que soit le type de guillemets utilisé pour définir la chaîne de caractères.
En Python, comme dans la plupart des langages de programmation, c’est le point qui est utilisé comme séparateur
décimal. Ainsi, 3.14 est un nombre reconnu comme un float en Python alors que ce n’est pas le cas de 3,14.
Il existe également des variables de type booléen. Un booléen 2 est une variable qui ne prend que deux valeurs : Vrai
ou Faux. En python, on utilise pour cela les deux mots réservés True et False :
1 >>> var = True
2 >>> var2 = False
3 >>> var
4 True
5 >>> var2
6 False
Nous verrons l’utilité des booléens dans les chapitres 5 Boucles et 6 Tests.
2.3 Nommage
Le nom des variables en Python peut être constitué de lettres minuscules (a à z), de lettres majuscules (A à Z), de
nombres (0 à 9) ou du caractère souligné (_). Vous ne pouvez pas utiliser d’espace dans un nom de variable.
Par ailleurs, un nom de variable ne doit pas débuter par un chiffre et il n’est pas recommandé de le faire débuter par
le caractère _ (sauf cas très particuliers).
De plus, il faut absolument éviter d’utiliser un mot « réservé » par Python comme nom de variable (par exemple :
print, range, for, from, etc.).
Dans la mesure du possible, il est conseillé de mettre des noms de variables explicites. Sauf dans de rares cas que
nous expliquerons plus tard dans le cours, évitez les noms de variables à une lettre.
Enfin, Python est sensible à la casse, ce qui signifie que les variables TesT, test et TEST sont différentes.
2. [Link]
1 >>> 1e6
2 1000000.0
3 >>> 3.12e-3
4 0.00312
On appelle cela écriture ou notation scientifique. On pourra noter deux choses importantes :
• 1e6 ou 3.12e-3 n’implique pas l’utilisation du nombre exponentiel e, mais signifie 1 × 106 ou 3.12 × 10−3 respec-
tivement ;
• même si on ne met que des entiers à gauche et à droite du symbole e (comme dans 1e6), Python génère systéma-
tiquement un float.
Enfin, vous avez sans doute constaté qu’il est parfois pénible d’écrire des nombres composés de beaucoup de chiffres,
par exemple le nombre d’Avogradro 6.02214076 × 1023 ou le nombre d’humains sur Terre 3 8094752749 au 5 mars 2024
à 19h34. Pour s’y retrouver, Python autorise l’utilisation du caractère « souligné » (ou underscore) _ pour séparer des
groupes de chiffres. Par exemple :
1 >>> avogadro_number = 6.022_140_76e23
2 >>> print(avogadro_number)
3 6.02214076e+23
4 >>> humans_on_earth = 8_094_752_749
5 >>> print(humans_on_earth)
6 8094752749
Dans ces exemples, le caractère _ (underscore ou « souligné ») est utilisé pour séparer des groupes de trois chiffres,
mais on peut faire ce qu’on veut :
1 >>> print(80_94_7527_49)
2 8094752749
2.5 Opérations
2.5.1 Opérations sur les types numériques
Les quatre opérations arithmétiques de base se font de manière simple sur les types numériques (nombres entiers et
floats) :
1 >>> x = 45
2 >>> x + 2
3 47
4 >>> x - 2
5 43
6 >>> x * 3
7 135
8 >>> y = 2.5
9 >>> x - y
10 42.5
11 >>> (x * 10) + y
12 452.5
Remarquez toutefois que si vous mélangez les types entiers et floats, le résultat est renvoyé comme un float (car ce
type est plus général). Par ailleurs, l’utilisation de parenthèses permet de gérer les priorités.
L’opérateur / effectue une division. Contrairement aux opérateurs +, - et *, celui-ci renvoie systématiquement un
float :
1 >>> 3 / 4
2 0.75
3 >>> 2.5 / 2
4 1.25
5 >>> 6 / 3
6 2.0
7 >>> 10 / 2
8 5.0
3. [Link]
Pour obtenir le quotient et le reste d’une division entière (voir ici 4 pour un petit rappel sur la division entière), on
utilise respectivement les symboles // et modulo % :
1 >>> 5 // 4
2 1
3 >>> 5 % 4
4 1
5 >>> 8 // 4
6 2
7 >>> 8 % 4
8 0
Les symboles +, -, *, /, **, // et % sont appelés opérateurs, car ils réalisent des opérations sur les variables.
Enfin, il existe des opérateurs « combinés » qui effectue une opération et une affectation en une seule étape :
1 >>> i = 0
2 >>> i = i + 1
3 >>> i
4 1
5 >>> i += 1
6 >>> i
7 2
8 >>> i += 2
9 >>> i
10 4
L’opérateur += effectue une addition puis affecte le résultat à la même variable. Cette opération s’appelle une «
incrémentation ».
Les opérateurs -=, *= et /= se comportent de manière similaire pour la soustraction, la multiplication et la division.
Attention
Vous observez que les opérateurs + et * se comportent différemment s’il s’agit d’entiers ou de chaînes de caractères.
Ainsi, l’opération 2 + 2 est une addition alors que l’opération "2" + "2" est une concaténation. On appelle ce compor-
tement redéfinition des opérateurs. Nous serons amenés à revoir cette notion dans le chapitre 24 Avoir plus la classe
avec les objets (en ligne).
4. [Link]
Notez que Python vous donne des informations dans son message d’erreur. Dans le second exemple, il indique que
vous devez utiliser une variable de type str, c’est-à-dire une chaîne de caractères et pas un int, c’est-à-dire un entier.
Attention
Pour Python, la valeur 2 (nombre entier) est différente de 2.0 (float) et est aussi différente de '2' (chaîne de
caractères).
On verra au chapitre 7 Fichiers que ces conversions sont essentielles. En effet, lorsqu’on lit ou écrit des nombres dans
un fichier, ils sont considérés comme du texte, donc des chaînes de caractères.
Toute conversion d’une variable d’un type en un autre est appelé casting en anglais, il se peut que vous croisiez ce
terme si vous consultez d’autres ressources.
Par rapport à la discussion de la rubrique précédente, min() et max() sont des exemples de fonctions prenant plusieurs
arguments. En Python, quand une fonction prend plusieurs arguments, on doit les séparer par une virgule. min() et max()
prennent en argument autant d’entiers et de floats que l’on veut, mais il en faut au moins deux.
2.10 Exercices
Conseil
Pour ces exercices, utilisez l’interpréteur Python.
• (1 + 28 ) × 5
• (2 + 18 )7
Affichage
Ligne 1. On a utilisé l’instruction print() classiquement en passant la chaîne de caractères "Hello world!" en
argument.
Ligne 3. On a ajouté un second argument end="", en précisant le mot-clé end. Nous aborderons les arguments
par mot-clé dans le chapitre 10 Fonctions. Pour l’instant, dites-vous que cela modifie le comportement par défaut des
fonctions.
Ligne 4. L’effet de l’argument end="" est que les trois chevrons >>> se retrouvent collés après la chaîne de caractères
"Hello world!".
Une autre manière de s’en rendre compte est d’utiliser deux fonctions print() à la suite. Dans la portion de code
suivante, le caractère « ; » sert à séparer plusieurs instructions Python sur une même ligne :
1 >>> print("Hello") ; print("Joe")
2 Hello
3 Joe
4 >>> print("Hello", end="") ; print("Joe")
5 HelloJoe
6 >>> print("Hello", end=" ") ; print("Joe")
7 Hello Joe
La fonction print() peut également afficher le contenu d’une variable quel que soit son type. Par exemple, pour un
entier :
1 >>> var = 3
2 >>> print(var)
3 3
24
3.2. Messages d’erreur Chapitre 3. Affichage
Il est également possible d’afficher le contenu de plusieurs variables (quel que soit leur type) en les séparant par des
virgules :
1 >>> x = 32
2 >>> nom = "John"
3 >>> print(nom, "a", x, "ans")
4 John a 32 ans
Python a écrit une phrase complète en remplaçant les variables x et nom par leur contenu. Vous remarquerez que
pour afficher plusieurs éléments de texte sur une seule ligne, nous avons utilisé le séparateur « , » entre les différents
éléments. Python a également ajouté un espace à chaque fois que l’on utilisait le séparateur « , ». On peut modifier ce
comportement en passant à la fonction print() l’argument par mot-clé sep :
1 >>> x = 32
2 >>> nom = "John"
3 >>> print(nom, "a", x, "ans", sep="")
4 Johna32ans
5 >>> print(nom, "a", x, "ans", sep="-")
6 John-a-32-ans
7 >>> print(nom, "a", x, "ans", sep="_")
8 John_a_32_ans
Pour afficher deux chaînes de caractères l’une à côté de l’autre, sans espace, on peut soit les concaténer, soit utiliser
l’argument par mot-clé sep avec une chaîne de caractères vide :
1 >>> ani1 = "chat"
2 >>> ani2 = "souris"
3 >>> print(ani1, ani2)
4 chat souris
5 >>> print(ani1 + ani2)
6 chatsouris
7 >>> print(ani1, ani2, sep="")
8 chatsouris
Vous avez sans doute repéré l’oubli d’une parenthèse fermante en ligne 1. Lorsqu’on lance le script, on obtient :
$ python [Link]
File "[Link]", line 1
print("chat"
^
SyntaxError: '(' was never closed
Comment doit-on lire ce message d’erreur ? Et bien cela se fait toujours du bas vers le haut. Le message s’appelle
une Traceback et contient plusieurs types d’information :
• Tout en bas : On a le type d’erreur qui a été généré (on verra plus tard que cela s’appelle en réalité une exception).
Ici une erreur de syntaxe appelée SyntaxError. Puis sur la même ligne, un indice supplémentaire (ici l’absence
d’une parenthèse).
• Un peu plus haut : une description de l’erreur où on voit la parenthèse ouverte qui n’a jamais été fermée.
• Encore plus haut : le numéro de ligne dans le code où l’erreur a été détectée.
Avec cette Traceback il devient facile de corriger l’erreur.
Attention
Dans les vieilles versions de Python (< 3.10), la même erreur conduisait à une Traceback beaucoup moins claire :
$ python3.5 [Link]
File "[Link]", line 2
print("souris")
^
SyntaxError: invalid syntax
L’interpréteur vous indiquait une erreur de syntaxe en ligne 2 alors que l’oubli de parenthèse était en ligne 1 ! Pour
cette raison, utilisez dans la mesure du possible une version récente de Python (3.12 ou 3.13).
Si nous corrigeons la ligne 1 en mettant la parenthèse finale et que nous relançons le script, nous aurons cette fois-ci
une erreur due à une division par zéro :
$ python [Link]
chat
souris
Traceback (most recent call last):
File "[Link]", line 3, in <module>
print(1 / 0)
~~^~~
ZeroDivisionError: division by zero
Si nous corrigeons cette erreur en ligne 3 en évitant la division par zéro (par exemple en mettant print(1 / 1)),
l’exécution donnera un autre message d’erreur dû à la ligne 4 où la transformation d’une chaîne de caractères en entier
n’est pas possible :
$ python [Link]
chat
souris
1
Traceback (most recent call last):
File "[Link]", line 4, in <module>
print(int("deux"))
^^^^^^^^^^^
ValueError: invalid literal for int() with base 10: 'deux'
À nouveau dans ces deux derniers exemples de Traceback, vous voyez qu’on a la même construction. Tout en bas, le
type d’erreur, puis en remontant une description du problème et le numéro de ligne où l’erreur a été détectée.
Conseil
Il est important de bien lire chaque message d’erreur généré par Python. En général, la clé du problème est mentionnée
dans ce message vous donnant des éléments pour le corriger.
Définition
L’écriture formatée est un mécanisme permettant d’afficher des variables avec un format précis, par exemple justifiées
à gauche ou à droite, ou encore avec un certain nombre de décimales pour les floats. L’écriture formatée est incontournable
lorsqu’on veut créer des fichiers organisés en « belles colonnes » comme par exemple les fichiers PDB (pour en savoir
plus sur ce format, reportez-vous à l’annexe A Quelques formats de données en biologie).
Depuis la version 3.6, Python a introduit les f-strings pour mettre en place l’écriture formatée que nous allons décrire
en détail dans cette rubrique. Il existe d’autres manières pour formater des chaînes de caractères qui étaient utilisées
avant la version 3.6, nous expliquons cela dans le chapitre 26 Remarques complémentaires (en ligne). Toutefois, nous
vous conseillons vivement l’utilisation des f-strings si vous débutez l’apprentissage de Python. Il est inutile d’apprendre
les anciennes manières.
Définition
f-string est le diminutif de formatted string literals. Mais encore ? Dans le chapitre précédent, nous avons vu les
chaînes de caractères ou encore strings qui étaient représentées par un texte entouré de guillemets simples ou doubles.
Par exemple :
1 "Ceci est une chaîne de caractères"
L’équivalent en f-string est la même chaîne de caractères précédée du caractère f sans espace entre les deux :
1 f"Ceci est une chaîne de caractères"
Ce caractère f avant les guillemets va indiquer à Python qu’il s’agit d’une f-string mettant en place le mécanisme de
l’écriture formatée, contrairement à une string normale.
Nous expliquons plus en détail dans le chapitre 11 Plus sur les chaînes de caractères pourquoi on doit mettre ce f et
quel est le mécanisme sous-jacent.
Il suffit de passer un nom de variable au sein de chaque couple d’accolades et Python les remplace par leur contenu.
La syntaxe apparait plus lisible que l’équivalent vu précédemment :
1 >>> print(nom, "a", x, "ans")
2 John a 32 ans
Bien sûr, il ne faut pas omettre le f avant le premier guillemet, sinon Python prendra cela pour une chaîne de
caractères normale et ne mettra pas en place le mécanisme de remplacement entre les accolades :
1 >>> print("{nom} a {x} ans")
2 {nom} a {x} ans
Remarque
Une variable est utilisable plus d’une fois pour une f-string donnée :
1 >>> var = "to"
2 >>> print(f"{var} et {var} font {var}{var}")
3 to et to font toto
4 >>>
Enfin, il est possible de mettre entre les accolades des valeurs numériques ou des chaînes de caractères :
1 >>> print(f"J'affiche l'entier {10} et le float {3.14}")
2 J'affiche l'entier 10 et le float 3.14
3 >>> print(f"J'affiche la chaine {'Python'}")
4 J'affiche la chaine Python
Même si cela ne présente que peu d’intérêt pour l’instant, il s’agit d’une commande Python parfaitement valide. Nous
verrons des exemples plus pertinents par la suite. Cela fonctionne avec n’importe quel type de variable (entiers, chaînes
de caractères, floats, etc.). Attention toutefois pour les chaînes de caractères, utilisez des guillemets simples au sein des
accolades si vous définissez votre f-string avec des guillemets doubles.
Le résultat obtenu présente trop de décimales (seize dans le cas présent). Pour écrire le résultat plus lisiblement, vous
pouvez spécifier dans les accolades {} le format qui vous intéresse. Dans le cas présent, vous voulez formater un float
pour l’afficher avec deux puis trois décimales :
1 >>> print(f"La proportion de GC est {prop_GC:.2f}")
2 La proportion de GC est 0.48
3 >>> print(f"La proportion de GC est {prop_GC:.3f}")
4 La proportion de GC est 0.478
Les instructions étant longues dans cet exemple, nous avons coupé chaque chaîne de caractères sur deux lignes. Il faut
mettre à chaque fois le f pour préciser à Python qu’on utilise une f-string. Les ... indiquent que l’interpréteur attend
que l’on ferme la parenthèse du print entamé sur la ligne précédente. Nous reverrons cette syntaxe dans le chapitre 11
Plus sur les chaînes de caractères.
Enfin, il est possible de préciser sur combien de caractères vous voulez qu’un résultat soit écrit et comment se fait
l’alignement (à gauche, à droite), ou si vous voulez centrer le texte. Dans la portion de code suivante, le caractère ; sert
de séparateur entre les instructions sur une même ligne :
Notez que > spécifie un alignement à droite, < spécifie un alignement à gauche et ^ spécifie un alignement centré.
Il est également possible d’indiquer le caractère qui servira de remplissage lors des alignements (l’espace est le caractère
par défaut).
Ce formatage est également possible sur des chaînes de caractères avec la lettre s (comme string) :
1 >>> print("atom HN") ; print("atom HDE1")
2 atom HN
3 atom HDE1
4 >>> print(f"atom {'HN':>4s}") ; print(f"atom {'HDE1':>4s}")
5 atom HN
6 atom HDE1
Vous voyez tout de suite l’énorme avantage de l’écriture formatée. Elle vous permet d’écrire en colonnes parfaitement
alignées. Nous verrons que ceci est très pratique si l’on veut écrire les coordonnées des atomes d’une molécule au format
PDB (pour en savoir plus sur ce format, reportez-vous à l’annexe A Quelques formats de données en biologie).
Pour les floats, il est possible de combiner le nombre de caractères à afficher avec le nombre de décimales :
1 >>> print(f"{perc_GC:7.3f}")
2 47.804
3 >>> print(f"{perc_GC:10.3f}")
4 47.804
L’instruction 7.3f signifie que l’on souhaite écrire un float avec 3 décimales et formaté sur 7 caractères (par défaut
justifiés à droite). L’instruction 10.3f fait la même chose sur 10 caractères. Remarquez que le séparateur décimal .
compte pour un caractère. De même, si on avait un nombre négatif, le signe - compterait aussi pour un caractère.
Une remarque importante, si on ne met pas de variable à formater entre les accolades dans une f-string, cela conduit
à une erreur :
1 >>> print(f"accolades sans variable {}")
2 File "<stdin>", line 1
3 SyntaxError: f-string: empty expression not allowed
Enfin, il est important de bien comprendre qu’une f-string est indépendante de la fonction print(). Si on donne
une f-string à la fonction print(), Python évalue d’abord la f-string et c’est la chaîne de caractères qui en résulte qui
est affichée à l’écran. Tout comme dans l’instruction print(5*5), c’est d’abord la multiplication (5*5) qui est évaluée,
puis son résultat qui est affiché à l’écran. On peut s’en rendre compte de la manière suivante dans l’interpréteur :
1 >>> f"{perc_GC:10.3f}"
2 ' 47.804'
3 >>> type(f"{perc_GC:10.3f}")
4 <class 'str'>
Python considère le résultat de l’instruction f"{perc_GC:10.3f}" comme une chaîne de caractères et la fonction
type() nous le confirme.
Nous aurons l’occasion de revenir sur cette fonctionnalité au fur et à mesure de ce cours.
Les possibilités offertes par les f-strings sont nombreuses. Pour vous y retrouver dans les différentes options de
formatage, nous vous conseillons de consulter ce mémo 1 (en anglais).
Il est également possible de définir le nombre de chiffres après la virgule. Dans l’exemple ci-dessous, on affiche un
nombre avec aucun, 3 et 6 chiffres après la virgule :
1 >>> avogadro_number = 6.022_140_76e23
2 >>> print(f"{avogadro_number:.0e}")
3 6e+23
4 >>> print(f"{avogadro_number:.3e}")
5 6.022e+23
6 >>> print(f"{avogadro_number:.6e}")
7 6.022141e+23
3.5 Exercices
Conseil
Pour les exercices 2 à 6, utilisez l’interpréteur Python.
3.5.2 Poly-A
Générez une chaîne de caractères représentant un brin d’ADN poly-A (c’est-à-dire qui ne contient que des bases A)
de 20 bases de longueur, sans taper littéralement toutes les bases.
Ici, 2 est le quotient de la division entière du numérateur par le dénominateur et 1 est le reste de la division entière
du numérateur par le dénominateur.
Faites de même pour les fractions suivantes :
9 23 21 7
, , et
4 5 8 2
Aide : Pour chaque fraction, créez les variables numerateur et denominateur pour stocker les valeurs du numérateur
et du dénominateur. Créez ensuite les variables quotient et reste à partir des variables numerateur et denominateur
en utilisant les opérateurs // et %. Utilisez enfin ces quatre variables pour afficher le résultat dans la forme demandée
avec une f-string.
Listes
4.1 Définition
Définition
Une liste est une structure de données qui contient une collection d’objets Python. Il s’agit d’un nouveau type par
rapport aux entiers, float, booléens et chaînes de caractères que nous avons vus jusqu’à maintenant. On parle aussi
d’objet séquentiel en ce sens qu’il contient une séquence d’autres objets.
Python autorise la construction de liste contenant des valeurs de types différents (par exemple entier et chaîne de
caractères), ce qui leur confère une grande flexibilité. Une liste est déclarée par une série de valeurs (n’oubliez pas les
guillemets, simples ou doubles, s’il s’agit de chaînes de caractères) séparées par des virgules, et le tout encadré par des
crochets. En voici quelques exemples :
1 >>> animaux = ["girafe", "tigre", "singe", "souris"]
2 >>> tailles = [5, 2.5, 1.75, 0.15]
3 >>> mixte = ["girafe", 5, "souris", 0.15]
4 >>> animaux
5 ['girafe', 'tigre', 'singe', 'souris']
6 >>> tailles
7 [5, 2.5, 1.75, 0.15]
8 >>> mixte
9 ['girafe', 5, 'souris', 0.15]
Lorsque l’on affiche une liste, Python la restitue telle qu’elle a été saisie.
4.2 Utilisation
Un des gros avantages d’une liste est que vous accédez à ses éléments par leur position. Ce numéro est appelé indice
(ou index) de la liste.
liste : ["girafe", "tigre", "singe", "souris"]
indice : 0 1 2 3
Soyez très attentif au fait que les indices d’une liste de n éléments commencent à 0 et se terminent à n − 1. Voyez
l’exemple suivant :
32
4.3. Opération sur les listes Chapitre 4. Listes
Par conséquent, si on appelle l’élément d’indice 4 de notre liste, Python renverra un message d’erreur :
1 >>> animaux[4]
2 Traceback (innermost last):
3 File "<stdin>", line 1, in ?
4 IndexError: list index out of range
Remarque
La notion de méthode est introduite dans la rubrique Note sur le vocabulaire et la syntaxe à la fin de ce chapitre.
puis lui ajouter deux éléments, l’un après l’autre, d’abord avec la concaténation :
1 >>> liste1 = liste1 + [15]
2 >>> liste1
3 [15]
4 >>> liste1 = liste1 + [-5]
5 >>> liste1
6 [15, -5]
Dans cet exemple, nous ajoutons des éléments à une liste en utilisant l’opérateur de concaténation + ou la méthode
.append().
Conseil
Nous vous conseillons dans ce cas précis d’utiliser la méthode .append(), dont la syntaxe est plus élégante.
Nous reverrons en détail la méthode .append() dans le chapitre 12 Plus sur les listes.
ou encore :
liste : ["A", "B", "C", "D", "E", "F"]
indice positif : 0 1 2 3 4 5
indice négatif : -6 -5 -4 -3 -2 -1
Les indices négatifs reviennent à compter à partir de la fin. Leur principal avantage est que vous pouvez accéder au
dernier élément d’une liste à l’aide de l’indice -1 sans pour autant connaître la longueur de cette liste. L’avant-dernier
élément a lui l’indice -2, l’avant-avant dernier l’indice -3, etc. :
1 >>> animaux = ["girafe", "tigre", "singe", "souris"]
2 >>> animaux[-1]
3 'souris'
4 >>> animaux[-2]
5 'singe'
Pour accéder au premier élément de la liste avec un indice négatif, il faut par contre connaître le bon indice :
1 >>> animaux[-4]
2 'girafe'
4.5 Tranches
Un autre avantage des listes est la possibilité de sélectionner une partie d’une liste en utilisant un indiçage construit
sur le modèle [m:n+1] pour récupérer tous les éléments, du émième au énième (de l’élément m inclu à l’élément n+1
exclu). On dit alors qu’on récupère une tranche de la liste, par exemple :
1 >>> animaux = ["girafe", "tigre", "singe", "souris"]
2 >>> animaux[0:2]
3 ['girafe', 'tigre']
4 >>> animaux[0:3]
5 ['girafe', 'tigre', 'singe']
6 >>> animaux[0:]
7 ['girafe', 'tigre', 'singe', 'souris']
8 >>> animaux[:]
9 ['girafe', 'tigre', 'singe', 'souris']
10 >>> animaux[1:]
11 ['tigre', 'singe', 'souris']
12 >>> animaux[1:-1]
13 ['tigre', 'singe']
Notez que lorsqu’aucun indice n’est indiqué à gauche ou à droite du symbole deux-points :, Python prend par défaut
tous les éléments depuis le début ou tous les éléments jusqu’à la fin respectivement.
On peut aussi préciser le pas en ajoutant un symbole deux-points supplémentaire et en indiquant le pas par un entier :
Finalement, on se rend compte que l’accès au contenu d’une liste fonctionne sur le modèle liste[début:fin:pas].
La commande list(range(10)) a généré une liste contenant tous les nombres entiers de 0 inclus à 10 exclu. Nous
verrons l’utilisation de la fonction range() toute seule dans le chapitre 5 Boucles et comparaisons.
Dans l’exemple ci-dessus, la fonction range() a pris un argument, mais elle peut également prendre deux ou trois
arguments, voyez plutôt :
1 >>> list(range(0, 5))
2 [0, 1, 2, 3, 4]
3 >>> list(range(15, 20))
4 [15, 16, 17, 18, 19]
5 >>> list(range(0, 1000, 200))
6 [0, 200, 400, 600, 800]
7 >>> list(range(2, -2, -1))
8 [2, 1, 0, -1]
L’instruction range() fonctionne sur le modèle range([début,] fin[, pas]). Les arguments entre crochets sont
optionnels. Pour obtenir une liste de nombres entiers, il faut l’utiliser systématiquement avec la fonction list().
Enfin, prenez garde aux arguments optionnels par défaut (0 pour début et 1 pour pas) :
1 >>> list(range(10,0))
2 []
Ici la liste est vide car Python a pris la valeur du pas par défaut qui est de 1. Ainsi, si on commence à 10 et qu’on
avance par pas de 1, on ne pourra jamais atteindre 0. Python génère ainsi une liste vide. Pour éviter ça, il faudrait, par
exemple, préciser un pas de -1 pour obtenir une liste d’entiers décroissants :
1 >>> list(range(10,0,-1))
2 [10, 9, 8, 7, 6, 5, 4, 3, 2, 1]
Dans cet exemple, chaque sous-liste contient une catégorie d’animal et le nombre d’animaux pour chaque catégorie.
Pour accéder à un élément de la liste, on utilise l’indiçage habituel :
1 >>> savane[1]
2 ['tigre', 2]
On verra un peu plus loin qu’il existe en Python des dictionnaires qui sont également très pratiques pour stocker
de l’information structurée. On verra aussi qu’il existe un module nommé NumPy qui permet de créer des listes ou des
tableaux de nombres (vecteurs et matrices) et de les manipuler.
Même si en théorie ces fonctions peuvent prendre en argument une liste de strings, on les utilisera la plupart du temps
avec des types numériques (liste d’entiers et / ou de floats).
Nous avions déjà croisé min(), max() dans le chapitre 2 Variables. Ces deux fonctions pouvaient prendre plusieurs
arguments entiers et / ou floats, par exemple :
1 >>> min(3, 4)
2 3
Attention toutefois à ne pas mélanger entiers et floats d’une part avec une liste d’autre part, car cela renvoie une
erreur :
1 >>> min(liste1, 3, 4)
2 Traceback (most recent call last):
3 File "<stdin>", line 1, in <module>
4 TypeError: '<' not supported between instances of 'int' and 'list'
Soit on passe plusieurs entiers et / ou floats en argument, soit on passe une liste unique.
Comme vous voyez en ligne 8, la modification de liste1 a modifié également liste2. Cela vient du fait que Python
a effectué la copie de liste en ligne 5 par référence. Ainsi, les deux listes pointent vers le même objet dans la mémoire.
Pour contrer ce problème et faire en sorte que liste2 soit bien distincte de liste1, on peut utiliser la fonction list() :
1 >>> liste1 = list(range(5))
2 >>> liste1
3 [0, 1, 2, 3, 4]
4 >>> liste2 = list(liste1)
5 >>> liste2
6 [0, 1, 2, 3, 4]
7 >>> liste1[3] = -50
8 >>> liste1
9 [0, 1, 2, -50, 4]
10 >>> liste2
11 [0, 1, 2, 3, 4]
Attention
Cette astuce ne fonctionne que pour des listes à une dimension (c’est-à-dire pour des listes qui ne contiennent que
des éléments de type simple comme des entiers, des floats, des chaînes de caractères et des booléens), mais pas pour des
listes de listes. Le chapitre 12 Plus sur les listes explique l’origine de ce comportement et comment s’en sortir à tous les
coups.
la méthode .append() est liée à liste1 qui est un objet de type liste. La méthode modifie l’objet liste en lui
ajoutant un élément.
Nous aurons de nombreuses occasions de revoir cette notation objet.méthode().
4.12 Exercices
Conseil
Pour ces exercices, utilisez l’interpréteur Python.
Prédisez le comportement de chaque instruction ci-dessous, sans les recopier dans un script ni dans l’interpréteur
Python :
• print(liste1[2])
• print(liste1[var])
• print(liste1[var2])
• print(liste1["var"])
Lorsqu’une instruction produit une erreur, identifiez pourquoi.
4.12.3 Saisons
Créez quatre listes hiver, printemps, ete et automne contenant les mois correspondants à ces saisons. Créez
ensuite une liste saisons contenant les listes hiver, printemps, ete et automne. Prévoyez ce que renvoient les
instructions suivantes, puis vérifiez-le dans l’interpréteur :
1. saisons[2]
2. saisons[1][0]
3. saisons[1:2]
4. saisons[:][1]. Comment expliquez-vous ce dernier résultat ?
Boucles et comparaisons
Si votre liste ne contient que 4 éléments, ceci est encore faisable mais imaginez qu’elle en contienne 100 voire 1 000 !
Pour remédier à cela, il faut utiliser les boucles . Regardez l’exemple suivant :
1 >>> animaux = ["girafe", "tigre", "singe", "souris"]
2 >>> for animal in animaux:
3 ... print(animal)
4 ...
5 girafe
6 tigre
7 singe
8 souris
39
Chapitre 5. Boucles et comparaisons 5.1. Boucles for
Nous verrons plus loin que la variable d’itération peut être de n’importe quel type selon la liste parcourue. En Python,
une boucle itère la plupart du temps sur un objet dit séquentiel (c’est-à-dire un objet constitué d’autres objets) tel
qu’une liste. De tels objets sont dits itérables car on peut effectuer une boucle dessus. Nous verrons aussi plus tard
d’autres objets séquentiels sur lesquels on peut itérer dans une boucle.
D’ores et déjà, prêtez attention au caractère deux-points « : » à la fin de la ligne débutant par for. Cela signifie
que la boucle for attend un bloc d’instructions, en l’occurrence toutes les instructions que Python répétera à chaque
itération de la boucle. On appelle ce bloc d’instructions le corps de la boucle. Comment indique-t-on à Python où ce
bloc commence et se termine ? Cela est signalé uniquement par l’indentation, c’est-à-dire le décalage vers la droite de
la (ou des) ligne(s) du bloc d’instructions.
Remarque
Les notions de bloc d’instruction et d’indentations ont été introduites dans le chapitre 1 Introduction.
Dans l’exemple suivant, le corps de la boucle contient deux instructions (ligne 2 et ligne 3) car elles sont indentées
par rapport à la ligne débutant par for :
1 for animal in animaux:
2 print(animal)
3 print(animal*2)
4 print("C'est fini")
La ligne 4 ne fait pas partie du corps de la boucle car elle est au même niveau que le for (c’est-à-dire non indentée par
rapport au for). Notez également que chaque instruction du corps de la boucle doit être indentée de la même manière
(ici 4 espaces).
Remarque
Outre une meilleure lisibilité, les deux-points et l’indentation sont formellement requis en Python. Même si on
peut indenter comme on veut (plusieurs espaces ou plusieurs tabulations, mais pas une combinaison des deux), les
développeurs recommandent l’utilisation de quatre espaces. Vous pouvez consulter à ce sujet le chapitre 16 Bonnes
pratiques de programmation en Python.
Faites en sorte de configurer votre éditeur de texte favori de façon à écrire quatre espaces lorsque vous tapez sur la
touche Tab (tabulation).
Dans les exemples ci-dessus, nous avons exécuté une boucle en itérant directement sur une liste. Une tranche d’une
liste étant elle même une liste, on peut également itérer dessus :
1 >>> animaux = ["girafe", "tigre", "singe", "souris"]
2 >>> for animal in animaux[1:3]:
3 ... print(animal)
4 ...
5 tigre
6 singe
On a vu que les boucles for pouvaient utiliser une liste contenant des chaînes de caractères, mais elles peuvent tout
aussi bien utiliser des listes contenant des entiers (ou n’importe quel type de variable) :
1. [Link]
La variable i prendra les valeurs successives 0, 1, 2 et 3 et on accèdera à chaque élément de la liste animaux par son
indice (i.e. animaux[i]). Notez à nouveau le nom i de la variable d’itération car on itère sur les indices.
Quand utiliser l’une ou l’autre des deux méthodes ? La plus efficace est celle qui réalise les itérations directement
sur les éléments :
1 >>> animaux = ["girafe", "tigre", "singe", "souris"]
2 >>> for animal in animaux:
3 ... print(animal)
4 ...
5 girafe
6 tigre
7 singe
8 souris
Remarque
Dans le chapitre 18 Jupyter et ses notebooks, nous mesurerons le temps d’exécution de ces deux méthodes pour vous
montrer que l’itération sur les éléments est la méthode la plus rapide.
Toutefois, il se peut qu’au cours d’une boucle vous ayez besoin des indices, auquel cas vous devrez itérer sur les
indices :
1 >>> animaux = ["girafe", "tigre", "singe", "souris"]
2 >>> for i in range(len(animaux)):
3 ... print(f"L'animal {i} est un(e) {animaux[i]}")
4 ...
5 L'animal 0 est un(e) girafe
6 L'animal 1 est un(e) tigre
7 L'animal 2 est un(e) singe
8 L'animal 3 est un(e) souris
Enfin, Python possède la fonction enumerate() qui vous permet d’itérer sur les indices et les éléments eux-mêmes :
1 >>> animaux = ["girafe", "tigre", "singe", "souris"]
2 >>> for i, animal in enumerate(animaux):
3 ... print(f"L'animal {i} est un(e) {animal}")
4 ...
5 L'animal 0 est un(e) girafe
6 L'animal 1 est un(e) tigre
7 L'animal 2 est un(e) singe
8 L'animal 3 est un(e) souris
5.2 Comparaisons
Avant de passer aux boucles while, abordons tout de suite les comparaisons. Celles-ci seront reprises dans le chapitre
6 Tests.
Python est capable d’effectuer toute une série de comparaisons entre le contenu de deux variables, telles que :
1 >>> x = 5
2 >>> x == 5
3 True
4 >>> x > 10
5 False
6 >>> x < 10
7 True
Python renvoie la valeur True si la comparaison est vraie et False si elle est fausse. True et False sont des booléens
comme nous avions vu au chapitre 2 Variables.
Faites bien attention à ne pas confondre l’opérateur d’affectation = qui affecte une valeur à une variable et
l’opérateur de comparaison == qui compare les valeurs de deux variables.
Vous pouvez également effectuer des comparaisons sur des chaînes de caractères.
1 >>> animal = "tigre"
2 >>> animal == "tig"
3 False
4 >>> animal != "tig"
5 True
6 >>> animal == "tigre"
7 True
Dans le cas des chaînes de caractères, a priori seuls les tests == et != ont un sens. En fait, on peut aussi utiliser les
opérateurs <, >, <= et >=. Dans ce cas, l’ordre alphabétique est pris en compte, par exemple :
1 >>> "a" < "b"
2 True
"a" est inférieur à "b" car le caractère a est situé avant le caractère b dans l’ordre alphabétique. En fait, c’est
l’ordre ASCII 2 des caractères qui est pris en compte (à chaque caractère correspond un code numérique), on peut donc
aussi comparer des caractères spéciaux (comme # ou ~) entre eux. Enfin, on peut comparer des chaînes de caractères de
plusieurs caractères :
1 >>> "ali" < "alo"
2 True
3 >>> "abb" < "ada"
4 True
Dans ce cas, Python compare les deux chaînes de caractères, caractère par caractère, de la gauche vers la droite (le
premier caractère avec le premier, le deuxième avec le deuxième, etc). Dès qu’un caractère est différent entre l’une et
l’autre des deux chaînes, il considère que la chaîne la plus petite est celle qui présente le caractère ayant le plus petit
code ASCII (les caractères suivants de la chaîne de caractères sont ignorés dans la comparaison), comme dans l’exemple
"abb" < "ada" ci-dessus.
Remarquez qu’il est encore une fois nécessaire d’indenter le bloc d’instructions correspondant au corps de la boucle
(ici, les instructions lignes 3 et 4).
2. [Link]
Une boucle while nécessite généralement trois éléments pour fonctionner correctement :
1. Initialisation de la variable d’itération avant la boucle (ligne 1).
2. Test de la variable d’itération associée à l’instruction while (ligne 2).
3. Mise à jour de la variable d’itération dans le corps de la boucle (ligne 4).
Faites bien attention aux tests et à l’incrémentation que vous utilisez, car une erreur mène souvent à des « boucles
infinies » qui ne s’arrêtent jamais. Vous pouvez néanmoins toujours stopper l’exécution d’un script Python à l’aide de la
combinaison de touches Ctrl-C (c’est-à-dire en pressant simultanément les touches Ctrl et C). Par exemple :
1 i = 0
2 while i < 10:
3 print("Le Python c'est cool !")
Ici, nous avons omis de mettre à jour la variable i dans le corps de la boucle. Par conséquent, la boucle ne s’arrêtera
jamais (sauf en pressant Ctrl-C) puisque la condition i < 10 sera toujours vraie.
La boucle while combinée à la fonction input() peut s’avérer commode lorsqu’on souhaite demander à l’utilisateur
une valeur numérique. Par exemple :
1 >>> i = 0
2 >>> while i < 10:
3 ... reponse = input("Entrez un entier supérieur à 10 : ")
4 ... i = int(reponse)
5 ...
6 Entrez un entier supérieur à 10 : 4
7 Entrez un entier supérieur à 10 : -3
8 Entrez un entier supérieur à 10 : 15
9 >>> i
10 15
La fonction input() prend en argument un message (sous la forme d’une chaîne de caractères), demande à l’utilisateur
d’entrer une valeur et renvoie celle-ci sous forme d’une chaîne de caractères, qu’il faut ensuite convertir en entier (avec
la fonction int() ligne 4). Si on reprend les trois éléments d’une boucle while, on trouve l’initialisation de la variable
d’itération en ligne 1, le test de sa valeur en ligne 2, et sa mise à jour en ligne 4.
Conseil
Comment choisir entre la boucle while et la boucle for ? La boucle while s’utilisera généralement lorsqu’on ne sait pas
à l’avance le nombre d’itérations (comme dans le dernier exemple). Si on connait à l’avance le nombre d’itérations, par
exemple si on veut écrire 10 fois Le Python c'est cool, nous vous conseillons la boucle for.
5.4 Exercices
Conseil
Pour ces exercices, créez des scripts puis exécutez-les dans un shell.
Conseil
Pensez à relire le début du chapitre 3 Affichage qui discute de la fonction print().
5.4.7 Triangle
Créez un script qui dessine un triangle comme celui-ci :
*
**
***
****
*****
******
*******
********
*********
**********
*
**
***
****
*****
******
*******
********
*********
**********
5.4.10 Pyramide
Créez un script [Link] qui dessine une pyramide comme celle-ci :
*
***
*****
*******
*********
***********
*************
***************
*****************
*******************
Essayez de faire évoluer votre script pour dessiner la pyramide à partir d’un nombre arbitraire de lignes N. Vous
pourrez demander à l’utilisateur le nombre de lignes de la pyramide avec les instructions suivantes qui utilisent la fonction
input() :
1 reponse = input("Entrez un nombre de lignes (entier positif): ")
2 N = int(reponse)
Attention à bien respecter l’alignement des chiffres qui doit être justifié à droite sur 4 caractères. Testez avec une
matrice de dimensions 3 × 3, puis 5 × 5, et enfin 10 × 10.
Créez une seconde version de votre script, cette fois-ci avec deux boucles while.
ligne colonne
1 2
1 3
1 4
2 3
2 4
3 4
Pour une matrice 4x4, on a parcouru 6 cases
Conseil
Utilisez l’instruction [Link]([-1,1]) qui renvoie au hasard les valeurs -1 ou 1 avec la même probabilité.
Avant d’utiliser cette instruction, mettez au tout début de votre script la ligne
import random
Nous verrons la signification de cette syntaxe particulière dans le chapitre 9 Modules.
3. [Link]
Tests
6.1 Définition
Les tests sont un élément essentiel à tout langage informatique si on veut lui donner un peu de complexité car ils
permettent à l’ordinateur de prendre des décisions. Pour cela, Python utilise l’instruction if ainsi qu’une comparaison
que nous avons abordée au chapitre précédent. Voici un premier exemple :
1 >>> x = 2
2 >>> if x == 2:
3 ... print("Le test est vrai !")
4 ...
5 Le test est vrai !
et un second :
1 >>> x = "souris"
2 >>> if x == "tigre":
3 ... print("Le test est vrai !")
4 ...
49
Chapitre 6. Tests 6.3. Importance de l’indentation
1 >>> x = 2
2 >>> if x == 2:
3 ... print("Le test est vrai !")
4 ... else:
5 ... print("Le test est faux !")
6 ...
7 Le test est vrai !
8 >>> x = 3
9 >>> if x == 2:
10 ... print("Le test est vrai !")
11 ... else:
12 ... print("Le test est faux !")
13 ...
14 Le test est faux !
On peut utiliser une série de tests dans la même instruction if, notamment pour tester plusieurs valeurs d’une même
variable.
Par exemple, on se propose de tirer au sort une base d’ADN puis d’afficher le nom de cette dernière. Dans le code
suivant, nous utilisons l’instruction [Link](liste) qui renvoie un élément choisi au hasard dans une liste.
L’instruction import random sera vue plus tard dans le chapitre 9 Modules, admettez pour le moment qu’elle est
nécessaire :
1 >>> import random
2 >>> base = [Link](["a", "t", "c", "g"])
3 >>> if base == "a":
4 ... print("choix d'une adénine")
5 ... elif base == "t":
6 ... print("choix d'une thymine")
7 ... elif base == "c":
8 ... print("choix d'une cytosine")
9 ... elif base == "g":
10 ... print("choix d'une guanine")
11 ...
12 choix d'une cytosine
Dans cet exemple, Python teste la première condition puis, si et seulement si elle est fausse, teste la deuxième et ainsi
de suite… Le code correspondant à la première condition vérifiée est exécuté puis Python sort du bloc d’instructions du
if. Il est également possible d’ajouter une condition else supplémentaire qui est exécutée si aucune des conditions du
if et des elif n’est vraie.
Code 1
1 nombres = [4, 5, 6]
2 for nb in nombres:
3 if nb == 5:
4 print("Le test est vrai")
5 print(f"car la variable nb vaut {nb}")
Résultat :
Le test est vrai
car la variable nb vaut 5
Code 2
1 nombres = [4, 5, 6]
2 for nb in nombres:
3 if nb == 5:
4 print("Le test est vrai")
5 print(f"car la variable nb vaut {nb}")
Résultat :
car la variable nb vaut 4
Le test est vrai
car la variable nb vaut 5
car la variable nb vaut 6
Les deux codes pourtant très similaires produisent des résultats très différents. Si vous observez avec attention
l’indentation des instructions sur la ligne 5, vous remarquerez que dans le code 1, l’instruction est indentée deux fois,
ce qui signifie qu’elle appartient au bloc d’instructions du test if. Dans le code 2, l’instruction de la ligne 5 n’est
indentée qu’une seule fois, ce qui fait qu’elle n’appartient plus au bloc d’instructions du test if, d’où l’affichage de
car la variable nb vaut xx pour toutes les valeurs de nb.
et de l’opérateur ET :
En Python, on utilise le mot réservé and pour l’opérateur ET et le mot réservé or pour l’opérateur OU. Respectez
bien la casse des opérateurs and et or qui, en Python, s’écrivent en minuscule. En voici un exemple d’utilisation :
1 >>> x = 2
2 >>> y = 2
3 >>> if x == 2 and y == 2:
4 ... print("le test est vrai")
5 ...
6 le test est vrai
Notez que le même résultat serait obtenu en utilisant deux instructions if imbriquées :
1 >>> x = 2
2 >>> y = 2
3 >>> if x == 2:
4 ... if y == 2:
5 ... print("le test est vrai")
6 ...
7 le test est vrai
Conseil
Nous vous conseillons la syntaxe avec un and qui est plus compacte. De manière générale, moins il y a de niveau
d’indentations mieux c’est pour la lisibilité.
Vous pouvez aussi tester directement l’effet de ces opérateurs à l’aide de True et False (attention à respecter la
casse) :
1 >>> True or False
2 True
Enfin, on peut utiliser l’opérateur logique de négation not qui inverse le résultat d’une condition :
1 >>> not True
2 False
3 >>> not False
4 True
5 >>> not (True and True)
6 False
L’instruction continue saute à l’itération suivante, sans exécuter la suite du bloc d’instructions de la boucle :
1 >>> for nombre in range(4):
2 ... if nombre == 2:
3 ... continue
4 ... print(nombre)
5 ...
6 0
7 1
8 3
Toutefois, nous vous le déconseillons formellement. Pourquoi ? Python stocke les valeurs numériques des floats sous
forme de nombres flottants (d’où leur nom), et cela mène à certaines limitations 1 . Observez l’exemple suivant :
1 >>> (3 - 2.7) == 0.3
2 False
3 >>> 3 - 2.7
4 0.2999999999999998
Nous voyons que le résultat de l’opération 3 - 2.7 n’est pas exactement 0.3 d’où le résultat False en ligne 2.
En fait, ce problème ne vient pas de Python, mais plutôt de la manière dont un ordinateur traite les nombres flottants
(comme un rapport de nombres binaires). Ainsi certaines valeurs de float ne peuvent être qu’approchées. Une manière
1. [Link]
de s’en rendre compte est d’utiliser l’écriture formatée en demandant l’affichage d’un grand nombre de décimales :
1 >>> 0.3
2 0.3
3 >>> f"{0.3:.5f}"
4 '0.30000'
5 >>> f"{0.3:.60f}"
6 '0.299999999999999988897769753748434595763683319091796875000000'
7 >>> var = 3 - 2.7
8 >>> f"{var:.60f}"
9 '0.299999999999999822364316059974953532218933105468750000000000'
10 >>> abs(var - 0.3)
11 1.6653345369377348e-16
On observe que lorsqu’on tape 0.3, Python affiche une valeur arrondie. En réalité, le nombre réel 0.3 ne peut être
qu’approché lorsqu’on le code en nombre flottant. Il est essentiel d’avoir cela en tête lorsque l’on compare deux floats.
Même si 0.3 et 3 - 2.7 ne donnent pas le même résultat, la différence est toutefois infinétisimale, de l’ordre de 1e-16
soit la 16me décimale !
Pour ces raisons, il ne faut surtout pas utiliser l’opérateur == pour tester si un float est égal à une certaine valeur, car
cet opérateur correspond à une égalité stricte. La bonne pratique est de vérifier si un float est compris dans un intervalle
avec une certaine précision. Si on appelle cette précision delta, on peut procéder ainsi :
1 >>> delta = 1e-5
2 >>> var = 3.0 - 2.7
3 >>> 0.3 - delta < var < 0.3 + delta
4 True
5 >>> abs(var - 0.3) < delta
6 True
Ici on teste si var est compris dans l’intervalle 0.3 ± delta. En choisissant delta à 1e-5, on teste jusqu’à la cinquième
décimale. Les deux méthodes mènent à un résultat strictement équivalent :
• La ligne 3 est plus intuitive car elle ressemble à un encadrement mathématique.
• La ligne 5 utilise la fonction valeur absolue abs() et est plus compacte.
Une dernière manière pour tester la valeur d’un float, apparue en Python 3.5, est d’utiliser la fonction [Link]
() :
1 >>> import math
2 >>> var = 3.0 - 2.7
3 >>> [Link](var, 0.3, abs_tol=1e-5)
4 True
Cette fonction prend en argument les deux floats à comparer, ainsi que l’argument par mot-clé abs_tol correspondant
à la précision souhaitée (que nous avions appelée delta ci-dessus). Nous vous conseillons de toujours préciser cet argument
abs_tol. Comme vu au dessus pour tirer une base au hasard, l’instruction import math sera vue dans le chapitre 9
Modules, admettez pour le moment qu’elle est nécessaire.
Conseil
Sur les trois manières de procéder pour comparer un float à une valeur, nous vous conseillons celle avec math.
isclose() qui nous parait la plus lisible.
6.7 Exercices
Conseil
Pour ces exercices, créez des scripts puis exécutez-les dans un shell.
Vous remarquerez qu’un nombre est pair lorsque le reste de sa division entière par 2 est nul.
Jusqu’à présent, la conjecture de Syracuse, selon laquelle depuis n’importe quel entier positif la suite de Syracuse
atteint 1, n’a pas été mise en défaut.
Par exemple, les premiers éléments de la suite de Syracuse si on prend comme point de départ 10 sont : 10, 5, 16, 8,
4, 2, 1…
Créez un script qui, partant d’un entier positif n (par exemple 10 ou 20), crée une liste des nombres de la suite de
Syracuse. Avec différents points de départ (c’est-à-dire avec différentes valeurs de n), la conjecture de Syracuse est-elle
toujours vérifiée ? Quels sont les nombres qui constituent le cycle trivial ?
Conseil
1. Pour cet exercice, vous avez besoin de faire un nombre d’itérations inconnu pour que la suite de Syracuse atteigne le
chiffre 1 puis entame son cycle trivial. Vous pourrez tester votre algorithme avec un nombre arbitraire d’itérations,
typiquement 20 ou 100, suivant votre nombre n de départ.
2. Un nombre est pair lorsque le reste de sa division entière (opérateur modulo %) par 2 est nul.
6.7.8 Attribution de la structure secondaire des acides aminés d’une protéine (exercice
+++)
Dans une protéine, les différents acides aminés sont liés entre eux par une liaison peptidique. Les angles phi et psi sont
deux angles mesurés autour de cette liaison peptidique. Leurs valeurs sont utiles pour définir la conformation spatiale
(appelée « structure secondaire ») adoptée par les acides aminés.
Par exemple, les angles phi et psi d’une conformation en « hélice alpha » parfaite ont une valeur de -57 degrés et -47
degrés respectivement. Bien sûr, il est très rare que l’on trouve ces valeurs parfaites dans une protéine, et il est habituel
de tolérer une déviation de ± 30 degrés autour des valeurs idéales de ces angles.
Vous trouverez ci-dessous une liste de listes contenant les valeurs des angles phi et psi de 15 acides aminés de la
protéine 1TFE 3 :
1 [[48.6, 53.4],[-124.9, 156.7],[-66.2, -30.8], \
2 [-58.8, -43.1],[-73.9, -40.6],[-53.7, -37.5], \
3 [-80.6, -26.0],[-68.5, 135.0],[-64.9, -23.5], \
4 [-66.9, -45.5],[-69.6, -41.0],[-62.7, -37.5], \
5 [-68.2, -38.3],[-61.2, -49.1],[-59.7, -41.1]]
Pour le premier acide aminé, l’angle phi vaut 48.6 et l’angle psi 53.4. Pour le deuxième, l’angle phi vaut -124.9 et
l’angle psi 156.7, etc.
En utilisant cette liste, créez un script qui teste, pour chaque acide aminé, s’il est ou non en hélice et affiche les
valeurs des angles phi et psi et le message adapté est en hélice ou n’est pas en hélice.
Par exemple, pour les trois premiers acides aminés :
[48.6, 53.4] n'est pas en hélice
[-124.9, 156.7] n'est pas en hélice
[-66.2, -30.8] est en hélice
D’après vous, quelle est la structure secondaire majoritaire de ces 15 acides aminés ?
Remarque
Pour en savoir plus sur le monde merveilleux des protéines, n’hésitez pas à consulter la page Wikipedia sur la structure
secondaire des protéines 4 .
Un nombre premier est un entier naturel qui admet exactement deux diviseurs distincts entiers et positifs (qui sont
alors 1 et lui-même). Cette définition exclut 1, qui n’a qu’un seul diviseur entier positif. Par opposition, un nombre non
nul produit de deux nombres entiers différents de 1 est dit composé. Par exemple 6 = 2 × 3 est composé, tout comme
21 = 3 × 7, mais 11 est premier car 1 et 11 sont les seuls diviseurs de 11. Les nombres 0 et 1 ne sont ni premiers ni
composés.
Déterminez tous les nombres premiers inférieurs à 100. Combien y a-t-il de nombres premiers entre 0 et 100 ? Pour
vous aider, nous vous proposons plusieurs méthodes.
Pour vous guider, voici ce que donnerait le programme avec la conversation précédente :
Pensez à un nombre entre 1 et 100.
Est-ce votre nombre est plus grand, plus petit ou égal à 50 ? [+/-/=] +
Est-ce votre nombre est plus grand, plus petit ou égal à 75 ? [+/-/=] +
Est-ce votre nombre est plus grand, plus petit ou égal à 87 ? [+/-/=] -
Est-ce votre nombre est plus grand, plus petit ou égal à 81 ? [+/-/=] -
Est-ce votre nombre est plus grand, plus petit ou égal à 78 ? [+/-/=] +
Est-ce votre nombre est plus grand, plus petit ou égal à 79 ? [+/-/=] =
J'ai trouvé en 6 questions !
Les caractères [+/-/=] indiquent à l’utilisateur comment il doit interagir avec l’ordinateur, c’est-à-dire entrer soit le
caractère + si le nombre choisi est plus grand que le nombre proposé par l’ordinateur, soit le caractère - si le nombre
choisi est plus petit que le nombre proposé par l’ordinateur, soit le caractère = si le nombre choisi est celui proposé par
l’ordinateur (en appuyant ensuite sur la touche Entrée).
Fichiers
Enregistrez ce fichier dans votre répertoire courant avec le nom [Link]. Puis, testez le code suivant dans
l’interpréteur Python :
1 >>> filin = open("[Link]", "r")
2 >>> filin
3 <_io.TextIOWrapper name='[Link]' mode='r' encoding='UTF-8'>
4 >>> [Link]()
5 ['girafe\n', 'tigre\n', 'singe\n', 'souris\n']
6 >>> [Link]()
7 >>> [Link]()
8 Traceback (most recent call last):
9 File "<stdin>", line 1, in <module>
10 ValueError: I/O operation on closed file.
58
7.1. Lecture dans un fichier Chapitre 7. Fichiers
• Ligne 2. Lorsqu’on affiche le contenu de la variable filin, on se rend compte que Python la considère comme un
objet de type fichier ouvert (ligne 3).
• Ligne 4. Nous utilisons à nouveau la syntaxe objet.méthode() (présentée dans le chapitre 3 Affichage). Ici la
méthode .readlines() agit sur l’objet filin en déplaçant le curseur de lecture du début à la fin du fichier, puis
elle renvoie une liste contenant toutes les lignes du fichier (dans notre analogie avec un livre, ceci correspondrait à
lire toutes les lignes du livre).
• Ligne 6. Enfin, on applique la méthode .close() sur l’objet filin, ce qui, vous vous en doutez, ferme le fichier
(ceci reviendrait à fermer le livre). Vous remarquerez que la méthode .close() ne renvoie rien, mais modifie l’état
de l’objet filin en fichier fermé. Ainsi, si on essaie de lire à nouveau les lignes du fichier, Python renvoie une
erreur, car il ne peut pas lire un fichier fermé (lignes 7 à 10).
Vous voyez qu’en cinq lignes de code, vous avez lu, parcouru le fichier et affiché son contenu.
Remarque
• Chaque élément de la liste lignes est une chaîne de caractères. C’est en effet sous forme de chaînes de caractères
que Python lit le contenu d’un fichier.
• Chaque élément de la liste lignes se termine par le caractère \n. Ce caractère un peu particulier correspond au «
saut de ligne 1 » qui permet de passer d’une ligne à la suivante (en anglais line feed). Ceci est codé par un caractère
spécial que l’on représente par \n. Vous pourrez parfois rencontrer également la notation octale \012. Dans la
suite de cet ouvrage, nous emploierons aussi l’expression « retour à la ligne » que nous trouvons plus intuitive.
• Par défaut, l’instruction print() affiche quelque chose puis revient à la ligne. Ce retour à la ligne dû à print()
se cumule alors avec celui de la fin de ligne (\n) de chaque ligne du fichier et donne l’impression qu’une ligne est
sautée à chaque fois.
Il existe en Python le mot-clé with qui permet d’ouvrir et de fermer un fichier de manière efficace. Si pour une raison
ou une autre l’ouverture ou la lecture du fichier conduit à une erreur, l’utilisation de with garantit la bonne fermeture
du fichier, ce qui n’est pas le cas dans le code précédent. Voici donc le même exemple avec with :
1. [Link]
Remarque
• L’instruction with introduit un bloc d’instructions qui doit être indenté. C’est à l’intérieur de ce bloc que nous
effectuons toutes les opérations sur le fichier.
• Une fois sorti du bloc d’instructions, Python fermera automatiquement le fichier. Vous n’avez donc plus besoin
d’utiliser la méthode .close().
L’objet filin est « itérable », ainsi la boucle for va demander à Python d’aller lire le fichier ligne par ligne.
Conseil
Privilégiez cette méthode par la suite.
Remarque
Les méthodes abordées précédemment permettent d’accéder au contenu d’un fichier, soit ligne par ligne (méthode
.readline()), soit globalement en une seule chaîne de caractères (méthode .read()), soit globalement avec les lignes
différenciées sous forme d’une liste de chaînes de caractères (méthode .readlines()). Il est également possible en
Python de se rendre à un endroit particulier d’un fichier avec la méthode .seek() mais qui sort du cadre de cet ouvrage.
• Ligne 4. L’écriture formatée, vue au chapitre 3 Affichage, permet d’ajouter un retour à la ligne (\n) après le nom
de chaque animal.
• Lignes 6 à 8. Le nombre d’octets écrits dans le fichier est augmenté de 1 par rapport à l’exemple précédent, car
le caractère retour à la ligne compte pour un seul octet.
Le contenu du fichier [Link] est alors :
poisson
abeille
chat
Vous voyez qu’il est relativement simple en Python de lire ou d’écrire dans un fichier.
Dans cet exemple, with permet une notation très compacte en s’affranchissant de deux méthodes .close().
Si vous souhaitez aller plus loin, sachez que l’instruction with est plus générale et peut être utilisée dans d’autres
contextes 2 .
7.4 Note sur les retours à la ligne sous Unix et sous Windows
Conseil
Si vous êtes débutant, vous pouvez sauter cette rubrique.
On a vu plus haut que le caractère spécial \n correspondait à un retour à la ligne. C’est le standard sous Unix (Mac
OS X et Linux).
Toutefois, Windows utilise deux caractères spéciaux pour le retour à la ligne : \r correspondant à un retour chariot
(hérité des machines à écrire) et \n comme sous Unix.
Si vous avez commencé à programmer en Python 2, vous aurez peut-être remarqué que, selon les versions, la lecture
de fichier supprimait parfois les \r et d’autres fois les laissait. Heureusement, la fonction open() dans Python 3 3 gère
2. [Link]
3. [Link]
tout ça automatiquement et renvoie uniquement des sauts de ligne sous forme d’un seul \n (même si le fichier a été
conçu sous Windows et qu’il contient initialement des \r).
7.7 Exercices
Conseil
Pour ces exercices, créez des scripts puis exécutez-les dans un shell.
Les coordonnées cartésiennes xA et yA d’un point A sur un cercle de rayon r s’expriment en fonction de l’angle θ
représenté sur la figure 7.1 comme :
xA = cos(θ ) × r
yA = sin(θ ) × r
Pour calculer les coordonnées cartésiennes qui décrivent la spirale, vous allez faire varier deux variables en même
temps :
• l’angle θ , qui va prendre des valeurs de 0 à 4π radians par pas de 0,1, ce qui correspond à deux tours complets ;
• le rayon du cercle r, qui va prendre comme valeur initiale 0,5 puis que vous allez incrémenter (c’est-à-dire augmenter)
par pas de 0,1.
Les fonctions trigonométriques sinus et cosinus sont disponibles dans le module math que vous découvrirez plus en
détails dans le chapitre 9 Modules. Pour les utiliser, vous ajouterez au début de votre script l’instruction :
import math
La fonction sinus sera [Link]() et la fonction cosinus [Link](). Ces deux fonctions prennent comme argument
une valeur d’angle en radian. La constante mathématique π sera également accessible grâce à ce module via [Link].
Par exemple :
1 >>> [Link](0)
2 0.0
3 >>> [Link]([Link]/2)
4 1.0
5 >>> [Link]([Link])
6 -1.0
Sauvegardez ensuite les coordonnées cartésiennes dans le fichier [Link] en respectant le format suivant :
• un couple de coordonnées (xA et yA ) par ligne ;
• au moins un espace entre les deux coordonnées xA et yA ;
• les coordonnées affichées sur 10 caractères avec 5 chiffres après la virgule.
Les premières lignes de [Link] devrait ressembler à :
0.50000 0.00000
0.59700 0.05990
0.68605 0.13907
0.76427 0.23642
0.82895 0.35048
0.87758 0.47943
[...] [...]
Une fois que vous avez généré le fichier [Link], visualisez votre spirale avec le code suivant (que vous pouvez
recopier dans un autre script ou à la suite de votre script [Link]) :
1 import [Link] as plt
2
3 x = []
4 y = []
5 with open("[Link]", "r") as f_in:
6 for line in f_in:
7 coords = [Link]()
8 [Link](float(coords[0]))
9 [Link](float(coords[1]))
10
11 fig, ax = [Link](figsize=(8,8))
12 mini = min(x+y) - 2
13 maxi = max(x+y) + 2
14 ax.set_xlim(mini, maxi)
15 ax.set_ylim(mini, maxi)
16 [Link](x, y)
17 [Link]("[Link]")
Remarque
Le module matplotlib est utilisé ici pour la visualisation de la spirale. Son utilisation est détaillée dans le chapitre 21
Module matplotlib.
Essayez de jouer sur les paramètres θ et r, et leur pas d’incrémentation, pour construire de nouvelles spirales.
Dictionnaires et tuples
Dans ce chapitre, nous allons voir deux nouveaux types d’objet qui s’avèrent extrêmement utiles : les dictionnaires et
les tuples. Comme les listes vues dans le chapitre 4, les dictionnaires et tuples contiennent une collection d’autres objets.
Toutefois, nous verrons que ces trois types sont régis par des règles différentes pour accéder à leur contenu, ainsi que
dans leur fonctionnement.
8.1 Dictionnaires
8.1.1 Définition et fonctionnement
Définition
Un dictionnaire contient une collection d’objets Python auxquels on accède à l’aide d’une clé de correspondance
plutôt qu’un indice. Ainsi, il ne s’agit pas d’objets séquentiels comme les listes, mais plutôt d’objets dits de correspondance
(mapping objects en anglais) ou tableaux associatifs.
• Ligne 1. On définit un dictionnaire vide avec les accolades {} (tout comme on peut le faire pour les listes avec
[]).
• Lignes 2 à 4. On remplit le dictionnaire avec plusieurs clés ("nom", "taille", "poids") auxquelles on affecte
des valeurs ("girafe", 5.0, 1100).
• Ligne 5. On affiche le contenu du dictionnaire. Les accolades nous montrent qu’il s’agit bien d’un dictionnaire,
et pour chaque élément séparé par une virgule on a une association du type clé: valeur. Ici, les clés sont des
chaînes de caractères (ce qui sera souvent le cas), et les valeurs peuvent être n’importe quel objet Python.
Une fois le dictionnaire créé, on récupère la valeur associée à une clé donnée avec une syntaxe du type dictionnaire
["clé"]. Par exemple :
66
8.1. Dictionnaires Chapitre 8. Dictionnaires et tuples
1 >>> animal1["nom"]
2 'girafe'
3 >>> animal1["taille"]
4 5.0
On se souvient que pour accéder à l’élément d’une liste, il fallait utiliser un indice (par exemple, liste[2]). Ici,
l’utilisation d’une clé (qui est souvent une chaîne de caractères) rend les choses plus explicites.
Vous pouvez mettre autant de couples clé / valeur que vous voulez dans un dictionnaire (tout comme vous pouvez
ajouter autant d’éléments que vous le souhaitez dans une liste).
Remarque
Jusqu’à la version 3.6 de Python, un dictionnaire était affiché sans ordre particulier. L’ordre d’affichage des éléments
n’était pas forcément le même que celui dans lequel il avait été rempli. De même, lorsqu’on itérait dessus, l’ordre n’était
pas garanti. Depuis Python 3.7 (inclus), ce comportement a changé : un dictionnaire est toujours affiché dans le même
ordre que celui utilisé pour le remplir. Et si on itère sur un dictionnaire, cet ordre est aussi respecté. Ce détail provient de
l’implémentation interne des dictionnaires dans Python, mais cela nous concerne peu. Ce qui importe, c’est de se rappeler
qu’on accède aux éléments par leur clé, et non par leur position telle que le dictionnaire est affiché. Cet ordre n’a pas
d’importance, sauf dans de rares cas.
On peut aussi initialiser toutes les clés et les valeurs d’un dictionnaire en une seule opération :
1 >>> animal2 = {"nom": "singe", "poids": 70, "taille": 1.75}
Mais rien ne nous empêche d’ajouter une clé et une valeur supplémentaire :
1 >>> animal2["age"] = 15
2 >>> animal2
3 {'nom': 'singe', 'poids': 70, 'taille': 1.75, 'age': 15}
Après ce premier tour d’horizon, on perçoit l’avantage des dictionnaires : pouvoir retrouver des éléments par des noms
(clés) plutôt que par des indices.
Les humains retiennent mieux les noms que les chiffres. Ainsi, les dictionnaires se révèlent très pratiques lorsque vous
devez manipuler des structures complexes à décrire et que les listes présentent leurs limites. L’usage des dictionnaires
rend en général le code plus lisible. Par exemple, si nous souhaitions stocker les coordonnées (x, y, z) d’un point dans
l’espace, nous pourrions utiliser coors = [0, 1, 2] pour la version liste et coors = {"x": 0, "y": 1, "z": 2}
pour la version dictionnaire. Quelqu’un qui lit le code comprendra tout de suite que coors["z"] contient la coordonnée
z, ce sera moins intuitif avec coors[2].
Conseil
Nous verrons dans le chapitre 14 Conteneurs que plusieurs types d’objets sont utilisables en tant que clé de dictionnaire.
Malgré cela, nous conseillons de n’utiliser que des chaînes de caractères lorsque vous débutez.
Par défaut, l’itération sur un dictionnaire se fait sur les clés. Dans cet exemple, la variable d’itération key prend
successivement la valeur de chaque clé, animal2[key] donne la valeur correspondant à chaque clé.
Les mentions dict_keys et dict_values indiquent que nous avons à faire à des objets un peu particuliers. Ils ne
sont pas indexables (on ne peut pas retrouver un élément par indice, par exemple [Link]()[0] renverra une erreur).
Si besoin, nous pouvons les transformer en liste avec la fonction list() :
1 >>> [Link]()
2 dict_values(['singe', 70, 1.75])
3 >>> list([Link]())
4 ['singe', 70, 1.75]
Toutefois, on peut itérer dessus dans une boucle (on dit qu’ils sont itérables) :
1 >>> for cle in [Link]():
2 ... print(cle)
3 ...
4 nom
5 poids
6 taille
On ne peut pas retrouver un élément par son indice dans un objet dict_items, toutefois on peut itérer dessus :
1 >>> [Link]()[2]
2 Traceback (most recent call last):
3 File "<stdin>", line 1, in <module>
4 TypeError: 'dict_items' object is not subscriptable
5 >>> for key, val in [Link]():
6 ... print(key, val)
7 ...
8 0 t
9 1 o
10 2 t
11 3 o
Notez la syntaxe particulière qui ressemble à la fonction enumerate() vue au chapitre 5 Boucles et comparaisons.
On itère à la fois sur key et sur val. Nous aurons l’explication de ce mécanisme dans la rubrique sur les tuples ci-après.
Dans le second test (lignes 10 à 12), le message n’est pas affiché car la clé age n’est pas présente dans le dictionnaire
animal2.
Si on souhaite tester si une valeur existe dans un dictionnaire, on peut utiliser l’opérateur in avec l’objet renvoyé par
la méthode .values() :
1 >>> animal2 = {'nom': 'singe', 'poids': 70, 'taille': 1.75}
2 >>> [Link]()
3 dict_values(['singe', 70, 1.75])
4 >>> "singe" in [Link]()
5 True
La méthode .get() s’affranchit de ce problème. Elle extrait la valeur associée à une clé mais ne renvoie pas d’erreur
si la clé n’existe pas :
1 >>> [Link]("nom")
2 'singe'
3 >>> [Link]("age")
4 >>>
Ici, la valeur associée à la clé nom est singe, mais la clé age n’existe pas. On peut également indiquer à .get() une
valeur par défaut si la clé n’existe pas :
1 >>> [Link]("age", 42)
2 42
Vous constatez ainsi que les dictionnaires permettent de gérer des structures complexes de manière plus explicite que
les listes.
8.2 Tuples
8.2.1 Définition
Définition
Les tuples (« n-uplets » en français) sont des objets séquentiels correspondant aux listes, mais ils sont toutefois
non modifiables. On dit aussi qu’ils sont immuables. Vous verrez ci-dessous que nous les avons déjà croisés à plusieurs
reprises !
Pratiquement, on utilise les parenthèses au lieu des crochets pour les créer :
1 >>> tuple1 = (1, 2, 3)
2 >>> tuple1
3 (1, 2, 3)
4 >>> type(tuple1)
5 <class 'tuple'>
6 >>> tuple1[2]
7 3
8 >>> tuple1[0:2]
9 (1, 2)
10 >>> tuple1[2] = 15
11 Traceback (most recent call last):
12 File "<stdin>", line 1, in <module>
13 TypeError: 'tuple' object does not support item assignment
L’affectation et l’indiçage fonctionnent comme avec les listes. Mais si on essaie de modifier un des éléments du tuple
(en ligne 10), Python renvoie un message d’erreur car les tuples sont non modifiables. Si vous voulez ajouter un élément
(ou le modifier), vous devez créer un nouveau tuple :
1 >>> tuple1 = (1, 2, 3)
2 >>> tuple1
3 (1, 2, 3)
4 >>> tuple1 = tuple1 + (2,)
5 >>> tuple1
6 (1, 2, 3, 2)
Conseil
Cet exemple montre que les tuples sont peu adaptés lorsqu’on a besoin d’ajouter, retirer, modifier des éléments. La
création d’un nouveau tuple à chaque étape s’avère lourde et il n’y a aucune méthode pour faire cela puisque les tuples
sont non modifiables. Pour ce genre de tâche, les listes sont clairement mieux adaptées.
Remarque
Pour créer un tuple d’un seul élément comme ci-dessus, utilisez une syntaxe avec une virgule (element,), pour
éviter une ambiguïté avec une simple expression. Par exemple, (2) équivaut à l’entier 2, alors que l’expression (2,) est
un tuple contenant l’élément 2.
Autre particularité des tuples, il est possible de les créer sans les parenthèses, dès lors que ceci ne pose pas d’ambiguïté
avec une autre expression :
1 >>> tuple1 = (1, 2, 3)
2 >>> tuple1
3 (1, 2, 3)
4 >>> tuple1 = 1, 2, 3
5 >>> tuple1
6 (1, 2, 3)
Toutefois, afin d’éviter les confusions, nous vous conseillons d’utiliser systématiquement les parenthèses lorsque vous
débutez.
Les opérateurs + et * fonctionnent comme pour les listes (concaténation et duplication) :
1 >>> (1, 2) + (3, 4)
2 (1, 2, 3, 4)
3 >>> (1, 2) * 4
4 (1, 2, 1, 2, 1, 2, 1, 2)
Enfin, on peut utiliser la fonction tuple(sequence) qui fonctionne exactement comme la fonction list(), c’est-
à-dire qu’elle prend en argument un objet et renvoie le tuple correspondant (opération de casting) :
1 >>> tuple([1,2,3])
2 (1, 2, 3)
3 >>> tuple("ATGCCGCGAT")
4 ('A', 'T', 'G', 'C', 'C', 'G', 'C', 'G', 'A', 'T')
5 >>> tuple(range(5))
6 (0, 1, 2, 3, 4)
Remarque
Comme la fonction list(), la fonction tuple() prend en argument un objet contenant d’autres objets. Elle ne
fonctionne pas avec les entiers, floats ou booléens. Par exemple, tuple(2) renvoie une erreur. On en verra plus sur ces
questions dans le chapitre 14 Conteneurs.
Attention, le nombre de variables et de valeurs doit être cohérents à gauche et à droite de l’opérateur = :
1 >>> x, y = 1, 2, 3
2 Traceback (most recent call last):
3 File "<stdin>", line 1, in <module>
4 ValueError: too many values to unpack (expected 2)
Il est aussi possible de faire des affectations multiples avec des listes, par exemple :
[x, y, z] = [1, 2, 3].
Toutefois, cette syntaxe est alourdie par la présence des crochets. On préfèrera donc la syntaxe avec les tuples sans
parenthèses.
Remarque
Nous avons appelé l’opération x, y, z = 1, 2, 3 affectation multiple pour signifier que l’on affectait des valeurs
à plusieurs variables en même temps.
Vous pourrez rencontrer aussi l’expression tuple unpacking que l’on pourrait traduire par « désempaquetage de tuple
». De même, il existe le list unpacking.
Ce terme tuple unpacking provient du fait que l’on peut décomposer un tuple initial de n éléments en autant de
variables différentes en une seule instruction.
Par exemple, si on crée un tuple de trois éléments :
Cela serait possible également avec l’indiçage, mais il faudrait utiliser autant d’instruction que d’éléments :
1 >>> x = tuple1[0]
2 >>> y = tuple1[1]
3 >>> z = tuple1[2]
Conseil
La syntaxe x, y, z = tuple1 pour désempaqueter un tuple est plus élégante, plus lisible et plus compacte. Elle
sera donc à privilégier.
L’affectation multiple est un mécanisme très puissant et important en Python. Nous verrons qu’il est particulièrement
utile avec les fonctions dans les chapitres 10 Fonctions et 13 Plus sur les fonctions.
Lignes 7 à 12. La fonction enumerate() itère sur une série de tuples. Pouvoir séparer indice et element dans la
boucle est possible avec l’affectation multiple, par exemple : indice, element = 0, 75 (voir rubrique précédente).
Dans le même ordre d’idée, nous avons déjà vu la méthode .items() qui permettait d’itérer sur des couples clé /
valeur d’un dictionnaire :
1 >>> dico = {"pinson": 2, "merle": 3}
2 >>> for cle, valeur in [Link]():
3 ... print(cle, valeur)
4 ...
5 pinson 2
6 merle 3
7 >>> for bidule in [Link]():
8 ... print(bidule, type(bidule))
9 ...
10 ('pinson', 2) <class 'tuple'>
11 ('merle', 3) <class 'tuple'>
On pourrait concevoir la même chose sur quatre ou cinq éléments, voire plus. La seule contrainte est d’avoir une
correspondance systématique entre le nombre de variables d’itération (par exemple trois variables dans l’exemple ci-dessus
avec x, y, z) et la longueur de chaque sous-tuple de la liste sur laquelle on itère (dans l’exemple ci-dessus, chaque
sous-tuple a trois éléments).
En utilisant l’affectation multiple, on peut ainsi récupérer à la volée le quotient et le reste en une seule ligne :
1 >>> quotient, reste = divmod(3, 4)
2 >>> quotient
3 0
4 >>> reste
5 3
Cette fonction est très pratique, notamment quand on souhaite convertir des secondes en minutes et secondes
résiduelles. Par exemple, si on veut convertir 754 secondes en minutes :
1 >>> 754 / 60
2 12.566666666666666
3 >>> divmod(754, 60)
4 (12, 34)
La division normale nous donne un float en minutes qui n’est pas très pratique, il faut encore convertir 0.566666666666666
minute en secondes et gérer les problèmes d’arrondi. La fonction divmod() renvoie le résultat directement : 12 min et
34 s. On pourrait raisonner de manière similaire pour convertir des minutes en heures, des heures en jours, etc.
8.3 Exercices
Conseil
Pour le premier exercice, utilisez l’interpréteur Python. Pour les suivants, créez des scripts puis exécutez-les dans un
shell.
Prédisez le comportement de chaque instruction ci-dessous, sans les recopier dans un script ni dans l’interpréteur
Python :
• print(dico["age"])
• print(dico[var])
• print(dico[24])
• print(dico["var"])
• print(dico["taille"])
Lorsqu’une instruction produit une erreur, identifiez pourquoi. Vérifiez ensuite vos prédictions en recopiant les ins-
tructions dans l’interpréteur Python.
Calculez la moyenne de ses notes de deux manières différentes. Calculez à nouveau la moyenne sans la note de biologie.
On souhaite convertir la séquence en acide aminé du domaine transmembranaire d’une intégrine humaine SNADVVYEKQMLYLYVLSGIGG
en une série de signes indiquant la nature des acides aminés (a, p, + et -). Affichez tout d’abord la séquence sur une
ligne, puis la nature des acides aminés sur une seconde ligne.
La séquence contient une hélice transmembranaire, donc une succession de résidus apolaires, essayez de la retrouver
visuellement.
Pour cet exercice, nous vous conseillons d’itérer sur la chaîne de caractères contenant la séquence. Nous reverrons
cela dans le chapitre 11 Plus sur les chaînes de caractères.
Modules
9.1 Définition
Les modules sont des programmes Python qui contiennent des fonctions que l’on est amené à souvent réutiliser (on
les appelle aussi bibliothèques, ou libraries en anglais). Ce sont des « boîtes à outils » qui vous seront très utiles.
Les développeurs de Python ont mis au point de nombreux modules qui effectuent différentes tâches. Pour cette
raison, prenez toujours le réflexe de vérifier si une partie du code que vous souhaitez écrire n’existe pas déjà sous forme
de module.
La plupart de ces modules sont déjà installés dans les versions standards de Python. Vous pouvez accéder à une
documentation exhaustive 1 sur le site de Python. N’hésitez pas à explorer un peu ce site, la quantité de modules
disponibles est impressionnante (plus de 300 modules).
1. [Link]
2. [Link]
76
9.2. Importation de modules Chapitre 9. Modules
En résumé, l’utilisation de la syntaxe import module permet d’importer tout une série de fonctions organisées par
« thèmes ». Par exemple, les fonctions gérant les nombres aléatoires avec random et les fonctions mathématiques avec
math. Python possède de nombreux autres modules internes (c’est-à-dire présent de base lorsqu’on installe Python).
Remarque
Dans le chapitre 3 Affichage, nous avons introduit la syntaxe [Link]() avec truc étant un objet et .bidule()
une méthode. Nous vous avions expliqué qu’une méthode était une fonction un peu particulière :
• elle était liée à un objet par un point ;
• en général, elle agissait sur ou utilisait l’objet auquel elle était liée.
Par exemple, la méthode .append() vue dans le chapitre 4 Listes. Dans l’instruction [Link](3), la méthode
.append() ajoute l’entier 3 à l’objet liste1 auquel elle est liée.
Avec les modules, nous rencontrons une syntaxe similaire. Par exemple, dans l’instruction [Link](), on pourrait
penser que .cos() est aussi une méthode. En fait la documentation officielle de Python 3 précise bien que dans ce cas
.cos() est une fonction. Dans cet ouvrage, nous utiliserons ainsi le mot fonction lorsqu’on évoquera des fonctions issues
de modules.
Si cela vous parait encore ardu, ne vous inquiétez pas : c’est à force de pratiquer et de lire que vous vous approprierez
le vocabulaire. La syntaxe [Link]() est là pour rappeler de quel module provient la fonction en un coup
d’œil.
À l’aide du mot-clé from, on peut importer une fonction spécifique d’un module donné. Remarquez bien qu’il est
inutile de répéter le nom du module dans ce cas : seul le nom de la fonction en question est requis.
On peut également importer toutes les fonctions d’un module :
1 >>> from random import *
2 >>> randint(0,50)
3 46
4 >>> uniform(0,2.5)
5 0.64943174760727951
L’instruction from random import * importe toutes les fonctions du module random. On peut utiliser toutes ses
fonctions directement, comme par exemple randint() et uniform() qui renvoient des nombres aléatoires entiers et
floats.
Dans la pratique, plutôt que de charger toutes les fonctions d’un module en une seule fois :
1 from random import *
Il est également possible de définir un alias (un nom plus court) pour un module :
3. [Link]
Dans cet exemple, les fonctions du module random sont accessibles via l’alias rand.
Enfin, pour vider de la mémoire un module déjà chargé, on peut utiliser l’instruction del :
1 >>> import random
2 >>> [Link](0,10)
3 2
4 >>> [Link](1, 3)
5 2.825594756352219
6 >>> del random
7 >>> [Link](0,10)
8 Traceback (most recent call last):
9 File "<stdin>", line 1, in ?
10 NameError: name 'random' is not defined. Did you forget to import 'random'?
On constate alors qu’un rappel (ligne 7) d’une fonction du module random, après l’avoir vidé de la mémoire (ligne 6),
retourne un message d’erreur (lignes 8-10). Dans le cas présent, le message d’erreur est explicite et demande à l’utilisateur
s’il n’a pas oublié d’importer le module random.
Ce qui renvoie :
Help on module random:
NAME
random - Random variable generators.
MODULE REFERENCE
[Link]
DESCRIPTION
integers
--------
uniform within range
sequences
---------
pick random element
pick random sample
Remarque
• Pour vous déplacer dans l’aide, utilisez les flèches du haut et du bas pour le parcourir ligne par ligne, ou les touches
Page-up et Page-down pour faire défiler l’aide page par page.
• Pour quitter l’aide, appuyez sur la touche Q.
• Pour chercher du texte, tapez le caractère / puis le texte que vous cherchez, puis la touche Entrée. Par exemple,
pour chercher l’aide sur la fonction randint(), tapez /randint puis Entrée.
• Vous pouvez également obtenir de l’aide sur une fonction particulière d’un module avec :
help([Link])
La commande help() est en fait une commande plus générale, permettant d’avoir de l’aide sur n’importe quel objet
chargé en mémoire :
1 >>> t = [1, 2, 3]
2 >>> help(t)
3 Help on list object:
4
5 class list(object)
6 | list() -> new list
7 | list(sequence) -> new list initialized from sequence's items
8 |
9 | Methods defined here:
10 |
11 | __add__(...)
12 | x.__add__(y) <==> x+y
13 |
14 |
15 ...
Enfin, pour connaître d’un seul coup d’œil toutes les méthodes ou variables associées à un objet, utilisez la fonction
dir() :
1 >>> import random
2 >>> dir(random)
3 ['BPF', 'LOG4', 'NV_MAGICCONST', 'RECIP_BPF', 'Random', 'SG_MAGICCONST',
4 'SystemRandom', 'TWOPI', 'WichmannHill', '_BuiltinMethodType', '_MethodT
5 ype', '__all__', '__builtins__', '__doc__', '__file__', '__name__', '_ac
6 os', '_ceil', '_cos', '_e', '_exp', '_hexlify', '_inst', '_log', '_pi',
7 '_random', '_sin', '_sqrt', '_test', '_test_generator', '_urandom', '_wa
8 rn', 'betavariate', 'choice', 'expovariate', 'gammavariate', 'gauss', 'g
9 etrandbits', 'getstate', 'jumpahead', 'lognormvariate', 'normalvariate',
10 'paretovariate', 'randint', 'random', 'randrange', 'sample', 'seed', 's
11 etstate', 'shuffle', 'uniform', 'vonmisesvariate', 'weibullvariate']
12 >>>
4. [Link]
5. [Link]
6. [Link]
7. [Link]
8. [Link]
9. [Link]
10. [Link]
11. [Link]
12. [Link]
Vous verrez dans le chapitre 15 Création de modules comment créer votre propre module lorsque vous souhaitez
réutiliser souvent vos propres fonctions.
Enfin, notez qu’il existe de nombreux autres modules externes qui ne sont pas installés de base dans Python, mais
qui sont très utilisés en bioinformatique et en analyse de données. Par exemple : NumPy (manipulations de vecteurs
et de matrices), Biopython (manipulation de séquences ou de structures de biomolécules), matplotlib (représentations
graphiques), pandas (analyse de données tabulées), etc. Ces modules vous serons présentés dans les chapitres 19 à 22.
La fonction choices() (avec un s à la fin) réalise plusieurs tirages aléatoires (avec remise, c’est-à-dire qu’on peut
piocher plusieurs fois le même élément) dans une liste donnée. Le nombre de tirages est précisé par le paramètre k :
1 >>> [Link](bases, k=5)
2 ['G', 'A', 'A', 'T', 'G']
3 >>> [Link](bases, k=5)
4 ['A', 'T', 'A', 'A', 'C']
5 >>> [Link](bases, k=10)
6 ['C', 'T', 'T', 'T', 'G', 'A', 'C', 'A', 'G', 'G']
Si vous exécutez vous-même les exemples précédents, vous devriez obtenir des résultats légèrement différents de ceux
indiqués.
Pour des besoins de reproductibilité des analyses en science, on a souvent besoin de retrouver les mêmes résultats
même si on utilise des nombres aléatoires. Pour cela, on peut définir ce qu’on appelle la « graine aléatoire ».
Définition
En informatique, la génération de nombres aléatoires est un problème complexe. On utilise plutôt des « générateurs
de nombres pseudo-aléatoires 14 ». Pour cela, une graine aléatoire 15 doit être définie. Cette graine est la plupart du temps
un nombre entier qu’on passe au générateur : celui-ci va alors produire une série donnée de nombres pseudo-aléatoires
qui dépendent de cette graine. Si on change la graine, la série de nombres change.
13. [Link]
14. [Link]
15. [Link]
Ici, la graine aléatoire est fixée à 42. Si on ne précise pas la graine, par défaut Python utilise la date (plus précisément,
il s’agit du nombre de secondes écoulées depuis une date fixe passée). Ainsi, à chaque fois qu’on relance Python, la graine
sera différente, car ce nombre de secondes sera différent.
Si vous exécutez ces mêmes lignes de code (depuis l’instruction [Link](42)), il se peut que vous ayez des
résultats différents selon la version de Python. Néanmoins, vous devriez systématiquement obtenir les mêmes résultats si
vous relancez plusieurs fois de suite ces instructions sur une même machine.
Remarque
Quand on utilise des nombres aléatoires, il est fondamental de connaitre la distribution de probablités utilisée par la
fonction.
Par exemple, la fonction de base du module random est [Link](), elle renvoie un float aléatoire entre 0 et
1 tiré dans une distribution uniforme. Si on tire beaucoup de nombres, on aura la même probabilité d’obtenir tous les
nombres possibles entre 0 et 1. La fonction [Link]() tire aussi un entier dans une distribution uniforme. La
fonction [Link]() tire quant à elle un float aléatoire dans une distribution gaussienne.
• Ligne 1. Le caractère $ représente l’invite du shell, [Link] est le nom du script Python, salut, girafe et 42
sont les arguments passés au script (tous séparés par un espace).
• Ligne 2. Le script affiche le contenu de la variable [Link]. Cette variable est une liste qui contient tous les
arguments de la ligne de commande, y compris le nom du script Python lui-même qu’on retrouve comme premier
élément de cette liste dans [Link][0]. On peut donc accéder à chacun des différents arguments du script avec
[Link][1], [Link][2], etc.
Toujours dans le module sys, la fonction [Link]() est utile pour quitter un script Python. On peut donner un
argument à cette fonction (en général une chaîne de caractères) qui sera renvoyé au moment où Python quittera le script.
Par exemple, si vous attendez au moins un argument en ligne de commande, vous pouvez renvoyer un message pour
indiquer à l’utilisateur ce que le script attend comme argument :
1 import sys
2
3 if len([Link]) != 2:
4 [Link]("ERREUR : il faut exactement un argument.")
5
6 print(f"Argument vaut : {[Link][1]}")
16. [Link]
Remarque
On vérifie dans cet exemple que le script possède deux arguments, car le nom du script lui-même compte pour un
argument (le tout premier).
L’intérêt de récupérer des arguments passés dans la ligne de commande à l’appel du script est de pouvoir ensuite les
utiliser dans le script.
Voici comme nouvel exemple le script compte_lignes.py, qui prend comme argument le nom d’un fichier puis
affiche le nombre de lignes qu’il contient :
1 import sys
2
3 if len([Link]) != 2:
4 [Link]("ERREUR : il faut exactement un argument.")
5
6 nom_fichier = [Link][1]
7 taille = 0
8 with open(nom_fichier, "r") as f_in:
9 taille = len(f_in.readlines())
10
11 print(f"{nom_fichier} contient {taille} lignes.")
Supposons que dans le même répertoire, nous ayons le fichier [Link] dont voici le contenu :
girafe
tigre
singe
souris
Par contre, le script ne vérifie pas si le fichier fourni en argument existe bien :
$ python compte_lignes.py [Link]
Traceback (most recent call last):
File "compte_lignes.py", line 8, in <module>
with open(nom_fichier, "r") as f_in:
^^^^^^^^^^^^^^^^^^^^^^
FileNotFoundError: [Errno 2] No such file or directory: '[Link]'
Dans cet exemple, si le fichier n’existe pas sur le disque dur, on quitte le programme avec la fonction exit() du
module sys que nous venons de voir.
La méthode .cwd() renvoie le chemin complet du répertoire depuis lequel est lancé Python (cwd signifiant current
working directory) :
1 >>> from pathlib import Path
2 >>> Path().cwd()
3 PosixPath('/home/pierre')
On obtient un objet de type PosixPath qu’il est possible de transformer si besoin en chaîne de caractères avec la
fonction str(), que nous avons vu dans le chapitre 2 Variables :
1 >>> str(Path().cwd())
2 '/home/pierre'
Mais l’intérêt de récupérer un objet de type PosixPath est qu’on peut ensuite utiliser les méthodes .name et .parent
pour obtenir respectivement le nom du répertoire (sans son chemin complet) et le répertoire parent :
1 >>> Path().cwd()
2 PosixPath('/home/pierre')
3 >>> Path().cwd().name
4 'pierre'
5 >>> Path().cwd().parent
6 PosixPath('/home')
Enfin, la méthode .iterdir() donne accès au contenu du répertoire depuis lequel est lancé Python :
1 >>> list(Path().iterdir())
2 [PosixPath('[Link]'), PosixPath('tests'), PosixPath('[Link]')]
Tout comme la fonction range() (voir le chapitre 4 Listes), la méthode .iterdir() est un itérateur. La fonction
list() permet d’obtenir une liste.
Toutefois, il est possible d’itérer très facilement sur le contenu d’un répertoire et de savoir s’il contient des fichiers
ou des sous-répertoires :
17. [Link]
La méthode .is_file() renvoie True si l’objet est un fichier, et False si ce n’est pas le cas.
La méthode .iterdir() parcourt le contenu d’un répertoire, sans en explorer les éventuels sous-répertoires. Si on
souhaite parcourir récursivement un répertoire, on utilise la méthode .glob(). Prenons l’arborescence suivante comme
exemple :
[Link]
[Link]
tests
├── [Link]
├── [Link]
└── [Link]
Le répertoire courant contient les fichiers [Link] et [Link], ainsi que le répertoire tests. Ce dernier contient
lui-même les fichiers [Link], [Link] et [Link].
On souhaite maintenant lister tous les scripts Python (dont l’extension est .py) présents dans le répertoire courant
et dans ses sous-répertoires :
1 >>> for nom in Path().glob("**/*.py"):
2 ... print(f"{nom}")
3 ...
4 [Link]
5 tests/[Link]
6 tests/[Link]
Dans la chaîne de caractères "**/*.py", ** recherche tous les sous-répertoires récursivement et *.py signifie
n’importe quel nom de fichier qui se termine par l’extension .py.
Il existe de nombreuse autres méthodes associées à la classe Path du module pathlib, n’hésitez pas à consulter la
documentation 18 .
9.8 Exercices
Conseil
Pour les trois premiers exercices, utilisez l’interpréteur Python. Pour les exercices suivants, créez des scripts puis
exécutez-les dans un shell.
9.8.2 Cosinus
Calculez le cosinus de π /2 en utilisant le module math avec la fonction cos() et la constante pi.
Consultez pour cela la documentation 20 de la fonction [Link]() et la documentation 21 de la constante [Link].
Conseil
• Jetez un oeil à la rubrique sur la comparaison de floats abordée dans le chapitre 6 Tests.
• Les constantes π et e sont obtenues par [Link] et math.e.
$ python [Link]
La main est ['7', 'A', '9', 'A', 'R', 'd', 'V', 'D'].
7 --> 0 points
A --> 11 points
9 --> 0 points
A --> 11 points
R --> 4 points
d --> 10 points
V --> 2 points
D --> 3 points
Le nombre total de points de la main est 41.
Conseil
Pour générer la séquence d’ADN, utilisez la fonction [Link]() abordée dans l’exercice précédent.
aire du cercle π
p= =
aire du carré 4
Soit n, le nombre de points effectivement dans le cercle, il vient alors
n π
p= = ,
N 4
d’où
n
π = 4× .
N
Déterminez une approximation de π par cette méthode. Pour cela, pour N itérations :
1. Choisissez aléatoirement les coordonnées x et y d’un point entre -1 et 1. Utilisez la fonction uniform() du module
random.
2. Calculez la distance entre le centre du cercle et ce point.
3. Déterminez si cette distance est inférieure au rayon du cercle, c’est-à-dire si le point est dans le cercle ou pas.
4. Si le point est effectivement dans le cercle, incrémentez le compteur n.
Finalement calculez le rapport entre n et N et proposez une estimation de π . Quelle valeur de π obtenez-vous pour
100 itérations ? 1000 itérations ? 10 000 itérations ? Comparez les valeurs obtenues à la valeur de π fournie par le module
math.
On rappelle que la distance d entre deux points A et B de coordonnées respectives (xA , yA ) et (xB , yB ) se calcule
comme :
√
d = (xB − xA )2 + (yB − yA )2
25. [Link]