Guide Python L2 : Fichiers, JSON et Pandas
Document de révision pour les épreuves universitaires.
1. Gestion des fichiers texte
Ouverture de fichier avec open().
Modes principaux :
- r : lecture
- w : écriture (écrase le contenu)
- a : ajout à la fin
Bonne pratique :
with open('[Link]', 'r') as f:
contenu = [Link]()
Méthodes importantes :
- read() : lit tout le fichier
- readline() : lit une seule ligne
- write() : écrit une chaîne
- writelines() : écrit une liste de chaînes
Toujours utiliser with pour fermer automatiquement le fichier.
2. JSON
JSON permet de stocker des données structurées.
import json
Écrire :
[Link](data, fichier, indent=4)
Lire :
[Link](fichier)
Ajouter un élément :
1. Charger avec load()
2. Modifier la liste avec append()
3. Réécrire avec dump()
À retenir :
dump/load travaillent avec des fichiers.
dumps/loads travaillent avec des chaînes de caractères.
3. Pandas et DataFrame
import pandas as pd
Création :
df = [Link](data)
Un DataFrame ressemble à une feuille Excel :
- lignes
- colonnes
- index
Exploration :
[Link]()
[Link]()
[Link]()
[Link]()
[Link]
[Link]
[Link]
4. Sélection et filtrage
Sélection d'une colonne :
df['Nom']
Filtrer :
df[df['Age'] > 20]
Combiner plusieurs conditions :
df[(df['Age'] > 20) & (df['Note'] >= 15)]
5. Statistiques
Moyenne :
df['Note'].mean()
Maximum :
df['Note'].max()
Minimum :
df['Note'].min()
Somme :
df['Note'].sum()
Nombre de valeurs :
df['Note'].count()
6. Recherche du meilleur étudiant
Indice de la note maximale :
df['Note'].idxmax()
Ligne complète :
[Link][df['Note'].idxmax()]
7. GroupBy
Regrouper par ville :
[Link]('Ville')
Moyenne des notes :
[Link]('Ville')['Note'].mean()
Plusieurs agrégations :
[Link]('Ville')['Note'].agg(
['mean', 'max', 'min', 'count']
)
Agrégations multiples :
[Link]('Ville').agg({
'Note': ['mean', 'max'],
'Age': ['mean', 'min']
})
8. Méthode de résolution des sujets
Questions fréquentes :
- Afficher les premiers étudiants -> head()
- Calculer une moyenne -> mean()
- Trouver le meilleur -> idxmax()
- Filtrer -> condition booléenne
- Grouper -> groupby()
Réflexe examen :
1. Identifier les données
2. Choisir la bonne méthode Pandas
3. Tester mentalement le résultat
4. Afficher le résultat