Master d’excellence académique
Management Digital de l’Agrobusiness Alimentaire
2025-2026
Outils de Traitement et de
Visualisation de Données en Python
Réalisé par :
Brahim Bouzaneur
Mohammed Oudenni
Yassine Ouharrou Encadré par :
Jirari Khadija Professeur: FACOITI HASSAN
Ennaciri Soukayna
Plan de l'Exposé
01 INTRODUCTION 05 Étude de cas : Agrobusiness Alimentaire
02 Python comme langage de traitement de données 06 Limites et perspectives
03 Outils de traitement de données 07 Conclusion
04 Outils de visualisation de données
2 / 22
1. Introduction
CONTEXTE ET ENJEUX
L'agrobusiness génère chaque jour de grandes quantités de données (prix, production, qualité, logistique).
Analyser ces données permet de prendre de meilleures décisions et d'optimiser la chaîne alimentaire.
Python est aujourd'hui l'un des outils les plus utilisés pour traiter et visualiser ces données.
Cet exposé présente les bibliothèques Python essentielles et leur application au secteur alimentaire.
Référence : McKinsey Global Institute, 2023 – The data economy in agrifood systems. 3 / 22
1. Introduction – Objectifs de l'exposé
TROIS OBJECTIFS PRINCIPAUX
1 2 3
APPLIQUER SUR UN CAS
COMPRENDRE PYTHON MAÎTRISER LES OUTILS
RÉEL
Identifier pourquoi Python est Présenter les bibliothèques de Analyser des données agricoles avec
adapté à la data science dans le traitement (Pandas, NumPy) et de une étude de cas concrète.
secteur alimentaire. visualisation (Matplotlib, Seaborn).
4 / 22
2. Python – Présentation générale
UN LANGAGE POLYVALENT ET PUISSANT
★ CRÉÉ EN 1991 – par Guido van Rossum. Version actuelle : Python 3.x.
★ SYNTAXE SIMPLE –Facile à apprendre, même pour les non-informaticiens.
★ OPEN-SOURCE – Gratuit et soutenu par une grande communauté mondiale.
★ TRÈS UTILISÉ EN
DATA –
Classé n°1 en data science selon l'enquête Stack Overflow 2023.
Référence : Stack Overflow Developer Survey 2023 – [Link]/survey/2023 5 / 22
2. Python – Pourquoi pour l'agrobusiness ?
GRATUIT ÉCOSYSTÈME RICHE
Aucune licence à payer, contrairement à Excel ou SAS. Plus de 300 000 bibliothèques disponibles sur PyPI.
AUTOMATISATION FLEXIBILITÉ
Automatise les tâches répétitives (nettoyage, rapports). Traite des fichiers CSV, Excel, bases de données, API.
COMMUNAUTÉ ACTIVE INTÉGRATION BI
Forums, tutoriels, cours en ligne disponibles partout. Compatible avec Tableau, Power BI, Jupyter Notebooks.
Référence : Python Software Foundation, 2024 – [Link] 6 / 22
3. Outils de Traitement de Données
NUMPY · PANDAS · SCIPY · SCIKIT-LEARN
7 / 22
3. Outils de traitement – NumPy
CALCUL NUMÉRIQUE RAPIDE ET EFFICACE
import numpy as np
NumPy (Numerical Python) est la base du calcul scientifique en Python.
# Tableau de rendements (t/ha)
rendements = [Link](
[3.2, 4.1, 2.8, 5.0])
Il permet de créer des tableaux (arrays) et d'effectuer des calculs
mathématiques sur de grandes données. moy = [Link](rendements)
print(moy) # 3.775
Avantages : très rapide, utilise peu de mémoire, facile à combiner avec
Pandas.
APPLICATIONS EN AGROBUSINESS :
Calcul de moyennes de rendement, statistiques de qualité des aliments, modèles
de prévision des prix.
Référence : Harris et al., 2020 – Array programming with NumPy. Nature, 585, 357–362. 8 / 22
3. Outils de traitement – Pandas
LA BIBLIOTHÈQUE INCONTOURNABLE POUR LES TABLEAUX DE DONNÉES
DATAFRAME LECTURE DE FICHIERS
Structure de tableau similaire à Excel. Lignes et colonnes
Lit CSV, Excel, SQL, JSON facilement avec pd.read_csv().
nommées.
NETTOYAGE AGRÉGATION
Supprime les valeurs manquantes, corrige les erreurs, filtre les Calcule des moyennes, sommes, groupes par catégorie
données. (groupby).
Référence : McKinney, W., 2022 – Python for Data Analysis. O'Reilly Media, 3ème éd. 9 / 22
3. Outils de traitement – SciPy & Scikit-learn
SCIPY SCIKIT-LEARN
Machine Learning : classification, régression,
Statistiques avancées : tests t, ANOVA, corrélation.
clustering.
Optimisation de fonctions et résolution d'équations. Prédiction des prix des matières premières agricoles.
Détection d'anomalies dans les processus de
Utile pour les analyses de qualité alimentaire.
production.
Référence : Pedregosa et al., 2011 – Scikit-learn: Machine Learning in Python. JMLR 12, 2825–2830. 10 / 22
4. Outils de Visualisation de Données
MATPLOTLIB · SEABORN · PLOTLY · BOKEH
11 / 22
4. Visualisation – Matplotlib
LA BIBLIOTHÈQUE DE BASE POUR CRÉER DES GRAPHIQUES
GRAPHIQUE EN BARRES COURBE TEMPORELLE
Comparaison de productions par région ou par produit. Évolution des prix agricoles au cours du temps.
HISTOGRAMME DIAGRAMME CIRCULAIRE
Distribution des poids ou des quantités livrées. Part de marché par filière alimentaire.
Référence : Hunter, J.D., 2007 – Matplotlib: A 2D Graphics Environment. Computing in Science & Engineering, 9(3), 90–95. 12 / 22
4. Visualisation – Seaborn & Plotly
SEABORN PLOTLY
Graphiques statistiques élégants en quelques lignes Graphiques interactifs : zoom, filtre, info-bulle au
de code. survol.
Heatmaps : visualiser des corrélations entre variables. Idéal pour les tableaux de bord (dashboards) en ligne.
Boxplots : analyser la variabilité des rendements Cartes géographiques des zones de production
agricoles. agricole.
Référence : Waskom, M., 2021 – Seaborn: statistical data visualization. JOSS 6(60). / Plotly Technologies, 2023. 13 / 22
4. Visualisation – Tableau comparatif
OUTIL TYPE INTERACTIVITÉ FACILITÉ USAGE PRINCIPAL
MATPLOTLIB STATIQUE NON ★★★ GRAPHIQUES DE BASE
SEABORN STATIQUE NON ★★★★ STATS & CORRÉLATIONS
PLOTLY INTERACTIF OUI ★★★ DASHBOARDS WEB
BOKEH INTERACTIF OUI ★★ APPLICATIONS WEB
Référence : VanderPlas, J., 2016 – Python Data Science Handbook. O'Reilly Media. 14 / 22
5. ÉTUDE DE CAS
Analyse de la Filière
Céréalière au Maroc
BLÉ TENDRE · BLÉ DUR · ORGE | DONNÉES 2015 – 2023
Source : ONICL / FAO Outils : Pandas, NumPy, Matplotlib, Seaborn Niveau : Étude quantitative
15 / 22
5. Étude de cas – Contexte et données
POURQUOI LES CÉRÉALES ? DESCRIPTION DU JEU DE DONNÉES
Variable Description
Les céréales représentent 60 % des terres cultivées au Maroc.
annee Année de récolte (2015–2023)
Blé tendre et orge sont les deux cultures les plus importantes. region Région agricole (9 régions)
culture Blé tendre, blé dur, orge
La production varie fortement selon les années de sécheresse.
production_qt Production en quintaux
Les prix dépendent de la production locale et des importations superficie_ha Superficie cultivée (ha)
mondiales.
rendement_qt_ha Rendement = prod. / superficie
Objectif : analyser les tendances de production et prévoir les
besoins futurs. pluviometrie_mm Pluviométrie annuelle (mm)
prix_dt_qt Prix de vente (DH/quintal)
Référence : ONICL, 2023 – Rapport statistique filière céréalière. Rabat. / FAO-STAT, 2023. 16 / 22
5. Étude de cas – Étape 1 & 2 : Collecte et Nettoyage
ÉTAPE 1 – CHARGEMENT DES DONNÉES ÉTAPE 2 – NETTOYAGE DES DONNÉES
import pandas as pd # Vérifier les valeurs manquantes
[Link]().sum()
import numpy as np
# Supprimer les lignes incomplètes
# Chargement du fichier CSV [Link](inplace=True)
df = pd.read_csv('cereales_maroc.csv',
# Convertir les types
encoding='utf-8')
df['annee'] = df['annee'].astype(int)
print([Link]) # (648, 8) df['rendement_qt_ha'] = (
df['production_qt'] /
df['superficie_ha'])
RÉSULTATS DU NETTOYAGE :
648 12 636 8
Lignes initiales Valeurs manquantes Lignes après nettoyage Variables utilisées
Référence : McKinney, W., 2022 – Python for Data Analysis. O'Reilly Media. 17 / 22
5. Étude de cas – Étape 3 : Analyse statistique
CODE PYTHON – ANALYSE PAR CULTURE RÉSULTATS STATISTIQUES (QUINTAUX/HA)
# Statistiques par type de céréale
stats = [Link]('culture')[ CULTURE MOYENNE ÉCART-TYPE MIN MAX
'rendement_qt_ha'].agg([
('Moyenne', 'mean'),
('Médiane', 'median'), Blé tendre 18,4 4,2 8,1 27,6
('Ecart-type', 'std'),
('Min', 'min'),
('Max', 'max')
Blé dur 15,7 3,8 6,5 23,1
]).round(2)
# Corrélation pluie vs rendement
corr = df[['pluviometrie_mm', Orge 13,2 3,5 5,0 21,4
'rendement_qt_ha']].corr()
print(corr) # r = 0.74
Corrélation pluie / rendement : r = 0,74 (forte relation positive)
INTERPRÉTATION :
Le blé tendre a le rendement le plus élevé (18,4 qt/ha). La corrélation r = 0,74 montre que la pluviométrie explique fortement les variations
de rendement : une bonne saison des pluies augmente significativement la production céréalière.
Référence : ONICL, 2023 – Bilan de campagne céréalière 2022-2023. Casablanca. 18 / 22
5. Étude de cas – Étape 4 : Visualisation des résultats
Blé tendre Blé dur Orge Blé tendre Blé dur
6000 25
5000
20
4000
15
3000
10
2000
5
1000
0 0
1.0 2.0 3.0 4.0 5.0 6.0 7.0 8.0 9.0 1.0 2.0 3.0 4.0 5.0 6.0 7.0 8.0 9.0
import [Link] as plt | import seaborn as sns
[Link](['annee','culture'])['production_qt'].sum().unstack().plot(kind='bar', figsize=(10,5), colormap='Greens') | [Link](data=df, x='annee', y='rendement_qt_ha',
hue='culture')
Référence : Hunter, J.D. (2007). Matplotlib. / Waskom, M. (2021). Seaborn. JOSS 6(60). 19 / 22
6. Limites et Perspectives
LIMITES ACTUELLES PERSPECTIVES
Intégration de l'intelligence artificielle (Deep Learning) pour
Courbe d'apprentissage importante pour les débutants.
la prédiction.
Moins adapté que R pour certaines analyses statistiques Développement de tableaux de bord en temps réel avec
très spécialisées. Plotly Dash.
Données agricoles souvent incomplètes ou non Connexion aux données satellitaires pour le suivi des
standardisées au Maroc. cultures.
Formation des acteurs agricoles marocains à la data
Temps de calcul élevé sur de très grands jeux de données.
science.
Référence : FAO, 2022 – Digital Agriculture in the Arab Countries. Rome. 20 / 22
7. Conclusion
✓ PYTHON : UN OUTIL
PUISSANT –
Avec NumPy, Pandas, Matplotlib et Seaborn, Python couvre tout le cycle d'analyse des
données.
✓ ADAPTÉ À
L'AGROBUSINESS –
Analyse des prix, suivi des rendements, prévision de la demande : autant d'applications
concrètes.
✓ ACCESSIBILITÉ –
Open-source, gratuit et soutenu par une large communauté de professionnels et
d'universitaires.
✓ La data science agricole est en pleine croissance. Python sera central dans cette
AVENIR PROMETTEUR –
transformation digitale.
21 / 22
Merci Pour Votre Attention
Références Bibliographiques
Harris, C.R. et al. (2020). Array programming with NumPy. Nature, 585, 357–362.
Hunter, J.D. (2007). Matplotlib: A 2D Graphics Environment. Computing in Science & Engineering, 9(3), 90–95.
McKinney, W. (2022). Python for Data Analysis. O'Reilly Media, 3e édition.
McKinsey Global Institute (2023). The data economy in agrifood systems.
ONICL, 2023 – Bilan de campagne céréalière 2022–2023. Casablanca.
Pedregosa, F. et al. (2011). Scikit-learn: Machine Learning in Python. JMLR 12, 2825–2830.
Python Software Foundation (2024). Python Documentation. [Link].
Stack Overflow (2023). Developer Survey 2023. [Link]/survey/2023.
VanderPlas, J. (2016). Python Data Science Handbook. O'Reilly Media.
Waskom, M. (2021). Seaborn: statistical data visualization. Journal of Open Source Software, 6(60).
FAO (2022). Digital Agriculture in the Arab Countries. Rome : Food and Agriculture Organization. 22 / 22