0% ont trouvé ce document utile (0 vote)
1 vues23 pages

G9 Python DataScience Agrobusiness

Ce document présente une étude sur l'utilisation de Python pour le traitement et la visualisation des données dans le secteur de l'agrobusiness alimentaire. Il décrit les outils et bibliothèques Python essentiels, ainsi qu'une étude de cas sur la filière céréalière au Maroc, mettant en lumière l'importance de l'analyse des données pour optimiser la chaîne alimentaire. Les conclusions soulignent la puissance de Python et son accessibilité pour les professionnels du secteur.

Transféré par

tanan.agro
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
1 vues23 pages

G9 Python DataScience Agrobusiness

Ce document présente une étude sur l'utilisation de Python pour le traitement et la visualisation des données dans le secteur de l'agrobusiness alimentaire. Il décrit les outils et bibliothèques Python essentiels, ainsi qu'une étude de cas sur la filière céréalière au Maroc, mettant en lumière l'importance de l'analyse des données pour optimiser la chaîne alimentaire. Les conclusions soulignent la puissance de Python et son accessibilité pour les professionnels du secteur.

Transféré par

tanan.agro
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Master d’excellence académique

Management Digital de l’Agrobusiness Alimentaire


2025-2026

Outils de Traitement et de
Visualisation de Données en Python

Réalisé par :
Brahim Bouzaneur
Mohammed Oudenni
Yassine Ouharrou Encadré par :
Jirari Khadija Professeur: FACOITI HASSAN
Ennaciri Soukayna
Plan de l'Exposé

01 INTRODUCTION 05 Étude de cas : Agrobusiness Alimentaire

02 Python comme langage de traitement de données 06 Limites et perspectives

03 Outils de traitement de données 07 Conclusion

04 Outils de visualisation de données

2 / 22
1. Introduction

CONTEXTE ET ENJEUX

L'agrobusiness génère chaque jour de grandes quantités de données (prix, production, qualité, logistique).

Analyser ces données permet de prendre de meilleures décisions et d'optimiser la chaîne alimentaire.

Python est aujourd'hui l'un des outils les plus utilisés pour traiter et visualiser ces données.

Cet exposé présente les bibliothèques Python essentielles et leur application au secteur alimentaire.

Référence : McKinsey Global Institute, 2023 – The data economy in agrifood systems. 3 / 22
1. Introduction – Objectifs de l'exposé

TROIS OBJECTIFS PRINCIPAUX

1 2 3
APPLIQUER SUR UN CAS
COMPRENDRE PYTHON MAÎTRISER LES OUTILS
RÉEL
Identifier pourquoi Python est Présenter les bibliothèques de Analyser des données agricoles avec
adapté à la data science dans le traitement (Pandas, NumPy) et de une étude de cas concrète.
secteur alimentaire. visualisation (Matplotlib, Seaborn).

4 / 22
2. Python – Présentation générale

UN LANGAGE POLYVALENT ET PUISSANT

★ CRÉÉ EN 1991 – par Guido van Rossum. Version actuelle : Python 3.x.

★ SYNTAXE SIMPLE –Facile à apprendre, même pour les non-informaticiens.

★ OPEN-SOURCE – Gratuit et soutenu par une grande communauté mondiale.

★ TRÈS UTILISÉ EN
DATA –
Classé n°1 en data science selon l'enquête Stack Overflow 2023.

Référence : Stack Overflow Developer Survey 2023 – [Link]/survey/2023 5 / 22


2. Python – Pourquoi pour l'agrobusiness ?

GRATUIT ÉCOSYSTÈME RICHE

Aucune licence à payer, contrairement à Excel ou SAS. Plus de 300 000 bibliothèques disponibles sur PyPI.

AUTOMATISATION FLEXIBILITÉ

Automatise les tâches répétitives (nettoyage, rapports). Traite des fichiers CSV, Excel, bases de données, API.

COMMUNAUTÉ ACTIVE INTÉGRATION BI

Forums, tutoriels, cours en ligne disponibles partout. Compatible avec Tableau, Power BI, Jupyter Notebooks.

Référence : Python Software Foundation, 2024 – [Link] 6 / 22


3. Outils de Traitement de Données

NUMPY · PANDAS · SCIPY · SCIKIT-LEARN

7 / 22
3. Outils de traitement – NumPy

CALCUL NUMÉRIQUE RAPIDE ET EFFICACE

import numpy as np
NumPy (Numerical Python) est la base du calcul scientifique en Python.
# Tableau de rendements (t/ha)
rendements = [Link](
[3.2, 4.1, 2.8, 5.0])
Il permet de créer des tableaux (arrays) et d'effectuer des calculs
mathématiques sur de grandes données. moy = [Link](rendements)
print(moy) # 3.775

Avantages : très rapide, utilise peu de mémoire, facile à combiner avec


Pandas.

APPLICATIONS EN AGROBUSINESS :

Calcul de moyennes de rendement, statistiques de qualité des aliments, modèles


de prévision des prix.

Référence : Harris et al., 2020 – Array programming with NumPy. Nature, 585, 357–362. 8 / 22
3. Outils de traitement – Pandas

LA BIBLIOTHÈQUE INCONTOURNABLE POUR LES TABLEAUX DE DONNÉES

DATAFRAME LECTURE DE FICHIERS

Structure de tableau similaire à Excel. Lignes et colonnes


Lit CSV, Excel, SQL, JSON facilement avec pd.read_csv().
nommées.

NETTOYAGE AGRÉGATION

Supprime les valeurs manquantes, corrige les erreurs, filtre les Calcule des moyennes, sommes, groupes par catégorie
données. (groupby).

Référence : McKinney, W., 2022 – Python for Data Analysis. O'Reilly Media, 3ème éd. 9 / 22
3. Outils de traitement – SciPy & Scikit-learn

SCIPY SCIKIT-LEARN

Machine Learning : classification, régression,


Statistiques avancées : tests t, ANOVA, corrélation.
clustering.

Optimisation de fonctions et résolution d'équations. Prédiction des prix des matières premières agricoles.

Détection d'anomalies dans les processus de


Utile pour les analyses de qualité alimentaire.
production.

Référence : Pedregosa et al., 2011 – Scikit-learn: Machine Learning in Python. JMLR 12, 2825–2830. 10 / 22
4. Outils de Visualisation de Données

MATPLOTLIB · SEABORN · PLOTLY · BOKEH

11 / 22
4. Visualisation – Matplotlib

LA BIBLIOTHÈQUE DE BASE POUR CRÉER DES GRAPHIQUES

GRAPHIQUE EN BARRES COURBE TEMPORELLE

Comparaison de productions par région ou par produit. Évolution des prix agricoles au cours du temps.

HISTOGRAMME DIAGRAMME CIRCULAIRE

Distribution des poids ou des quantités livrées. Part de marché par filière alimentaire.

Référence : Hunter, J.D., 2007 – Matplotlib: A 2D Graphics Environment. Computing in Science & Engineering, 9(3), 90–95. 12 / 22
4. Visualisation – Seaborn & Plotly

SEABORN PLOTLY

Graphiques statistiques élégants en quelques lignes Graphiques interactifs : zoom, filtre, info-bulle au
de code. survol.

Heatmaps : visualiser des corrélations entre variables. Idéal pour les tableaux de bord (dashboards) en ligne.

Boxplots : analyser la variabilité des rendements Cartes géographiques des zones de production
agricoles. agricole.

Référence : Waskom, M., 2021 – Seaborn: statistical data visualization. JOSS 6(60). / Plotly Technologies, 2023. 13 / 22
4. Visualisation – Tableau comparatif

OUTIL TYPE INTERACTIVITÉ FACILITÉ USAGE PRINCIPAL

MATPLOTLIB STATIQUE NON ★★★ GRAPHIQUES DE BASE

SEABORN STATIQUE NON ★★★★ STATS & CORRÉLATIONS

PLOTLY INTERACTIF OUI ★★★ DASHBOARDS WEB

BOKEH INTERACTIF OUI ★★ APPLICATIONS WEB

Référence : VanderPlas, J., 2016 – Python Data Science Handbook. O'Reilly Media. 14 / 22
5. ÉTUDE DE CAS

Analyse de la Filière
Céréalière au Maroc
BLÉ TENDRE · BLÉ DUR · ORGE | DONNÉES 2015 – 2023

Source : ONICL / FAO Outils : Pandas, NumPy, Matplotlib, Seaborn Niveau : Étude quantitative

15 / 22
5. Étude de cas – Contexte et données

POURQUOI LES CÉRÉALES ? DESCRIPTION DU JEU DE DONNÉES

Variable Description
Les céréales représentent 60 % des terres cultivées au Maroc.

annee Année de récolte (2015–2023)

Blé tendre et orge sont les deux cultures les plus importantes. region Région agricole (9 régions)

culture Blé tendre, blé dur, orge


La production varie fortement selon les années de sécheresse.
production_qt Production en quintaux

Les prix dépendent de la production locale et des importations superficie_ha Superficie cultivée (ha)
mondiales.
rendement_qt_ha Rendement = prod. / superficie

Objectif : analyser les tendances de production et prévoir les


besoins futurs. pluviometrie_mm Pluviométrie annuelle (mm)

prix_dt_qt Prix de vente (DH/quintal)


Référence : ONICL, 2023 – Rapport statistique filière céréalière. Rabat. / FAO-STAT, 2023. 16 / 22
5. Étude de cas – Étape 1 & 2 : Collecte et Nettoyage

ÉTAPE 1 – CHARGEMENT DES DONNÉES ÉTAPE 2 – NETTOYAGE DES DONNÉES

import pandas as pd # Vérifier les valeurs manquantes


[Link]().sum()
import numpy as np
# Supprimer les lignes incomplètes
# Chargement du fichier CSV [Link](inplace=True)
df = pd.read_csv('cereales_maroc.csv',
# Convertir les types
encoding='utf-8')
df['annee'] = df['annee'].astype(int)
print([Link]) # (648, 8) df['rendement_qt_ha'] = (
df['production_qt'] /
df['superficie_ha'])

RÉSULTATS DU NETTOYAGE :

648 12 636 8
Lignes initiales Valeurs manquantes Lignes après nettoyage Variables utilisées

Référence : McKinney, W., 2022 – Python for Data Analysis. O'Reilly Media. 17 / 22
5. Étude de cas – Étape 3 : Analyse statistique

CODE PYTHON – ANALYSE PAR CULTURE RÉSULTATS STATISTIQUES (QUINTAUX/HA)


# Statistiques par type de céréale
stats = [Link]('culture')[ CULTURE MOYENNE ÉCART-TYPE MIN MAX
'rendement_qt_ha'].agg([
('Moyenne', 'mean'),
('Médiane', 'median'), Blé tendre 18,4 4,2 8,1 27,6
('Ecart-type', 'std'),
('Min', 'min'),
('Max', 'max')
Blé dur 15,7 3,8 6,5 23,1
]).round(2)

# Corrélation pluie vs rendement


corr = df[['pluviometrie_mm', Orge 13,2 3,5 5,0 21,4
'rendement_qt_ha']].corr()
print(corr) # r = 0.74
Corrélation pluie / rendement : r = 0,74 (forte relation positive)

INTERPRÉTATION :

Le blé tendre a le rendement le plus élevé (18,4 qt/ha). La corrélation r = 0,74 montre que la pluviométrie explique fortement les variations
de rendement : une bonne saison des pluies augmente significativement la production céréalière.

Référence : ONICL, 2023 – Bilan de campagne céréalière 2022-2023. Casablanca. 18 / 22


5. Étude de cas – Étape 4 : Visualisation des résultats
Blé tendre Blé dur Orge Blé tendre Blé dur
6000 25

5000
20

4000

15

3000

10

2000

5
1000

0 0
1.0 2.0 3.0 4.0 5.0 6.0 7.0 8.0 9.0 1.0 2.0 3.0 4.0 5.0 6.0 7.0 8.0 9.0

import [Link] as plt | import seaborn as sns


[Link](['annee','culture'])['production_qt'].sum().unstack().plot(kind='bar', figsize=(10,5), colormap='Greens') | [Link](data=df, x='annee', y='rendement_qt_ha',
hue='culture')

Référence : Hunter, J.D. (2007). Matplotlib. / Waskom, M. (2021). Seaborn. JOSS 6(60). 19 / 22
6. Limites et Perspectives

LIMITES ACTUELLES PERSPECTIVES

Intégration de l'intelligence artificielle (Deep Learning) pour


Courbe d'apprentissage importante pour les débutants.
la prédiction.

Moins adapté que R pour certaines analyses statistiques Développement de tableaux de bord en temps réel avec
très spécialisées. Plotly Dash.

Données agricoles souvent incomplètes ou non Connexion aux données satellitaires pour le suivi des
standardisées au Maroc. cultures.

Formation des acteurs agricoles marocains à la data


Temps de calcul élevé sur de très grands jeux de données.
science.

Référence : FAO, 2022 – Digital Agriculture in the Arab Countries. Rome. 20 / 22


7. Conclusion

✓ PYTHON : UN OUTIL
PUISSANT –
Avec NumPy, Pandas, Matplotlib et Seaborn, Python couvre tout le cycle d'analyse des
données.

✓ ADAPTÉ À
L'AGROBUSINESS –
Analyse des prix, suivi des rendements, prévision de la demande : autant d'applications
concrètes.

✓ ACCESSIBILITÉ –
Open-source, gratuit et soutenu par une large communauté de professionnels et
d'universitaires.

✓ La data science agricole est en pleine croissance. Python sera central dans cette
AVENIR PROMETTEUR –
transformation digitale.

21 / 22
Merci Pour Votre Attention
Références Bibliographiques
Harris, C.R. et al. (2020). Array programming with NumPy. Nature, 585, 357–362.

Hunter, J.D. (2007). Matplotlib: A 2D Graphics Environment. Computing in Science & Engineering, 9(3), 90–95.

McKinney, W. (2022). Python for Data Analysis. O'Reilly Media, 3e édition.

McKinsey Global Institute (2023). The data economy in agrifood systems.

ONICL, 2023 – Bilan de campagne céréalière 2022–2023. Casablanca.

Pedregosa, F. et al. (2011). Scikit-learn: Machine Learning in Python. JMLR 12, 2825–2830.

Python Software Foundation (2024). Python Documentation. [Link].

Stack Overflow (2023). Developer Survey 2023. [Link]/survey/2023.

VanderPlas, J. (2016). Python Data Science Handbook. O'Reilly Media.

Waskom, M. (2021). Seaborn: statistical data visualization. Journal of Open Source Software, 6(60).

FAO (2022). Digital Agriculture in the Arab Countries. Rome : Food and Agriculture Organization. 22 / 22

Vous aimerez peut-être aussi