0% ont trouvé ce document utile (0 vote)
8 vues4 pages

Modèle de Machine Learning en Python

Transféré par

Zacharie
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
8 vues4 pages

Modèle de Machine Learning en Python

Transféré par

Zacharie
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Live coding session – Machine Learning

Technical Document: Building a Basic Machine Learning Model


Session 2: Live Coding Session by GNDC

Session Introduction
Welcome to the second session of our Live Coding Series: Building a Basic Machine Learning
Model. This session aims to introduce you to the fundamental concepts of Machine Learning
(ML) and guide you in building a simple predictive model using Python. You will explore
essential tools and practical steps for creating a predictive model, focusing on real-world
applications like agricultural product price prediction.

Session Objectives
• Understand the basics of Machine Learning.
• Explore the use of Python libraries for ML.
• Build and evaluate a simple predictive model.
• Apply your knowledge to real-world problems, particularly in predicting agricultural product
prices.

Technical Prerequisites

For an optimal experience, ensure you have the following tools installed:

1. Python
o Recommended version: 3.8 or higher.
o Download Link
2. Development Environment
o IDEs: Visual Studio Code, PyCharm, or Jupyter Notebook.
o Install Jupyter Notebook:

pip install notebook

3. Python Libraries
Install the following libraries before the session:

pip install numpy pandas matplotlib scikit-learn joblib openpyxl

4. Clone the Project Repository


Clone the GitHub repository for the session: GitHub Project Link

Dataset Description

Source of Data

The dataset includes agricultural product price information sourced from two reputable
institutions in Cameroon:

1. MINADER Cameroon:
o Bulletin d’information sur les prix des produits agricoles dans les marchés des régions
de l’Adamaoua, du Nord et de l’Extrême-Nord.
o Published by the Ministry of Agriculture and Rural Development, this bulletin monitors
and reports agricultural price trends across key regions.

By Isaac Touza – Machine Learning Researcher 1


Live coding session – Machine Learning

2. INS Cameroon:
o Systèmes d’information sur les marchés agricoles – Infos prix produits agricoles, année
2020.
o Part of the National Institute of Statistics initiative, this document provides detailed
insights into agricultural product prices across various regions.

Dataset Shape

• Rows: 5,185
• Columns: 5

Columns Description

1. Zone (Categorical)
o Geographical region where the data was collected.
o Examples: Adamaoua, Nord, Extrême-Nord.
o Captures regional variability in prices.
2. Product (Categorical)
o Type of agricultural product.
o Examples: Maize, Sorghum, Millet, Groundnuts.
o Useful for identifying product-specific trends.
3. Month (Integer)
o Month of data collection (1: January to 12: December).
o Useful for analyzing seasonal price variations.
4. Year (Integer)
o Year of data collection, spanning multiple years.
o Provides insights into inter-annual trends.
5. Price (Numerical)
o Price of the product in CFA Franc.
o The target variable for prediction in the Random Forest model.

Session Plan

1. Introduction to Machine Learning


o Definition and importance.
o Types of Machine Learning: Supervised, Unsupervised, and Reinforcement.
o Overview of key steps: data collection, preparation, modeling, evaluation, and
deployment.
2. Data Exploration
o Importing data with Pandas.
o Cleaning and exploratory data analysis (EDA).
o Example dataset: Agricultural product price data.
3. Model Building
o Preparing data for modeling.
o Comparing four models: Linear Regression, Decision Tree, Random Forest, Gradient
Boosting.
o Visualizing model performance.
4. Model Evaluation
o Performance metrics: Mean Squared Error (MSE), Coefficient of Determination (R²).
o Interpreting results.
5. Conclusion and Q&A
o Discussion on real-world applications of the constructed model.
o Suggestions for further exploration

By Isaac Touza – Machine Learning Researcher 2


Live coding session – Machine Learning

Document Technique : Construire un Modèle de Machine Learning de Base


Session 2 : Live Coding Session by GNDC

Introduction à la Session
Bienvenue à la deuxième session de notre Live Coding : « Construire un Modèle de Machine
Learning de Base ». Cette session est conçue pour vous initier aux concepts fondamentaux du
Machine Learning (ML) et vous guider dans la construction d’un modèle simple de prédiction
en utilisant Python. Vous apprendrez à manipuler des outils essentiels tout en découvrant des
étapes pratiques pour la création d’un modèle prédictif.

Objectifs de la Session
• Comprendre les bases du Machine Learning.
• Découvrir l’utilisation des bibliothèques Python pour le ML.
• Créer et évaluer un modèle de prédiction simple.
• Appliquer vos connaissances à des problèmes réels, notamment la prédiction des prix
des produits agricoles.

Prérequis Techniques

Pour une expérience optimale, veuillez installer les outils suivants avant la session :

1. Python

• Version recommandée : 3.8 ou supérieure.


• Lien de téléchargement

2. Environnement de développement
• IDE : Visual Studio Code, PyCharm ou Jupyter Notebook.
• Installer Jupyter Notebook :

pip install notebook


3. Bibliothèques Python

Veuillez installer les bibliothèques suivantes avant la session :

pip install numpy pandas matplotlib scikit-learn joblib openpyxl

4. Cloner le projet
Clonez le dépôt GitHub pour cette session : Lien du projet GitHub

Description du Dataset

Source des Données


Le dataset inclut des informations sur les prix des produits agricoles issues de deux institutions
reconnues au Cameroun :

1. MINADER Cameroun :
o Bulletin d’information sur les prix des produits agricoles dans les marchés des régions
de l’Adamaoua, du Nord et de l’Extrême-Nord.
o Publié par le Ministère de l’Agriculture et du Développement Rural, ce bulletin
surveille et rapporte les tendances des prix agricoles dans des régions clés.
2. INS Cameroun :

By Isaac Touza – Machine Learning Researcher 3


Live coding session – Machine Learning

o Systèmes d’information sur les marchés agricoles – Infos prix produits agricoles, année
2020.
o Ce document, issu de l’initiative de l’Institut National de la Statistique, fournit des
données détaillées sur les prix des produits agricoles dans diverses régions.

Structure du Dataset
• Lignes : 5 185
• Colonnes : 5

Description des Colonnes


1. Zone (Catégorielle)
o Région géographique où les données ont été collectées.
o Exemples : Adamaoua, Nord, Extrême-Nord.
o Reflète la variabilité régionale des prix.
2. Produit (Catégorielle)
o Type de produit agricole.
o Exemples : Maïs, Sorgho, Mil, Arachides.
o Utile pour identifier les tendances spécifiques à chaque produit.
3. Mois (Entier)
o Mois de collecte des données (de 1 : Janvier à 12 : Décembre).
o Utile pour analyser les variations saisonnières des prix.
4. Année (Entier)
o Année de collecte des données, couvrant plusieurs années.
o Permet d’examiner les tendances interannuelles.
5. Prix (Numérique)
o Prix du produit en Franc CFA.
o Variable cible pour la prédiction avec le modèle Random Forest.

Plan de la Session

1. Introduction au Machine Learning


• Définition et importance.
• Types de Machine Learning : supervisé, non-supervisé et par renforcement.
• Aperçu des étapes clés : collecte des données, préparation, modélisation, évaluation et
déploiement.
2. Exploration des Données
• Importation des données avec Pandas.
• Nettoyage et analyse exploratoire des données (EDA).
• Exemple de données : Dataset des prix des produits agricoles.
3. Construction du Modèle
• Préparation des données pour les modèles.
• Comparaison de quatre modèles : Linear Regression, Decision Tree, Random Forest,
Gradient Boosting.
• Visualisation des performances des modèles.
4. Evaluation du Modèle
• Calcul des performances : erreur quadratique moyenne (MSE), coefficient de
détermination (R²).
• Interprétation des résultats.
5. Conclusion et Q&A
• Discussion des applications réelles du modèle construit.
• Suggestions pour aller plus loin.

By Isaac Touza – Machine Learning Researcher 4

Vous aimerez peut-être aussi