NOTES DE COURS
Intelligence Artificielle & Python
Machine Learning • Deep Learning • Industrie 5.0
1. Bibliothèques Python essentielles
Vue d'ensemble des principales bibliothèques utilisées en Data Science et Machine Learning.
Bibliothèqu
Objectif principal Fonctions clés
e
NumPy Calculs numériques, array, matrix → opérations mathématiques rapides
algèbre linéaire,
statistiques
Pandas Manipulation et analyse DataFrame(df), head(10), tail(), info(), describe(),
de données tabulaires drop(), read_csv()
Matplotlib Visualisation graphique [Link](), scatter, hist, graphique (mode sklearn)
Seaborn Visualisation statistique [Link] → types de graphiques avancés
avancée
Scikit-learn Machine Learning split_data → train/test, types de modèles
1.1 Fonctions Pandas clés
Fonction Pandas Description
pd.read_csv('[Link]') Charger un fichier CSV dans un DataFrame
import pandas as pd Importer la bibliothèque Pandas
[Link](df) Créer un tableau (comme Excel / SQL)
head(10) Afficher les 10 premières lignes (de 0 jusqu'à 10)
tail() Afficher les dernières lignes
info() Informations sur le dataset : types de données, valeurs nulles
describe() Statistiques descriptives
drop() Supprimer une colonne ou une ligne
Nbr lignes et colonnes shape attribute → (rows, cols)
1.2 Structures Python (boucles, fonctions, conditions)
Structure Python Description / Syntaxe
print() Afficher une valeur ou du texte
range(n) Séquence de 0 à n-1
range(n, m) Séquence de n à m-1
Boucle for for (in m): → nbr de répétition (break pour arrêter)
Conditions if/else Structure conditionnelle — dépend d'une condition
Définir une fonction def nom_fonction(): → corps
Structure continue Passer à l'itération suivante
(continue)
Appeler la fonction nom_fonction()
2. Industrie 5.0 — Collaboration Homme-Machine
L'Industrie 5.0 représente une évolution vers une collaboration plus étroite entre l'humain et la
machine, centrée sur la durabilité et la résilience.
Concept Description Technologies
Industrie 5.0 Collaboration homme-machine IoT, Edge, Big Data,
Cybersécurité, Cloud
Principes Interconnectivité, Automatisation pour optimiser les processus
& robotisation, Analyse de
données avancée
Edge IA agentique : agit et prend des Machine Learning embarqué →
décisions par données sans sans connexion centrale
apprentissage explicite
Technologies clés IoT, Big Data, Cybersécurité, Durabilité, Résilience,
Cloud Computing, Chatbots Adaptabilité, Intérêt humain
Principes fondamentaux de l'Industrie 5.0
• Interconnectivité : systèmes connectés entre eux
• Automatisation et robotisation : délégation de tâches répétitives
• Analyse de données avancée : pour optimiser les processus
• Durabilité : réponse aux enjeux environnementaux
• Résilience et adaptabilité : face aux changements
• Intérêt humain (Human-centric) : la machine au service de l'humain
3. Types d'Apprentissage Machine
Type Description Exemples
Supervisé Avec des données étiquetées Classification, Régression
(input–output)
Non supervisé Données non étiquetées → auto- Clustering (K-Means, KNN)
organisation
Par renforcement Piloté par récompense → l'agent Jeux, robotique, IA générative
apprend par expérience
3.1 Split Train / Test
Le modèle apprend sur les données d'entraînement (Train) et est évalué sur des données
inconnues (Test).
Âge Salaire Achat
Train → ... ... ...Trainy
Test (x) → ... ... ...Testy
Code Python :
from sklearn.model_selection import train_test_split
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.2)
ypred = [Link](X_test) → comparaison réel vs prédit
4. Régression — Prédire des valeurs numériques
La régression est utilisée pour prédire une valeur numérique continue (ex : prix, salaire,
température).
Tâche Régression Classification
Sortie Valeur numérique continue Classe / Catégorie
Exemple Prix, salaire, température Spam ou non, maladie ou saine
Modèle simple y = ax + b (linéaire simple) y ∈ {0, 1} → probabilité
Modèle multiple y = a1x1 + a2x2 + ... + anXn + b KNN, Régression logistique
4.1 Régression linéaire — Fonctionnement
• Il faut définir les valeurs A et B
• Le modèle s'appuie sur une base centrale : A*B = cette base données
• A% train : données avec lesquelles il apprend → il "s'entraîne"
• B% test : données sur lesquelles on évalue ses performances
• Dans la régression linéaire : on donne au modèle les données, le modèle les apprend tout
seul
• on lit p(x, y) pour approfondir la relation
4.2 Régression simple vs multiple
Régression simple : y = ax + b (1 variable explicative)
Régression multiple : y = a1x1 + a2x2 + ... + anxn + b (plusieurs variables)
5. Classification & Évaluation du Modèle
La classification consiste à attribuer une étiquette (classe) à un point de données. On utilise
plusieurs métriques pour évaluer la qualité du modèle.
5.1 Matrice de confusion
Prédit : 1 Prédit : 0
Réel : 1 TP (True Positive) FN (False
Negative)
Réel : 0 FP (False TN (True
Positive) Negative)
• TP (True Positive) : Vrai Positif — prédit positif et c'est juste
• TN (True Negative) : Vrai Négatif — prédit négatif et c'est juste
• FP (False Positive) : Faux Positif — prédit positif mais c'est faux
• FN (False Negative) : Faux Négatif — prédit négatif mais c'est faux
• TP + TN doivent être élevés → le modèle doit une bonne classification
5.2 Métriques d'évaluation
Métrique Formule Interprétation
Accuracy (TP + TN) / Total % de bonnes prédictions
globales
Precision TP / (TP + FP) Parmi les prédits positifs,
combien sont vrais
Recall TP / (TP + FN) Parmi les vrais positifs, combien
détectés
Note Si 60% vs 40% → pas équilibré Augmenter base données pour
→ utiliser SMOTE l'équilibre
⚠️Déséquilibre de classes :
• Si 60% vs 40% → pas équilibré → on utilise SMOTE
• SMOTE : augmenter la base de données pour avoir un équilibre
• La base de données n'est pas toujours équilibrée — on compare les métriques
6. Algorithmes de Voisinage : KNN & K-Means
Critère KNN (K-Nearest Neighbors) K-Means
Type Supervisé Non supervisé
Objectif Classifier un nouveau point Regrouper des points en K
clusters
Principe Trouver les K plus proches Tirage aléatoire, calcul centroïde,
voisins (distance minimale) réaffectation
Choisir K Impair (évite l'égalité), tester Méthode du coude (elbow) ou
plusieurs valeurs indice de silhouette
Surapprentissage Risque si trop petit K Modèle beaucoup appris → ne
généralise pas en test
6.1 KNN — K-Nearest Neighbors (Supervisé)
• Permet de classer un nouveau point
• Il faut déterminer K (d'après l'erreur minimale)
• Voir les K voisins les plus proches au point à classer
• Si K est pair : on ne voit que la distance
• Surapprentissage : le modèle a beaucoup appris depuis les données train → ne peut pas
généraliser dans les données de test
6.2 K-Means (Non supervisé — Regroupement)
• Nombre de groupes K fixé à l'avance
• Tirer au sort K centroïdes aléatoirement pour chaque cluster
• Calculer le centre de gravité de chaque point et attribuer chaque point au centroïde le plus
proche
• Répéter jusqu'à ce qu'aucun point ne change
Comment déterminer K :
• Utiliser la méthode du coude (elbow method)
• Utiliser l'inertie : somme des distances au centroïde
• Selon la méthode : si l'inertie se stabilise → c'est le bon K
• Indice de silhouette : entre 0 et 1 pour mesurer la validité → Rocks = 1, Distorsion faible
6.3 Normalisation vs Standardisation
Normalisation Standardisation
Principe Mettre les valeurs entre Mettre les valeurs à une
[0 et 1] échelle m=0, σ=1
Intervalle [0, 1] Centrée réduite
Usage Intervalle fixe prédéfini Distribution normale
requise
7. Deep Learning & IA Générative
Concept Description Détail
Deep Learning Nécessite big data Plusieurs couches de neurones
→ apprend des patterns
complexes
IA Générative Produit un contenu quelconque S'améliore → Générer l'image
(image, texte…)
Prompt Rôle du prompt : agir comme Input → Contexte : Chat,
Expert Contexte, Exemple
LLM Large Language Model Bases Python : Hugging Face,
LangChain, Ollama
7.1 Deep Learning
• Nécessite big data → beaucoup de données
• Plusieurs couches de neurones empilées (réseau de neurones profond)
• Apprend automatiquement des représentations complexes
• Applications : vision par ordinateur, NLP, reconnaissance vocale
7.2 IA Générative
• Permet de produire un contenu quelconque : image, texte, son, vidéo
• S'améliore via apprentissage → Générer l'image, améliorer progressivement
• Exemples : ChatGPT, DALL-E, Midjourney, Claude
7.3 Prompt Engineering
Un bon prompt doit contenir :
• Rôle : agir comme un Expert dans le domaine
• Contexte : informations de fond (Chat, Contexte, Exemple)
• Input : entrer les données ou instructions précises
• Format de sortie : spécifier le format attendu
7.4 Bibliothèques Python pour le LLM
• Hugging Face : bibliothèque open-source pour NLP
• LangChain : framework pour construire des apps LLM
• Ollama : exécuter des LLMs localement
8. Récapitulatif général
Thème Algorithme / Concept Usage
Régression Linéaire simple / multiple Prédire valeur numérique
continue
Classification KNN, Régression logistique Attribuer une classe / catégorie
Clustering K-Means Regrouper sans étiquettes
Évaluation Matrice confusion, Accuracy, Mesurer les performances du
Recall, Precision modèle
Deep Learning Réseaux de neurones profonds Images, texte, son (big data
requis)
IA Générative LLM, Prompt Engineering Générer contenu : texte, image,
code
Industrie 5.0 IoT, Edge, Cloud, Cybersécurité Collaboration homme-machine
optimisée
Bibliothèques NumPy, Pandas, Sklearn, Base de tout projet Data Science
Matplotlib Python
— Fin des notes —