0% ont trouvé ce document utile (0 vote)
0 vues10 pages

Notes IA Python

Ce document présente un cours sur l'intelligence artificielle et Python, couvrant des bibliothèques essentielles comme NumPy, Pandas et Scikit-learn, ainsi que des concepts clés en machine learning et deep learning. Il aborde également l'Industrie 5.0, mettant l'accent sur la collaboration homme-machine et les technologies associées. Enfin, il décrit les types d'apprentissage machine, les méthodes d'évaluation des modèles, et les algorithmes de voisinage comme KNN et K-Means.

Transféré par

rv6sc9gvwr
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats DOCX, PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
0 vues10 pages

Notes IA Python

Ce document présente un cours sur l'intelligence artificielle et Python, couvrant des bibliothèques essentielles comme NumPy, Pandas et Scikit-learn, ainsi que des concepts clés en machine learning et deep learning. Il aborde également l'Industrie 5.0, mettant l'accent sur la collaboration homme-machine et les technologies associées. Enfin, il décrit les types d'apprentissage machine, les méthodes d'évaluation des modèles, et les algorithmes de voisinage comme KNN et K-Means.

Transféré par

rv6sc9gvwr
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats DOCX, PDF, TXT ou lisez en ligne sur Scribd

NOTES DE COURS

Intelligence Artificielle & Python


Machine Learning • Deep Learning • Industrie 5.0

1. Bibliothèques Python essentielles


Vue d'ensemble des principales bibliothèques utilisées en Data Science et Machine Learning.

Bibliothèqu
Objectif principal Fonctions clés
e

NumPy Calculs numériques, array, matrix → opérations mathématiques rapides


algèbre linéaire,
statistiques

Pandas Manipulation et analyse DataFrame(df), head(10), tail(), info(), describe(),


de données tabulaires drop(), read_csv()

Matplotlib Visualisation graphique [Link](), scatter, hist, graphique (mode sklearn)

Seaborn Visualisation statistique [Link] → types de graphiques avancés


avancée

Scikit-learn Machine Learning split_data → train/test, types de modèles

1.1 Fonctions Pandas clés


Fonction Pandas Description

pd.read_csv('[Link]') Charger un fichier CSV dans un DataFrame

import pandas as pd Importer la bibliothèque Pandas

[Link](df) Créer un tableau (comme Excel / SQL)

head(10) Afficher les 10 premières lignes (de 0 jusqu'à 10)

tail() Afficher les dernières lignes

info() Informations sur le dataset : types de données, valeurs nulles

describe() Statistiques descriptives


drop() Supprimer une colonne ou une ligne

Nbr lignes et colonnes shape attribute → (rows, cols)

1.2 Structures Python (boucles, fonctions, conditions)


Structure Python Description / Syntaxe

print() Afficher une valeur ou du texte

range(n) Séquence de 0 à n-1

range(n, m) Séquence de n à m-1

Boucle for for (in m): → nbr de répétition (break pour arrêter)

Conditions if/else Structure conditionnelle — dépend d'une condition

Définir une fonction def nom_fonction(): → corps

Structure continue Passer à l'itération suivante


(continue)

Appeler la fonction nom_fonction()


2. Industrie 5.0 — Collaboration Homme-Machine
L'Industrie 5.0 représente une évolution vers une collaboration plus étroite entre l'humain et la
machine, centrée sur la durabilité et la résilience.

Concept Description Technologies

Industrie 5.0 Collaboration homme-machine IoT, Edge, Big Data,


Cybersécurité, Cloud

Principes Interconnectivité, Automatisation pour optimiser les processus


& robotisation, Analyse de
données avancée

Edge IA agentique : agit et prend des Machine Learning embarqué →


décisions par données sans sans connexion centrale
apprentissage explicite

Technologies clés IoT, Big Data, Cybersécurité, Durabilité, Résilience,


Cloud Computing, Chatbots Adaptabilité, Intérêt humain

Principes fondamentaux de l'Industrie 5.0


• Interconnectivité : systèmes connectés entre eux
• Automatisation et robotisation : délégation de tâches répétitives
• Analyse de données avancée : pour optimiser les processus
• Durabilité : réponse aux enjeux environnementaux
• Résilience et adaptabilité : face aux changements
• Intérêt humain (Human-centric) : la machine au service de l'humain
3. Types d'Apprentissage Machine
Type Description Exemples

Supervisé Avec des données étiquetées Classification, Régression


(input–output)

Non supervisé Données non étiquetées → auto- Clustering (K-Means, KNN)


organisation

Par renforcement Piloté par récompense → l'agent Jeux, robotique, IA générative


apprend par expérience

3.1 Split Train / Test


Le modèle apprend sur les données d'entraînement (Train) et est évalué sur des données
inconnues (Test).

Âge Salaire Achat

Train → ... ... ...Trainy

Test (x) → ... ... ...Testy

Code Python :
from sklearn.model_selection import train_test_split
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.2)
ypred = [Link](X_test) → comparaison réel vs prédit
4. Régression — Prédire des valeurs numériques
La régression est utilisée pour prédire une valeur numérique continue (ex : prix, salaire,
température).

Tâche Régression Classification

Sortie Valeur numérique continue Classe / Catégorie

Exemple Prix, salaire, température Spam ou non, maladie ou saine

Modèle simple y = ax + b (linéaire simple) y ∈ {0, 1} → probabilité

Modèle multiple y = a1x1 + a2x2 + ... + anXn + b KNN, Régression logistique

4.1 Régression linéaire — Fonctionnement


• Il faut définir les valeurs A et B
• Le modèle s'appuie sur une base centrale : A*B = cette base données
• A% train : données avec lesquelles il apprend → il "s'entraîne"
• B% test : données sur lesquelles on évalue ses performances
• Dans la régression linéaire : on donne au modèle les données, le modèle les apprend tout
seul
• on lit p(x, y) pour approfondir la relation

4.2 Régression simple vs multiple


Régression simple : y = ax + b (1 variable explicative)
Régression multiple : y = a1x1 + a2x2 + ... + anxn + b (plusieurs variables)
5. Classification & Évaluation du Modèle
La classification consiste à attribuer une étiquette (classe) à un point de données. On utilise
plusieurs métriques pour évaluer la qualité du modèle.

5.1 Matrice de confusion


Prédit : 1 Prédit : 0

Réel : 1 TP (True Positive) FN (False


Negative)

Réel : 0 FP (False TN (True


Positive) Negative)

• TP (True Positive) : Vrai Positif — prédit positif et c'est juste


• TN (True Negative) : Vrai Négatif — prédit négatif et c'est juste
• FP (False Positive) : Faux Positif — prédit positif mais c'est faux
• FN (False Negative) : Faux Négatif — prédit négatif mais c'est faux
• TP + TN doivent être élevés → le modèle doit une bonne classification

5.2 Métriques d'évaluation


Métrique Formule Interprétation

Accuracy (TP + TN) / Total % de bonnes prédictions


globales

Precision TP / (TP + FP) Parmi les prédits positifs,


combien sont vrais

Recall TP / (TP + FN) Parmi les vrais positifs, combien


détectés

Note Si 60% vs 40% → pas équilibré Augmenter base données pour


→ utiliser SMOTE l'équilibre

⚠️Déséquilibre de classes :
• Si 60% vs 40% → pas équilibré → on utilise SMOTE
• SMOTE : augmenter la base de données pour avoir un équilibre
• La base de données n'est pas toujours équilibrée — on compare les métriques
6. Algorithmes de Voisinage : KNN & K-Means
Critère KNN (K-Nearest Neighbors) K-Means

Type Supervisé Non supervisé

Objectif Classifier un nouveau point Regrouper des points en K


clusters

Principe Trouver les K plus proches Tirage aléatoire, calcul centroïde,


voisins (distance minimale) réaffectation

Choisir K Impair (évite l'égalité), tester Méthode du coude (elbow) ou


plusieurs valeurs indice de silhouette

Surapprentissage Risque si trop petit K Modèle beaucoup appris → ne


généralise pas en test

6.1 KNN — K-Nearest Neighbors (Supervisé)


• Permet de classer un nouveau point
• Il faut déterminer K (d'après l'erreur minimale)
• Voir les K voisins les plus proches au point à classer
• Si K est pair : on ne voit que la distance
• Surapprentissage : le modèle a beaucoup appris depuis les données train → ne peut pas
généraliser dans les données de test

6.2 K-Means (Non supervisé — Regroupement)


• Nombre de groupes K fixé à l'avance
• Tirer au sort K centroïdes aléatoirement pour chaque cluster
• Calculer le centre de gravité de chaque point et attribuer chaque point au centroïde le plus
proche
• Répéter jusqu'à ce qu'aucun point ne change

Comment déterminer K :
• Utiliser la méthode du coude (elbow method)
• Utiliser l'inertie : somme des distances au centroïde
• Selon la méthode : si l'inertie se stabilise → c'est le bon K
• Indice de silhouette : entre 0 et 1 pour mesurer la validité → Rocks = 1, Distorsion faible

6.3 Normalisation vs Standardisation


Normalisation Standardisation

Principe Mettre les valeurs entre Mettre les valeurs à une


[0 et 1] échelle m=0, σ=1

Intervalle [0, 1] Centrée réduite


Usage Intervalle fixe prédéfini Distribution normale
requise
7. Deep Learning & IA Générative
Concept Description Détail

Deep Learning Nécessite big data Plusieurs couches de neurones


→ apprend des patterns
complexes

IA Générative Produit un contenu quelconque S'améliore → Générer l'image


(image, texte…)

Prompt Rôle du prompt : agir comme Input → Contexte : Chat,


Expert Contexte, Exemple

LLM Large Language Model Bases Python : Hugging Face,


LangChain, Ollama

7.1 Deep Learning


• Nécessite big data → beaucoup de données
• Plusieurs couches de neurones empilées (réseau de neurones profond)
• Apprend automatiquement des représentations complexes
• Applications : vision par ordinateur, NLP, reconnaissance vocale

7.2 IA Générative
• Permet de produire un contenu quelconque : image, texte, son, vidéo
• S'améliore via apprentissage → Générer l'image, améliorer progressivement
• Exemples : ChatGPT, DALL-E, Midjourney, Claude

7.3 Prompt Engineering


Un bon prompt doit contenir :
• Rôle : agir comme un Expert dans le domaine
• Contexte : informations de fond (Chat, Contexte, Exemple)
• Input : entrer les données ou instructions précises
• Format de sortie : spécifier le format attendu

7.4 Bibliothèques Python pour le LLM


• Hugging Face : bibliothèque open-source pour NLP
• LangChain : framework pour construire des apps LLM
• Ollama : exécuter des LLMs localement
8. Récapitulatif général
Thème Algorithme / Concept Usage

Régression Linéaire simple / multiple Prédire valeur numérique


continue

Classification KNN, Régression logistique Attribuer une classe / catégorie

Clustering K-Means Regrouper sans étiquettes

Évaluation Matrice confusion, Accuracy, Mesurer les performances du


Recall, Precision modèle

Deep Learning Réseaux de neurones profonds Images, texte, son (big data
requis)

IA Générative LLM, Prompt Engineering Générer contenu : texte, image,


code

Industrie 5.0 IoT, Edge, Cloud, Cybersécurité Collaboration homme-machine


optimisée

Bibliothèques NumPy, Pandas, Sklearn, Base de tout projet Data Science


Matplotlib Python

— Fin des notes —

Vous aimerez peut-être aussi