Introduction au Deep Learning
Réseaux de neurones multi-couches
Eléments bibliographiques
Exposé basé sur le livre en ligne de Michael Nielsen
[Link]
avec codes en Python :
[Link]
et exemples d’utilisation de la librairie Theano de Python
Introduction au Deep Learning
Réseaux de neurones multi-couches
Eléments bibliographiques
Exemple illustratif : base de données MNIST 1
Image de taille d = 28 × 28 = 784 pixels, K = 10 classes
1. [Link]
Introduction au Deep Learning
Réseaux de neurones multi-couches
Eléments bibliographiques
Classification par réseaux de neurones convolutionnels
Ensemble d’apprentissage de 50000 images
Taux de classification > 99%
Ensemble test de 10000 images : taux de classification > 99%
Introduction au Deep Learning
Réseaux de neurones multi-couches
Eléments bibliographiques
33 images mal-classées sur l’ensemble test 1
Vraie classe : coin supérieur droit
Classe prédite : coin inférier droit
1. [Link]
Introduction au Deep Learning
Réseaux de neurones multi-couches
Eléments bibliographiques
Pour ceux qui n’aiment pas la lecture...
Vidéos en ligne sur le site du Collège de France :
Cours de Yann LeCun, “L’apprentissage profond : théorie et
pratique”, Collège de France (2015-2016), Informatique et
Sciences du Numérique.
[Link]/site/yann-lecun/[Link]
Cours de Stéphane Mallat, “Mystères mathématiques des
réseaux de neurones convolutionnels”, Collège de France
(2015-2016), Informatique et Sciences du Numérique.
[Link]/site/yann-lecun/seminar-2016-02-19-15h30.
Introduction au Deep Learning
Réseaux de neurones multi-couches
Méthode d’apprentissage linéaire
Choix d’une méthode d’apprentissage - séparation de classes par
un hyperplan
Introduction au Deep Learning
Réseaux de neurones multi-couches
Méthode d’apprentissage linéaire
Choix d’une méthode d’apprentissage - séparation de classes par
un hyperplan
Equation d’un hyperplan x ∈ Rd : hx, wi + b = 0 où
θ = (w, b) ∈ Rd × R sont les paramètres de l’hyperplan (ici d = 2)
Introduction au Deep Learning
Réseaux de neurones multi-couches
Méthode d’apprentissage linéaire
Choix d’une méthode d’apprentissage - séparation de classes par
un hyperplan
Points au-dessus de l’hyperplan x ∈ Rd : hx, wi + b > 0
Points au-dessous de l’hyperplan x ∈ Rd : hx, wi + b < 0
Introduction au Deep Learning
Réseaux de neurones multi-couches
Méthode d’apprentissage linéaire
Choix d’une méthode d’apprentissage - séparation de classes par
un hyperplan
Règle de classification f (x, θ) = σ (hx, wi + b) avec σ(z) = 11R+ (z) ou
1
σ(z) = 1+exp(−z) avec θ = (w, b) ∈ Rd × R
Introduction au Deep Learning
Réseaux de neurones multi-couches
Construction d’un réseau de neurones
Neurone de base : modèle du Perceptron (Rosenblatt, 1957)
Source : [Link]
Combinaison linéaire de x ∈ Rd avec les poids ω1 , . . . , ωd et un biais b
Fonction non-linéaire d’activation f (z) = σ(z) = 11{z≥0}
Introduction au Deep Learning
Réseaux de neurones multi-couches
Construction d’un réseau de neurones
Neurone de base : modèle du Perceptron (Rosenblatt, 1957)
Source : [Link]
Combinaison linéaire de x ∈ Rd avec les poids ω1 , . . . , ωd et un biais b
1
Autre choix σ(z) = 1+exp(−z) (sigmoı̈de) ou σ(z) = max(0, z) (ReLU)