Rapport : Exploration des Modèles YOLO et
Optimisations
1. Introduction
Objectif de l'étude : Explorer les performances de différentes
configurations d'entraînement YOLO sur le dataset des oiseaux.
Méthodologie :
o Analyse des architectures YOLO (petit, moyen, grand).
o Comparaison entre datasets original et augmenté.
o Optimisations avancées via l'ajustement des
hyperparamètres et des stratégies de scheduler.
Utilisation de WandB pour suivre les métriques (loss, accuracy,
etc.).
2. Expériences
2.1. Expérience 1 : Modèle de base
Configuration :
python
Copy code
results = [Link](
data="/kaggle/working/data",
project="birds",
name="exp001",
batch=16,
lr0=0.001,
epochs=50,
val=True
)
Description :
o Dataset : Original.
o Optimiseur : Adam (par défaut).
o Hyperparamètres :
Apprentissage initial : 0.001.
50 époques sans réduction dynamique du taux
d'apprentissage.
Résultats :
o Perte minimale atteinte : X.
o Précision finale : Y%.
o Graphiques :
Courbes de perte et précision sur WandB.
Comparaison entre entraînement et validation.
Analyse :
o Performance stable mais pas optimale.
o Observations sur les sur-ajustements après 40 époques.
2.2. Expérience 2 : Scheduler Cosine
Configuration :
python
Copy code
results = [Link](
data="/kaggle/working/data",
project="birds",
name="exp002",
batch=16,
lr0=0.001,
lrf=0.01,
cos_lr=True,
epochs=50
)
Description :
o Dataset : Original.
o Optimiseur : Adam.
o Stratégies d'apprentissage :
Scheduler cosinus pour ajuster le taux
d'apprentissage de manière fluide.
Réduction dynamique maximale de 0.01.
o Augmentation des données non appliquée.
Résultats :
o Perte minimale atteinte : X.
o Précision finale : Y%.
o Graphiques :
Courbes WandB : Amélioration progressive sur
validation.
Analyse :
o Scheduler Cosine a amélioré la convergence par rapport à
l'expérience 1.
o Réduction des sur-ajustements.
o Performance légèrement meilleure sur le dataset de
validation.
o
2.3. Expérience 3 : Optimiseur SGD
Configuration :
python
Copy code
results = [Link](
data="/kaggle/working/data",
project="birds",
name="exp003",
batch=16,
lr0=0.001,
lrf=0.01,
optimizer="SGD",
momentum=0.9,
weight_decay=0.0005
)
Description :
o Dataset : Augmenté.
o Optimiseur : SGD avec momentum (0.9) et pénalisation
des poids.
o Stratégies d'apprentissage :
Scheduler cosinus.
Réduction dynamique à 0.01.
Résultats :
o Perte minimale atteinte : X.
o Précision finale : Y%.
o Graphiques :
Courbes WandB : Impact positif de l'optimiseur SGD
sur la généralisation.
Analyse :
o Optimiseur SGD améliore les performances globales,
surtout en validation.
o Dataset augmenté a réduit les sur-ajustements.
o Bon compromis entre vitesse de convergence et
généralisation.
3. Comparaison des Expériences
Perte Précision
Expérience Configuration Observations
Min. Finale
Base, légère sur-
Adam, dataset
Exp001 X Y% adaptation après 40
original
époques.
Scheduler Cosine
Adam, Cosine
Exp002 X Y% améliore légèrement
LR, original
les résultats.
Performances
SGD, Cosine LR,
Exp003 X Y% optimales grâce à
augmenté
l'optimiseur SGD.
4. Conclusions
L'utilisation d'un dataset augmenté combiné avec l'optimiseur
SGD et le scheduler Cosine a permis les meilleurs résultats.
Recommandations :
o Intégrer un dataset plus diversifié pour valider la
robustesse.
o Étudier d'autres architectures YOLO pour des
améliorations potentielles.
5. Annexes
Courbes WandB des pertes et précisions.
Visualisation des échantillons du dataset original et augmenté.
4. Exploration des Architectures : Small, Medium,
Large
4.1 Architecture Small
Configuration :
o Modèle : YOLO Small.
o Hyperparamètres : Utilisation de l’expérience Exp0012
(Adam, dataset original, 50 époques, learning rate 0.001).
Description :
o YOLO Small est optimisé pour une exécution rapide avec
des ressources limitées.
o Convient aux systèmes embarqués ou aux applications
temps réel.
Résultats :
o Perte minimale atteinte : X.
o Précision finale : Y%.
o Temps d'entraînement : Z secondes par époque.
Analyse :
o Modèle léger avec une précision inférieure aux
architectures plus grandes.
o Temps d'inférence très rapide.
o Sur-ajustement limité.
4.2 Architecture Medium
Configuration :
o Modèle : YOLO Medium.
o Hyperparamètres : Utilisation de l’expérience Exp0022
(Adam, scheduler Cosine, dataset original).
Description :
o YOLO Medium est un compromis entre performance et
complexité.
o Convient pour des applications nécessitant un équilibre
entre précision et vitesse.
Résultats :
o Perte minimale atteinte : X.
o Précision finale : Y%.
o Temps d'entraînement : Z secondes par époque.
Analyse :
o Amélioration notable de la précision par rapport à YOLO
Small.
o Temps d'entraînement raisonnable.
o Bonne généralisation sur le dataset de validation.
4.3 Architecture Large
Configuration :
o Modèle : YOLO Large.
o Hyperparamètres : Utilisation de l’expérience Exp0033
(SGD, momentum, dataset augmenté, scheduler Cosine).
Description :
o YOLO Large offre une capacité maximale pour détecter
des détails complexes dans les images.
o Requiert des ressources matérielles importantes.
Résultats :
o Perte minimale atteinte : X.
o Précision finale : Y%.
o Temps d'entraînement : Z secondes par époque.
Analyse :
o Meilleure précision parmi les trois architectures.
o Sur-ajustement possible sur des datasets non diversifiés.
o Temps d'inférence plus élevé, adapté aux systèmes avec
GPU.
4.4 Comparaison des Architectures
Temps
Pert
Architectu Configurati Précisio d'entraîneme
e Observations
re on n Finale nt (par
Min.
époque)
YOLO Rapide, mais
Base Y% X Zs
Small précision limitée.
Bon équilibre
YOLO Scheduler
Y% X Zs performance/vites
Medium Cosine
se.
SGD, Excellente
YOLO
Dataset Y% X Zs précision, mais
Large
Augmenté lent.
4.5 Conclusions sur les Architectures
YOLO Small : Idéal pour des applications légères avec des
contraintes matérielles strictes.
YOLO Medium : Le meilleur compromis pour des systèmes
généralistes.
YOLO Large : Recommandé pour des applications critiques où la
précision est prioritaire, mais nécessitant des ressources
importantes.
Pour des tâches de reconnaissance d’oiseaux, YOLO Medium a
été jugé le plus adapté au vu des contraintes de rapidité et de
précision.