Explication du Flux de Travail en Apprentissage
Automatique
Ce diagramme montre comment les données circulent dans un
système pour aboutir à une décision ou un traitement basé sur un modèle
de Machine Learning.
1. La Source des Données (À gauche de la ligne pointillée)
Machine Learning Framework DATA (Cadre d'Apprentissage
Automatique Données) : C'est le point de départ. Cela représente
l'environnement ou la plateforme (comme TensorFlow, PyTorch,
scikit-learn, ou même une base de données) où tes données brutes
sont gérées et où les outils d'apprentissage automatique sont
configurés.
Le flux de données (indiqué par la flèche Flow DATA) passe de ce
cadre à la partie active du processus.
2. Le Cœur du Traitement (À droite de la ligne pointillée)
C'est là que la magie du Machine Learning opère.
Machine Learning Model (Modèle d'Apprentissage Automatique) :
C'est l'algorithme entraîné (par exemple, un réseau neuronal, une
régression logistique, un arbre de décision). Il reçoit les données
(Data) qui arrivent du processus de traitement.
Il produit un Score : c'est la prédiction, la classification, ou la valeur
de sortie que le modèle génère pour ces données.
Feature – DATA Références (Caractéristiques – Données de
Références) : Ces sont des informations supplémentaires ou des
caractéristiques (aussi appelées features) qui sont nécessaires
pour que le modèle fonctionne correctement.
Le processus peut Write (Écrire/Stocker) de nouvelles
caractéristiques ou des données de référence, et peut Read
(Lire/Consulter) des données existantes. Elles enrichissent
l'information pour le modèle et le processus.
Process Machine Learning (Processus d'Apprentissage
Automatique) : C'est la logique opérationnelle qui gère
l'ensemble du flux. Il prend le Score du modèle et les données
entrantes. Son rôle est de coordonner : il s'assure que les données
sont prêtes pour le modèle, reçoit le résultat du modèle, et prend les
mesures qui s'imposent.
3. Les Conditions et les Sorties (En haut et en bas) Les Carrés du
Haut (Bleu, Orange, Vert) : Ces boîtes représentent les données
d'entrée initiales qui sont injectées dans le processus. Elles peuvent
représenter des flux de données différents ou des ensembles de données
multiples.
Conditions : C'est l'étape où la logique du processus
d'apprentissage automatique est appliquée. Elle reçoit les données
initiales et définit les règles ou les critères pour savoir comment
le modèle doit être utilisé (par exemple, "Seulement si la
température est supérieure à 25 degrés, alors utilise ce modèle").
DATA (Carrés du Bas - Orange, Vert) : C'est la sortie du système,
ou bien les données qui sont modifiées et enregistrées après que
le processus d'apprentissage automatique a pris une décision. Les
flèches indiquent que les données traitées sont soit stockées (le
carré du bas) soit renvoyées dans le Process Machine Learning
pour une boucle de traitement continue.
En Résumé :
Les Données Brutes sont préparées dans un Cadre ML ;
Elles sont combinées avec des Règles (Conditions) et des
Références (Features) ;
Le Processus ML alimente le Modèle ML avec ces données ;
Le Modèle ML génère un Score (une prédiction) ;
Le Processus ML utilise ce score pour décider de l'Action Finale et
Stocker les Données traitées ;