0% ont trouvé ce document utile (0 vote)
5 vues2 pages

Introduction au Process Mining et Event Log

Ce document présente les solutions aux exercices du TD1 sur le process mining et la construction d'un event log. Il définit des concepts clés comme l'event log, la différence entre trace et événement, et l'utilisation du format XES. Les exercices incluent l'analyse d'un fichier CSV, la simulation d'un event log, et l'introduction à l'utilisation de PM4Py.

Transféré par

Zineb LAMGHARI
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
5 vues2 pages

Introduction au Process Mining et Event Log

Ce document présente les solutions aux exercices du TD1 sur le process mining et la construction d'un event log. Il définit des concepts clés comme l'event log, la différence entre trace et événement, et l'utilisation du format XES. Les exercices incluent l'analyse d'un fichier CSV, la simulation d'un event log, et l'introduction à l'utilisation de PM4Py.

Transféré par

Zineb LAMGHARI
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Corrigé du TD1 : Introduction au Process Mining et

à la Construction dun Event Log


Ce document fournit les solutions aux exercices du TD1, qui vise à introduire les
concepts de base du process mining et à préparer les étudiants à la construction dun
event log pour le TP1.

Exercice 1 : Concepts de base du Process Mining


1. Quest-ce quun event log dans le cadre du process mining ? Donnez une
définition claire.
Un event log est un ensemble structuré de données enregistrant les événements dun
processus. Chaque événement est associé à un identifiant de cas (case ID), une acti-
vité, un timestamp (date et heure), et éventuellement des attributs supplémentaires
comme une ressource (acteur). Il représente lhistorique dexécution dun processus
pour permettre son analyse via des outils de process mining.
2. Quelle est la différence entre une trace et un événement dans un event
log ?
Une trace est une séquence ordonnée dévénements correspondant à une instance
unique dun processus (par exemple, une demande de prêt spécifique). Un événement
est une action individuelle (par exemple, soumettre une demande) au sein de cette
trace, caractérisée par une activité, un timestamp et dautres attributs.
3. Pourquoi le format XES est-il utilisé pour le process mining ? Quels sont
ses avantages par rapport à un fichier CSV ?
Le format XES (eXtensible Event Stream) est un standard XML pour les event logs,
conçu pour le process mining. Ses avantages incluent :
— Une structure hiérarchique claire (logs, traces, événements, attributs).
— Une compatibilité avec les outils comme PM4Py et ProM.
— La possibilité dajouter des métadonnées (attributs globaux, extensions).
— Une standardisation qui facilite linteropérabilité, contrairement au CSV qui
est un format brut sans structure prédéfinie.

Exercice 2 : Analyse dun fichier CSV


1. Combien de traces différentes sont présentes dans cet extrait ? Justifiez
votre réponse.
Lextrait contient deux traces différentes, correspondant aux case IDs LoanCase1
et LoanCase2. Une trace est définie par un identifiant de cas unique, et ici, deux
identifiants distincts sont présents.
2. Identifiez les événements associés à la trace LoanCase1. Listez-les dans
lordre chronologique.
Les événements associés à LoanCase1, dans lordre chronologique, sont :
— Submit Application, 2025-09-15 08:00:00, Client
— Review Application, 2025-09-15 09:00:00, EmployeeA
— Approve Loan, 2025-09-15 10:00:00, Manager

1
3. Quelle information manque dans ce CSV pour quil soit pleinement com-
patible avec les outils comme PM4Py ? Proposez des noms de colonnes
standardisés.
Le CSV contient les informations nécessaires (case_id, activity, timestamp,
resource), mais les noms des colonnes doivent être standardisés pour PM4Py.
Les noms standardisés sont :
— case_id case:concept:name
— activity concept:name
— timestamp time:timestamp
— resource peut rester inchangé (attribut optionnel).

Exercice 3 : Simulation manuelle dun Event Log


Construisez un event log pour le processus de commande dun café :
case_id activity timestamp resource
Customer1 Order Coffee 2025-09-17 10 :00 :00 Customer1
Customer1 Prepare Coffee 2025-09-17 10 :05 :00 Barista
Customer1 Pay Order 2025-09-17 10 :10 :00 Customer1
Customer1 Deliver Coffee 2025-09-17 10 :15 :00 Barista

Exercice 4 : Introduction à PM4Py


1. Quel est le rôle de la fonction log_converter.apply() dans PM4Py ?
La fonction log_converter.apply() convertit un DataFrame pandas (par exemple,
un CSV chargé) en un objet event log utilisable par PM4Py. Elle mappe les colonnes
du DataFrame aux attributs standards dun event log (comme case:concept:name,
concept:name, time:timestamp).
2. Pourquoi faut-il renommer les colonnes du CSV avant de les passer à
PM4Py ? Donnez un exemple de correspondance entre les colonnes du
CSV et les noms standards attendus par PM4Py.
PM4Py attend des noms de colonnes spécifiques pour reconnaître les attributs dun
event log. Renommer les colonnes garantit la compatibilité. Exemple de correspon-
dance :
— CSV : case_id PM4Py : case:concept:name
— CSV : activity PM4Py : concept:name
— CSV : timestamp PM4Py : time:timestamp
3. (Facultatif) Si vous deviez écrire une ligne de code pour exporter un
event log au format XES, quelle fonction de PM4Py utiliseriez-vous ?
La fonction xes_exporter.apply(event_log, ’[Link]’) est utilisée pour
exporter un event log au format XES.

Conclusion
Ces solutions vous ont permis de comprendre les concepts théoriques du process mi-
ning, danalyser un event log CSV, de créer un log fictif, et de vous préparer à lutilisation
de PM4Py dans le TP1.

Vous aimerez peut-être aussi