Informatique Décisionnelle
Génie Informatique S8
Pr. I. AIT LBACHIR
Chapitre 1: Introduction à l’informatique décisionnelle
2
Introduction à l’informatique décisionnelle
1. Définition
Exemple explicatif
• Imaginez que vous êtes
allés à un
supermarché/grande
surface pour acheter du
fromage
3
Introduction à l’informatique décisionnelle
1. Définition
Exemple
• Quand vous payez votre
fromage et sortez du
Produit Date et Quantit Prix
magasin, il faut savoir que heure é
le supermarché rassemble Fromag 18/03/2 1/4kg 30dh
de nouvelles données sur e 018, 16h
le fromage que vous avez
acheté: Heure, Quantité,
Prix…
4
Introduction à l’informatique décisionnelle
1. Définition
Exemple
• Mettez-vous maintenant sous la peau du directeur du magasin. Chaque jour, il doit déterminer
combien de fromage doit-il commander ou avoir dans son magasin
• Le seul moyen de le deviner est de savoir combien de fromage a-t-il été acheté par les
consommateurs chaque jour
• Pour cela, le directeur doit consulter toutes les transactions pour voir combien de fromage a été
acheté par jour. Mais ceci prend beaucoup de temps
Produit heure Quantité Prix
Fromage 9h 1/4kg 30dh
œufs 10h 5 7dh
miel 11h 1kg 100dh
Fromage 14h 1/8kg 15dh
Jus 15h 1l 15dh
d’orange
5
Introduction à l’informatique décisionnelle
1. Définition
Exemple
• Puisque ceci est une décision que le directeur doit prendre chaque semaine, il a décidé
d’utiliser un outil d’informatique décisionnel pour prévoir et fournir cette information
• Le directeur a maintenant suffisamment de temps pour analyser les données et ensuite
prendre une décision 6
Introduction à l’informatique décisionnelle
1. Définition
Exemple
• L’informatique décisionnelle est alors le processus de passer des données brutes à des
informations lisibles
Produit heure Quantité Prix
Fromage 9h 1/4kg 30dh
œufs 10h 5 7dh
miel 11h 1kg 100dh
Fromage 14h 1/8kg 15dh
Jus 15h 1l 15dh
d’orange
7
Introduction à l’informatique décisionnelle
1. Définition
• L’espace qu’occupe un système ID/BI est très
large : Il traite du big data.
• Par exemple, le reçu que vous recevez d’une
machine à distributeur de billets
automatiques ATM est un formulaire
prédéfini par le ID/BI
• C’est en quelque sorte une Template
définissant comment les données doivent
être délivrés
8
Introduction à l’informatique décisionnelle
1. Définition
• L’informatique décisionnelle/analytique ou Business intelligence en anglais est
l’informatique à l’usage des décideurs et des dirigeants des entreprises.
• La Business Intelligence désigne en effet un ensemble d'outils technologiques,
méthodiquement assemblés, et déployés en parfaite cohérence avec la stratégie
d'entreprise préalablement élaborée. La BI n'a d'autre finalité que de délivrer les
informations pertinentes à chaque manager afin qu'il puisse le plus efficacement
possible prendre les meilleures décisions selon son contexte d'action, ses
prérogatives et ses objectifs tactiques et stratégiques.
9
Introduction à l’informatique décisionnelle
1. Définition
• Les systèmes de ID/BI sont utilisés par les décideurs pour obtenir une
connaissance approfondie de l’entreprise et de définir et de soutenir leurs
stratégies d’affaires, par exemple : d’acquérir un avantage concurrentiel,
d’améliorer la performance de l’entreprise, de répondre plus rapidement aux
changements, d’augmenter la rentabilité, et d’une façon générale la création de
valeur ajoutée de l’entreprise
10
Introduction à l’informatique décisionnelle
2. Origines
• Naissance de la business intelligence à 1958 par Hans Peter Luhn, un analyste d’IBM,
auteur d’un article intitulé « A Business Intelligence System » dans lequel il décrit « un
système automatique pour diffuser des informations aux différentes parties prenantes
d'une organisation industrielle, scientifique ou gouvernementale. »
• Luhn définit même la BI comme « la capacité à appréhender les interrelations entre les
faits pour les présenter de façon à orienter l'action vers un but désiré. »
11
Introduction à l’informatique décisionnelle
2. Origines
• Années 70-90 : débuts de l’Informatique Décisionnelle :
• Développement d'outils d'édition de rapports, de statistiques, exploitant les BD
opérationnelles
• Développement de petits systèmes d’aide à la décision à base de tableurs
(simulation budgétaire, …)
• Développement de systèmes experts (IA) systèmes à base de règles, conçus par
extraction de la connaissance d'un ou plusieurs experts : intérêts et résultats
limités
• Développement de systèmes spécifiques d'aide à la décision : basés sur des
techniques de Recherche Opérationnelle (RO), la simulation, l’optimisation, …
=> Systèmes en général mal intégrés au SI opérationnel
12
Introduction à l’informatique décisionnelle
2. Origines
Années 90 - 2000 : essor de l’informatique décisionnelle :
• Technologie informatique permettant le développement d’Entrepôts de Données
(Data Warehouse)
• Nouveaux algorithmes :
• souvent issus des statistiques et de l’IA, permettant d'extraire des informations
à partir de données brutes
• permettant l’extraction d'informations nouvelles ou cachées, de connaissances
à partir de données
• regroupés dans des logiciels de Fouille de données (Data Mining)
• Données issues du Web : Recherche d’Information (RI) et Fouille de données sur le
Web « Web Mining »
13
Introduction à l’informatique décisionnelle
2. Origines
L’ID/BI moderne: Après les années 90
• La ID/BI est un ensemble de processus, d'outils et de technologies pour transformer
les données de l'entreprise en informations exactes et à jour pour soutenir des
processus décisionnels:
• Data Warehousing (DW)
• On-Line Analytical Processing (OLAP)
• Data Mining (DM) et visualisation de données (VIS)
• Analyse des décisions (what-if)
• Customer Relationship Management (CRM)
• La ID/BI peut être considérée comme l’opposé de l'Intelligence Artificielle (IA) :
• les systèmes d'IA prennent des décisions pour les utilisateurs
• les systèmes de BI permettent aux utilisateurs de prendre les bonnes
décisions sur la base des données disponibles
• mais de nombreuses techniques de BI ont leurs racines dans l’IA 14
Introduction à l’informatique décisionnelle
3. Objectifs - Enjeux
• Améliorer les performances décisionnelles de l'entreprise
• Anticiper les besoins du client
• Contrôler l’intégrité et la qualité des flux de gestion
• Répondre plus rapidement aux changements
• Augmenter la rentabilité
• Création de la valeur ajoutée de l’entreprise
15
Introduction à l’informatique décisionnelle
4. Processus décisionnel
• La prise de décision en entreprise
• Une décision est le résultat d'un processus comportant le choix conscient
entre plusieurs solutions, en vue d'atteindre un objectif.
• L'efficacité des services d'une entreprise dépend de la qualité de ses
décisions.
• Améliorer l'habilité à prendre des décisions, c'est faire usage des
ressources dont dispose l'entreprise.
16
Introduction à l’informatique décisionnelle
4. Processus décisionnel
• Le processus décisionnel peut être découpé en 5 étapes
• Définir le problème
• Rassembler les faits et données
• Evaluer et interpréter les faits et données
• Etablir plusieurs solutions
• Décider (choisir une solution)
17
Introduction à l’informatique décisionnelle
5. Système informatique décisionnelle – Système d’aide à la décision
18
Introduction à l’informatique décisionnelle
5. Système informatique décisionnelle – Système d’aide à la décision
19
Introduction à l’informatique décisionnelle
6. Métiers
Les métiers associés aux systèmes d’aide à la décision:
• Intégrateur de données / Data Integrator
• Analyste de données / Data analyst
• Chercheur de données / Data Scientist
• Responsable des données / Data Stewart
20
Introduction à l’informatique décisionnelle
6. Métiers
Data Integration
• Combiner des informations hétérogènes venants de sources différentes
Data Analysis
• Inspection, nettoyage, transformation et modélisation des données.
• Data Mining, Data Vizualisation
• Rendre la donnée compréhensible
• Communiquer à partir de la donnée
21
Introduction à l’informatique décisionnelle
6. Métiers
Data Scientist
• Il s’agit de disposer de compétences de haut niveau en matière d’analyse de données,
en combinant à la fois les méthodes statistiques, mais aussi d’autres connaissances telles
que la linguistique, la sémantique, utiles notamment pour travailler sur des données non
structurées, sans oublier la bonne compréhension du métier sur lequel on travaille, et
de mettre en œuvre une démarche d’analyse itérative, en acceptant de tester des
hypothèses sans a priori sur le résultat recherché.
Data Steward - Responsable des Données
• [. . . ] susceptibles sur un périmètre métier sur lequel ils détiennent une expertise
reconnue, de spécifier les exigences sur les données et d’en contrôler la qualité. Ces
responsables de données peuvent être positionnés à différents niveaux dans
l’organisation, et peuvent être pilotés par des coordinateurs au niveau d’un métier,
d’une fonction support ou d’une géographie
22
Introduction à l’informatique décisionnelle
7. Architecture
Extracteur
Referentiel
Integrateur
Extracteur
Entrepôt de
données
Extracteur
Reporting Décideurs
Sources
23
Introduction à l’informatique décisionnelle
7. Architecture
• Les données opérationnelles sont extraites périodiquement de sources hétérogènes : fichiers plats, fichiers
Excel, base de données (DB2, Oracle, SQL Server, etc.), service web, données massives et stockées dans un
entrepôt de données.
• Les données sont restructurées, enrichies, agrégées, reformatées, nomenclaturées pour être présentées à
l’utilisateur sous une forme sémantique (vues métiers ayant du sens) qui permettent aux décideurs
d’interagir:
• avec les données sans avoir à connaître leur structure de stockage physique,
• schémas en étoile qui permettent de répartir les faits et mesures selon des dimensions
hiérarchisées,
• rapports pré-préparés paramétrables,
• tableaux de bords plus synthétiques et interactifs.
• Ces données sont livrées aux divers domaines fonctionnels (direction stratégique, finance, production,
comptabilité, ressources humaines, etc.) à travers un système de sécurité ou de datamart spécialisés à des
fins de consultations, d’analyse, d’alertes prédéfinies.
24
Introduction à l’informatique décisionnelle
7. Architecture
• Extraction des données
• Bases de données
• Autres sources
• Structuration des données
• Prétraitements
• Agrégation
• Interface
• Présentation des données
• Visualisation, alertes automatiques
• Pour une tâche donnée
• À destination d’un décideur
25
Introduction à l’informatique décisionnelle
[Link]
• Base de données opérationnelle
• Fonctionnement normal de l’entreprise
• Pas forcément un historique très grand
• Peut changer dans le temps
• Datawarehouse
• Stockage pour le BI
• Archivage sur toute l’histoire de l’entreprise
• Format stable dans le temps
• Datamart
• Vue métier
• À destination du décideur
26
Introduction à l’informatique décisionnelle
9. Domaines d’application de l’ID/BI
• Domaines concernés :
commercial, financier, transport, télécommunications, santé,
services, ...
• Applications :
• gestion de la relation client
• gestion de commandes, de stocks
• prévisions de ventes
• définition de profil utilisateur
• analyse de transactions bancaires
• détection de fraudes
27
Introduction à l’informatique décisionnelle
11. Importance de la collecte pertinente des données
28
Introduction à l’informatique décisionnelle
11. Du transactionnel au décisionnel
29
Introduction à l’informatique décisionnelle
OLTP
OLTP = Online Transaction Processing : système de traitement transactionnel
en ligne, c’est-à-dire :
un système informatique conçu pour gérer les opérations courantes et
répétitives d’une entreprise en temps réel.
Exemples d’opérations OLTP :
•Ajouter une commande client
•Mettre à jour un stock
•Enregistrer un paiement
•Modifier une fiche client
30
Introduction à l’informatique décisionnelle
OLTP
Caractéristique Description
Objectif Gérer les transactions quotidiennes
Données Données détaillées et en temps réel
Performance Très rapide pour de petites
transactions fréquentes
Base de données Normalisée, structurée pour éviter les
redondances
Intégrité Haute intégrité (ex: via des contraintes
et des transactions ACID)
Utilisateurs typiques Opérateurs, employés, caissiers, etc.
31
Introduction à l’informatique décisionnelle
OLAP
OLAP = Online Analytical Processing
▪ OLAP signifie traitement analytique en ligne.
▪ C’est une technologie utilisée pour interroger, analyser et explorer les
données d’un entrepôt de données (Data Warehouse) de manière rapide,
souvent avec une approche multidimensionnelle.
OLAP sert à :
• Faire des analyses poussées sur les données historiques
• Construire des rapports interactifs
• Créer des tableaux de bord de performance
• Explorer les données selon plusieurs dimensions (temps, produit,
région, etc.)
32
Introduction à l’informatique décisionnelle
OLAP
Exemples de ce qu’on peut faire avec OLAP :
•Chiffre d’affaires par mois, par région, par produit
•Comparaison des ventes année N vs N-1
•Analyse de la rentabilité par segment de client
•Exploration dynamique avec des drill-down (descendre dans le
détail)
33
Introduction à l’informatique décisionnelle
OLAP vs OLTP
Critère OLTP OLAP
Objectif Gérer les transactions quotidiennes Analyser les données pour la prise
de décision
Type de données Données détaillées et en temps réel Données agrégées et historisées
Utilisation Opérations fréquentes, courtes Analyses complexes, peu fréquentes
Performance Très rapide pour l’écriture Optimisé pour la lecture intensive
Base de données Normalisée, relationnelle Dénormalisée, multidimensionnelle
Utilisateurs Employés opérationnels Décideurs, analystes
Exemples d'outils Odoo, SAP, Oracle ERP Power BI, Tableau, QlikView
34
Introduction à l’informatique décisionnelle
OLAP vs OLTP
Exemple concret :
Dans une boutique en ligne :
•Quand un client passe commande → OLTP (enregistrement de la commande)
•Quand le directeur veut analyser les ventes de la semaine → OLAP / BI
35
Introduction à l’informatique décisionnelle
OLAP vs OLTP
36
L’entrepôt de données / DataWarehouse
▪ Un data warehouse est une base de données centralisée conçue
spécialement pour stocker, organiser et analyser les données issues de
différentes sources d’une entreprise (ERP, CRM, fichiers Excel, etc.).
▪ Il est au cœur de tout système de Business Intelligence (BI).
Pourquoi ne pas utiliser directement les bases de données des applications (ERP, etc.) ?
Parce que ces bases (OLTP) sont faites pour les transactions, pas pour les
analyses complexes.
Le data warehouse est :
•Structuré différemment
•Nettoyé
•Historisé
•Optimisé pour l’analyse rapide 37
L’entrepôt de données / DataWarehouse
▪ Un data warehouse est une base de données centralisée conçue
spécialement pour stocker, organiser et analyser les données issues de
différentes sources d’une entreprise (ERP, CRM, fichiers Excel, etc.).
▪ Il est au cœur de tout système de Business Intelligence (BI).
Pourquoi ne pas utiliser directement les bases de données des applications (ERP, etc.) ?
Parce que ces bases (OLTP) sont faites pour les transactions, pas pour les
analyses complexes.
Le data warehouse est :
•Structuré différemment
•Nettoyé
•Historisé
•Optimisé pour l’analyse rapide 38
L’entrepôt de données / DataWarehouse
Caractéristique Description
Objectif Analyser les données pour prendre des décisions
Données Nettoyées, transformées, homogénéisées
Historique Contient des données historiques, parfois sur
plusieurs années
Stockage Grande capacité de stockage
Structure Schémas en étoile ou en flocon (modèle
multidimensionnel)
Fréquence de mise à jour Périodique (quotidienne, hebdomadaire...)
Utilisation Requêtes, tableaux de bord, rapports
39
L’entrepôt de données / DataWarehouse
Exemple concret :
Une entreprise a des données :
•de ventes (ERP),
•de clients (CRM),
•de stocks (Excel)
Le data warehouse va regrouper tout cela dans une même base pour que les dirigeants
puissent analyser les ventes par région, par mois, par produit, etc.
40
L’entrepôt de données / DataWarehouse
Lien avec l’ETL
Avant d’entrer dans le Data Warehouse, les données passent par un processus
ETL :
•Extract : on les extrait des systèmes sources (ERP, CRM…)
•Transform : on les nettoie, standardise, enrichit
•Load : on les charge dans le Data Warehouse
41
L’entrepôt de données / DataWarehouse
42
L’entrepôt de données / DataWarehouse
conception
• Kimball : commence par les Data Marts spécifiques (ventes, clients…), puis les relie. Rapide
et pragmatique.
• Inmon : construit d’abord un Data Warehouse centralisé, puis en extrait des Data Marts.
Plus rigide, mais plus structuré. 43
L’entrepôt de données / DataWarehouse
conception
44
L’entrepôt de données / DataWarehouse
conception
45
L’entrepôt de données / DataWarehouse
conception
46
L’entrepôt de données / DataWarehouse
conception
47
L’entrepôt de données / DataWarehouse
conception
48
L’entrepôt de données / DataWarehouse
étapes de conception
1. Analyse des besoins métier
•Identifier les utilisateurs finaux (managers, analystes…)
•Recueillir les besoins en reporting : KPI, indicateurs, rapports attendus
•Déterminer les dimensions d’analyse (temps, produit, région, client…)
2. Modélisation conceptuelle
•Définir les tables de faits (transactions, ventes, commandes…)
•Définir les tables de dimensions (client, produit, temps…)
•Choisir un modèle de schéma :
• Étoile (Kimball) : simple, performant
• Flocon (Inmon) : plus normalisé, structuré
3. Choix des sources de données
•Identifier les systèmes sources : ERP, CRM, fichiers Excel, bases de données…
•Cartographier les flux de données à intégrer
49
L’entrepôt de données / DataWarehouse
étapes de conception
4. Conception du processus ETL
•Extract : extraire les données brutes
•Transform : nettoyer, normaliser, enrichir, historiser
•Load : charger les données dans l’entrepôt
Outils possibles : Power BI (Power Query), Talend, SSIS, Pentaho…
5. Implémentation du Data Warehouse
•Création de la base de données décisionnelle
•Construction des tables de faits et dimensions
•Mise en place de l’historisation (ex: SCD - Slowly Changing Dimensions)
6. Création des rapports et tableaux de bord
•Connexion d’un outil OLAP ou de datavisualisation (Power BI, Tableau…)
•Construction des indicateurs et rapports
•Validation avec les utilisateurs
50
L’entrepôt de données / DataWarehouse
étapes de conception
7. Tests & Validation
•Vérification de la qualité des données
•Tests de performance et de cohérence
•Recettes avec les utilisateurs
8. Déploiement et maintenance
•Mise en production du DW
•Suivi des performances, erreurs ETL, mises à jour
•Évolution des besoins (nouvelles sources, nouveaux indicateurs)
51
L’entrepôt de données / DataWarehouse
étapes de conception
52
L’entrepôt de données / DataWarehouse
étapes de conception
53
Quiz
1. Qu’est-ce que la Business Intelligence (BI) ?
2. Quelle est la principale différence entre OLTP et OLAP ?
3. Cochez la bonne réponse : Le système OLTP est principalement utilisé pour :
a) L’analyse de données
b) Le traitement des transactions
c) La visualisation de KPI
4. Donnez deux exemples concrets d'utilisation d'un entrepôt de données (Data Warehouse).
5. Associez les éléments suivants :
- OLAP / OLTP
- Lecture intensive / Écriture fréquente
- Données agrégées / Données détaillées
54
Quiz
6. Quelle est la différence entre un Data Warehouse et un Data Mart ?
7. Quelles sont les trois étapes principales du processus ETL ?
8. Quelle structure est la plus utilisée dans la modélisation des données BI selon Kimball ?
a) Schéma en étoile
b) Schéma en flocon
c) Schéma relationnel normalisé
9. Dans quelle situation choisirait-on une approche Kimball plutôt qu'une approche Inmon pour
concevoir un entrepôt de données ?
10. Classez les étapes suivantes dans l’ordre logique de conception d’un Data Warehouse :
a) Modélisation conceptuelle
b) Analyse des besoins
c) Déploiement et maintenance
d) Processus ETL
e) Tests et validation 55
Modélisation multidimentionnelle
Rappel-Contexte
56
Modélisation multidimentionnelle
Rappel-Contexte
57
Modélisation multidimentionnelle
Rappel-Contexte
58
Modélisation multidimentionnelle
Modélisation Entité/Association (E/A)
▪ C’est une méthode de modélisation conceptuelle qui permet de représenter :
•des entités (objets du monde réel : client, produit…)
•et les relations (associations) entre elles (ex : un client passe une commande)
▪ Elle est souvent traduite en Modèle Logique Relationnel (tables, clés primaires,
étrangères).
Dans le contexte de la BI :
•On ne modélise pas tout, uniquement ce qui est utile à l’analyse.
•On distingue :
• Les faits (données quantitatives)
• Les dimensions (contexte des faits)
59
Modélisation multidimentionnelle
Modélisation Entité/Association (E/A)
Utilité de l’E/A en BI
Elle est utile en amont, pour :
•identifier les entités sources pertinentes (ex : Client, Produit,
Commande)
•définir les relations métier entre elles
•aider à dériver le schéma multidimensionnel (étoile ou flocon)
Dans l’E/A classique En BI / Entrepôt de données
Entité forte Dimension
Fait (si elle contient des
Association (1,n)
mesures)
Clé de dimension / clé
Clé primaire
étrangère 60
Modélisation multidimentionnelle
Modélisation Entité/Association (E/A)
Exemple :
Modèle E/A :
•Client (Client_ID, Nom)
•Produit (Produit_ID, Nom, Catégorie)
•Commande (Commande_ID, Date, Montant)
•Relation : Client Commande Produit
Devient :
Table de faits :
•Faits_Commandes : Date_ID, Client_ID, Produit_ID, Montant,
Quantité
Tables de dimensions :
•Dim_Client
•Dim_Produit
•Dim_Date
61
Modélisation multidimentionnelle
Modélisation des DW
• Nouvelle méthode de conception autour des concepts métiers
• Ne pas normaliser au maximum
• Introduction de nouveaux types de table:
• Table de faits
• Table de dimensions
• Introduction de nouveaux modèles:
• Modèle en étoile
• Modèle en flocon
62
Modélisation multidimentionnelle
Table de faits
● Une table de faits est le cœur d’un entrepôt de données
● Elle stocke des données quantitatives qu'on souhaite analyser, souvent
appelées mesures.
● Objectif
➔ Permettre l’analyse des événements métiers mesurables (ex :
ventes, commandes, paiements…)
➔ Être reliée à plusieurs tables de dimensions pour donner du
contexte à ces mesures
• Contenu d’une table de faits:
1. Mesures numériques à analyser (ex. Montant, Quantité , Durée…)
2. Clés étrangères pointant vers les tables de dimensions (ex. Client_ID,
Product_ID …)
63
Modélisation multidimentionnelle
Table de faits
● Exemple
64
Modélisation multidimentionnelle
Table de faits
• Fait:
• Ce que l’on souhaite mesurer
• Quantités vendues, montant des ventes…
• Contient les clés étrangères des axes d’analyse
(dimension)
• Date, produit, magasin
65
Modélisation multidimentionnelle
Granularité de la table de faits
• Répondre à la question :
• Que représente un enregistrement de la table de faits?
• La granularité définit le niveau de détails de la table de faits:
• Exemple: une ligne de commande par produit, par client et par jour
66
Modélisation multidimentionnelle
Table de dimension
▪ Une dimension est une table descriptive qui permet de donner du
sens aux mesures contenues dans la table de faits.
▪ Une dimension, c’est le contexte autour d’un événement mesurable.
Fait (à analyser) Dimensions associées
Produit, Client, Date, Magasin,
Chiffre d’affaires
Région
Nombre de commandes Date, Vendeur, Canal de vente
Usine, Machine, Semaine, Type de
Quantité produite
produit
67
Modélisation multidimentionnelle
Table de dimension
Caractéristiques d’une dimension :
•Contient des attributs descriptifs (ex : nom, ville, segment…)
•Est reliée à la table de faits par une clé étrangère
•Peut avoir une hiérarchie (ex : Année > Mois > Jour)
Exemple de table de dimension : Dim_Produit
Produit_I Nom_Pro
Catégorie Marque
D duit
P01 Savon Hygiène Dove
P02 Lait Boisson Danone
68
Modélisation multidimentionnelle
Table de dimension
La dimension Temps
▪ Commune à l’ensemble du DW
▪ Reliée à toute table de faits
69
Modélisation multidimentionnelle
Granularité d’une dimension
• Une dimension contient des membres organisés en hiérarchie :
• Chacun des membres appartient à un niveau
hiérarchique (ou niveau de granularité) particulier
• Granularité d’une dimension : nombre
de niveaux hiérarchiques
• Temps :
• année – semestre – trimestre - mois
70
Modélisation multidimentionnelle
Les types de modèles
71
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile
• Une table de fait centrale et des dimensions
• Les dimensions n’ont pas de liaison entre elles
• Avantages:
• Facilité de navigation
• Nombre de jointures limité
• Inconvénients:
• Redondance dans les dimensions
• Toutes les dimensions ne concernent pas les mesures
72
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile
73
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile
74
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile
75
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile - Exemple
76
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile - Exemple
77
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon
• Une table de fait et des dimensions décomposées en sous hiérarchies
• On a un seul niveau hiérarchique dans une table de dimension
• La table de dimension de niveau hiérarchique le plus bas est reliée à
la table de fait. On dit qu’elle a la granularité la plus fine
• Avantages:
• Normalisation des dimensions
• Économie d’espace disque
• Inconvénients:
• Modèle plus complexe (jointure)
Requêtes moins performantes
78
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon
79
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon
80
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon
81
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon - Exemple
82
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon - Exemple
83
Modélisation multidimentionnelle
Les types de modèles – Modèle en constellation
84
Modélisation multidimentionnelle
Les types de modèles – Exercices d’application –Exercice 1
Tu travailles pour une université qui souhaite analyser les résultats des étudiants.
Données disponibles :
•Étudiants (Nom, Prénom, Filière, Ville)
•Matières (Nom, Code, Département)
•Examens (Date, Session)
•Professeurs (Nom, Grade, Département)
•Notes obtenues (sur 20)
Crée un schéma en étoile en identifiant :
[Link] table de faits
[Link] dimensions
[Link] clés primaires / étrangères
[Link] un petit schéma pour représenter les relations
85
Modélisation multidimentionnelle
Les types de modèles – Exercices d’application –Exercice 2
Une université souhaite analyser les résultats académiques de ses étudiants tout en conservant une
structure de données plus normalisée.
L’établissement veut pouvoir analyser les moyennes par matière, par département, par niveau et
par semestre.
L’analyste BI décide donc d’adopter un modèle en flocon (snowflake) pour représenter les données
de manière détaillée et optimisée.
Données disponibles
- Table de faits : Faits_Notes (Étudiant_ID, Matière_ID, Note, Examen_ID)
- Dim_Etudiant (Étudiant_ID, Nom, Prénom, Sexe, Niveau_ID)
- Dim_Niveau (Niveau_ID, Libellé)
- Dim_Matiere (Matière_ID, Nom_Matière, Département_ID)
- Dim_Departement (Département_ID, Nom_Departement, Faculté)
- Dim_Examen (Examen_ID, Date, Semestre_ID)
- Dim_Semestre (Semestre_ID, Nom_Semestre, Année)
86
Modélisation multidimentionnelle
Les types de modèles – Exercices d’application –Exercice 2
1. Identifier les clés primaires et étrangères pour chaque table.
2. Représenter graphiquement le schéma en flocon.
3. Expliquer les avantages de cette modélisation par rapport au modèle en étoile dans ce cas précis.
4. Créer un modèle relationnel dans Excel (Power Pivot) ou sur papier à partir de ces données.
5. Proposer un exemple d'analyse possible à effectuer avec ce modèle (ex : moyenne par faculté et
semestre).
87
Modélisation multidimentionnelle
Alimentation et mise à jour du DW
• Entrepôt mis à jour régulièrement
• Besoin d’un outil permettant d’automatiser les chargements dans l’entrepôt
➔Utilisation d’outils ETL (Extract, Transform, Load)
Définition d’un ETL
• Offre un environnement de développement
• Offre des outils de gestion des opérations et de maintenance
• Permet de découvrir, analyser et extraire les données à partir de sources
hétérogènes
• Permet de nettoyer et standardiser les données
• Permet de charger les données dans un entrepôt
88
Modélisation multidimentionnelle
Alimentation et mise à jour du DW
Extraction
• Extraire des données des systèmes de production
• Dialoguer avec différentes sources:
• Base de données,
• Fichiers,
• Bases propriétaires
• Utilise divers connecteurs :
• ODBC,
• SQL natif,
• Fichiers plats
89
Modélisation multidimentionnelle
Alimentation et mise à jour du DW
Transformation
• Rendre cohérentes les données des différentes sources
• Transformer, nettoyer, trier, unifier les données
• Exemple: unifier le format des dates (MM/JJ/AA ➔ JJ/MM/AA)
• Etape très importante, garantit la cohérence et la fiabilité des données
Chargement
• Insérer ou modifier les données dans l’entrepôt
• Utilisation de connecteurs:
• ODBC,
• SQL natif,
• Fichiers plats
90
Modélisation multidimentionnelle
Alimentation et mise à jour du DW
Aperçu d’ETL
91
Modélisation multidimentionnelle
Alimentation et mise à jour du DW
Aperçu d’ETL
92
Modélisation multidimentionnelle
L’analyse multidimensionnelle
93
Modélisation multidimentionnelle
L’hypercube
▪ Un hypercube est un modèle de données multidimensionnel utilisé pour
représenter des données dans les systèmes OLAP (Online Analytical
Processing).
▪ C’est une structure qui permet d’analyser des faits (mesures) selon
plusieurs dimensions en même temps.
Exemple de cube :
Les ventes peuvent être analysées par :
•Produit
•Région
•Temps
Ce cube aura 3 dimensions :
Produit × Région × Temps
Chaque cellule du cube contient une mesure (ex : chiffre d’affaires). 94
Modélisation multidimentionnelle
L’hypercube
95
Modélisation multidimentionnelle
L’hypercube
96
Modélisation multidimentionnelle
L’hypercube
97
Modélisation multidimentionnelle
L’hypercube
98
Modélisation multidimentionnelle
L’hypercube
99
Modélisation multidimensionnelle
L’analyse multidimensionnelle
100
Modélisation multidimensionnelle
L’analyse multidimensionnelle
101
Modélisation multidimensionnelle
L’analyse multidimensionnelle
102
Modélisation multidimensionnelle
L’analyse multidimensionnelle
103
Modélisation multidimensionnelle
L’analyse multidimensionnelle
104
Modélisation multidimensionnelle
L’analyse multidimensionnelle
105
Modélisation multidimensionnelle
L’analyse multidimensionnelle
106
Modélisation multidimensionnelle
L’analyse multidimensionnelle
107
Modélisation multidimensionnelle
L’analyse multidimensionnelle
108
Modélisation multidimensionnelle
L’analyse multidimensionnelle
109
Modélisation multidimensionnelle
L’analyse multidimensionnelle
110
Modélisation multidimensionnelle
L’analyse multidimensionnelle
111
Modélisation multidimensionnelle
L’analyse multidimensionnelle
112
Modélisation multidimensionnelle
L’analyse multidimensionnelle
113
Modélisation multidimensionnelle
L’analyse multidimensionnelle
114
Modélisation multidimensionnelle
L’analyse multidimensionnelle
115
Modélisation multidimensionnelle
L’analyse multidimensionnelle
116
Modélisation multidimensionnelle
L’analyse multidimensionnelle
MDX (Multidimensional Expressions)
• Langage permettant de définir, d'utiliser et de récupérer des
données à partir d'objets multidimensionnels
• Permet d’effectuer les opérations décrites précédemment
• Equivalent de SQL pour le monde OLTP
• Origine: Microsoft
117
Modélisation multidimensionnelle
L’analyse multidimensionnelle
118
Modélisation multidimensionnelle
Le marché du décisionnel
119
Modélisation multidimensionnelle
Le marché du décisionnel
120
Modélisation multidimensionnelle
Le marché du décisionnel
121