0% ont trouvé ce document utile (0 vote)
13 vues121 pages

Introduction à l'informatique décisionnelle

L'informatique décisionnelle (ID/BI) est un processus qui transforme des données brutes en informations exploitables pour aider les décideurs à prendre des décisions éclairées. Elle repose sur des outils technologiques et méthodologiques, permettant d'analyser les données et d'anticiper les besoins des clients. Les systèmes ID/BI sont essentiels pour améliorer les performances d'une entreprise et créer de la valeur ajoutée.

Transféré par

younes
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
13 vues121 pages

Introduction à l'informatique décisionnelle

L'informatique décisionnelle (ID/BI) est un processus qui transforme des données brutes en informations exploitables pour aider les décideurs à prendre des décisions éclairées. Elle repose sur des outils technologiques et méthodologiques, permettant d'analyser les données et d'anticiper les besoins des clients. Les systèmes ID/BI sont essentiels pour améliorer les performances d'une entreprise et créer de la valeur ajoutée.

Transféré par

younes
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Informatique Décisionnelle

Génie Informatique S8

Pr. I. AIT LBACHIR


Chapitre 1: Introduction à l’informatique décisionnelle

2
Introduction à l’informatique décisionnelle
1. Définition

Exemple explicatif

• Imaginez que vous êtes


allés à un
supermarché/grande
surface pour acheter du
fromage

3
Introduction à l’informatique décisionnelle
1. Définition

Exemple

• Quand vous payez votre


fromage et sortez du
Produit Date et Quantit Prix
magasin, il faut savoir que heure é
le supermarché rassemble Fromag 18/03/2 1/4kg 30dh
de nouvelles données sur e 018, 16h
le fromage que vous avez
acheté: Heure, Quantité,
Prix…

4
Introduction à l’informatique décisionnelle
1. Définition

Exemple
• Mettez-vous maintenant sous la peau du directeur du magasin. Chaque jour, il doit déterminer
combien de fromage doit-il commander ou avoir dans son magasin
• Le seul moyen de le deviner est de savoir combien de fromage a-t-il été acheté par les
consommateurs chaque jour
• Pour cela, le directeur doit consulter toutes les transactions pour voir combien de fromage a été
acheté par jour. Mais ceci prend beaucoup de temps

Produit heure Quantité Prix


Fromage 9h 1/4kg 30dh
œufs 10h 5 7dh
miel 11h 1kg 100dh
Fromage 14h 1/8kg 15dh
Jus 15h 1l 15dh
d’orange
5
Introduction à l’informatique décisionnelle
1. Définition

Exemple
• Puisque ceci est une décision que le directeur doit prendre chaque semaine, il a décidé
d’utiliser un outil d’informatique décisionnel pour prévoir et fournir cette information

• Le directeur a maintenant suffisamment de temps pour analyser les données et ensuite


prendre une décision 6
Introduction à l’informatique décisionnelle
1. Définition

Exemple
• L’informatique décisionnelle est alors le processus de passer des données brutes à des
informations lisibles

Produit heure Quantité Prix


Fromage 9h 1/4kg 30dh
œufs 10h 5 7dh
miel 11h 1kg 100dh
Fromage 14h 1/8kg 15dh
Jus 15h 1l 15dh
d’orange

7
Introduction à l’informatique décisionnelle
1. Définition

• L’espace qu’occupe un système ID/BI est très


large : Il traite du big data.
• Par exemple, le reçu que vous recevez d’une
machine à distributeur de billets
automatiques ATM est un formulaire
prédéfini par le ID/BI
• C’est en quelque sorte une Template
définissant comment les données doivent
être délivrés

8
Introduction à l’informatique décisionnelle
1. Définition

• L’informatique décisionnelle/analytique ou Business intelligence en anglais est


l’informatique à l’usage des décideurs et des dirigeants des entreprises.

• La Business Intelligence désigne en effet un ensemble d'outils technologiques,


méthodiquement assemblés, et déployés en parfaite cohérence avec la stratégie
d'entreprise préalablement élaborée. La BI n'a d'autre finalité que de délivrer les
informations pertinentes à chaque manager afin qu'il puisse le plus efficacement
possible prendre les meilleures décisions selon son contexte d'action, ses
prérogatives et ses objectifs tactiques et stratégiques.

9
Introduction à l’informatique décisionnelle
1. Définition

• Les systèmes de ID/BI sont utilisés par les décideurs pour obtenir une
connaissance approfondie de l’entreprise et de définir et de soutenir leurs
stratégies d’affaires, par exemple : d’acquérir un avantage concurrentiel,
d’améliorer la performance de l’entreprise, de répondre plus rapidement aux
changements, d’augmenter la rentabilité, et d’une façon générale la création de
valeur ajoutée de l’entreprise

10
Introduction à l’informatique décisionnelle
2. Origines

• Naissance de la business intelligence à 1958 par Hans Peter Luhn, un analyste d’IBM,
auteur d’un article intitulé « A Business Intelligence System » dans lequel il décrit « un
système automatique pour diffuser des informations aux différentes parties prenantes
d'une organisation industrielle, scientifique ou gouvernementale. »

• Luhn définit même la BI comme « la capacité à appréhender les interrelations entre les
faits pour les présenter de façon à orienter l'action vers un but désiré. »

11
Introduction à l’informatique décisionnelle
2. Origines

• Années 70-90 : débuts de l’Informatique Décisionnelle :


• Développement d'outils d'édition de rapports, de statistiques, exploitant les BD
opérationnelles
• Développement de petits systèmes d’aide à la décision à base de tableurs
(simulation budgétaire, …)
• Développement de systèmes experts (IA) systèmes à base de règles, conçus par
extraction de la connaissance d'un ou plusieurs experts : intérêts et résultats
limités
• Développement de systèmes spécifiques d'aide à la décision : basés sur des
techniques de Recherche Opérationnelle (RO), la simulation, l’optimisation, …
=> Systèmes en général mal intégrés au SI opérationnel

12
Introduction à l’informatique décisionnelle
2. Origines

Années 90 - 2000 : essor de l’informatique décisionnelle :


• Technologie informatique permettant le développement d’Entrepôts de Données
(Data Warehouse)
• Nouveaux algorithmes :
• souvent issus des statistiques et de l’IA, permettant d'extraire des informations
à partir de données brutes
• permettant l’extraction d'informations nouvelles ou cachées, de connaissances
à partir de données
• regroupés dans des logiciels de Fouille de données (Data Mining)
• Données issues du Web : Recherche d’Information (RI) et Fouille de données sur le
Web « Web Mining »

13
Introduction à l’informatique décisionnelle
2. Origines

L’ID/BI moderne: Après les années 90


• La ID/BI est un ensemble de processus, d'outils et de technologies pour transformer
les données de l'entreprise en informations exactes et à jour pour soutenir des
processus décisionnels:
• Data Warehousing (DW)
• On-Line Analytical Processing (OLAP)
• Data Mining (DM) et visualisation de données (VIS)
• Analyse des décisions (what-if)
• Customer Relationship Management (CRM)
• La ID/BI peut être considérée comme l’opposé de l'Intelligence Artificielle (IA) :
• les systèmes d'IA prennent des décisions pour les utilisateurs
• les systèmes de BI permettent aux utilisateurs de prendre les bonnes
décisions sur la base des données disponibles
• mais de nombreuses techniques de BI ont leurs racines dans l’IA 14
Introduction à l’informatique décisionnelle
3. Objectifs - Enjeux

• Améliorer les performances décisionnelles de l'entreprise


• Anticiper les besoins du client
• Contrôler l’intégrité et la qualité des flux de gestion
• Répondre plus rapidement aux changements
• Augmenter la rentabilité
• Création de la valeur ajoutée de l’entreprise

15
Introduction à l’informatique décisionnelle
4. Processus décisionnel

• La prise de décision en entreprise


• Une décision est le résultat d'un processus comportant le choix conscient
entre plusieurs solutions, en vue d'atteindre un objectif.
• L'efficacité des services d'une entreprise dépend de la qualité de ses
décisions.
• Améliorer l'habilité à prendre des décisions, c'est faire usage des
ressources dont dispose l'entreprise.

16
Introduction à l’informatique décisionnelle
4. Processus décisionnel

• Le processus décisionnel peut être découpé en 5 étapes


• Définir le problème
• Rassembler les faits et données
• Evaluer et interpréter les faits et données
• Etablir plusieurs solutions
• Décider (choisir une solution)

17
Introduction à l’informatique décisionnelle
5. Système informatique décisionnelle – Système d’aide à la décision

18
Introduction à l’informatique décisionnelle
5. Système informatique décisionnelle – Système d’aide à la décision

19
Introduction à l’informatique décisionnelle
6. Métiers

Les métiers associés aux systèmes d’aide à la décision:


• Intégrateur de données / Data Integrator
• Analyste de données / Data analyst
• Chercheur de données / Data Scientist
• Responsable des données / Data Stewart

20
Introduction à l’informatique décisionnelle
6. Métiers

Data Integration
• Combiner des informations hétérogènes venants de sources différentes

Data Analysis
• Inspection, nettoyage, transformation et modélisation des données.
• Data Mining, Data Vizualisation
• Rendre la donnée compréhensible
• Communiquer à partir de la donnée

21
Introduction à l’informatique décisionnelle
6. Métiers

Data Scientist
• Il s’agit de disposer de compétences de haut niveau en matière d’analyse de données,
en combinant à la fois les méthodes statistiques, mais aussi d’autres connaissances telles
que la linguistique, la sémantique, utiles notamment pour travailler sur des données non
structurées, sans oublier la bonne compréhension du métier sur lequel on travaille, et
de mettre en œuvre une démarche d’analyse itérative, en acceptant de tester des
hypothèses sans a priori sur le résultat recherché.

Data Steward - Responsable des Données


• [. . . ] susceptibles sur un périmètre métier sur lequel ils détiennent une expertise
reconnue, de spécifier les exigences sur les données et d’en contrôler la qualité. Ces
responsables de données peuvent être positionnés à différents niveaux dans
l’organisation, et peuvent être pilotés par des coordinateurs au niveau d’un métier,
d’une fonction support ou d’une géographie
22
Introduction à l’informatique décisionnelle
7. Architecture

Extracteur
Referentiel

Integrateur
Extracteur
Entrepôt de
données
Extracteur

Reporting Décideurs
Sources
23
Introduction à l’informatique décisionnelle
7. Architecture

• Les données opérationnelles sont extraites périodiquement de sources hétérogènes : fichiers plats, fichiers
Excel, base de données (DB2, Oracle, SQL Server, etc.), service web, données massives et stockées dans un
entrepôt de données.
• Les données sont restructurées, enrichies, agrégées, reformatées, nomenclaturées pour être présentées à
l’utilisateur sous une forme sémantique (vues métiers ayant du sens) qui permettent aux décideurs
d’interagir:
• avec les données sans avoir à connaître leur structure de stockage physique,
• schémas en étoile qui permettent de répartir les faits et mesures selon des dimensions
hiérarchisées,
• rapports pré-préparés paramétrables,
• tableaux de bords plus synthétiques et interactifs.
• Ces données sont livrées aux divers domaines fonctionnels (direction stratégique, finance, production,
comptabilité, ressources humaines, etc.) à travers un système de sécurité ou de datamart spécialisés à des
fins de consultations, d’analyse, d’alertes prédéfinies.

24
Introduction à l’informatique décisionnelle
7. Architecture

• Extraction des données


• Bases de données
• Autres sources

• Structuration des données


• Prétraitements
• Agrégation
• Interface

• Présentation des données


• Visualisation, alertes automatiques
• Pour une tâche donnée
• À destination d’un décideur

25
Introduction à l’informatique décisionnelle
[Link]

• Base de données opérationnelle


• Fonctionnement normal de l’entreprise
• Pas forcément un historique très grand
• Peut changer dans le temps

• Datawarehouse
• Stockage pour le BI
• Archivage sur toute l’histoire de l’entreprise
• Format stable dans le temps

• Datamart
• Vue métier
• À destination du décideur

26
Introduction à l’informatique décisionnelle
9. Domaines d’application de l’ID/BI

• Domaines concernés :
commercial, financier, transport, télécommunications, santé,
services, ...

• Applications :
• gestion de la relation client
• gestion de commandes, de stocks
• prévisions de ventes
• définition de profil utilisateur
• analyse de transactions bancaires
• détection de fraudes
27
Introduction à l’informatique décisionnelle
11. Importance de la collecte pertinente des données

28
Introduction à l’informatique décisionnelle
11. Du transactionnel au décisionnel

29
Introduction à l’informatique décisionnelle
OLTP

OLTP = Online Transaction Processing : système de traitement transactionnel


en ligne, c’est-à-dire :

un système informatique conçu pour gérer les opérations courantes et


répétitives d’une entreprise en temps réel.

Exemples d’opérations OLTP :


•Ajouter une commande client
•Mettre à jour un stock
•Enregistrer un paiement
•Modifier une fiche client

30
Introduction à l’informatique décisionnelle
OLTP

Caractéristique Description
Objectif Gérer les transactions quotidiennes
Données Données détaillées et en temps réel
Performance Très rapide pour de petites
transactions fréquentes
Base de données Normalisée, structurée pour éviter les
redondances
Intégrité Haute intégrité (ex: via des contraintes
et des transactions ACID)

Utilisateurs typiques Opérateurs, employés, caissiers, etc.


31
Introduction à l’informatique décisionnelle
OLAP

OLAP = Online Analytical Processing

▪ OLAP signifie traitement analytique en ligne.


▪ C’est une technologie utilisée pour interroger, analyser et explorer les
données d’un entrepôt de données (Data Warehouse) de manière rapide,
souvent avec une approche multidimensionnelle.

OLAP sert à :
• Faire des analyses poussées sur les données historiques
• Construire des rapports interactifs
• Créer des tableaux de bord de performance
• Explorer les données selon plusieurs dimensions (temps, produit,
région, etc.)
32
Introduction à l’informatique décisionnelle
OLAP

Exemples de ce qu’on peut faire avec OLAP :

•Chiffre d’affaires par mois, par région, par produit


•Comparaison des ventes année N vs N-1
•Analyse de la rentabilité par segment de client
•Exploration dynamique avec des drill-down (descendre dans le
détail)

33
Introduction à l’informatique décisionnelle
OLAP vs OLTP

Critère OLTP OLAP


Objectif Gérer les transactions quotidiennes Analyser les données pour la prise
de décision

Type de données Données détaillées et en temps réel Données agrégées et historisées


Utilisation Opérations fréquentes, courtes Analyses complexes, peu fréquentes
Performance Très rapide pour l’écriture Optimisé pour la lecture intensive
Base de données Normalisée, relationnelle Dénormalisée, multidimensionnelle
Utilisateurs Employés opérationnels Décideurs, analystes

Exemples d'outils Odoo, SAP, Oracle ERP Power BI, Tableau, QlikView

34
Introduction à l’informatique décisionnelle
OLAP vs OLTP

Exemple concret :
Dans une boutique en ligne :
•Quand un client passe commande → OLTP (enregistrement de la commande)
•Quand le directeur veut analyser les ventes de la semaine → OLAP / BI

35
Introduction à l’informatique décisionnelle
OLAP vs OLTP

36
L’entrepôt de données / DataWarehouse

▪ Un data warehouse est une base de données centralisée conçue


spécialement pour stocker, organiser et analyser les données issues de
différentes sources d’une entreprise (ERP, CRM, fichiers Excel, etc.).
▪ Il est au cœur de tout système de Business Intelligence (BI).

Pourquoi ne pas utiliser directement les bases de données des applications (ERP, etc.) ?

Parce que ces bases (OLTP) sont faites pour les transactions, pas pour les
analyses complexes.
Le data warehouse est :
•Structuré différemment
•Nettoyé
•Historisé
•Optimisé pour l’analyse rapide 37
L’entrepôt de données / DataWarehouse

▪ Un data warehouse est une base de données centralisée conçue


spécialement pour stocker, organiser et analyser les données issues de
différentes sources d’une entreprise (ERP, CRM, fichiers Excel, etc.).
▪ Il est au cœur de tout système de Business Intelligence (BI).

Pourquoi ne pas utiliser directement les bases de données des applications (ERP, etc.) ?

Parce que ces bases (OLTP) sont faites pour les transactions, pas pour les
analyses complexes.
Le data warehouse est :
•Structuré différemment
•Nettoyé
•Historisé
•Optimisé pour l’analyse rapide 38
L’entrepôt de données / DataWarehouse

Caractéristique Description
Objectif Analyser les données pour prendre des décisions

Données Nettoyées, transformées, homogénéisées


Historique Contient des données historiques, parfois sur
plusieurs années
Stockage Grande capacité de stockage

Structure Schémas en étoile ou en flocon (modèle


multidimensionnel)

Fréquence de mise à jour Périodique (quotidienne, hebdomadaire...)

Utilisation Requêtes, tableaux de bord, rapports


39
L’entrepôt de données / DataWarehouse

Exemple concret :
Une entreprise a des données :
•de ventes (ERP),
•de clients (CRM),
•de stocks (Excel)
Le data warehouse va regrouper tout cela dans une même base pour que les dirigeants
puissent analyser les ventes par région, par mois, par produit, etc.

40
L’entrepôt de données / DataWarehouse

Lien avec l’ETL


Avant d’entrer dans le Data Warehouse, les données passent par un processus
ETL :
•Extract : on les extrait des systèmes sources (ERP, CRM…)
•Transform : on les nettoie, standardise, enrichit
•Load : on les charge dans le Data Warehouse

41
L’entrepôt de données / DataWarehouse

42
L’entrepôt de données / DataWarehouse
conception

• Kimball : commence par les Data Marts spécifiques (ventes, clients…), puis les relie. Rapide
et pragmatique.
• Inmon : construit d’abord un Data Warehouse centralisé, puis en extrait des Data Marts.
Plus rigide, mais plus structuré. 43
L’entrepôt de données / DataWarehouse
conception

44
L’entrepôt de données / DataWarehouse
conception

45
L’entrepôt de données / DataWarehouse
conception

46
L’entrepôt de données / DataWarehouse
conception

47
L’entrepôt de données / DataWarehouse
conception

48
L’entrepôt de données / DataWarehouse
étapes de conception

1. Analyse des besoins métier


•Identifier les utilisateurs finaux (managers, analystes…)
•Recueillir les besoins en reporting : KPI, indicateurs, rapports attendus
•Déterminer les dimensions d’analyse (temps, produit, région, client…)

2. Modélisation conceptuelle
•Définir les tables de faits (transactions, ventes, commandes…)
•Définir les tables de dimensions (client, produit, temps…)
•Choisir un modèle de schéma :
• Étoile (Kimball) : simple, performant
• Flocon (Inmon) : plus normalisé, structuré

3. Choix des sources de données


•Identifier les systèmes sources : ERP, CRM, fichiers Excel, bases de données…
•Cartographier les flux de données à intégrer

49
L’entrepôt de données / DataWarehouse
étapes de conception

4. Conception du processus ETL


•Extract : extraire les données brutes
•Transform : nettoyer, normaliser, enrichir, historiser
•Load : charger les données dans l’entrepôt
Outils possibles : Power BI (Power Query), Talend, SSIS, Pentaho…

5. Implémentation du Data Warehouse


•Création de la base de données décisionnelle
•Construction des tables de faits et dimensions
•Mise en place de l’historisation (ex: SCD - Slowly Changing Dimensions)

6. Création des rapports et tableaux de bord


•Connexion d’un outil OLAP ou de datavisualisation (Power BI, Tableau…)
•Construction des indicateurs et rapports
•Validation avec les utilisateurs

50
L’entrepôt de données / DataWarehouse
étapes de conception

7. Tests & Validation


•Vérification de la qualité des données
•Tests de performance et de cohérence
•Recettes avec les utilisateurs

8. Déploiement et maintenance
•Mise en production du DW
•Suivi des performances, erreurs ETL, mises à jour
•Évolution des besoins (nouvelles sources, nouveaux indicateurs)

51
L’entrepôt de données / DataWarehouse
étapes de conception

52
L’entrepôt de données / DataWarehouse
étapes de conception

53
Quiz

1. Qu’est-ce que la Business Intelligence (BI) ?


2. Quelle est la principale différence entre OLTP et OLAP ?
3. Cochez la bonne réponse : Le système OLTP est principalement utilisé pour :
a) L’analyse de données
b) Le traitement des transactions
c) La visualisation de KPI
4. Donnez deux exemples concrets d'utilisation d'un entrepôt de données (Data Warehouse).
5. Associez les éléments suivants :
- OLAP / OLTP
- Lecture intensive / Écriture fréquente
- Données agrégées / Données détaillées

54
Quiz

6. Quelle est la différence entre un Data Warehouse et un Data Mart ?


7. Quelles sont les trois étapes principales du processus ETL ?
8. Quelle structure est la plus utilisée dans la modélisation des données BI selon Kimball ?
a) Schéma en étoile
b) Schéma en flocon
c) Schéma relationnel normalisé
9. Dans quelle situation choisirait-on une approche Kimball plutôt qu'une approche Inmon pour
concevoir un entrepôt de données ?
10. Classez les étapes suivantes dans l’ordre logique de conception d’un Data Warehouse :
a) Modélisation conceptuelle
b) Analyse des besoins
c) Déploiement et maintenance
d) Processus ETL
e) Tests et validation 55
Modélisation multidimentionnelle
Rappel-Contexte

56
Modélisation multidimentionnelle
Rappel-Contexte

57
Modélisation multidimentionnelle
Rappel-Contexte

58
Modélisation multidimentionnelle
Modélisation Entité/Association (E/A)

▪ C’est une méthode de modélisation conceptuelle qui permet de représenter :


•des entités (objets du monde réel : client, produit…)
•et les relations (associations) entre elles (ex : un client passe une commande)
▪ Elle est souvent traduite en Modèle Logique Relationnel (tables, clés primaires,
étrangères).

Dans le contexte de la BI :
•On ne modélise pas tout, uniquement ce qui est utile à l’analyse.
•On distingue :
• Les faits (données quantitatives)
• Les dimensions (contexte des faits)

59
Modélisation multidimentionnelle
Modélisation Entité/Association (E/A)

Utilité de l’E/A en BI
Elle est utile en amont, pour :
•identifier les entités sources pertinentes (ex : Client, Produit,
Commande)
•définir les relations métier entre elles
•aider à dériver le schéma multidimensionnel (étoile ou flocon)

Dans l’E/A classique En BI / Entrepôt de données

Entité forte Dimension


Fait (si elle contient des
Association (1,n)
mesures)
Clé de dimension / clé
Clé primaire
étrangère 60
Modélisation multidimentionnelle
Modélisation Entité/Association (E/A)

Exemple :
Modèle E/A :
•Client (Client_ID, Nom)
•Produit (Produit_ID, Nom, Catégorie)
•Commande (Commande_ID, Date, Montant)
•Relation : Client Commande Produit
Devient :
Table de faits :
•Faits_Commandes : Date_ID, Client_ID, Produit_ID, Montant,
Quantité
Tables de dimensions :
•Dim_Client
•Dim_Produit
•Dim_Date
61
Modélisation multidimentionnelle
Modélisation des DW

• Nouvelle méthode de conception autour des concepts métiers


• Ne pas normaliser au maximum
• Introduction de nouveaux types de table:
• Table de faits
• Table de dimensions
• Introduction de nouveaux modèles:
• Modèle en étoile
• Modèle en flocon

62
Modélisation multidimentionnelle
Table de faits

● Une table de faits est le cœur d’un entrepôt de données


● Elle stocke des données quantitatives qu'on souhaite analyser, souvent
appelées mesures.
● Objectif
➔ Permettre l’analyse des événements métiers mesurables (ex :
ventes, commandes, paiements…)
➔ Être reliée à plusieurs tables de dimensions pour donner du
contexte à ces mesures
• Contenu d’une table de faits:
1. Mesures numériques à analyser (ex. Montant, Quantité , Durée…)
2. Clés étrangères pointant vers les tables de dimensions (ex. Client_ID,
Product_ID …)
63
Modélisation multidimentionnelle
Table de faits

● Exemple

64
Modélisation multidimentionnelle
Table de faits

• Fait:
• Ce que l’on souhaite mesurer

• Quantités vendues, montant des ventes…


• Contient les clés étrangères des axes d’analyse
(dimension)
• Date, produit, magasin

65
Modélisation multidimentionnelle
Granularité de la table de faits

• Répondre à la question :
• Que représente un enregistrement de la table de faits?
• La granularité définit le niveau de détails de la table de faits:
• Exemple: une ligne de commande par produit, par client et par jour

66
Modélisation multidimentionnelle
Table de dimension

▪ Une dimension est une table descriptive qui permet de donner du


sens aux mesures contenues dans la table de faits.
▪ Une dimension, c’est le contexte autour d’un événement mesurable.

Fait (à analyser) Dimensions associées

Produit, Client, Date, Magasin,


Chiffre d’affaires
Région

Nombre de commandes Date, Vendeur, Canal de vente

Usine, Machine, Semaine, Type de


Quantité produite
produit
67
Modélisation multidimentionnelle
Table de dimension

Caractéristiques d’une dimension :

•Contient des attributs descriptifs (ex : nom, ville, segment…)


•Est reliée à la table de faits par une clé étrangère
•Peut avoir une hiérarchie (ex : Année > Mois > Jour)

Exemple de table de dimension : Dim_Produit

Produit_I Nom_Pro
Catégorie Marque
D duit
P01 Savon Hygiène Dove
P02 Lait Boisson Danone
68
Modélisation multidimentionnelle
Table de dimension

La dimension Temps

▪ Commune à l’ensemble du DW
▪ Reliée à toute table de faits

69
Modélisation multidimentionnelle
Granularité d’une dimension

• Une dimension contient des membres organisés en hiérarchie :


• Chacun des membres appartient à un niveau
hiérarchique (ou niveau de granularité) particulier
• Granularité d’une dimension : nombre
de niveaux hiérarchiques
• Temps :
• année – semestre – trimestre - mois

70
Modélisation multidimentionnelle
Les types de modèles

71
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile

• Une table de fait centrale et des dimensions


• Les dimensions n’ont pas de liaison entre elles
• Avantages:
• Facilité de navigation
• Nombre de jointures limité
• Inconvénients:
• Redondance dans les dimensions
• Toutes les dimensions ne concernent pas les mesures

72
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile

73
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile

74
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile

75
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile - Exemple

76
Modélisation multidimentionnelle
Les types de modèles – Modèle en étoile - Exemple

77
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon

• Une table de fait et des dimensions décomposées en sous hiérarchies


• On a un seul niveau hiérarchique dans une table de dimension
• La table de dimension de niveau hiérarchique le plus bas est reliée à
la table de fait. On dit qu’elle a la granularité la plus fine
• Avantages:

• Normalisation des dimensions


• Économie d’espace disque
• Inconvénients:
• Modèle plus complexe (jointure)
Requêtes moins performantes
78
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon

79
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon

80
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon

81
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon - Exemple

82
Modélisation multidimentionnelle
Les types de modèles – Modèle en flocon - Exemple

83
Modélisation multidimentionnelle
Les types de modèles – Modèle en constellation

84
Modélisation multidimentionnelle
Les types de modèles – Exercices d’application –Exercice 1

Tu travailles pour une université qui souhaite analyser les résultats des étudiants.
Données disponibles :
•Étudiants (Nom, Prénom, Filière, Ville)
•Matières (Nom, Code, Département)
•Examens (Date, Session)
•Professeurs (Nom, Grade, Département)
•Notes obtenues (sur 20)
Crée un schéma en étoile en identifiant :
[Link] table de faits
[Link] dimensions
[Link] clés primaires / étrangères
[Link] un petit schéma pour représenter les relations

85
Modélisation multidimentionnelle
Les types de modèles – Exercices d’application –Exercice 2

Une université souhaite analyser les résultats académiques de ses étudiants tout en conservant une
structure de données plus normalisée.
L’établissement veut pouvoir analyser les moyennes par matière, par département, par niveau et
par semestre.
L’analyste BI décide donc d’adopter un modèle en flocon (snowflake) pour représenter les données
de manière détaillée et optimisée.

Données disponibles
- Table de faits : Faits_Notes (Étudiant_ID, Matière_ID, Note, Examen_ID)
- Dim_Etudiant (Étudiant_ID, Nom, Prénom, Sexe, Niveau_ID)
- Dim_Niveau (Niveau_ID, Libellé)
- Dim_Matiere (Matière_ID, Nom_Matière, Département_ID)
- Dim_Departement (Département_ID, Nom_Departement, Faculté)
- Dim_Examen (Examen_ID, Date, Semestre_ID)
- Dim_Semestre (Semestre_ID, Nom_Semestre, Année)
86
Modélisation multidimentionnelle
Les types de modèles – Exercices d’application –Exercice 2

1. Identifier les clés primaires et étrangères pour chaque table.


2. Représenter graphiquement le schéma en flocon.
3. Expliquer les avantages de cette modélisation par rapport au modèle en étoile dans ce cas précis.
4. Créer un modèle relationnel dans Excel (Power Pivot) ou sur papier à partir de ces données.
5. Proposer un exemple d'analyse possible à effectuer avec ce modèle (ex : moyenne par faculté et
semestre).

87
Modélisation multidimentionnelle
Alimentation et mise à jour du DW

• Entrepôt mis à jour régulièrement


• Besoin d’un outil permettant d’automatiser les chargements dans l’entrepôt
➔Utilisation d’outils ETL (Extract, Transform, Load)

Définition d’un ETL


• Offre un environnement de développement
• Offre des outils de gestion des opérations et de maintenance
• Permet de découvrir, analyser et extraire les données à partir de sources
hétérogènes
• Permet de nettoyer et standardiser les données
• Permet de charger les données dans un entrepôt

88
Modélisation multidimentionnelle
Alimentation et mise à jour du DW

Extraction
• Extraire des données des systèmes de production
• Dialoguer avec différentes sources:
• Base de données,
• Fichiers,
• Bases propriétaires
• Utilise divers connecteurs :
• ODBC,
• SQL natif,
• Fichiers plats

89
Modélisation multidimentionnelle
Alimentation et mise à jour du DW

Transformation
• Rendre cohérentes les données des différentes sources
• Transformer, nettoyer, trier, unifier les données
• Exemple: unifier le format des dates (MM/JJ/AA ➔ JJ/MM/AA)
• Etape très importante, garantit la cohérence et la fiabilité des données
Chargement
• Insérer ou modifier les données dans l’entrepôt
• Utilisation de connecteurs:
• ODBC,
• SQL natif,
• Fichiers plats

90
Modélisation multidimentionnelle
Alimentation et mise à jour du DW

Aperçu d’ETL

91
Modélisation multidimentionnelle
Alimentation et mise à jour du DW

Aperçu d’ETL

92
Modélisation multidimentionnelle
L’analyse multidimensionnelle

93
Modélisation multidimentionnelle
L’hypercube

▪ Un hypercube est un modèle de données multidimensionnel utilisé pour


représenter des données dans les systèmes OLAP (Online Analytical
Processing).
▪ C’est une structure qui permet d’analyser des faits (mesures) selon
plusieurs dimensions en même temps.

Exemple de cube :
Les ventes peuvent être analysées par :
•Produit
•Région
•Temps
Ce cube aura 3 dimensions :
Produit × Région × Temps
Chaque cellule du cube contient une mesure (ex : chiffre d’affaires). 94
Modélisation multidimentionnelle
L’hypercube

95
Modélisation multidimentionnelle
L’hypercube

96
Modélisation multidimentionnelle
L’hypercube

97
Modélisation multidimentionnelle
L’hypercube

98
Modélisation multidimentionnelle
L’hypercube

99
Modélisation multidimensionnelle
L’analyse multidimensionnelle

100
Modélisation multidimensionnelle
L’analyse multidimensionnelle

101
Modélisation multidimensionnelle
L’analyse multidimensionnelle

102
Modélisation multidimensionnelle
L’analyse multidimensionnelle

103
Modélisation multidimensionnelle
L’analyse multidimensionnelle

104
Modélisation multidimensionnelle
L’analyse multidimensionnelle

105
Modélisation multidimensionnelle
L’analyse multidimensionnelle

106
Modélisation multidimensionnelle
L’analyse multidimensionnelle

107
Modélisation multidimensionnelle
L’analyse multidimensionnelle

108
Modélisation multidimensionnelle
L’analyse multidimensionnelle

109
Modélisation multidimensionnelle
L’analyse multidimensionnelle

110
Modélisation multidimensionnelle
L’analyse multidimensionnelle

111
Modélisation multidimensionnelle
L’analyse multidimensionnelle

112
Modélisation multidimensionnelle
L’analyse multidimensionnelle

113
Modélisation multidimensionnelle
L’analyse multidimensionnelle

114
Modélisation multidimensionnelle
L’analyse multidimensionnelle

115
Modélisation multidimensionnelle
L’analyse multidimensionnelle

116
Modélisation multidimensionnelle
L’analyse multidimensionnelle

MDX (Multidimensional Expressions)

• Langage permettant de définir, d'utiliser et de récupérer des


données à partir d'objets multidimensionnels
• Permet d’effectuer les opérations décrites précédemment
• Equivalent de SQL pour le monde OLTP
• Origine: Microsoft

117
Modélisation multidimensionnelle
L’analyse multidimensionnelle

118
Modélisation multidimensionnelle
Le marché du décisionnel

119
Modélisation multidimensionnelle
Le marché du décisionnel

120
Modélisation multidimensionnelle
Le marché du décisionnel

121

Vous aimerez peut-être aussi