0% ont trouvé ce document utile (0 vote)
6 vues67 pages

Data Analytics

La visualisation de données transforme des données abstraites en représentations visuelles interactives pour faciliter la prise de décision. Les propriétés visuelles, comme la position, la longueur et la couleur, sont essentielles pour représenter différentes types de données. Les graphiques, tels que les diagrammes en barres et les courbes, sont choisis selon l'objectif analytique, qu'il s'agisse de comparaison, de distribution ou de corrélation.

Transféré par

hafsazineb540
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
6 vues67 pages

Data Analytics

La visualisation de données transforme des données abstraites en représentations visuelles interactives pour faciliter la prise de décision. Les propriétés visuelles, comme la position, la longueur et la couleur, sont essentielles pour représenter différentes types de données. Les graphiques, tels que les diagrammes en barres et les courbes, sont choisis selon l'objectif analytique, qu'il s'agisse de comparaison, de distribution ou de corrélation.

Transféré par

hafsazineb540
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Data Analytics

L’objectif principal d’une visualisation de données:


Permettre une exploration et une compréhension approfondies des données
afin d’aider à la prise de décision.
L’objectif principal d’une visualisation de données est de transformer des
données abstraites en représentations visuelles interactives permettant
d’amplifier la cognition humaine, de détecter des tendances, des corrélations et
des anomalies, et de faciliter la prise de décision.

Qu’est-ce qu’une propriété visuelle ?


Une propriété visuelle (ou canal visuel) est une caractéristique graphique
utilisée pour représenter une variable dans une visualisation.
Elle permet de coder une information visuellement.

🔹 Principales propriétés visuelles (cours)


Position
Longueur
Angle
Aire
Taille
Couleur
Saturation
Forme

🔹 La plus importante (à retenir pour


l’examen)
Selon la hiérarchie perceptuelle vue en cours :

Data Analytics 1
✔ La POSITION est la propriété visuelle la plus précise pour
représenter des valeurs numériques.
👉 Pourquoi ?
Parce que l’œil humain compare plus facilement des positions sur un axe que
des couleurs ou des surfaces.

🔹 Selon le type de données :


🔢 Données numériques
✔ Position
✔ Longueur
📊 Données ordinales
✔ Longueur
✔ Position
🏷 Données catégoriques
✔ Couleur
✔ Forme
Formulation parfaite pour l’examen
Une propriété visuelle est un canal graphique permettant de représenter une
variable. La position est la plus efficace pour représenter des valeurs
numériques car elle offre la meilleure précision perceptuelle.

Le type des graphe et la différence entre eux

📊 1️⃣ Bar Chart (Diagramme en barres)


✔ Utilisation
Comparer des catégories
Faire un classement

Data Analytics 2
Comparer des valeurs discrètes

✔ Type de données
Variable catégorique + variable numérique

✔ Propriété visuelle principale


Longueur

🔎 Différence
Adapté aux comparaisons entre catégories
Pas idéal pour montrer une évolution continue

📈 2️⃣ Line Chart (Courbe)


✔ Utilisation
Montrer une évolution dans le temps
Observer une tendance

✔ Type de données
Variable temporelle ou continue

✔ Propriété visuelle principale


Position + continuité

🔎 Différence avec Bar Chart


Line chart → continuité
Bar chart → comparaison catégorielle

🔵 3️⃣ Scatter Plot


✔ Utilisation
Montrer une relation entre deux variables continues

Data Analytics 3
Analyser la corrélation

✔ Type de données
Deux variables numériques

✔ Propriété visuelle principale


Position (X et Y)

🔎 Différence
Scatter → relation
Line → évolution
Bar → comparaison

📦 4️⃣ Histogramme
✔ Utilisation
Montrer la distribution d’une variable numérique

✔ Montre
Dispersion
Symétrie
Concentration
Outliers potentiels

🔎 Différence
Histogramme → distribution
Bar chart → catégories

📊 5️⃣ Boxplot
✔ Utilisation
Résumé statistique

Data Analytics 4
Identifier médiane et outliers

✔ Montre
Q1, Médiane, Q3
Valeurs aberrantes

🔎 Différence
Histogramme → forme complète
Boxplot → résumé statistique

🌡 6️⃣ Heatmap
✔ Utilisation
Matrice de valeurs numériques
Détecter patterns globaux

✔ Propriété principale
Couleur

🔎 Différence
Heatmap → grande quantité de données
Scatter → relation précise

🗺 7️⃣ Carte (Map)


✔ Utilisation
Données géographiques

✔ Différence
Encode position spatiale réelle
Peut combiner couleur ou taille

Data Analytics 5
🌳 8️⃣ Treemap
✔ Utilisation
Données hiérarchiques
Part-to-whole

✔ Encode
Surface

🔎 Différence
Treemap → hiérarchie
Bar chart → comparaison simple

📊 9️⃣ Area Chart


✔ Utilisation
Évolution + contribution cumulée

🔎 Différence
Line → tendance
Area → volume cumulé

🎯 RÉSUMÉ GLOBAL POUR L’EXAMEN


Graphique Sert à Type de données
Bar chart Comparer catégories Catégorique + Numérique
Line chart Évolution temporelle Temporelle
Scatter plot Corrélation 2 numériques
Histogramme Distribution Numérique
Boxplot Résumé statistique Numérique
Heatmap Matrice Numérique
Treemap Hiérarchie Catégorie + Numérique

Data Analytics 6
Graphique Sert à Type de données
Carte Géographique Spatial

🧠 Phrase parfaite à écrire à l’examen


Le choix du type de graphique dépend de l’objectif analytique : comparaison,
distribution, corrélation, évolution temporelle ou hiérarchie.

📊 Différence entre un graphique statique


et interactif
🔹 1️⃣ Graphique statique
✅ Définition
Un graphique statique est une visualisation fixe, qui ne change pas selon
l’utilisateur.

✅ Caractéristiques
Pas de filtres
Pas de zoom
Pas de sélection
Pas d’animation
Image immuable (PDF, image, papier)

✅ Exemple
Un graphique imprimé dans un rapport
Une image insérée dans un PowerPoint

🔹 2️⃣ Graphique interactif


✅ Définition

Data Analytics 7
Un graphique interactif permet à l’utilisateur de modifier, explorer ou
manipuler les données en temps réel.

✅ Caractéristiques
Filtres dynamiques
Zoom
Sélection de catégories
Highlight
Tooltips (infobulles)
Animation (motion chart)

✅ Exemple
Dashboard Tableau
Visualisation web interactive

🎯 Différence principale
Graphique Statique Graphique Interactif
Fixe Dynamique
Pas de modification Manipulation possible
Vue unique Exploration multiple
Passif Actif

🧠 Formulation parfaite pour l’examen


Un graphique statique est une représentation fixe des données, tandis qu’un
graphique interactif permet à l’utilisateur d’explorer, filtrer et manipuler les
données en temps réel afin d’approfondir l’analyse.

📌 Pourquoi l’interactivité est importante


(cours Part 1)
Data Analytics 8
Parce qu’une seule vue statique ne montre qu’un seul aspect des données,
alors que l’interaction permet :
Exploration multi-niveaux
Analyse détaillée
Comparaison dynamique

Quel type de données convient le mieux à


une heatmap ?
✅ Réponse correcte (QCM)
✔ Des matrices de valeurs numériques
📌 Pourquoi ?
Une heatmap est adaptée lorsque :
Les données sont organisées en tableau (lignes × colonnes)
Chaque cellule contient une valeur numérique
On veut visualiser des intensités, des patterns ou des corrélations
La couleur encode la magnitude de la valeur.

📘 Structure typique d’une heatmap


Var1 Var2 Var3
Obs1 10 25 8
Obs2 5 30 12
Obs3 18 4 20
Chaque cellule → couleur selon la valeur.

📌 Exemples d’utilisation
Matrice de corrélation

Data Analytics 9
Similarité entre objets
Données de performance
Clustering
Analyse de grands volumes

🎯 Formulation parfaite pour l’examen


Une heatmap convient aux matrices de valeurs numériques où l’intensité de
la couleur représente la magnitude des données, permettant d’identifier
rapidement des patterns ou des corrélations.

⚠ Important
Heatmap ≠ Carte géographique (même si parfois le terme est confondu).
Heatmap = matrice numérique
Carte = données spatiales

Quand utiliser un Line Chart plutôt qu’un


Bar Chart ?
✅ Réponse correcte (QCM)
✔ Pour représenter des relations continues ou temporelles
📊 Explication claire
🔹 Line Chart (Courbe)
On l’utilise quand :
Les données sont continues
Il y a une dimension temporelle
On veut montrer une tendance

Data Analytics 10
On veut observer des variations dans le temps

Exemple :
Évolution des ventes par mois
Température quotidienne
Croissance annuelle
👉 Le line chart montre la continuité entre les points.
🔹 Bar Chart (Diagramme en barres)
On l’utilise quand :
On compare des catégories distinctes
Les données ne sont pas continues
On veut faire un classement

Exemple :
Ventes par catégorie
Population par pays
Nombre d’employés par département
👉 Le bar chart montre une comparaison entre groupes séparés.
🎯 Différence principale
Line Chart Bar Chart
Données continues Données catégorielles
Montre une tendance Compare des groupes
Axe temporel fréquent Axe catégorique

🧠 Formulation parfaite pour l’examen


On utilise un line chart lorsqu’on souhaite représenter une évolution ou une
relation continue (notamment temporelle), tandis que le bar chart est plus

Data Analytics 11
adapté à la comparaison entre catégories distinctes.

🎨 L’utilisation des couleurs peut-elle être


trompeuse ?
✅ Réponse correcte (QCM)
✔ Toutes les réponses ci-dessus
Parce que plusieurs facteurs peuvent fausser l’interprétation.

📌 Pourquoi la couleur peut être


trompeuse ?
1️⃣ Perception culturelle
Certaines couleurs ont des significations différentes selon les cultures :
Rouge = danger (souvent)
Rouge = chance (dans certaines cultures)
Donc interprétation subjective.

2️⃣ Mauvaise palette


Si la palette est mal choisie :
Les différences peuvent paraître plus fortes qu’elles ne le sont.
Un gradient mal calibré peut exagérer ou minimiser les écarts.
Exemple :
Utiliser rouge vif pour une petite variation peut dramatiser les données.

3️⃣ Daltonisme
Certaines personnes ne distinguent pas bien :
Rouge / vert
Bleu / violet

Data Analytics 12
Donc certaines palettes deviennent illisibles.

4️⃣ Saturation excessive


Des couleurs trop contrastées peuvent :
Attirer l’attention sur des éléments non importants
Créer un biais visuel

🎯 Bonne pratique (à écrire à l’examen)


L’utilisation des couleurs peut être trompeuse si la palette n’est pas adaptée
au type de données, si elle induit un biais perceptuel ou si elle ne tient pas
compte des différences culturelles et du daltonisme.

🧠 Règles à retenir
Données quantitatives → palette séquentielle
Données divergentes → palette centrée sur zéro
Données catégoriques → palette discrète
Éviter rouge/vert seul

Quelles sont les bonnes pratiques pour


choisir un encodage visuel ?
✅ Réponse correcte (QCM)
✔ Choisir un encodage visuel basé sur le type et l’importance des données.
📌 Explication basée sur le cours (Part 1 –
Marks & Channels)
Un encodage visuel doit respecter :

1️⃣
Data Analytics 13
1️⃣ Adapter l’encodage au type de données
🔢 Données numériques
Position (meilleur)
Longueur

📊 Données ordinales
Position
Longueur

🏷 Données catégoriques
Couleur (discrète)
Forme

2️⃣ Respecter la hiérarchie perceptuelle


Selon la précision visuelle humaine :
1. Position (plus précis)
2. Longueur
3. Angle
4. Aire
5. Couleur (moins précis pour comparer)
👉 Donc éviter d’utiliser la couleur pour représenter des valeurs numériques
importantes.

3️⃣ Respecter le principe d’Expressivité


Le graphique doit :
Représenter toutes les informations nécessaires
Ne pas ajouter d’informations inutiles

4️⃣ Minimiser la charge cognitive


Data Analytics 14
Éviter surcharge visuelle
Éviter trop de couleurs
Éviter effets décoratifs inutiles

5️⃣ Tenir compte du contexte


Public cible
Objectif analytique (comparaison, corrélation, distribution…)

🧠 Formulation parfaite pour l’examen


Une bonne pratique consiste à choisir un encodage visuel en fonction du
type de données (numériques, ordinales ou catégorielles) et de l’objectif
analytique, tout en privilégiant les canaux les plus précis comme la position
et la longueur, et en respectant le principe d’expressivité.

Quels graphiques utiliser pour montrer


une corrélation ?
✅ 1️⃣ Scatter Plot (Graphique de dispersion) — ✔ Le
plus adapté
🔹 Quand ?
Deux variables numériques continues
On veut analyser une relation

🔹 Pourquoi ?
Chaque point = une observation
Position X = variable 1
Position Y = variable 2
Permet de visualiser :
Corrélation positive

Data Analytics 15
Corrélation négative
Absence de corrélation
Forme non linéaire

🔹 On peut ajouter :
Une ligne de tendance
Le coefficient R²
✔ C’est la réponse correcte dans ton QCM
data viz 2024 t

📈 2️⃣ Line Chart (dans certains cas)


Utilisé si :
Les deux variables évoluent dans le temps
On veut comparer leurs tendances
⚠ Mais ce n’est pas le meilleur pour analyser une corrélation directe.
📦 3️⃣ Heatmap de corrélation
Utilisée quand :
Plusieurs variables numériques
On veut voir les corrélations entre toutes les paires
Exemple :
Matrice de corrélation avec couleurs (−1 à +1)

🚫 Graphiques non adaptés pour


corrélation
Bar chart ❌
Pie chart ❌
Histogramme ❌
Data Analytics 16
Boxplot ❌ (montre distribution, pas relation)
🎯 Formulation parfaite pour l’examen
Le scatter plot est le graphique le plus adapté pour montrer une corrélation
entre deux variables numériques continues, car il permet d’observer la
direction, la force et la forme de la relation.

🧠 Important à ajouter si question longue


Corrélation ≠ causalité
Une relation observée ne signifie pas qu’une variable cause l’autre.

Qu’est-ce qu’une propriété visuelle ?


Une propriété visuelle (ou canal visuel) est un moyen graphique utilisé pour
représenter une variable dans une visualisation.

📊 Principales propriétés visuelles (cours


Part 1)
Position
Longueur
Angle
Aire
Taille
Couleur
Saturation
Forme

Data Analytics 17
🎯 Quelle propriété utiliser selon le type
de données ?
🔢 1️⃣ Pour des valeurs numériques
✔ Position (la plus précise)
✔ Longueur
👉 Réponse correcte dans ton examen :
La propriété la plus adaptée pour représenter des valeurs numériques est la
position
data viz 2024 t

📊 2️⃣ Pour des valeurs ordinales


✔ Longueur
✔ Position
Car il y a un ordre à respecter.

🏷 3️⃣ Pour des données catégoriques


✔ Couleur (discrète)
✔ Forme
🧠 Pourquoi la position est la meilleure ?
Parce que selon la hiérarchie perceptuelle :
1. Position (plus précis)
2. Longueur
3. Angle
4. Aire
5. Couleur (moins précis pour comparer des quantités)

Data Analytics 18
✍️ Formulation parfaite pour l’examen
La propriété visuelle la plus adaptée pour représenter des valeurs
numériques est la position, car elle offre la meilleure précision perceptuelle
pour comparer des quantités.

Le changement de vue dans le temps peut


engendrer…
✅ Réponse attendue :
✔ L’organisation
📌 Explication (basée sur le cours)
Quand une visualisation change dans le temps (animation, transition, évolution
dynamique), cela peut :
Modifier l’organisation visuelle des éléments
Changer la disposition spatiale
Influencer la perception des relations
Créer une nouvelle structure interprétative
👉 L’utilisateur doit réorganiser mentalement l’information à chaque
changement.

🎯 Formulation parfaite pour l’examen


Le changement de vue dans le temps peut engendrer une nouvelle
organisation visuelle des données, modifiant la perception des relations et la
structure interprétative.

⚠ Important
Le changement dans le temps peut :

Data Analytics 19
Améliorer la compréhension si bien conçu
Créer de la confusion si mal contrôlé

Quelle couleur représente les niveaux de


ventes élevés sur une carte mondiale des
ventes ?
✅ Réponse attendue :
✔ Rouge vif
📌 Pourquoi ?
Dans une carte utilisant une palette séquentielle (du faible vers le fort) :
Couleurs claires → valeurs faibles
Couleurs foncées / chaudes → valeurs élevées
Le rouge vif est souvent utilisé pour représenter :
Des niveaux élevés
Une forte intensité
Une valeur importante

🎨 Règle générale (cours Data Viz)


🔹 Données quantitatives (progression)
→ Palette séquentielle (clair → foncé)

🔹 Données divergentes (positif / négatif)


→ Palette centrée sur zéro

🔹 Données catégoriques
→ Palette discrète

Data Analytics 20
✍️ Formulation parfaite pour l’examen
Sur une carte mondiale des ventes utilisant une palette séquentielle, les
niveaux élevés sont généralement représentés par une couleur chaude et
intense comme le rouge vif, indiquant une forte valeur.

⚠ Attention
La couleur dépend toujours :
De la palette choisie
Du contexte
De la légende

C’est un graphique où une série d'images


est générée pour passer en douceur d'un
état à un autre
✅ Réponse correcte :
✔ La transition animée
📌 Explication
Une transition animée :
Génère une séquence d’images
Permet un passage progressif entre deux états
Aide à visualiser l’évolution dans le temps
Maintient la continuité perceptuelle

📊 Exemple
Motion chart

Data Analytics 21
Animation temporelle d’un dashboard
Évolution d’un scatter plot au fil des années

🎯 Formulation parfaite pour l’examen


Une transition animée est une technique de visualisation dynamique où une
série d’images est générée progressivement afin d’assurer une continuité
visuelle entre deux états d’une visualisation.

⚠ Important
Avantage :
Meilleure compréhension des changements
Risque :
Peut désorganiser la perception si trop rapide

📊 Types d’attributs (Types de données)


avec exemples
En visualisation et en analyse de données, on distingue principalement 3 types
d’attributs :

1️⃣ Attribut Catégorique (Nominal)


📌 Définition
Valeurs qualitatives
Pas d’ordre naturel
Sert à identifier ou classer

📌 Exemple
Marque de voiture (Toyota, BMW, Renault)
Pays

Data Analytics 22
Numéro de série d’un livre
Genre (Homme/Femme)

📌 Visualisations adaptées
Bar chart
Pie chart
Treemap

2️⃣ Attribut Ordinal


📌 Définition
Valeurs qualitatives
Avec un ordre logique
Mais sans distance mesurable entre les catégories

📌 Exemple
Taille T-shirt (S, M, L, XL)
Niveau de satisfaction (Faible, Moyen, Élevé)
Classement (1er, 2e, 3e)

📌 Visualisations adaptées
Bar chart ordonné
Line chart (si progression)

3️⃣ Attribut Numérique (Quantitatif)


📌 Définition
Valeurs mesurables
Distance entre valeurs significative

📌 Deux sous-types :
🔹
Data Analytics 23
🔹 a) Discret
Valeurs comptables
Ex : Nombre d’enfants, Nombre de ventes

🔹 b) Continu
Valeurs mesurées
Ex : Taux de décès, Température, Montant d’achat

📌 Visualisations adaptées
Histogramme
Boxplot
Scatter plot
Line chart

🎯 Exemple d’examen (comme dans ton


sujet data viz 2024 t)
Attribut Type
Numéro de série d’un livre Catégorique
Taux de décès Numérique
Taille T-shirt Ordinal
Marque de voiture Catégorique

🧠 Formulation parfaite pour l’examen


Les attributs peuvent être catégoriques (sans ordre), ordinaux (avec ordre)
ou numériques (quantitatifs). Le choix de la visualisation dépend du type
d’attribut.

Qu’est-ce qu’une palette de couleurs ?

Data Analytics 24
Une palette de couleurs est un ensemble organisé de couleurs utilisé pour
représenter des données dans une visualisation.
Le choix dépend du type de données.

📊 1️⃣ Palette Séquentielle


📌 Utilisation
Données quantitatives continues
Valeurs allant du faible au élevé

📌 Structure
Couleur claire → Couleur foncée

📌 Exemple
Ventes
Population
Température

📌 Exemple visuel
Bleu clair → Bleu foncé
Jaune → Rouge

⚖ 2️⃣ Palette Divergente


📌 Utilisation
Données avec point central neutre
Valeurs positives / négatives

📌 Structure
Couleur A → Neutre → Couleur B

📌
Data Analytics 25
📌 Exemple
Bénéfices (+) / Pertes (−)
Variation autour de 0
Taux de croissance

📌 Exemple visuel
Rouge → Blanc → Bleu
✔ C’est la bonne réponse dans ton QCM
data viz 2024 t

🏷 3️⃣ Palette Catégorique (Discrète)


📌 Utilisation
Données qualitatives
Catégories distinctes

📌 Exemple
Pays
Marque
Département
⚠ Pas adaptée aux données numériques continues.
🎯 Règle d’or à écrire à l’examen
Le choix de la palette de couleurs dépend du type de données : séquentielle
pour les données quantitatives, divergente pour les données centrées autour
d’un point neutre, et catégorique pour les données qualitatives.



Erreurs fréquentes
Utiliser palette catégorique pour données numériques

Data Analytics 26
❌ Utiliser rouge/vert (daltonisme)
❌ Utiliser trop de couleurs
❌ Saturation excessive
🧠 Résumé rapide
Type de données Palette adaptée
Numérique Séquentielle
Positif / négatif Divergente
Catégorique Discrète

1️⃣ Palettes Séquentielles


📌 Utilisation
Pour des données numériques continues allant du faible au élevé.

📌 Structure
Une seule teinte avec variation d’intensité :
Clair → Foncé
Faible → Élevé

📌 Exemple
Ventes
Population
Température
Revenus

📌 Objectif
Montrer une progression ou une intensité croissante

Data Analytics 27
🏷 2️⃣ Palettes Catégoriques (Discrètes)
📌 Utilisation
Pour des données qualitatives / nominales

📌 Structure
Couleurs distinctes sans ordre

📌 Exemple
Pays
Marque
Département
Catégorie produit
⚠ Chaque couleur représente une catégorie différente, pas une intensité.
🔢 3️⃣ Palettes Multi-classes
📌 Utilisation
Quand on a plusieurs classes ordonnées, souvent en classification.

📌 Exemple
Niveau de risque (faible, moyen, élevé)
Classes socio-économiques
Tranches de performance
Elles peuvent ressembler à des palettes séquentielles mais sont divisées en
classes distinctes.

⚖ 4️⃣ Palettes centrées sur un point nul


(neutre)

Data Analytics 28
(= Palettes Divergentes)

📌 Utilisation
Pour des données avec :
Valeurs positives et négatives
Un point central important (0, moyenne…)

📌 Structure
Couleur A → Couleur neutre → Couleur B
Exemple :
Rouge → Blanc → Bleu

📌 Exemple
Profit / perte
Variation autour de zéro
Croissance positive / négative
✔ C’est la bonne réponse dans ton QCM pour données divergentes
data viz 2024 t

🎯 Résumé clair pour l’examen


Palette Type de données Exemple
Séquentielle Numérique continue Ventes
Catégorique Qualitative Pays
Multi-classes Classes ordonnées Niveaux
Centrée sur zéro Positif / négatif Profit

🧠 Phrase parfaite à écrire


Le choix de la palette dépend du type de données : séquentielle pour les
données quantitatives, catégorique pour les données qualitatives, multi-

Data Analytics 29
classes pour des classes ordonnées, et divergente (centrée sur un point
neutre) pour des données comportant des valeurs positives et négatives.

🎯 Le principe de codage visuel


Le codage visuel consiste à associer les attributs d’un jeu de données à des
propriétés visuelles (position, couleur, taille, etc.) afin de représenter
l’information graphiquement.
Autrement dit :
Transformer des données abstraites en éléments visuels interprétables.

📊 Deux principes fondamentaux du


codage visuel
1️⃣ Principe d’Expressivité
Un graphique doit :
Représenter toutes les informations contenues dans les données
Représenter uniquement ces informations
Ne pas introduire d’éléments trompeurs
✔ Réponse correcte dans ton QCM : Expressivité
data viz 2024 t

2️⃣ Principe d’Effectivité


Le codage doit :
Utiliser les canaux visuels les plus précis
Faciliter la compréhension
Minimiser les erreurs d’interprétation
Exemple :
Utiliser la position plutôt que la couleur pour comparer des valeurs
numériques.

Data Analytics 30
🎨 Marques & Canaux (base du codage
visuel)
🔹 Marques
Points
Lignes
Aires
Rectangles

🔹 Canaux visuels
Position
Longueur
Taille
Aire
Couleur
Saturation
Forme

🧠 Hiérarchie perceptuelle (à retenir)


Pour comparer des quantités :
1. Position (plus précis)
2. Longueur
3. Angle
4. Aire
5. Couleur (moins précis)

✍️ Formulation parfaite pour l’examen


Data Analytics 31
Le principe de codage visuel consiste à associer les attributs des données à
des propriétés visuelles appropriées, tout en respectant les principes
d’expressivité et d’effectivité afin de garantir une représentation fidèle et
compréhensible.

❓ Le principe où le codage visuel doit


exprimer toutes et uniquement les
informations contenues dans les attributs
du jeu de données
✅ Réponse correcte :
✔ Le principe d’Expressivité
📌 Définition claire
Le principe d’expressivité signifie que :
Le graphique doit représenter toutes les informations pertinentes du
dataset
Il ne doit représenter aucune information supplémentaire ou trompeuse
Autrement dit :
Le codage visuel ne doit ni omettre des données importantes, ni en inventer.

📊

Exemple
Correct :
Un bar chart montrant les ventes par catégorie avec axe proportionnel.
❌ Violation d’expressivité :
Un axe tronqué qui exagère les différences.

🎯 Formulation parfaite pour l’examen


Data Analytics 32
Le principe d’expressivité exige que le codage visuel représente toutes et
uniquement les informations contenues dans les attributs du jeu de données,
sans distorsion ni omission.

⚠ À ne pas confondre
Expressivité → fidélité de l’information
Effectivité → efficacité perceptuelle du canal visuel

Comparer les parts de marché de


plusieurs produits au sein de plusieurs
catégories
Quel type de graphique choisir ?

✅ Réponse correcte :
✔ Diagramme à barres groupées (Grouped Bar Chart)
📌 Pourquoi ?
On veut :
Comparer plusieurs produits
À l’intérieur de plusieurs catégories
Observer les différences côte à côte
Le diagramme à barres groupées permet :
Une comparaison claire entre produits
Une lecture simple par catégorie
Une analyse visuelle précise grâce à la longueur (canal précis)

🎯

Pourquoi pas les autres ?
Diagramme en aires empilées

Data Analytics 33
→ Bon pour évolution temporelle, pas pour comparaison précise.

❌ Diagramme en secteur (Pie chart)


→ Mauvais pour comparer plusieurs groupes simultanément.
❌ Graphique radar
→ Peu précis, difficile à comparer.

🧠 Formulation parfaite pour l’examen


Pour comparer les parts de marché de plusieurs produits au sein de
différentes catégories, le diagramme à barres groupées est le plus adapté,
car il permet une comparaison visuelle claire et précise entre les groupes
grâce à la longueur des barres.

Quel type de graphique est le mieux


adapté pour représenter des relations
entre deux variables continues ?
✅ Réponse correcte :
✔ Scatter Plot (Graphique de dispersion)
📌 Pourquoi ?
Quand on a :
Deux variables numériques continues
On veut analyser une relation
On cherche à observer une corrélation
Le scatter plot est le plus adapté car :
Chaque point représente une observation
Axe X = variable 1
Axe Y = variable 2

Data Analytics 34
Permet de voir :
Corrélation positive
Corrélation négative
Absence de corrélation
Relation linéaire ou non linéaire

📈 On peut ajouter :
Une ligne de tendance
Le coefficient R²
Une troisième variable (taille ou couleur)

❌ Pourquoi pas les autres ?


Bar chart → comparaison de catégories
Line chart → évolution temporelle
Histogramme → distribution d’une seule variable
Boxplot → résumé statistique

✍️ Formulation parfaite pour l’examen


Le scatter plot est le graphique le plus adapté pour représenter la relation
entre deux variables continues, car il permet d’observer la direction, la force
et la forme de la corrélation entre les variables.

⚠ Important à ajouter si question longue :


Corrélation ≠ causalité.

❓ Quel graphique permet le mieux de


présenter une évolution dans le temps ?

Data Analytics 35
Commentez.
✅ Réponse :
✔ Le Line Chart (Graphique en courbe)
📌 Explication
Le line chart est le plus adapté pour représenter une évolution dans le temps
car :
Il montre la continuité des données
Il permet d’identifier facilement :
Les tendances (croissance / baisse)
Les pics
Les fluctuations
Il facilite la comparaison de plusieurs séries temporelles

📊 Pourquoi pas les autres ?


Bar chart → mieux pour comparer des catégories distinctes
Histogramme → montre une distribution, pas une évolution
Pie chart → montre des proportions, pas une dynamique temporelle

🎯 Formulation parfaite pour l’examen


Le graphique en courbe est le plus adapté pour présenter une évolution dans
le temps, car il met en évidence la continuité des données et permet
d’identifier clairement les tendances, variations et fluctuations sur une
période donnée.

🧠 Si tu veux aller plus loin (bonus)


Data Analytics 36
On peut aussi utiliser :
Area chart (si on veut montrer la contribution cumulée)
Motion chart (si on veut animation temporelle)
Mais la réponse principale reste :
✔ Line Chart
Quels graphiques permettent d’afficher la
distribution des variables numériques ?
✅ Les principaux graphiques sont :
1️⃣ Histogramme (le plus classique)
✔ Permet de voir :
La forme de la distribution
La symétrie / asymétrie
La concentration
La dispersion
Les pics (modes)

✔ Utilisé quand :
On veut analyser la répartition des valeurs d’une variable continue.

2️⃣ Boxplot (Boîte à moustaches)


✔ Permet de voir :
Médiane
Quartiles (Q1, Q3)
Étendue
Valeurs aberrantes (outliers)

Data Analytics 37
✔ Utilisé quand :
On veut un résumé statistique clair et comparer plusieurs groupes.

3️⃣ Density Plot (si avancé)


Représentation lissée de l’histogramme.

🎯 Réponse attendue à l’examen


Les graphiques les plus adaptés pour afficher la distribution des variables
numériques sont l’histogramme et le boxplot. L’histogramme montre la forme
complète de la distribution, tandis que le boxplot permet d’identifier les
quartiles et les valeurs aberrantes.

❌ Graphiques non adaptés


Bar chart → comparaison de catégories
Line chart → évolution temporelle
Scatter plot → relation entre deux variables

🧠 Résumé rapide
Graphique Sert à
Histogramme Voir la forme complète
Boxplot Voir résumé statistique
Density plot Distribution lissée

❓ Dans quelle situation un Bar Chart est


le graphique le plus adapté ?
✅ Réponse principale
Un bar chart est le plus adapté lorsqu’on veut :

Data Analytics 38
Comparer des catégories distinctes
Faire un classement
Montrer des différences entre groupes
Comparer des valeurs discrètes

📊 Situations typiques
1️⃣ Comparer des catégories
Exemple :
Ventes par catégorie
Population par pays
Nombre d’étudiants par filière

2️⃣ Faire un classement


Exemple :
Top 10 produits les plus vendus
Classement des régions

3️⃣ Comparer une même mesure entre groupes


Exemple :
Profit par département
Revenu moyen par tranche d’âge

📌 Pourquoi le bar chart est adapté ?


Parce qu’il utilise la longueur comme propriété visuelle, qui est un canal précis
pour comparer des quantités.

❌ Quand ne pas l’utiliser ?


Data Analytics 39
Pour montrer une évolution continue dans le temps → Line chart
Pour analyser une corrélation → Scatter plot
Pour montrer une distribution → Histogramme
Pour données hiérarchiques → Treemap

✍️ Formulation parfaite pour l’examen


Le bar chart est le graphique le plus adapté lorsque l’objectif est de
comparer des valeurs numériques entre différentes catégories distinctes ou
d’établir un classement clair entre plusieurs groupes.

❓ Problème
1000 objets
20 caractéristiques (donc multidimensionnel)
Objectif : analyser les similarités



Réponse recommandée
Heatmap avec clustering (matrice de similarité)
ou
✔ Projection dimensionnelle (ex : PCA) + Scatter plot
📊 Option 1 : Heatmap avec clustering
Pourquoi ?
Les données peuvent être transformées en matrice de similarité
1000 objets → Scatter plot simple devient illisible
La heatmap permet :
Visualiser des patterns globaux
Identifier des groupes similaires

Data Analytics 40
Voir des blocs (clusters)

Avantage :
Bonne scalabilité

📈 Option 2 : PCA + Scatter Plot


On réduit les 20 dimensions à 2 dimensions.
Ensuite :
Chaque point = un objet
Proximité = similarité
Avantage :
Vision globale
Regroupements visibles

❌ Pourquoi pas un bar chart ?


Ne montre pas similarité
Pas adapté au multidimensionnel

🎯 Réponse parfaite à écrire à l’examen


Pour analyser les similarités entre 1000 objets basés sur 20 caractéristiques,
une heatmap avec clustering est adaptée, car elle permet de représenter une
matrice de similarité et d’identifier visuellement des groupes d’objets
similaires. Une projection dimensionnelle comme la PCA suivie d’un scatter
plot peut également être utilisée pour visualiser les regroupements dans un
espace réduit.

🧠 Ce que le prof veut voir


Scalabilité

Data Analytics 41
Multidimensionnalité
Justification du choix
Compréhension des limites perceptuelles

🌳 Tree Map (Treemap)


✅ 1️⃣ Principe
Un treemap est une visualisation utilisée pour représenter des données
hiérarchiques sous forme de rectangles imbriqués.
Chaque rectangle représente une catégorie ou sous-catégorie.
La surface du rectangle correspond à une valeur quantitative.
Les rectangles sont organisés selon la hiérarchie des données.
👉 Il permet de visualiser la structure et la proportion simultanément.
🎨

2️⃣ Marques utilisées
Marque principale : Aire (rectangle)
Chaque rectangle représente un élément (branche ou feuille).

🎨 3️⃣ Canaux visuels utilisés


Surface (aire) → représente une valeur numérique
Couleur → peut représenter :
Une autre variable quantitative
Une catégorie
Position / organisation spatiale → montre la hiérarchie

📊 4️⃣ Dans quel cas l’utiliser ?


Un treemap est adapté lorsque :
Les données sont hiérarchiques

Data Analytics 42
On veut analyser une répartition part-to-whole
On veut voir quelles sous-catégories dominent
On a beaucoup de catégories

Exemple :
Ventes par catégorie → sous-catégorie
Budget par département → service
Structure d’un portefeuille d’investissement

⚠ Limites
Comparaison précise difficile (aire moins précise que longueur)
Peut devenir confus si trop de petites catégories

🎯 Réponse parfaite à écrire à l’examen


Le treemap est une visualisation hiérarchique utilisant des rectangles
imbriqués. Les marques sont des aires rectangulaires, et les principaux
canaux visuels sont la surface (représentant une valeur quantitative) et la
couleur. Il est utilisé pour représenter des données hiérarchiques et analyser
la répartition proportionnelle des sous-catégories.

Ci-joint (graphique A, B, C et F) quatre codages


visuels différents. déterminer pour chaque
graphique, les marques et les canaux utilisés,
expliquer comment ils sont utilisés et analyser les
avantages et / ou les inconvénients de chaque
graphique

🔵 Figure A – (Life expectancy vs Fertility)


🔹
Data Analytics 43
🔹 Type de graphique
Scatter plot (graphique de dispersion)

🔹 Marques utilisées
Points
Chaque point représente un pays.

🔹 Canaux visuels
Position X → Fertility
Position Y → Life expectancy
Taille → Population (si variable proportionnelle visible)
Couleur → Région / groupe

🔹 Comment ils sont utilisés


La position encode deux variables numériques continues, permettant
d’observer la relation.
La taille ajoute une troisième variable quantitative.
La couleur distingue des catégories.

🔹 Avantages
Excellent pour montrer corrélation
Permet visualisation multidimensionnelle
Permet ajout de ligne de tendance

🔹 Inconvénients
Peut devenir surchargé avec beaucoup de points
Interprétation difficile si chevauchement important

🔵 Figure B – Carte avec flux


🔹
Data Analytics 44
🔹 Type de graphique
Carte géographique avec superposition de flux (Flow map)

🔹 Marques utilisées
Polygones (territoires)
Lignes (flux)

🔹 Canaux visuels
Position spatiale réelle → localisation géographique
Épaisseur des lignes → volume
Couleur → intensité ou catégorie

🔹 Comment ils sont utilisés


La position encode la localisation.
Les lignes représentent les connexions ou flux entre régions.

🔹 Avantages
Intuitif pour données géographiques
Montre relations spatiales

🔹 Inconvénients
Peut devenir illisible si trop de flux
Superposition excessive possible

🔵 Figure C – Small Multiples


🔹 Type de graphique
Petits multiples (plusieurs mini line charts)

🔹 Marques utilisées
Data Analytics 45
Lignes

🔹 Canaux visuels
Position X → Temps
Position Y → Valeur
Encodage identique dans chaque sous-graphe

🔹 Comment ils sont utilisés


Même encodage visuel répété pour différents pays ou catégories.

🔹 Avantages
Comparaison claire entre groupes
Évite surcharge d’un seul graphique
Bonne lisibilité

🔹 Inconvénients
Prend plus d’espace
Comparaison précise nécessite effort visuel

🔵 Figure F – Heatmap avec clustering


🔹 Type de graphique
Heatmap (matrice)

🔹 Marques utilisées
Rectangles (cellules)

🔹 Canaux visuels
Couleur → valeur numérique
Organisation en matrice (lignes × colonnes)

🔹
Data Analytics 46
🔹 Comment ils sont utilisés
Chaque cellule encode une valeur par intensité de couleur.
Le clustering organise les lignes/colonnes pour révéler des patterns.

🔹 Avantages
Bonne scalabilité
Permet identifier rapidement des patterns
Adapté aux grands volumes

🔹 Inconvénients
Comparaison précise difficile
Dépend fortement du choix de palette

🎯 Conclusion générale à écrire en fin de


réponse
Ces quatre graphiques illustrent différents codages visuels :
Figure A → position comme canal principal (relation)
Figure B → position spatiale + superposition
Figure C → coordination de vues (petits multiples)
Figure F → couleur comme canal principal (matrice)
Chaque graphique est adapté à un objectif analytique spécifique (corrélation,
flux géographique, comparaison temporelle, similarité).

(graphique C, D et E) Quel type de coordination des


vues est utilisé (vue unique, multiformes, petits
multiples, juxtaposition de vue, superposition de
vue) ? Justifiez votre choix très brièvement en
indiquant si le codage visuel (shared encoding) est le
même ou différents et si les données (shared data)
sont partagées

Data Analytics 47
🔵 Graphique C
✅ Type de coordination
✔ Petits multiples (Small Multiples)

🔹 Shared Encoding
✔ Même encodage visuel
Même type de graphique (line chart)
Même axes
Même codage position X / Y

🔹 Shared Data
❌ Données différentes (chaque sous-graphe représente un pays ou une
catégorie différente)

🎯 Justification courte à écrire


Le graphique C utilise des petits multiples car plusieurs graphiques similaires
sont répétés avec le même encodage visuel mais pour des données
différentes, facilitant la comparaison entre groupes.

🔵 Graphique D
✅ Type de coordination
✔ Juxtaposition de vues

🔹 Shared Encoding
❌ Encodage visuel différent (plusieurs types de graphiques dans un
dashboard)

🔹 Shared Data
✔ Données partagées (même dataset)

🎯
Data Analytics 48
🎯 Justification courte à écrire
Le graphique D correspond à une juxtaposition de vues car plusieurs
visualisations différentes sont placées côte à côte, utilisant les mêmes
données mais avec des encodages visuels différents.

🔵 Graphique E
D’après la figure E (comparaison côte à côte de deux représentations
similaires).

✅ Type de coordination
✔ Juxtaposition de vues

🔹 Shared Encoding
❌ Encodage différent entre les sous-graphes

🔹 Shared Data
✔ Données similaires ou partagées

🎯 Justification courte à écrire


Le graphique E utilise une juxtaposition de vues, car plusieurs
représentations sont affichées côte à côte avec des encodages différents
mais basées sur les mêmes données.

🧠 Résumé clair pour l’examen


Graphique Type Shared Encoding Shared Data
C Petits multiples Même Différentes
D Juxtaposition Différent Partagées
E Juxtaposition Différent Partagées

Data Analytics 49
⚠ Ce que le prof veut voir
Compréhension de coordination des vues
Différence entre petits multiples et juxtaposition
Mention explicite de shared encoding et shared data

Présenter une évolution des ventes sur 12


mois
Quel graphique utiliser et pourquoi ?

✅ Graphique recommandé :
✔ Line Chart (Graphique en courbe)
📌 Justification
Le line chart est le plus adapté pour représenter une évolution dans le temps
car :
Les 12 mois représentent une dimension temporelle continue
Il permet d’identifier clairement :
Les tendances (hausse / baisse)
Les pics saisonniers
Les fluctuations mensuelles
Il montre la continuité entre les points
La propriété visuelle principale utilisée est la position, qui est le canal le plus
précis pour représenter des valeurs numériques.

📊 Pourquoi pas un bar chart ?


Un bar chart pourrait montrer les ventes mensuelles, mais :
Il ne met pas bien en évidence la continuité
Il rend l’analyse de tendance moins intuitive

Data Analytics 50
🎯 Réponse parfaite à écrire à l’examen
Pour présenter l’évolution des ventes sur 12 mois, le graphique en courbe
(line chart) est le plus adapté car il permet de visualiser la continuité
temporelle, d’identifier les tendances et de détecter les variations
saisonnières de manière claire et précise.

Comparer les ventes de différentes


catégories sur une année
Quel graphique utiliser ?

✅ Graphique recommandé :
✔ Diagramme à barres (Bar Chart)
(éventuellement barres groupées si plusieurs sous-catégories)

📌 Justification
On veut :
Comparer des catégories distinctes
Sur une période donnée (une année complète)
Observer quelle catégorie performe le plus
Le bar chart est adapté car :
Il utilise la longueur, qui est un canal visuel précis
Il permet un classement clair
Il facilite la comparaison visuelle entre groupes

📊 Si on veut aller plus loin


Si on veut comparer les catégories mois par mois sur l’année, on peut utiliser :
✔ Line chart multi-séries
ou

Data Analytics 51
✔ Bar chart groupé par mois
❌ Pourquoi pas un pie chart ?
Mauvais pour comparer plusieurs catégories précisément
Peu adapté quand il y a beaucoup de catégories

🎯 Réponse parfaite à écrire à l’examen


Pour comparer les ventes de différentes catégories sur une année, le
diagramme à barres est le plus adapté car il permet une comparaison claire
et précise entre catégories grâce à la longueur des barres, facilitant ainsi le
classement et l’analyse des performances.

Présenter les ventes par région


Quel graphique utiliser ?

✅ Graphique recommandé :
✔ Carte géographique (Choropleth Map)
ou
✔ Diagramme à barres (si on ne veut pas utiliser la dimension spatiale)
📌 Cas 1 : Si la dimension géographique
est importante
✔ Carte (Choropleth Map)
Justification :
Les régions ont une dimension spatiale réelle
La position géographique facilite la compréhension
La couleur (palette séquentielle) représente l’intensité des ventes
Permet d’identifier rapidement les zones performantes

Data Analytics 52
📌 Cas 2 : Si l’objectif est la comparaison
précise
✔ Bar Chart
Justification :
La longueur est un canal plus précis que la couleur
Meilleur pour comparer quantitativement les régions
Permet un classement clair

🎯 Réponse parfaite à écrire à l’examen


Pour présenter les ventes par région, une carte géographique est adaptée si
l’on souhaite mettre en évidence la dimension spatiale et identifier les zones
performantes. Toutefois, pour une comparaison plus précise des valeurs, un
diagramme à barres peut être plus efficace grâce à la précision du canal
longueur.

🧠 Ce que le prof aime voir


Compréhension du contexte
Justification basée sur les propriétés visuelles
Mention de la palette séquentielle

Les ventes par région et par catégorie


🟢 Cas 1 : Une dizaine de catégories
(nombre modéré)
✅ Graphique recommandé :
Data Analytics 53
✔ Diagramme à barres groupées
ou
✔ Barres empilées
📌 Pourquoi ?
Quand on a environ 10 catégories :
Le bar chart groupé permet de comparer :
Les régions
Les catégories à l’intérieur de chaque région
La longueur est un canal précis
La lecture reste claire

Alternative :
Barres empilées si on veut montrer la contribution de chaque catégorie au total
régional.

🧠 Justification à écrire :
Lorsque le nombre de catégories est modéré (une dizaine), un diagramme à
barres groupées est adapté car il permet une comparaison claire entre
régions et catégories grâce au canal longueur.

🔴 Cas 2 : Très grand nombre de


catégories
❗ Problème
Le bar chart devient illisible
Trop de couleurs
Surcharge visuelle


Data Analytics 54
✅ Graphique recommandé :
✔ Treemap
ou
✔ Heatmap
📌 Pourquoi ?
🔹 Treemap
Adapté aux nombreuses catégories
Bonne visualisation hiérarchique (région → catégorie)
Compact

🔹 Heatmap
Permet une matrice région × catégorie
Bonne scalabilité
Couleur encode intensité

🎯 Réponse parfaite à écrire à l’examen


Lorsque le nombre de catégories est limité (environ 10), un diagramme à
barres groupées est adapté pour comparer les ventes par région et par
catégorie. En revanche, si le nombre de catégories est très élevé, un
treemap ou une heatmap est préférable afin d’éviter la surcharge visuelle et
d’améliorer la lisibilité.

🧠 Ce que le prof veut voir


Notion de scalabilité
Adaptation du graphique au volume
Justification basée sur lisibilité

Data Analytics 55
Proposez un graphique pour analyser les
relations de corrélation entre les ventes
de certaines catégories
✅ Graphique recommandé :
✔ Scatter Plot (Graphique de dispersion)
📌 Pourquoi ?
Pour analyser une corrélation, on a :
Deux variables numériques continues
(ex : ventes catégorie A vs ventes catégorie B)
Le scatter plot permet :
De visualiser la relation entre les deux catégories
D’identifier :
Corrélation positive
Corrélation négative
Absence de corrélation
D’ajouter une ligne de tendance
De calculer R²

📊 Exemple
Axe X → Ventes catégorie A
Axe Y → Ventes catégorie B
Chaque point → une région ou une période

📈

Si plusieurs catégories
Matrice de scatter plots

Data Analytics 56
ou
✔ Heatmap de corrélation
🎯 Réponse parfaite à écrire à l’examen
Pour analyser la relation de corrélation entre les ventes de différentes
catégories, le graphique de dispersion (scatter plot) est le plus adapté, car il
permet d’observer la direction, la force et la forme de la relation entre deux
variables numériques continues.

⚠ Important à ajouter
Corrélation ne signifie pas causalité.

Permettre à l'utilisateur de choisir une


plage de date ou une catégorie
✅ Concept utilisé :
✔ Filtre
📌 Justification
Un filtre permet :
De restreindre les données affichées
De sélectionner une période spécifique
De choisir une ou plusieurs catégories
D’adapter dynamiquement la visualisation
Le filtre agit directement sur le dataset affiché.

🎯 Réponse parfaite à écrire à l’examen


Data Analytics 57
Le concept utilisé est le filtre, car il permet à l’utilisateur de sélectionner une
plage de dates ou une catégorie spécifique afin de restreindre les données
affichées et d’adapter dynamiquement la visualisation.

⚠ À ne pas confondre
Filtre → réduit les données affichées
Highlight → met en évidence sans supprimer
Agrégation → regroupe les données
Superposition → combine plusieurs graphiques

Afficher les catégories vendues dans


chaque région sélectionnée
✅ Concept utilisé :
✔ Highlight
ou
✔ Filtre croisé (Cross-filtering)
(La réponse la plus attendue ici est souvent Filtre croisé.)

📌 Justification
Lorsque l’utilisateur sélectionne une région :
Les catégories correspondantes sont mises à jour automatiquement
Les autres données peuvent être masquées ou mises en évidence
Si la sélection réduit les données affichées →
👉 Filtre croisé
Si la sélection met seulement en évidence sans supprimer →
👉 Highlight

Data Analytics 58
🎯 Réponse parfaite à écrire à l’examen
Le concept utilisé est le filtre croisé, car la sélection d’une région met à jour
dynamiquement les catégories affichées en fonction des données associées
à cette région.

🧠 Ce que le prof veut voir


Compréhension de l’interaction entre vues
Différence entre filtre et highlight
Notion de coordination des vues

Comparer l’évolution des ventes par


catégories
✅ Concept utilisé :
✔ Juxtaposition de vues
ou
✔ Superposition (si plusieurs courbes dans le même graphique)
📌 Cas 1 : Plusieurs courbes dans un
même graphique
✔ Superposition
Une seule vue
Plusieurs catégories représentées par différentes couleurs
Permet de comparer directement les tendances
👉 Avantage : comparaison directe
👉 Inconvénient : peut devenir chargé si trop de catégories

Data Analytics 59
📌 Cas 2 : Une courbe par catégorie
séparément
✔ Juxtaposition de vues
ou
✔ Petits multiples
Même encodage
Données différentes par catégorie
Meilleure lisibilité si nombreuses catégories

🎯 Réponse parfaite à écrire à l’examen


Pour comparer l’évolution des ventes par catégories, on peut utiliser la
superposition en affichant plusieurs courbes dans un même graphique afin
de comparer directement les tendances. Si le nombre de catégories est
élevé, les petits multiples ou la juxtaposition de vues permettent une
meilleure lisibilité.

🧠 Ce que le prof veut voir


Compréhension de la coordination des vues
Notion de scalabilité
Justification basée sur lisibilité

Afficher progressivement les ventes sur


l’année lorsqu’on agrandit la zone
d’affichage
✅ Concept utilisé :
✔ Zoom (interaction)
ou

Data Analytics 60
✔ Filtre dynamique lié au zoom
📌 Justification
Lorsque l’utilisateur agrandit la zone d’affichage :
La visualisation révèle progressivement plus de détails
Les données deviennent plus précises (ex : passer de vue annuelle →
mensuelle → quotidienne)
Cela permet une exploration hiérarchique des données
Le zoom est une interaction qui modifie le niveau de détail sans changer la
structure globale.

🎯 Réponse parfaite à écrire à l’examen


Le concept utilisé est le zoom interactif, car l’agrandissement de la zone
d’affichage permet de révéler progressivement un niveau de détail plus fin
dans les données temporelles.

🧠 Ce que le prof veut voir


Compréhension des interactions
Différence entre filtre et zoom
Notion de niveau de détail (LOD)

Proposez un graphique qui va vous


permettre d’afficher l’évolution des ventes
par catégorie pour toutes les catégories.
✅ Graphique recommandé :
✔ Line chart multi-séries (courbes superposées)
ou

Data Analytics 61
✔ Petits multiples (Small multiples)
📌

Cas 1 : Nombre modéré de catégories
Line chart multi-séries
Axe X → Temps
Axe Y → Ventes
Une couleur différente par catégorie

Pourquoi ?
Permet de comparer directement les tendances
Met en évidence la continuité temporelle
Facilite l’analyse des variations entre catégories
⚠ Limite : peut devenir illisible si trop de catégories.
📌

Cas 2 : Grand nombre de catégories
Petits multiples (un line chart par catégorie)
Même encodage
Données séparées
Meilleure lisibilité

Pourquoi ?
Évite surcharge visuelle
Permet comparaison claire
Bonne scalabilité

🎯 Réponse parfaite à écrire à l’examen


Pour afficher l’évolution des ventes par catégorie, un line chart multi-séries
est adapté lorsque le nombre de catégories est limité, car il permet de
comparer directement les tendances. En cas de grand nombre de catégories,

Data Analytics 62
les petits multiples sont préférables afin d’améliorer la lisibilité et d’éviter la
surcharge visuelle.

🧠 Ce que le prof attend


Mention de la dimension temporelle
Justification par la continuité
Notion de scalabilité

Objectif
Créer 2 dashboards :
1️⃣ Analyse globale des ventes
2️⃣ Analyse par région et par catégorie
Dataset :
Âge des clients
Catégorie de produits
Produits
Date d’achat
Montant d’achat
Pays

🟢 DASHBOARD 1 : Analyse globale des


ventes
📊 1️⃣ Répartition des clients par âge
✔ Histogramme
Pourquoi ?
Âge = variable numérique continue

Data Analytics 63
Permet d’analyser distribution
Identifier tranches dominantes

📊 2️⃣ Répartition des clients par âge et par catégorie


✔ Bar chart empilé
ou
✔ Heatmap (Âge × Catégorie)
Pourquoi ?
Permet comparaison croisée
Visualise popularité selon âge

📊 3️⃣ Répartition des achats par catégorie et sous-


catégorie
✔ Treemap
Pourquoi ?
Données hiérarchiques (catégorie → sous-catégorie)
Montre part-to-whole
Compact

📊 4️⃣
d’âge
Catégories les plus populaires selon tranches
✔ Bar chart groupé
Axe X : Tranches d’âge
Axe Y : Montant / nombre ventes
Couleur : Catégorie

📊 5️⃣ Catégories les plus vendues


✔ Bar chart trié décroissant
Data Analytics 64
Classement clair
Utilise longueur (canal précis)

🔵

Interactions utilisées (Dashboard 1)
Filtres
Date
Pays
Catégorie
✔ Filtre croisé
Sélectionner une tranche d’âge met à jour autres graphiques
✔ Highlight
Met en évidence catégorie sélectionnée
✔ Tooltips (Info-bulles)
Afficher détails précis

🎯 Justification interaction
Les filtres permettent une exploration dynamique, le filtre croisé assure la
coordination des vues, et les infobulles offrent un niveau de détail sans
surcharger la visualisation.

🔵 DASHBOARD 2 : Analyse par région et


catégorie
📍 1️⃣ Ventes par pays
✔ Carte (Choropleth Map)
Position géographique
Couleur séquentielle (intensité ventes)

Data Analytics 65
📊 2️⃣ Ventes par catégorie dans chaque région
✔ Bar chart groupé
ou
✔ Heatmap région × catégorie
📈 3️⃣ Évolution des ventes par région
✔ Line chart multi-séries
📊 4️⃣ Catégories dominantes par région
✔ Treemap par région
ou
✔ Bar chart trié
🔵

Interactions utilisées (Dashboard 2)
Filtre région
✔ Filtre date
✔ Drill-down
Région → Pays → Ville
✔ Superposition
Plusieurs courbes dans même graphique
✔ Juxtaposition
Carte + bar chart + line chart

🎯 Justification interactions
L’utilisation du filtre régional permet une analyse ciblée, le drill-down facilite
l’exploration hiérarchique, et la juxtaposition de vues améliore la
compréhension globale en combinant plusieurs perspectives analytiques.

Data Analytics 66
🧠 Ce que le prof veut voir
Bon choix graphique selon type de données
Mention de hiérarchie
Notion de coordination des vues
Interaction dynamique
Justification claire

✍️ Conclusion à écrire
Ces deux dashboards permettent une analyse globale et régionale des
ventes en combinant des visualisations adaptées au type de données et des
interactions dynamiques facilitant l’exploration et la prise de décision.

Data Analytics 67

Vous aimerez peut-être aussi