0% ont trouvé ce document utile (0 vote)
41 vues171 pages

Introduction à la Data Science et DaaS

Le document présente une introduction à la Data Science, décrivant son évolution historique, ses composantes principales et son importance croissante dans le monde moderne. Il aborde également le concept de DaaS (Data as a Service), ses avantages, son architecture et les défis associés. Enfin, il souligne le rôle clé de la Data Science dans la prise de décision éclairée et l'optimisation des processus d'affaires.

Transféré par

gharbiabdo2608
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
41 vues171 pages

Introduction à la Data Science et DaaS

Le document présente une introduction à la Data Science, décrivant son évolution historique, ses composantes principales et son importance croissante dans le monde moderne. Il aborde également le concept de DaaS (Data as a Service), ses avantages, son architecture et les défis associés. Enfin, il souligne le rôle clé de la Data Science dans la prise de décision éclairée et l'optimisation des processus d'affaires.

Transféré par

gharbiabdo2608
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Introduction

à la Data Science
par Cdt Nour Elhak FRADI
PLAN

01 Introduction
02 DaaS: Aspect fondamentaux
03 Architecture de DaaS
04 Avantages et défis
01
Introduction
01 Introduction

▪ 1962, dans The future of Data Analysis, John Wilder


Tukey, dit préférer le terme de « data analysis » à
celui de statistique.

▪ 1974, la Data Science est mise en avant au sein d’œuvres universitaires


comme Concise Survey of Computer Methods de Peter Naur.

▪ 2002-2003, Lancement en avril 2002 du Data Science Journal puis en


janvier 2003 du Journal of Data Science.

▪ 2010-2012, L’explosion du terme Data Science. Les les offres d’emploi


pour le poste de Data Scientist ont augmenté de plus de 15 000%

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 4
01 Introduction

▪ Smartphones : Il y a environ 6 à 7 milliards de


smartphones en circulation dans le monde.

▪ Appareils IoT : On estime qu'il y a environ 15 à 20


milliards d'appareils IoT dans le monde.

Ce chiffre inclut une large gamme d'objets connectés


comme les appareils domestiques intelligents, les
capteurs industriels, les équipements de santé, et plus
encore.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 5
01 Introduction
▪ Explosion du volume de données les dernières années.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 6
01 Introduction
* Définition sémantique
« Data » « Science »

▪ Données ▪ Science, méthodes scientifiques :


▪ Informations transmises ou stockées o Mathématiques
par voie électronique o Statistiques
o Informatique
o …

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 7
01 Introduction
* Définition analytique

▪ La Data science ou science de données est une discipline


▪ Exploiter et analyser des données brutes

→ les transformer en informations précieuses

→ Résoudre un problème dans l’entreprise


▪ La data science est une démarche empirique qui se base sur les données pour apporter
une réponse à un problème

▪ La data science, ou science des données, est un domaine interdisciplinaire qui utilise des
techniques scientifiques, des algorithmes, des processus et des systèmes pour extraire des
connaissances et des insights (informations clés) à partir de données structurées ou non
structurées.

▪ Elle s'appuie sur un large éventail de méthodes issues de plusieurs disciplines, notamment
les statistiques, l'informatique, et les mathématiques, pour analyser et interpréter les
données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 8
01 Introduction
* Data Science

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 9
01 Introduction
* Composantes principales de la data science :
1. Collecte des données : La première étape consiste à recueillir des données à partir de diverses sources.
2. Préparation et nettoyage des données : Cette étape consiste à rendre les données utilisables, en traitant les valeurs
manquantes, en éliminant les anomalies, et en transformant les données en un format adapté pour l'analyse.
3. Analyse des données : Les analystes utilisent des algorithmes et des méthodes statistiques pour identifier des
tendances, des modèles et des relations dans les données.
4. Modélisation : On construit des modèles prédictifs ou explicatifs à l'aide de techniques telles que l'apprentissage
automatique (machine learning) ou l'intelligence artificielle (IA).
5. Interprétation des résultats : Les insights obtenus à partir des données sont interprétés afin de prendre des
décisions informées. La visualisation des données est souvent utilisée pour rendre les résultats plus
compréhensibles.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  10
01 Introduction
* Pourquoi la Data Science ?

▪ L'explosion des données ▪ Personnalisation


▪ Prise de décision éclairée ▪ Résolution de problèmes complexes
▪ Automatisation et optimisation ▪ Prédictions fiables
▪ Avantages concurrentiels ▪ Amélioration de la productivité

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  11
01 Introduction
* Les métiers Data
▪ Le « Data Analyst » est celui qui va analyser les données, avec des chiffres, Analyser des données pour que le
manager puisse prendre des décisions.

▪ Le « Data Scientist » il Explore, fouille, et analyse des données mais d’une manière plus poussée. Il fait appel à des
procédés mathématiques scientifiques pour analyser les données et des algorithmes avancés pour résoudre des
problèmes métier.

▪ Le « Data Engineer » ▪ Le « Data Steward »


Développe et assure la Le contrôleur qualité et
maintenance de métier des données
l’infrastructure technique
fait évoluer cette
infrastructure.

▪ Le «Data Protection Officer» ▪ Le «Chief Data Officer»


Le commissaire de la bonne Le chef d’orchestre de la
application de la transformation data,
règlementation autour des directeur des données
données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  12
02
DaaS: Aspect
fondamentaux
02 DaaS: Aspect fondamentaux
* C’est quoi le DaaS ?
▪ Le DaaS (Data as a Service), ou « données en tant que service »,
est un modèle qui permet aux utilisateurs d'accéder aux données
via une plateforme ou un réseau, souvent via le cloud, sans avoir
à gérer les infrastructures de stockage ou les traitements
nécessaires.

▪ Cela permet aux entreprises et aux utilisateurs d'obtenir des


données structurées ou non structurées sans avoir à investir
dans des infrastructures complexes de stockage et d'analyse des
données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  14
02 DaaS: Aspect fondamentaux
* Pourquoi le DaaS ?
▪ Les données deviennent une denrée de plus en plus précieuse.

▪ Les données sont le moteur de l'apprentissage automatique, de


la détection des fraudes et de nombreuses autres applications
sophistiquées.

▪ Il vous faudra:
• Collecter / acheter des données
• Avoir les ressources matériels
• Coder ou faire appel à des ingénieurs coûteux pour y parvenir

→ Données en tant que service entrent en jeu


→ Les fournisseurs de DaaS donnent accès aux données stockées
dans leurs systèmes en nuage sans que le client ait besoin
d'ingénierie ou de codage.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  15
02 DaaS: Aspect fondamentaux
* Aspect fondamentaux

▪ Accessibilité : Les données sont accessibles depuis n'importe où, à n'importe quel moment.

▪ Scalabilité : Le DaaS est conçu pour être scalable. Cela signifie que les utilisateurs peuvent
augmenter ou diminuer les volumes de données traitées et stockées en fonction de leurs besoins,
sans avoir à investir dans des infrastructures supplémentaires.

▪ Réduction des coûts : Avec le DaaS, les entreprises n'ont plus besoin de maintenir des centres de
données complexes ou d'investir dans des solutions de stockage onéreuses. Les données sont
hébergées par des fournisseurs de services cloud, ce qui réduit considérablement les coûts liés à la
maintenance et à la gestion des infrastructures.

▪ Facilité d'intégration : Le DaaS permet l’intégration simple avec d'autres systèmes et applications
via des API. Cela facilite l'extraction, la transformation et le chargement des données dans d'autres
plateformes sans avoir besoin d’opérations manuelles lourdes.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  16
02 DaaS: Aspect fondamentaux
* Aspect fondamentaux

▪ Sécurité des données : Les fournisseurs de DaaS investissent massivement dans la sécurité pour
protéger les données sensibles. Cela inclut des mesures de chiffrement, des contrôles d’accès, et
des audits réguliers pour garantir que les données des clients sont protégées contre les violations
ou les pertes.

▪ Qualité des données : Le DaaS améliore la qualité des données grâce à une gestion centralisée,
avec des processus standardisés pour la validation, la transformation et l'enrichissement des
données avant qu'elles ne soient accessibles par les utilisateurs.

▪ Flexibilité et personnalisation : Les utilisateurs peuvent personnaliser les services DaaS en


fonction de leurs besoins. Cela inclut l’accès à des ensembles de données spécifiques ou
l'application de règles de gestion de données propres à leur entreprise.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  17
03
Architecture
de DaaS
03 Architecture de DaaS

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  19
03 Architecture de DaaS
* Aspect fondamentaux

▪ Source de données (Data Sources) :


• Les données proviennent de différentes sources, qu'elles soient internes (comme les
bases de données d’entreprise, les systèmes ERP, CRM, etc.) ou externes (données
publiques, données du marché, données des réseaux sociaux).
• Ces sources peuvent inclure des données structurées (bases de données relationnelles),
semi-structurées (fichiers JSON, XML), ou non structurées (texte, images).

▪ Interface d’accès (API et services web) :


• API (Application Programming Interface) : Elles permettent également l'intégration avec d'autres systèmes
et applications.
• Services Web : Permettent l’échange de données entre l'application cliente et la plateforme DaaS via des
protocoles comme REST ou SOAP.

▪ Cloud et infrastructure de stockage (Cloud Storage) :


• Stockage dans le cloud : Les données sont hébergées et stockées sur des
infrastructures cloud qui assurent une grande capacité de stockage, la résilience,
et la haute disponibilité des données.
• Scalabilité : L’architecture DaaS est conçue pour évoluer en fonction des besoins,
permettant d'augmenter ou de réduire facilement la capacité de stockage en
fonction du volume de données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  20
03 Architecture de DaaS
* Aspect fondamentaux

▪ Gestion et traitement des données (Data Management Layer) :


• Transformation des données : Les données brutes provenant de diverses sources sont nettoyées,
transformées et formatées pour être utilisables.
• Enrichissement des données : Processus d'enrichissement des données, ajoutant des informations
supplémentaires pour améliorer leur valeur.
• Qualité des données : Garantir leur exactitude, cohérence, et intégrité.

▪ Sécurité et confidentialité des données (Data Security Layer) :


• Chiffrement des données : Les données en transit et stockées sont chiffrées pour empêcher tout accès non
autorisé.
• Contrôle d’accès : L'architecture DaaS intègre des mécanismes de contrôle d’accès basés sur les rôles (RBAC)
pour garantir que seules les personnes autorisées puissent accéder à certaines données sensibles.
• Audit et traçabilité : Les systèmes DaaS enregistrent toutes les interactions avec les données, permettant de
suivre qui a accédé aux données, quand et pourquoi, afin d’assurer la conformité réglementaire.

▪ Gestion des utilisateurs (User Management) :


• Accès multi-locataires : Plusieurs utilisateurs ou organisations peuvent accéder à la même plateforme, avec
une isolation des données pour chaque locataire.
• Personnalisation : Chaque utilisateur ou client peut personnaliser les services et les ensembles de données
auxquels ils ont accès en fonction de leurs besoins spécifiques.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  21
•Reprise après sinistre : Des systèmes de sauvegarde et de restauration sont intégrés p
03 Architecture de DaaS
* Aspect fondamentaux

▪ Distribution et livraison des données (Data Delivery) :


• Formats multiples : Les données peuvent être livrées sous différents formats selon
les besoins des utilisateurs (par exemple, CSV, JSON, XML). Cela permet une
flexibilité d'utilisation dans diverses applications.
• Temps réel ou batch : Les données peuvent être fournies en temps réel (streaming)
ou par lots (batch processing), selon l'architecture et les besoins des utilisateurs.

▪ Automatisation et orchestration (Automation Layer):


• Automatisation des processus : Les tâches telles que l'extraction, la transformation, et la mise à jour des
données peuvent être automatisées pour optimiser la performance et réduire les interventions humaines.
• Orchestration : L'architecture DaaS comprend souvent des outils pour orchestrer et superviser les flux de
données afin de garantir que les processus se déroulent de manière fluide et efficace.

▪ Disponibilité et résilience (Availability and Resilience)


• Haute disponibilité : L’architecture DaaS garantit un accès constant aux données avec des mécanismes de
redondance pour éviter les interruptions de service.
• Reprise après sinistre : Des systèmes de sauvegarde et de restauration sont intégrés pour protéger les
données contre les pannes ou les catastrophes.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  22
04
Avantages
et défis
04 Avantages et défis
* Avantages

▪ Accès à distance et flexibilité


▪ Réduction des coûts
▪ Scalabilité
▪ Simplification de la gestion des données
▪ Meilleure qualité des données
▪ Sécurité améliorée
▪ Facilité d'intégration
▪ Innovation accélérée

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  24
04 Avantages et défis
* Défis

▪ Confidentialité des données et conformité aux lois


▪ Problèmes de sécurité
▪ Dépendance aux fournisseurs
▪ Performance et latence
▪ Disponibilité et continuité de service

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  25
Modern Business
Intelligence
par Cdt Nour Elhak FRADI
PLAN

01 Introduction
02 Big Data Analytics
03 Plateforme BI
04 Management BI
01
Introduction
01 Introduction
Qu’est-ce que la Business Intelligence ?

▪ Le terme Business Intelligence (BI) désigne les technologies, applications et


pratiques de collecte, d'intégration, d'analyse et de présentation de
l'information.

▪ L'objectif de la Business Intelligence est de soutenir une meilleure prise de


décision des verticales métiers, commerciale, marketing, finance.

▪ Essentiellement, les systèmes de Business Intelligence sont des


systèmes d'aide à la décision axés sur les données.

BI → Informatique décisionnelle

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 4
01 Introduction
Qu’est-ce que la Business Intelligence ?

Une BI efficace aide les entreprises à trouver


des réponses à leurs questions sur leurs
données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 5
01 Introduction
Historique de la BI

▪ Années 1950: Naissance du concept de Business Intelligence. Hans Peter Luhn, chez
IBM, pose les bases de l'utilisation des ordinateurs pour analyser les données et faciliter
la prise de décision.

▪ Années 1980: Émergence des entrepôts de données. Ces systèmes centralisés


permettent de stocker et de traiter de grandes quantités de données en provenance de
diverses sources.

▪ Années 2000: Révolution du Big Data. L'explosion du volume des données et l'essor
d'internet accélèrent le développement de la BI. L'intelligence artificielle commence à
être intégrée dans les outils de BI.

▪ Aujourd'hui: La BI est omniprésente dans les entreprises. Elle est caractérisée par une
démocratisation des outils, une visualisation de données toujours plus poussée et une
intégration avec d'autres technologies comme le cloud et l'IoT.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 6
01 Introduction
Historique de la BI

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 7
01 Introduction
Pourquoi la BI moderne est essentielle ?
•Prise de décision éclairée: La BI fournit des données précises et à jour,
permettant aux dirigeants de prendre des décisions stratégiques en toute
connaissance de cause.

•Optimisation des processus: En identifiant les goulots d'étranglement et les


inefficacités, la BI permet d'optimiser les processus et d'améliorer la productivité.

•Amélioration de la performance: En mesurant les indicateurs clés de


performance (KPI), la BI permet d'évaluer l'efficacité des stratégies mises en
œuvre et d'identifier les axes d'amélioration.

•Identification de nouvelles opportunités: En analysant les tendances du


marché, la BI permet d'identifier de nouvelles opportunités de croissance.

•Anticipation des risques: En analysant les données historiques, la BI permet


d'anticiper les risques potentiels et de mettre en place des mesures préventives.
Exemple : réactivité des entreprises face à la pandémie

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 8
01 Introduction
Exemple d’utilisation de BI
❖ Commerce
•Optimisation des ventes: Analyse des données de vente pour identifier les produits les
plus performants, les tendances saisonnières, les clients les plus fidèles, etc. Cela permet
de mieux cibler les campagnes marketing et d'adapter l'offre aux besoins des clients.
•Gestion des stocks: Prévision de la demande pour éviter les ruptures de stock ou les
surstocks. Optimisation de la chaîne d'approvisionnement.
•Personnalisation de l'expérience client: Création de recommandations produits
personnalisées en fonction du comportement d'achat des clients.

❖ Armée
•Logistique: Optimisation des chaînes d'approvisionnement, gestion des stocks,
planification des missions.
•Intelligence: Analyse des données de renseignement pour anticiper les menaces,
identifier les cibles potentielles et optimiser les stratégies militaires.
•Simulation: Création de simulations réalistes pour tester de nouvelles tactiques et
améliorer la formation des soldats.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 9
01 Introduction
Processus de BI

* ETL: Extract Transform Load

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  10
01 Introduction
Data Science vs BI

* ETL: Extract Transform Load

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  11
02
Big Data
Analytics
02 Big Data Analytics
Qu’est-ce que le Big Data ?
▪ Un ensemble de données volumineux, variés et complexes qui
dépassent les capacités des outils traditionnels de gestion de
bases de données.

▪ Les 5 V du Big Data : Volume, Vélocité, Variété, Véracité, Valeur.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  13
02 Big Data Analytics
Comment le Big Data influence la BI moderne ?

▪ Élargissement des sources de données: Au-delà des bases de données classiques, le Big
Data intègre des sources variées (textes, images, etc.), offrant une vision plus complète
et nuancée des données.

▪ Amélioration de la qualité des analyses: Les volumes massifs de données permettent


des analyses plus précises, identifiant des tendances et corrélations plus fines,
renforçant ainsi les modèles prédictifs.

▪ Accélération de la prise de décision: Les résultats d'analyse en temps quasi-réel


facilitent une prise de décision plus rapide et adaptée à un environnement en
constante évolution.

▪ Personnalisation accrue: En connaissant mieux les clients, les entreprises


personnalisent leurs offres et renforcent leur relation avec eux.

▪ Nouveaux services et produits: Le Big Data permet de développer de nouveaux


produits ou services innovants, mieux adaptés aux besoins des clients.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  14
02 Big Data Analytics
Les principales techniques d’analyse

▪ Apprentissage automatique (Machine Learning) : Construction de modèles à partir de


données pour effectuer des prédictions ou des classifications.

▪ Intelligence artificielle (IA) : Permet des tâches plus complexes comme la


compréhension du langage naturel ou la vision par ordinateur.

▪ Analyse prédictive : Prévoir des événements futurs. Par exemple, prédire la demande
d'un produit ou détecter une fraude.

▪ Analyse en temps réel: Traitement des données au fur et à mesure qu'elles sont
générées pour prendre des décisions immédiates.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  15
03
Plateforme BI
03 Plateforme BI
Qu’est-ce qu’une plateforme BI ?

▪ Une plateforme BI, est un outil logiciel conçu pour collecter, stocker, analyser et
visualiser de grandes quantités de données.

▪ Son objectif principal est de transformer ces données brutes en informations


pertinentes et exploitables pour aider les entreprises à prendre des décisions éclairées

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  17
03 Plateforme BI
Rôle d’une plateforme BI

▪ Centraliser les données: Rassembler des données provenant de différentes sources


(bases de données, fichiers, applications, etc.) en un seul endroit.

▪ Les nettoyer et les préparer: Assurer la qualité des données en éliminant les erreurs et
les incohérences.

▪ Les analyser: Appliquer des techniques statistiques et mathématiques pour extraire des
informations significatives.

▪ Les visualiser: Présenter les résultats de manière claire et intuitive, souvent sous forme
de graphiques, de tableaux de bord ou de cartes.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  18
03 Plateforme BI
Différents types de plateformes BI
1. BI en libre-service
Ces plateformes sont conçues pour être utilisées par des utilisateurs non techniques, permettant de
créer des rapports et des tableaux de bord sans assistance de la part de spécialistes IT.

2. BI en temps réel
Ces outils offrent des données en temps réel, permettant aux entreprises de prendre des décisions
rapidement en fonction des dernières informations disponibles.

3. BI Cloud
Ces plateformes sont hébergées sur le cloud, ce qui permet une grande flexibilité et un accès à
distance aux données. Elles réduisent les besoins en infrastructure interne.

4. BI traditionnelle ou en entreprise
Les solutions traditionnelles ou de grande échelle sont généralement utilisées dans les grandes
entreprises avec une infrastructure dédiée. Elles nécessitent souvent des équipes techniques pour la
gestion et la personnalisation.

5. BI prédictive
Ces outils utilisent des modèles statistiques avancés et l'intelligence artificielle pour prévoir les
tendances futures et proposer des recommandations.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  19
03 Plateforme BI
Critères de choix d'une plateforme BI

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  20
03 Plateforme BI
Critères de choix d'une plateforme BI

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  21
04
Management
BI
04 Management BI
Définition

▪ Le Management BI, ou gestion de la Business Intelligence,


désigne l'ensemble des activités liées à la mise en place, à la
gestion et à l'optimisation d'une solution de Business
Intelligence au sein d'une entreprise.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  23
04 Management BI
Définition
▪ Définir la stratégie BI: Identifier les besoins de l'entreprise en matière d'analyse
de données, définir les indicateurs clés de performance (KPI) à suivre, et établir
un plan d'action pour mettre en œuvre la solution.

▪ Choisir les outils et les technologies appropriés: Sélectionner la plateforme BI la


plus adaptée aux besoins de l'entreprise en fonction de sa taille, de son budget,
de ses sources de données et de ses objectifs.

▪ Mettre en œuvre la solution: Déployer la plateforme BI, intégrer les sources de


données, configurer les accès utilisateurs et former les équipes.

▪ Gérer la solution au quotidien: Assurer la maintenance de la plateforme, mettre


à jour les données, développer de nouveaux rapports et tableaux de bord, et
répondre aux demandes des utilisateurs.

▪ Optimiser la solution: Améliorer continuellement la performance de la solution,


adapter les analyses aux évolutions de l'entreprise et mesurer le retour sur
investissement.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  24
04 Management BI
Le rôle du manager BI

•La coordination des projets BI: Il travaille en étroite collaboration avec les
différents services de l'entreprise pour définir les besoins, concevoir les solutions
et assurer le déploiement.

•La gestion des équipes BI: Il encadre les équipes techniques et fonctionnelles
chargées de mettre en œuvre et de maintenir la solution BI.

•La communication avec les utilisateurs: Il sensibilise les utilisateurs aux


bénéfices de la BI et les accompagne dans l'utilisation des outils.

•La mesure de la performance: Il évalue l'impact de la solution BI sur la prise


de décision et sur la performance de l'entreprise.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  25
Les Bases de
DATA Governance
par Cdt Nour Elhak FRADI
PLAN

01 Historique
02 Concepts et définitions
03 Modèle Data Governance
01
Historique
01 Historique
Introduction générale

▪ La Data Governance ou gouvernance des données, est un cadre organisationnel


qui permet de gérer la qualité, la sécurité, l’intégrité et la disponibilité des
données au sein d’une entreprise ou organisation.

▪ La gouvernance des données consiste à établir des normes internes (politiques de


données) concernant la façon dont les données sont collectées, stockées, traitées
et supprimées.

▪ Elle permet de définir qui peut accéder aux différents types de données et quels
types de données sont concernés.

▪ La gouvernance des données implique également la conformité avec les normes


externes définies par les associations du secteur, les autorités administratives et
les autres acteurs.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 4
01 Historique
Chronologie

Années 1980-1990 :

•Début de l'importance croissante de


l'informatique dans les entreprises.

•Les entreprises commencent à


collecter des volumes croissants de
données, mais sans stratégie claire
pour leur gestion.

•Problèmes fréquents liés à la qualité,


l'intégrité et la sécurité des données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 5
01 Historique
Chronologie

Années 2000 :
•Explosion des données avec l'essor du Big Data et la multiplication des
sources de données (internes et externes).

•Reconnaissance de l'importance d'un cadre de gouvernance des données


pour une gestion plus efficace.

•Apparition de réglementations strictes, comme Sarbanes-Oxley (SOX) aux


États-Unis, qui impose des contrôles rigoureux sur la gestion des
informations financières.

•Les entreprises réalisent qu'une mauvaise gestion des données peut


entraîner des risques financiers et juridiques.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 6
01 Historique
Chronologie

2010 et au-delà :

•L'introduction de lois et réglementations spécifiques comme le RGPD en


Europe et la HIPAA aux États-Unis met l'accent sur la protection des
données personnelles et sensibles.

•Cybermenaces croissantes : La nécessité de protéger les données des


cyberattaques et des fuites de données devient prioritaire.

•Adoption accrue de la Data Governance par les entreprises pour assurer la


qualité, la conformité et la sécurité.

•Les rôles de Chief Data Officer (CDO) et de Data Steward se popularisent,


visant à encadrer et orchestrer la gestion stratégique des données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 7
02
Concepts et
définitions
02 Concepts et définitions
Définition de la Data Governance

▪ La Data Governance peut être définie comme l’ensemble des


processus, des règles, des politiques et des responsabilités qui
permettent de gérer la qualité, la sécurité, , l’intégrité, la
disponibilité et l’utilisation des données au sein d’une
organisation.

▪ C’est une approche proactive qui aide à définir et à appliquer des


directives pour maximiser la valeur des données tout en
minimisant les risques associés à leur mauvaise gestion.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 9
02 Concepts et définitions
Objectifs de la Data Governance

▪ Améliorer la qualité des données : S'assurer que les données


sont précises, complètes et à jour.
▪ Garantir la sécurité des données : Protéger les données contre
les accès non autorisés, la perte ou la corruption.
▪ Respecter les réglementations : Se conformer aux lois locales et
internationales en matière de confidentialité des données.
▪ Améliorer la gestion des données : S’assurer que les bonnes
personnes ont accès aux bonnes données au bon moment.
▪ Accroître la transparence : Faciliter la traçabilité des données et
la responsabilité des parties prenantes.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  10
02 Concepts et définitions
Acteurs et rôles dans la Data Governance

▪ Data Owner (Propriétaire de données) : Responsable de la


qualité, de la protection et de la gestion des données spécifiques
à son domaine.
▪ Data Steward (Gestionnaire de données) : Assure la mise en
œuvre des règles et politiques définies, veille à la cohérence des
données.
▪ Data Governance Committee : Comité en charge de définir la
stratégie de gouvernance des données et d'approuver les
politiques et les procédures.
▪ Chief Data Officer (CDO) : Responsable de la stratégie globale de
gestion des données au sein de l’organisation, souvent en lien
direct avec la direction.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  11
02 Concepts et définitions
Acteurs et rôles dans la Data Governance

▪ Data Owner (Propriétaire de données) : Responsable de la


qualité, de la protection et de la gestion des données spécifiques
à son domaine.
▪ Data Steward (Gestionnaire de données) : Assure la mise en
œuvre des règles et politiques définies, veille à la cohérence des
données.
▪ Data Governance Committee : Comité en charge de définir la
stratégie de gouvernance des données et d'approuver les
politiques et les procédures.
▪ Chief Data Officer (CDO) : Responsable de la stratégie globale de
gestion des données au sein de l’organisation, souvent en lien
direct avec la direction.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  12
02 Concepts et définitions
Principes de la Data Governance

▪ Qualité des données : La gouvernance vise à améliorer la


précision, la fiabilité et la pertinence des données.

▪ Sécurité des données : Elle se concentre sur la confidentialité et


la protection contre les accès non autorisés.

▪ Traçabilité des données : Garantir que toutes les données


peuvent être retracées à leur origine pour s’assurer de leur
validité.

▪ Responsabilité : Chaque acteur doit avoir des responsabilités


claires en ce qui concerne la gestion des données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  13
03
Modèle Data
Governance
03 Modèle Data Governance
Cadre et composants d’un modèle de Data Governance
Un modèle de gouvernance des données repose sur plusieurs composants clés pour
s’assurer que les données sont correctement gérées tout au long de leur cycle de vie.

Ces composants incluent :

•Stratégie de gouvernance : Établit les objectifs, la vision et les priorités pour la


gestion des données.

•Politiques et règles : Définit les standards et les procédures qui doivent être
suivis par toute l'organisation pour la gestion des données.

•Processus de gouvernance : Comprend les workflows pour la gestion des


données (création, modification, suppression) et la validation des politiques.

•Technologie : Systèmes et outils nécessaires pour collecter, stocker, analyser et


sécuriser les données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  15
03 Modèle Data Governance
Modèles de gouvernance

•Modèle centralisé : Toutes les décisions et la gestion des données sont gérées
par un groupe central ou une équipe dédiée à la Data Governance. Ce modèle
offre une grande uniformité, mais peut manquer de flexibilité.

•Modèle décentralisé : Chaque département ou unité d'affaires a ses propres


pratiques de gouvernance, ce qui permet plus de flexibilité mais peut conduire à
des incohérences.

•Modèle hybride : Un mélange des deux, où une structure centrale définit des
directives globales, mais laisse aux unités locales la gestion des données
spécifiques selon leurs besoins.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  16
03 Modèle Data Governance
Cycle de vie des données dans la gouvernance

•Collecte des données : S'assurer que les données sont recueillies de


manière efficace et conforme.

•Stockage des données : Veiller à ce que les données soient stockées en


toute sécurité et restent accessibles.

•Qualité et nettoyage des données : Impliquer des processus pour détecter et


corriger les erreurs dans les données.

•Utilisation des données : S’assurer que les données sont utilisées


conformément aux politiques établies.

•Archivage et suppression : Définir des politiques pour la conservation ou la


suppression des données en fin de cycle.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  17
03 Modèle Data Governance
Mesures et indicateurs clés

Pour évaluer l'efficacité d’un programme de Data Governance, il est nécessaire d’avoir
des Key Performance Indicators (KPI) tels que :

•Taux d’erreurs dans les données : Mesurer la qualité des données.

•Taux de conformité : Évaluer la conformité avec les réglementations en matière


de données.

•Temps d’accès aux données : Mesurer la rapidité avec laquelle les utilisateurs
peuvent accéder aux informations nécessaires.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  18
Conclusion
La Data Governance est un élément fondamental pour les
entreprises qui veulent non seulement gérer leurs données de
manière efficace, mais aussi les valoriser pour en faire un atout
stratégique.
Un modèle bien défini, des concepts clairs et une gestion
rigoureuse assurent que les données sont un vecteur de succès
et non une source de risque.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  19
DATA
Management
par Cdt Nour Elhak FRADI
PLAN

01 Elements de Data Management


02 Relation avec Data Governance
03 Architecture
04 Cas d’étude
01
Eléments de Data
Management
01 Eléments de Data Management
Qu’est-ce que le Data Management?

▪ Le Data Management (ou gestion des données) fait référence à l'ensemble


des processus, pratiques, et technologies utilisés pour collecter, stocker,
organiser, protéger, et exploiter les données tout au long de leur cycle de
vie.

▪ L'objectif principal du Data Management est de garantir que les données


soient accessibles, fiables, sécurisées, et utilisées de manière efficace au
sein d'une organisation pour soutenir les prises de décision, améliorer les
processus et atteindre les objectifs stratégiques.

▪ Le Data Management englobe tous les processus et pratiques liés à la


gestion du cycle de vie des données dans une organisation, de la collecte à
l’utilisation finale.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 4
01 Eléments de Data Management
Principaux éléments
▪ Collecte des Données :

•Sources internes et externes : Systèmes de gestion internes (ERP, CRM), plateformes


de réseaux sociaux, capteurs IoT, partenaires externes, etc.
•Techniques de collecte : API, ETL (Extract, Transform, Load), services web,
formulaires, etc.

▪ Stockage des Données :

•Bases de données : Relationnelles (SQL) ou non relationnelles (NoSQL) selon les


besoins de l'entreprise.
•Entrepôts de données (Data Warehouses) : Destinés à l'analyse et au reporting à
grande échelle.
•Lacs de données (Data Lakes) : Stockage flexible pour les données structurées et non
structurées.
•Cloud : Solutions de stockage cloud (AWS, Azure, Google Cloud) pour la scalabilité et la
gestion centralisée.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 5
01 Eléments de Data Management
Principaux éléments
▪ Qualité des Données :

•Data Cleaning : Suppression des doublons, correction des erreurs, etc.


•Data Profiling : Analyse des données pour comprendre leur structure, cohérence et
valeur.
•Data Enrichment : Ajout d'informations ou d'attributs supplémentaires pour augmenter
la valeur des données.

▪ Sécurité des Données :

•Protection des données : Chiffrement, gestion des accès, audits de sécurité.


•Réglementations : RGPD (Règlement Général sur la Protection des Données), CCPA,
HIPAA (selon le secteur d’activité et la localisation).

▪ Gouvernance des Données :

•Assurer que les données sont gérées de manière conforme, en répondant aux
exigences internes et réglementaires.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 6
02
Relation avec
Data Governance
02 Relation avec Data Governance

▪ La Data Governance est le cadre qui définit


comment une organisation gère ses données.

▪ Tandis que le Data Management se concentre sur


les aspects pratiques du traitement des données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 8
02 Relation avec Data Governance

•Rôles et Responsabilités : La gouvernance des données établit les rôles


(propriétaires de données, gestionnaires, utilisateurs), tandis que la gestion des
données implique l'exécution des tâches liées à ces rôles.

•Conformité et Risques : La gouvernance définit les politiques pour assurer la


conformité aux lois (comme le RGPD). Le Data Management s'assure que ces
politiques sont appliquées à travers des processus tels que la gestion des accès
et la protection des données.

•Qualité des Données : La gouvernance des données fixe les normes et règles
de qualité. Le Data Management surveille et améliore cette qualité à travers des
contrôles et des processus.

•Gestion du Cycle de Vie des Données : La gouvernance définit les règles sur
la durée de conservation des données, et le Data Management met en œuvre
les mécanismes nécessaires pour gérer ces cycles (archivage, suppression).

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 9
02 Relation avec Data Governance

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  10
02 Relation avec Data Governance
Le niveau stratégique : Stratégie des données
La stratégie des données opère au niveau stratégique
d'une organisation. Elle consiste à concevoir une manière
logique de naviguer à travers l'incertitude, en guidant
l'organisation vers ses objectifs malgré des conditions
imprévisibles.

Comme l'a dit Roger Martin, « La stratégie n'est pas un


plan. » Cela est important à souligner, car la planification
se fait avec des ressources, du capital, des conditions de
marché, etc., qui sont tous des facteurs pouvant être
prédits avec un certain niveau de certitude.

Au contraire, c'est une logique qui définit comment une


organisation vise à atteindre ses objectifs dans un
environnement incertain.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  11
02 Relation avec Data Governance
Le niveau opérationnel : Gestion des données

La gestion des données existe au niveau opérationnel, en

se concentrant sur l'exécution des tâches quotidiennes

pour garantir que les données sont utilisées de manière

efficace, efficiente, fiable et à grande échelle. Elle englobe

un large éventail de pratiques et de domaines de

connaissances, ce qui la rend intrinsèquement

interfonctionnelle.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  12
02 Relation avec Data Governance
Le niveau tactique : Gouvernance des données
La gouvernance des données fonctionne au niveau
tactique, entre la stratégie des données et la gestion des
données. Elle traduit l'orientation stratégique de
l'entreprise en actions spécifiques en alignant les
personnes, les processus et la technologie avec la
responsabilité, la proposition de valeur et la logique
stratégique.

Vers le niveau opérationnel, la gouvernance des données


fournit une supervision et des conseils pour les décisions
liées aux données, en s'assurant qu'elles sont conformes
aux objectifs stratégiques de l'organisation. Bien qu'elle
fasse techniquement partie de la gestion des données,
son rôle est unique en ce sens qu'elle sert de pont entre
la vision stratégique et l'exécution opérationnelle.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  13
03
Architecture
03 Architecture

Architecture en couches :
•Couche de source de données : Là où les données sont initialement collectées à partir
de systèmes opérationnels, de capteurs, etc.

•Couche d'intégration : Processus ETL (extraction, transformation, chargement) pour


intégrer les données de différentes sources.

•Couche de stockage : Entrepôts de données, lacs de données, bases de données


opérationnelles, solutions en cloud, etc.

•Couche d'accès : Accès aux données via des API, outils d’analyse, visualisation,
requêtes SQL/NoSQL.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  15
03 Architecture
Architecture des systèmes distribués :

•Big Data : Utilisation de plateformes distribuées comme Hadoop et Spark


pour gérer des volumes massifs de données.

•Cloud Computing : L’infrastructure cloud (comme AWS ou Azure) permet de


gérer les données à grande échelle, avec des capacités de stockage et de
traitement flexibles.

Outils et technologies clés :

•Bases de données : MySQL, PostgreSQL, MongoDB, Cassandra.

•Outils ETL : Talend, Informatica, Apache NiFi.

•Solutions de BI (Business Intelligence) : Tableau, Power BI, Qlik.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  16
04
Cas d’étude
04 Cas d’étude
Gestion des Données dans une Agence de Voyage

Contexte
Une agence de voyage souhaite améliorer ses services en utilisant efficacement les
données clients, les tendances du marché, et les performances de ses offres.
L'objectif est de personnaliser les expériences de voyage et d'optimiser la gestion des
réservations.

Objectifs
•Améliorer la satisfaction client par des offres personnalisées.
•Optimiser la gestion des réservations et des opérations.
•Analyser les tendances du marché pour ajuster les offres.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  18
04 Cas d’étude
Étapes de Mise en Œuvre du Data Management

1- Collecte des Données :

•Sources internes : Informations sur les clients (profils, préférences de voyage,


historiques de réservation), données sur les destinations (attractions, avis, prix).

•Sources externes : Données sur les tendances du marché (demandes de voyages,


saisons, promotions), et informations des partenaires (compagnies aériennes,
hôtels, services de transport).

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  19
04 Cas d’étude
Étapes de Mise en Œuvre du Data Management

2- Stockage des Données :

•Base de données client : Mise en place d’une base de données pour stocker les
informations clients, facilitant la segmentation et le ciblage.

•Système de gestion des réservations : Utilisation d’un système pour suivre les
réservations, gérer les annulations, et automatiser les confirmations et rappels.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  20
04 Cas d’étude
Étapes de Mise en Œuvre du Data Management

3- Qualité des Données :

•Data Cleaning : Nettoyage des données pour supprimer les doublons (par
exemple, des enregistrements de clients) et corriger les erreurs (comme des
adresses e-mail incorrectes).

•Enrichissement des données : Collecte d’informations supplémentaires, comme


les préférences de voyage et les évaluations des clients sur leurs voyages
précédents.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  21
04 Cas d’étude
Étapes de Mise en Œuvre du Data Management

4 - Analyse et Utilisation :

•Analyse des préférences : Utilisation d'outils d'analyse pour examiner les


préférences de voyage des clients, permettant de créer des offres personnalisées.

•Rapports de performance : Élaboration de rapports sur les ventes par destination,


les périodes de forte demande, et l’efficacité des campagnes marketing.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  22
04 Cas d’étude
Étapes de Mise en Œuvre du Data Management

4 - Analyse et Utilisation :

•Analyse des préférences : Utilisation d'outils d'analyse pour examiner les


préférences de voyage des clients, permettant de créer des offres personnalisées.

•Rapports de performance : Élaboration de rapports sur les ventes par destination,


les périodes de forte demande, et l’efficacité des campagnes marketing.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  23
04 Cas d’étude
Étapes de Mise en Œuvre du Data Management

5 - Sécurité des Données :

•Protection des données personnelles : Mise en œuvre de mesures pour protéger


les informations sensibles des clients, comme les détails de paiement et les
informations de voyage.

•Conformité : Respect des réglementations de protection des données, garantissant


que les clients sont informés de l'utilisation de leurs données et qu'ils peuvent les
modifier ou les supprimer.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  24
04 Cas d’étude
Étapes de Mise en Œuvre du Data Management

6- Résultats

•Personnalisation des offres : Grâce à l'analyse des données clients, l'agence a pu


proposer des offres de voyage sur mesure, augmentant ainsi la satisfaction et la
fidélité des clients.

•Augmentation des ventes : L'optimisation des campagnes marketing basées sur


des analyses de données a entraîné une augmentation des réservations de 25 %.

•Meilleure gestion des opérations : L’automatisation des réservations et des


confirmations a réduit les erreurs et le temps consacré à la gestion manuelle,
permettant au personnel de se concentrer sur le service client.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  25
DATA
Visualisation
par Cdt Nour Elhak FRADI
PLAN

01 Introduction
02 Types de DataViz
03 Pratique
01
Introduction
01 Introduction
Qu’est-ce que le Data Visualisation?

▪ Représenter graphiquement une information souvent abstraite


et/ou à très grande volumétrie.

▪ Communiquer des chiffres ou des informations brutes en les


transformant en objets visuels : points, barres, courbes,
cartographies…

• Rendre compréhensible des données


• Faciliter le raisonnement
• Transmettre de l’information

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 4
01 Introduction
RETOUR AUX SOURCES DE LA VISUALISATION DE DONNEES

▪ William Playfair (ingénieur et économiste écossais / 1759-


1823) considéré comme l’inventeur des graphiques pour
représenter les données : line plots, bar chart and pie chart

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 5
01 Introduction
RETOUR AUX SOURCES DE LA VISUALISATION DE DONNEES

▪ Charles Minard (ingénieur civil français / 1781-1870) a


fortement contribué au domaine de l’information graphique et
statistique en particulier avec l’utilisation de cartes.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 6
01 Introduction
RETOUR AUX SOURCES DE LA VISUALISATION DE DONNEES

▪ Florence Nightingale (infirmière britannique / 1820-1910)


estconnue comme étant la “mère” de la profession d’infirmière
moderne. Elle a aussi contribué aux représentations
graphiques.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 7
01 Introduction
Aujourd’hui

La DataViz (Data Visualisation) : les techniques


permettant de présenter des données sous forme
visuelle afin d’en faciliter la compréhension et/ou
l’analyse.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 8
01 Introduction
Aujourd’hui

La DataViz (Data Visualisation) : les techniques


permettant de présenter des données sous forme
visuelle afin d’en faciliter la compréhension et/ou
l’analyse.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 9
01 Introduction
L’ère de la visualisation

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  10
01 Introduction
La visualisation pour l’analyse des données
▪ Elle offre une ligne d’attaque frontale, révèle la structure complexe de
données qui ne pourraient être comprises d’aucune autre façon.
▪ Permet de découvrir des résultats inattendus et de remettre en question
les conclusions attendues.
▪ Cherche à rendre compréhensibles et accessibles des données brutes en les
scénarisant.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  11
01 Introduction
DataViz
▪ L’idée : présenter des données complexes de façon simple, juste et
attractive
▪ Une Dataviz sert à rendre l’information lisible par tous pour faciliter la
compréhension en s’adressant au côté sensoriel et rationnel
▪ Pour répondre à ces objectifs, la DataViz doit fournir une information :

• Interprétable, c’est-à-dire claire, quelque soit le volume, la nature ou


la provenance des données

• Pertinente, c’est à dire qui réponde à un objectif métier dans un


contexte défini

• Novatrice, en fournissant une perspective nouvelle d’appréhension de


données

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  12
01 Introduction
Types de DataViz

•Graphiques à barres : Comparent des valeurs entre différentes catégories.

•Graphiques à lignes : Montrent l’évolution d’une variable dans le temps.

•Graphiques circulaires (camemberts) : Illustrent les proportions dans un

ensemble.

•Graphiques à nuages de points : Montrent la relation entre deux variables

continues.

•Cartes de chaleur : Représentent des valeurs avec des couleurs, souvent

utilisées pour identifier des modèles ou tendances.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  13
01 Introduction
Types de DataViz

•Diagrammes en boîte (boxplots) : Illustrent la distribution des données à


travers leurs quartiles.
•Histogrammes : Montrent la distribution des données en utilisant des
intervalles.
•Graphiques en cascade (Waterfall charts) : Illustrent la contribution
cumulative de différentes données.
•Infographies : Combinaison de visuels et de textes pour raconter une histoire
complexe de manière simple.
•Nuages de mots : Représentent la fréquence des mots dans un texte avec
des tailles de police variables.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  14
02
Types de DataViz
02 Types de DataViz

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  16
02 Types de DataViz
Visualisations pour les distributions de données :
Histogrammes: Parfaits pour représenter la fréquence
de différentes valeurs dans un ensemble de données.

Diagrammes en boîte à moustaches: Utilisés pour


visualiser la dispersion des données, les quartiles et
les valeurs aberrantes.

Diagrammes de densité: Offrent une représentation


plus lisse et continue de la distribution des données.

Diagrammes en violon: Similaires aux diagrammes en


boîte à moustaches, mais avec une représentation
plus détaillée de la densité.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  17
02 Types de DataViz
Visualisations pour les comparaisons :
Diagrammes en barres: Permettent de comparer des quantités pour différentes
catégories.

Diagrammes en colonnes: Similaires aux diagrammes en barres, mais orientés


verticalement.

Diagrammes circulaires (camemberts): Utilisés pour représenter des proportions d'un


tout.

Graphiques en aires empilées: Permettent de visualiser l'évolution de plusieurs


catégories dans le temps.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  18
02 Types de DataViz
Visualisations pour les relations :
Nuages de points: Utilisés pour explorer les
relations entre deux variables numériques.

Cartes de chaleur: Représentent les données


sous forme de couleurs, mettant en évidence
les zones de haute et basse densité.

Graphiques en bulles: Combinent la taille des


bulles avec leur position pour représenter trois
variables.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  19
02 Types de DataViz
Visualisations pour les tendances temporelles :
Courbes: Utilisées pour représenter l'évolution d'une variable au fil du temps.

Lignes multiples: Permettent de comparer l'évolution de plusieurs variables dans le


temps.

Cartes temporelles: Visualisent les changements au fil du temps.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  20
02 Types de DataViz
Autres types de visualisations :
Infographies: Combinent des éléments visuels, du texte et des données pour raconter
une histoire.

Dashboards: Présentent un ensemble de visualisations pour surveiller les indicateurs


clés de performance (KPI).

Arbres et diagrammes de réseau: Utilisés pour représenter des hiérarchies ou des


relations entre des éléments.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  21
02 Types de DataViz
Infographie

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  22
02 Types de DataViz
Infographie

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  23
02 Types de DataViz
Infographie

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  24
02 Types de DataViz
Le choix du type de visualisation dépend de plusieurs facteurs :

•Le type de données: Les données numériques, catégorielles ou temporelles


nécessitent des visualisations différentes.

•Le nombre de variables: Les visualisations simples sont généralement plus efficaces
pour un petit nombre de variables.

•La question que vous cherchez à répondre: La visualisation doit être adaptée à
l'objectif de votre analyse.

•L'audience: La complexité de la visualisation doit être adaptée au niveau de


connaissance de votre public.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  25
02 Types de DataViz
Outils de data visualisation: Il existe de nombreux outils pour créer des visualisations,
tels que:

•Tableau: Un outil puissant et flexible pour la création de visualisations


interactives.
•Power BI: Un autre outil populaire, souvent utilisé en entreprise.
•Google Data Studio: Une option gratuite et facile à utiliser pour créer des
tableaux de bord.
•Python (avec des bibliothèques comme Matplotlib, Seaborn, Plotly): Pour une
grande flexibilité et une personnalisation avancée.
•R: Un autre langage de programmation statistique avec de nombreuses
bibliothèques de visualisation.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  26
03
Pratique
02 Types de DataViz

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  28
03 Architecture

1er Cas:
Jeu de données : Un tableau Excel avec les ventes mensuelles d'un produit sur 5 ans.

Question : Quel type de visualisation permettrait de montrer clairement l'évolution des


ventes au fil du temps et d'identifier les tendances ?

Réponse : Une courbe est idéal pour représenter l'évolution d'une variable numérique
dans le temps.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  29
03 Architecture

2eme Cas:
Jeu de données : Un tableau Excel avec l'âge de chaque client ayant effectué un achat.

Question : Comment représenter visuellement la distribution des âges des clients pour
identifier les tranches d'âge les plus représentées ?

Réponse : Un histogramme est le plus adapté pour visualiser la fréquence de


différentes valeurs (ici, les âges) dans un ensemble de données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  30
03 Architecture

3eme Cas:
Jeu de données : Un tableau Excel avec les parts de marché de 5 entreprises
concurrentes sur un marché donné.

Question : Quelle visualisation permettrait de comparer visuellement les parts de


marché de ces entreprises ?

Réponse : Un diagramme circulaire/secteur est parfait pour représenter des


proportions d'un tout.
de données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  31
03 Architecture

4eme Cas:
Jeu de données : Un tableau Excel avec les parts de marché de 5 entreprises
concurrentes sur un marché donné.

Question : Quelle visualisation permettrait de comparer visuellement les parts de


marché de ces entreprises ?

Réponse : Un diagramme circulaire est parfait pour représenter des proportions d'un
tout.
de données.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  32
03 Architecture

5eme Cas:
Jeu de données : Un tableau Excel avec le prix de vente et le nombre de ventes pour
différents produits.

Question : Comment visualiser la relation entre le prix et le nombre de ventes pour


identifier une éventuelle corrélation ?

Réponse : Un nuage de points est adapté pour explorer la relation entre deux variables
numériques.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  33
03 Architecture

6eme Cas:
Jeu de données : Un tableau Excel avec les notes attribuées par les clients à différents
services (sur une échelle de 1 à 5).

Question : Comment comparer visuellement la satisfaction client pour chaque service


et identifier les points forts et les points faibles ?

Réponse : Un diagramme en barres est adapté pour comparer des quantités pour
différentes catégories. Une boîte à moustaches pourrait également être utilisée pour
visualiser la dispersion des notes pour chaque service.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  34
Intelligence
Artificielle
par Cdt Nour Elhak FRADI
PLAN

01 Introduction
02 Machine Learning
03 Pratique
01
Introduction
01 Introduction
Qu’est-ce que l’IA?
▪L'intelligence artificielle (IA) est un domaine de l'informatique qui
vise à créer des machines capables de simuler l'intelligence
humaine.

▪L'Intelligence Artificielle (IA) désigne un domaine de l'informatique


qui se concentre sur la création de systèmes capables de réaliser des
tâches normalement exécutées par des humains.

▪Ces tâches incluent l'apprentissage, le raisonnement, la


perception, et la prise de décision.

▪L'IA repose sur des algorithmes sophistiqués et l'analyse de


données massives pour imiter certaines fonctions cognitives
humaines.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 4
01 Introduction
Les Origines : Des Idées Anciennes
▪Mythologie: Les créatures artificielles, comme le
Golem de la mythologie juive ou le robot de la
mythologie grecque (Talos), témoignent d'une
fascination ancestrale pour la création d'êtres
artificiels doués de vie et d'intelligence.

▪Philosophie: Des philosophes comme René


Descartes ont posé les bases de la réflexion sur la
nature de l'intelligence et la possibilité de la
reproduire artificiellement.

« animal machine »
Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 5
01 Introduction
La Naissance de l'IA Moderne
▪Conférence de Dartmouth (1956): Cet événement marque
officiellement la naissance de l'intelligence artificielle en tant que
discipline académique. Des chercheurs de différents horizons se
réunissent pour explorer les possibilités de créer des machines
capables de penser.

▪Les premières réussites: Les années 1950 et 1960 sont marquées


par des avancées significatives dans des domaines comme les jeux
d'échecs ou la démonstration de théorèmes mathématiques.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 6
01 Introduction
La Naissance de l'IA Moderne

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 7
01 Introduction
La Naissance de l'IA Moderne

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 8
01 Introduction
La Naissance de l'IA Moderne

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 9
01 Introduction
L’IA et la Science de données

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  10
01 Introduction
Les Applications de l'IA :

L'IA est présente dans de nombreux domaines de notre vie :

•Santé: Diagnostic médical assisté, développement de nouveaux médicaments.

•Industrie: Maintenance prédictive, optimisation de la chaîne logistique.

•Transport: Voitures autonomes, optimisation des transports en commun.

•Finance: Détection de fraudes, trading algorithmique.

•Marketing: Recommandations personnalisées, analyse de sentiment.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  11
02
Les piliers de l'IA
02 Les piliers de l'IA
2.1 Apprentissage automatique (Machine Learning)
▪ L’apprentissage automatique est une méthode qui permet aux systèmes
d’apprendre à partir de données sans avoir été explicitement programmés.

▪ Il s'agit d'un processus dans lequel des modèles sont créés pour reconnaître des
motifs et prendre des décisions basées sur des données.

Une machine apprend lorsque sa performance P à faire une Tâche T s’améliore grâce
à une nouvelle Expérience E

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  13
02 Les piliers de l'IA
2.1 Apprentissage automatique (Machine Learning)
▪ Apprentissage supervisé : Les modèles sont formés sur des ensembles de données
étiquetés. Chaque entrée est associée à une sortie souhaitée. Par exemple, on
pourrait former un modèle à reconnaître des chiens et des chats en lui fournissant
des milliers d'images étiquetées comme "chien" ou "chat".

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  14
02 Les piliers de l'IA
2.1 Apprentissage automatique (Machine Learning)
▪ Apprentissage supervisé :

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  15
02 Les piliers de l'IA
2.1 Apprentissage automatique (Machine Learning)
▪ Apprentissage non supervisé : Les modèles sont formés sur des ensembles de
données étiquetés. Chaque entrée est associée à une sortie souhaitée. Par
exemple, on pourrait former un modèle à reconnaître des chiens et des chats en lui
fournissant des milliers d'images étiquetées comme "chien" ou "chat".

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  16
02 Les piliers de l'IA
2.1 Apprentissage automatique (Machine Learning)
▪ Apprentissage non supervisé :

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  17
02 Les piliers de l'IA
2.1 Apprentissage automatique (Machine Learning)
▪ Apprentissage non supervisé :

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  18
02 Les piliers de l'IA
2.1 Apprentissage automatique (Machine Learning)
▪ Apprentissage par renforcement : L'agent apprend en interagissant avec un
environnement et en recevant des récompenses ou des punitions en fonction de
ses actions. Ce type d'apprentissage est utilisé pour la formation des robots ou
dans les jeux, comme avec l'algorithme AlphaGo de Google DeepMind.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  19
02 Les piliers de l'IA
2.1 Apprentissage automatique (Machine Learning)

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  20
02 Les piliers de l'IA
2.2 Apprentissage profond (Deep Learning)
▪ L'apprentissage profond est une sous-catégorie de l’apprentissage automatique qui
repose sur des réseaux de neurones artificiels.

▪ Ces réseaux sont inspirés de la structure du cerveau humain et permettent de


traiter des données complexes.

▪ Ce sous-domaine est à l'origine des avancées les plus spectaculaires de l'IA ces
dernières années, notamment en reconnaissance d'images, traduction
automatique, et compréhension du langage naturel.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  21
02 Les piliers de l'IA
2.2 Apprentissage profond (Deep Learning)

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  22
02 Les piliers de l'IA
2.3 Traitement du Langage Naturel (NLP - Natural Language Processing)
Le NLP vise à permettre aux machines de comprendre, interpréter, et générer le langage humain.
Il s'agit d'un domaine complexe car le langage naturel est plein d'ambiguïtés, de nuances et de
contextes culturels.

• Analyse syntaxique et sémantique : Comprendre la structure grammaticale et le sens d'un


texte. Les systèmes NLP peuvent analyser des phrases pour en extraire des informations ou
même répondre à des questions.

• Modèles de langage : Des modèles comme GPT-4 peuvent générer du texte cohérent et
engageant, et sont utilisés dans les assistants vocaux, les chatbots, et la génération de contenu.

• Traduction automatique : L'un des exemples les plus connus est Google Translate, qui utilise le
NLP pour convertir du texte d'une langue à une autre.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  23
02 Les piliers de l'IA
2.4 Vision par ordinateur (Computer Vision)
La vision par ordinateur permet aux machines de
percevoir et comprendre le monde visuel. Cela englobe
la reconnaissance d'objets, la segmentation d'images,
et la détection de mouvements, entre autres. Ce sous-
domaine est crucial dans des applications comme la
conduite autonome, la surveillance, et la réalité
augmentée.

•Reconnaissance d'images : Les algorithmes de


vision par ordinateur sont capables de
reconnaître des objets dans des images ou des
vidéos avec une grande précision. Cela est utilisé
dans des systèmes comme Google Images, ou
encore dans les voitures autonomes.

•Détection et suivi d'objets : Cette technologie


permet de suivre des objets en mouvement dans
des vidéos, utilisée par exemple dans les
systèmes de surveillance ou dans les drones
autonomes.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  24
02 Les piliers de l'IA
2.4 Robots autonomes et Intelligence Embarquée
Les robots autonomes utilisent l'IA pour percevoir leur environnement et effectuer
des tâches sans intervention humaine. Ils peuvent être équipés de capteurs pour
comprendre le monde physique et utiliser des algorithmes d'apprentissage
automatique pour prendre des décisions en temps réel.

•Robots industriels : Utilisés dans les usines, ils peuvent ajuster leurs actions en
fonction de leur environnement, comme déplacer des objets, les assembler ou les
inspecter.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  25
02 Les piliers de l'IA
2.4 Vision par ordinateur (Computer Vision)
La vision par ordinateur permet aux machines de
percevoir et comprendre le monde visuel. Cela englobe
la reconnaissance d'objets, la segmentation d'images,
et la détection de mouvements, entre autres. Ce sous-
domaine est crucial dans des applications comme la
conduite autonome, la surveillance, et la réalité
augmentée.

•Reconnaissance d'images : Les algorithmes de


vision par ordinateur sont capables de
reconnaître des objets dans des images ou des
vidéos avec une grande précision. Cela est utilisé
dans des systèmes comme Google Images, ou
encore dans les voitures autonomes.

•Détection et suivi d'objets : Cette technologie


permet de suivre des objets en mouvement dans
des vidéos, utilisée par exemple dans les
systèmes de surveillance ou dans les drones
autonomes.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  26
03
Pratique
Machine Learning
Protection des
données privées
par Cdt Nour Elhak FRADI
PLAN

01 Concepts de base
02 Data Privacy
03 Conseils de protection
01
Introduction
01 Introduction

▪Dans la société de l’Information, chaque personne laisse


constamment des traces numériques qui peuvent ˆêtre reliées
à son identité.

▪Danger: collecte des traces numériques par une entité non-


autorisée pour utilisation à des fins malveillantes.

▪Exemple : lorsque vous consultez une page web, il est


possible de relier l’adresse IP de votre ordinateur à cette page.
⇒ permet d’associer le sujet de cette page à votre identité
mais aussi d’inférer votre localisation ⇒ bris de vie privée!!!

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 4
01 Introduction

▪ La protection des données privées se


réfère aux mesures et aux pratiques
visant à préserver la confidentialité,
l'intégrité et la disponibilité des données
personnelles.

▪ Différence avec la sécurité des données


: La sécurité des données concerne la
défense contre les accès non autorisés,
tandis que la protection des données vise
aussi à respecter les droits des individus
sur leurs informations.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 5
01 Introduction
Importance de la Vie Privée des Données
•Protection des droits individuels : La vie privée est un droit fondamental qui permet aux
individus de contrôler leurs informations personnelles et de limiter leur exploitation par des
tiers sans consentement.

•Prévention de l'usurpation d'identité et des fraudes : En minimisant les données


accessibles, les utilisateurs se protègent contre des pratiques frauduleuses ou malveillantes
qui exploitent les données personnelles pour commettre des délits.

•Sécurité en ligne : Une meilleure protection des données privées réduit la vulnérabilité aux
cyberattaques. Les utilisateurs ont moins de risques de voir leurs données exposées lors de
violations de sécurité.

•Confiance envers les entreprises et institutions : Les consommateurs sont plus enclins à
interagir avec des entreprises transparentes et responsables dans leur gestion des données.
La protection de la vie privée améliore ainsi la réputation et la fidélité client.

•Conformité avec les réglementations : Dans de nombreux pays, la protection des


données privées est régie par des lois strictes (comme le RGPD en Europe). Les
organisations doivent se conformer pour éviter des sanctions légales et financières.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 6
02
Concepts de base
02 Concepts de base
Types de Données à Protéger

• Données personnelles : Informations qui identifient directement ou


indirectement une personne, comme le nom, l'adresse, l'email, ou le numéro de
téléphone.

• Données sensibles : Catégorie de données personnelles qui nécessitent une


protection accrue en raison de leur caractère confidentiel, incluant les données
de santé, l'origine ethnique, les convictions religieuses, ou les informations
financières.

• Données biométriques : Données basées sur des caractéristiques


biologiques ou comportementales, telles que les empreintes digitales, la
reconnaissance faciale ou la voix, permettant d'identifier une personne de
manière unique.

• Données de localisation et comportementales : Informations qui suivent la


position géographique (GPS) d’une personne ou son comportement en ligne
(historique de navigation, préférences), souvent utilisées pour des analyses de
profil ou du ciblage publicitaire.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 8
02 Concepts de base
Principales Menaces

1. Phishing et Hameçonnage
•Définition : Messages trompeurs imitant des entités de confiance pour voler des
informations.
•Impact : Usurpation d’identité, accès frauduleux aux comptes.

2. Malware et Ransomwares
•Malware : Programmes volants ou corrompant les données.
•Ransomware : Verrouille les données et demande une rançon pour les
débloquer.
•Impact : Coût financier, paralysie des activités.

3. Violation de Données (Data Breach)


•Définition : Fuite ou vol de données via accès non autorisé.
•Impact : Perte de confidentialité, dommages financiers et réputation.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025 9
02 Concepts de base
Principales Menaces

4. Utilisation Abusive des Informations


•Exemple : Partage de données personnelles à des tiers sans consentement.
•Impact : Atteinte à la vie privée, publicités invasives.

5. Spyware et Suivi Non Autorisé


•Spyware : Logiciels espions collectant des informations secrètes.
•Impact : Profilage et publicités intrusives.

6. Ingénierie Sociale
•Définition : Manipulation pour soutirer des informations sensibles.
•Impact : Facilite le vol de données, l'accès à des systèmes sécurisés.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  10
02 Concepts de base
Protection des données privées en Tunisie

• En Tunisie, les droits des individus sur leurs données personnelles sont protégés
principalement par la Loi Organique n° 2004-63 du 27 juillet 2004 relative à la
protection des données à caractère personnel, souvent appelée « Loi sur la
Protection des Données Personnelles ».

• Cette loi, inspirée des standards internationaux, établit des droits pour les
citoyens concernant le traitement et la gestion de leurs données par des
entreprises ou des entités publiques.

• La Instance Nationale de Protection des Données Personnelles (INPDP) est


l’autorité chargée de superviser le respect de cette loi. Elle reçoit et traite les
plaintes des citoyens, et peut imposer des sanctions en cas de violation.

• Ces droits et protections visent à renforcer la vie privée des citoyens tunisiens
dans un contexte de traitement croissant de données personnelles par les
entreprises et les administrations publiques.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  11
02 Concepts de base
Protection des données privées en Tunisie

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  12
02 Concepts de base
Protection des données privées en Tunisie / Les Droits

•Droit d'Accès: Les individus ont le droit de savoir si leurs données personnelles sont traitées
et, le cas échéant, d’obtenir des informations sur la nature des données, les objectifs du
traitement, et les destinataires de ces données.

•Droit de Rectification: Les citoyens peuvent demander la correction de leurs données


personnelles si elles sont inexactes, incomplètes ou obsolètes.

•Droit d’Opposition: Les individus peuvent s’opposer au traitement de leurs données


personnelles dans certains cas, notamment pour des raisons légitimes ou dans le cas d'une
utilisation à des fins de prospection.

•Droit à l’Oubli: Bien que moins explicite dans la loi tunisienne que dans le RGPD européen, les
individus peuvent demander la suppression de leurs données personnelles si elles ne sont plus
nécessaires pour les finalités pour lesquelles elles ont été collectées.

•Droit de Portabilité: Bien que ce droit soit moins détaillé que dans les réglementations
récentes, les individus ont le droit de récupérer une copie de leurs données, notamment lorsque
celles-ci doivent être transférées entre services.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  13
03
Conseils de protection
03 Conseils de protection

•Éviter de partager des informations personnelles sensibles en ligne.


•Utiliser des paramètres de confidentialité sur les réseaux sociaux pour contrôler
les accès.
•Limiter les applications et services ayant accès à vos données.
•Lire attentivement les conditions d'utilisation et les politiques de confidentialité.
•Désactiver le suivi de localisation lorsque cela n'est pas nécessaire.
•Utiliser un réseau privé virtuel (VPN) pour protéger votre connexion Internet.
•Utiliser des moteurs de recherche respectueux de la vie privée.
•Supprimer régulièrement les anciens comptes en ligne non utilisés.
•Éviter de se connecter à des réseaux Wi-Fi publics sans protection.
•Être vigilant sur les emails et messages suspects pour éviter le phishing.

Data Science et Intelligence Artificielle | Cdt Nour Elhak FRADI | EEM 2024-2025  15

Vous aimerez peut-être aussi