0% ont trouvé ce document utile (0 vote)
7 vues7 pages

Deep Learning pour la Lecture Interactive

Le projet vise à développer un système interactif de lecture d'histoires pour enfants, utilisant le Deep Learning pour créer une narration vocale expressive et répondre aux questions des jeunes lecteurs. Le rapport détaille la méthodologie CRISP-DM adoptée, l'architecture technique incluant des modules de Synthèse Vocale et de Traitement Automatique du Langage, ainsi que les étapes de préparation et de pré-traitement des données. L'objectif est de transformer la lecture passive en une expérience éducative et engageante pour les enfants.

Transféré par

saharbs994
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats DOCX, PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
7 vues7 pages

Deep Learning pour la Lecture Interactive

Le projet vise à développer un système interactif de lecture d'histoires pour enfants, utilisant le Deep Learning pour créer une narration vocale expressive et répondre aux questions des jeunes lecteurs. Le rapport détaille la méthodologie CRISP-DM adoptée, l'architecture technique incluant des modules de Synthèse Vocale et de Traitement Automatique du Langage, ainsi que les étapes de préparation et de pré-traitement des données. L'objectif est de transformer la lecture passive en une expérience éducative et engageante pour les enfants.

Transféré par

saharbs994
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats DOCX, PDF, TXT ou lisez en ligne sur Scribd

Institut Supérieur des Mathématiques

Appliquées et d’Informatique de Kairouan

Projet Tutoré
Rapport de Stage
Étude et mise en place du Deep Learning pour le
projet smart story

Année Universitaire 2025-2026


Introduction Générale

L'ère numérique a transformé l'accès à l'information et au divertissement, ouvrant


de nouvelles avenues pour l'éducation des enfants. Historiquement, la lecture d'histoires a
toujours été un pilier du développement de l'imagination et du langage. Cependant, cette
activité, lorsqu'elle est médiatisée par des supports traditionnels, reste souvent une
expérience passive, limitant l'engagement actif de l'enfant. Face à
cette limite, et tirant parti de la démocratisation des tablettes éducatif pour les enfants et
des avancées en Intelligence Artificielle (IA), une opportunité majeure se présente : celle
de transformer la lecture en un dialogue interactif et éducatif.
Notre projet s'inscrit dans cette dynamique d'innovation en proposant un Système
Interactif de Lecture d'Histoires basé sur le Deep Learning. L'objectif principal est de
concevoir une plateforme capable de lire des récits avec une voix naturelle et
expressive, tout en comprenant les questions ou les réactions écrites de l'enfant pour y
répondre de manière simple, sécurisée et bienveillante. Ce système vise à transcender la
simple écoute pour créer une expérience ludique, où l'enfant devient un participant actif
de l'histoire qu'il lit, stimulant ainsi son développement cognitif et linguistique de
manière plus efficace.
Le défi technique est double : d'une part, maîtriser les techniques de Synthèse
Vocale (Text-to-Speech - TTS) pour générer un rendu audio adapté à l'univers enfantin ;
et d'autre part, déployer des modèles avancés de Traitement Automatique du Langage
Naturel (NLP) pour maintenir une conversation cohérente et pédagogique.
Ce rapport détaille la conception et la réalisation de ce système. Le Chapitre 1
(Cadre du Projet et Contexte) établira la problématique, l'état de l'art et la
méthodologie adoptée (CRISP-DM). Le Chapitre 2 (Conception et Réalisation
Technique) décrira l'architecture des modules Deep Learning, notamment le TTS
expressif et le modèle de dialogue interactif. Enfin, le Chapitre 3 (Évaluation, Résultats
et Discussion) présentera les métriques de performance et les tests utilisateurs, concluant
sur les succès, les défis rencontrés et les perspectives d'amélioration de ce système d'IA
conversationnel dédié à l'enfance.
Chapitre1 : Cadre du Projet et Contexte

I. Introduction du Chapitre
Ce premier chapitre a pour vocation de définir le périmètre, les motivations et le contexte théorique dans
lequel s'inscrit notre projet de système interactif de lecture. Nous commencerons par une analyse approfondie
de l'environnement actuel, en identifiant les solutions existantes pour la narration numérique et l'interaction
conversationnelle. Cette étude de l'état de l'art permettra de définir précisément la problématique à résoudre et
de formuler une solution technologique claire. Enfin, nous détaillerons la méthodologie CRISP-DM choisie pour
encadrer et structurer l'intégralité du cycle de vie du projet.

II. Contexte du Projet


1. Étude de l'Existence :
La lecture d’histoires aide les enfants à développer leur imagination et leur langage, mais elle reste souvent
une activité passive. Pour rendre cette expérience plus interactive et éducative, notre projet propose un
système basé sur le Deep Learning capable de lire des histoires et de communiquer avec l’enfant de manière
naturelle et bienveillante.

2. Problématique :
En se basant sur les lacunes identifiées dans l'étude de l’existence, la problématique centrale de notre projet
s'articule autour de la question suivante :

Comment concevoir et implémenter, via le Deep Learning, un système interactif de lecture capable non
seulement de générer une narration vocale suffisamment expressive pour captiver un jeune public, mais aussi
de comprendre leurs questions écrites en temps réel et d'y apporter des réponses pertinentes, sécurisées et
d'un ton bienveillant, transformant ainsi la lecture passive en une expérience dialoguée et éducative ?

3. Solution Proposée :
Pour répondre à cette problématique, nous proposons la conception d'une plateforme basée sur une
architecture modulaire de Deep Learning :

 Module TTS Expressif : Entraînement ou affinage (fine-tuning) d'un modèle neuronal pour maximiser
l'expressivité et l'adaptation du rythme de la voix à l'ambiance du récit.
 Module NLP: Développement d'un modèle de génération de langage spécialisé, doté de règles strictes
de sécurité et calibré pour un niveau de langage simple et encourageant, capable de se référer au
contexte de l'histoire.
 Interface Intégrée : Création d'une interface utilisateur simple pour interaction enfant et modèle .
III. Méthodologie du Projet :
1. Présentation de la Méthodologie CRISP-DM :
L e processus Cross-Industry Standard Process for Data Mining (CRISP-DM) est un modèle méthodologique
reconnu pour guider le déploiement de projets d'analyse de données et d'apprentissage automatique. Il se
décompose en six phases interconnectées, assurant une approche rigoureuse et itérative, essentielle pour gérer
les incertitudes inhérentes au Deep Learning.

Les six phases sont représentées par l’annexe suivante :

L'adoption de CRISP-DM garantit un suivi précis des objectifs initiaux et permet une gestion structurée
des étapes cruciales de la modélisation et de l'évaluation, assurant que le produit final répond aux attentes de
sécurité et d'expressivité pour le public ciblé.
Chapitre 2 : Conception et Réalisation Technique

I. Compréhension et Préparation des Données


2. Introduction :
La réussite d'un système de Deep Learning est intrinsèquement liée à la qualité et à la préparation du
corpus de données d'entraînement. En cohérence avec les phases de Compréhension et de Préparation de la
méthodologie CRISP-DM, cette étape a été capitale pour transformer des données brutes en un format optimal
pour la modélisation ultérieure.

3. Choix Technique :
[Link]ées :
La phase de Deep Learning requérant un jeu de données à la fois vaste et thématiquement pertinent,
une attention particulière a été portée à la sélection du corpus initial. Pour garantir que le modèle de langage
puisse comprendre et générer des récits adaptés à notre public cible, nous avons sélectionné le jeu de données
tinystories disponible sur la plateforme Hugging Face. Ce choix n'est pas fortuit : le corpus tinystories a été
spécifiquement conçu pour l'entraînement de modèles de langage sur des récits courts, simples et éducatifs,
alignant ainsi la complexité lexicale et syntaxique des données avec le niveau de compréhension des jeunes
enfants. Ce contenu narratif constitue la matière première pour le Module d'Agent Conversationnel (NLP/NLG),
qui doit être capable de puiser dans ce type de narration pour contextualiser ses réponses. De plus, la
structuration initiale des données a nécessité une étape d'uniformisation. Pour garantir la cohérence dans le
pipeline de traitement, nous avons identifié la colonne principale contenant les histoires grâce à une analyse de
la longueur du texte, la standardisant afin de préparer l'étape de nettoyage et d'assurer une base commune
pour l'indexation de chaque histoire par un identifiant unique.

[Link]. Google Colaboratory :


Nous avons choisi Google Colaboratory (Colab), un environnement de notebook Jupyter exécuté dans le
cloud, qui fournit un accès gratuit et immédiat à des Unités de Traitement Graphique (GPU). Cette plateforme a
permis de réduire drastiquement les temps d'entraînement pour les architectures basées sur PyTorch et Keras,
avec un gain de performance estimé à environ vingt fois (20 \times). L'intégration naturelle de Colab avec
Google Drive a également facilité la gestion et l'exportation des jeux de données et des modèles entraînés,
optimisant ainsi l'itération et l'efficacité de la phase de modélisation. Cette technologie nous a permis de gagner
énormément de temps.

[Link]. Python et ses librairies :


L'écosystème Python a servi de socle de programmation, avec PyTorch sélectionné comme framework
principal pour la modélisation de la Synthèse Vocale et de la Génération de Langage Naturel, offrant la flexibilité
requise pour les architectures expérimentales. Enfin, les bibliothèques Pandas et les expressions régulières (re)
ont été fondamentales pour la phase amont de préparation des données, assurant le chargement structuré et le
nettoyage rigoureux du corpus d'histoires.

4. Pré-traitement des Données :


Le pré-traitement des données est une étape essentielle dans tout processus d’apprentissage
automatique. Les résultats dépendent en effet entièrement de la qualité et de la cohérence des données
d’entrée.

Cette phase, encapsulée principalement dans la fonction preparer_donnees, a débuté par le chargement du
corpus, tinystories_20k.xlsx. Une méthode heuristique basée sur la longueur moyenne du texte a permis
d'identifier et de normaliser la colonne principale contenant les histoires sous le nom de 'story'. Chaque entrée
s'est vue attribuer un identifiant unique ('story_id') pour faciliter le suivi et la gestion des systèmes de
classification et de recommandation ultérieurs.

L'opération la plus critique fut le nettoyage des textes, appliqué via la fonction nettoyer_texte pour créer la
colonne 'story_clean'. Cette fonction a été conçue pour garantir l'uniformité et la propreté du corpus. Elle a
méthodiquement géré les valeurs manquantes, assuré la conversion en chaîne de caractères, et procédé à la
standardisation des espaces (remplaçant les séquences multiples par un seul espace). Surtout, un filtrage strict
a été appliqué pour la suppression des caractères spéciaux non pertinents (conservant uniquement lettres,
chiffres et ponctuation essentielle), suivi par la normalisation des guillemets et la suppression des blancs en
début et fin de chaîne. Ces étapes de pré-traitement ont été essentielles pour transformer les données brutes
en un format standardisé, garantissant ainsi la robustesse et la fiabilité des modèles d'apprentissage profond à
venir.

Vous aimerez peut-être aussi