Contexte:
Le contexte de cette étude se situe dans le domaine de l'apprentissage profond (deep learning) et
plus spécifiquement dans le domaine des réseaux de neurones convolutionnels (CNN). Les CNN sont
largement reconnus pour leurs performances exceptionnelles dans des tâches telles que la vision par
ordinateur et le traitement du langage naturel. Cependant, malgré leur succès, il existe encore des
lacunes dans la compréhension globale des CNN, notamment en ce qui concerne l'exploration de
nouvelles idées et la couverture de toutes les dimensions des convolutions, y compris 1-D et
multidimensionnelles.
Problématique:
La problématique abordée par cette étude réside dans le besoin de fournir une analyse approfondie
et complète des CNN, en tenant compte des avancées récentes et en proposant des perspectives
pour l'avenir. Les travaux existants ont souvent tendance à se concentrer sur des applications
spécifiques sans aborder les CNN sous un angle général, et certains aspects novateurs ne sont pas
couverts. Par conséquent, il est nécessaire de combler cette lacune en fournissant une vue
d'ensemble exhaustive des CNN, de leurs différentes convolutions et de leurs applications.
Synthèse des travaux existants:
Les travaux existants ont été résumés dans cette étude pour mettre en évidence les lacunes et les
limites des revues précédentes. Ces revues se concentrent souvent sur des applications spécifiques
des CNN sans considérer les aspects plus généraux de cette technologie. De plus, certains travaux
n'ont pas couvert les idées novatrices récemment proposées dans le domaine. Par conséquent, il est
nécessaire de mener une analyse approfondie qui prend en compte l'ensemble du spectre des CNN,
des convolutions de base aux modèles avancés, et d'identifier les lacunes dans les travaux existants
pour proposer des pistes de recherche futures.
Proposition en détails:
Cette étude propose une approche méthodique pour combler les lacunes identifiées dans les travaux
existants. Elle se concentre sur plusieurs aspects clés, notamment:
Une analyse approfondie des différentes convolutions utilisées dans les CNN, y compris les blocs de
construction de base ainsi que les convolutions déformables, de groupe, orientables, etc.
Une revue détaillée des modèles classiques basés sur les CNN, en mettant en évidence les points clés
qui les ont amenés à atteindre des résultats de pointe.
Une exploration des applications des convolutions 1-D, 2-D et multidimensionnelles dans divers
domaines.
Une analyse expérimentale pour tirer des conclusions et fournir des recommandations sur la
sélection de fonctions et de paramètres hyperparamétriques.
Une discussion sur les problèmes ouverts et les directions prometteuses pour la recherche future
dans le domaine des CNN.
Résultats:
Les résultats de cette étude comprennent une vision d'ensemble approfondie et complète des CNN,
de leurs différentes convolutions et de leurs applications. Des recommandations pratiques sont
fournies pour guider les praticiens dans le choix des architectures et des paramètres pour des tâches
spécifiques. De plus, des perspectives futures sont identifiées pour stimuler la recherche et le
développement ultérieurs dans le domaine des CNN.
Auteurs Principaux Travaux Limitations et Lacunes
Aloysius et Chronologie des cadres de Ne pas expliquer en détail les architectures et les
Geetha l'apprentissage profond raisons de leur efficacité
Dhillon et Architectures des réseaux Ne pas couvrir les réseaux de nouvelle génération et
Verma classiques les idées novatrices récentes
Se concentrer uniquement sur un domaine
Rawat et CNN pour la reconnaissance spécifique sans une vue d'ensemble générale des
Wang d'images CNN
Se concentrer uniquement sur un domaine
CNN pour la reconnaissance spécifique sans une vue d'ensemble générale des
Liu et al. d'images CNN
Se concentrer uniquement sur un domaine
CNN pour la segmentation spécifique sans une vue d'ensemble générale des
Ajmal et al. d'images CNN