Chapitre 2 : Gestion avancée des services de stockage
L'objectif de ce chapitre est de passer d'un stockage simple à une architecture de données
résiliente, sécurisée et optimisée en termes de coûts.
1. Utilisation avancée des services de stockage objet
Le stockage objet (ex: AWS S3, Azure Blob Storage, Google Cloud Storage) ne se limite pas
au simple dépôt de fichiers.
Versioning (Gestion des versions) : Permet de conserver plusieurs variantes d'un
objet dans le même compartiment. Essentiel pour se protéger contre les suppressions
accidentelles ou les écrasements malveillants.
Réplication inter-régions (CRR) : Copie automatique des données vers une autre
zone géographique pour assurer la haute disponibilité et la reprise après sinistre
(Disaster Recovery).
Accélération de transfert : Utilisation des points de présence (Edge Locations) du
fournisseur cloud pour uploader des données via un réseau optimisé plutôt que par
l'Internet public.
2. Configuration des politiques de rétention et d'archivage
La gestion du cycle de vie des données est cruciale pour éviter l'accumulation de données
inutiles et coûteuses.
Classes de stockage :
o Standard : Accès fréquent, haute performance.
o Infrequent Access (IA) : Moins cher, mais frais de récupération plus élevés.
o Archive / Glacier : Coût de stockage infime, mais temps de récupération de
quelques minutes à plusieurs heures.
Politiques de cycle de vie (Lifecycle Policies) :
o Exemple : Déplacer les objets vers "Archive" après 90 jours, puis les supprimer
définitivement après 7 ans pour conformité légale.
Verrouillage d'objet (WORM - Write Once Read Many) : Empêche toute
modification ou suppression pendant une période définie, idéal pour la conformité
réglementaire (SEC, FINRA).
3. Gestion avancée des bases de données dans le Cloud
Le passage du On-premise au Cloud permet d'exploiter des fonctionnalités de gestion
automatisée.
Scalabilité verticale vs Horizontale : * Verticale : Augmenter la RAM/CPU de
l'instance.
o Horizontale (Read Replicas) : Créer des copies en lecture seule pour
décharger la base de données principale et améliorer les performances de
lecture mondiales.
Multi-AZ (Zones de Disponibilité) : Réplication synchrone vers une instance de
secours. En cas de panne, le basculement (failover) est automatique.
Bases de données Serverless : (ex: Aurora Serverless, DynamoDB) Ajustement
automatique de la capacité sans gérer de serveurs, facturation à l'usage exact.
4. Sécurisation des données stockées
La sécurité repose sur le modèle de responsabilité partagée.
Chiffrement (Encryption) :
o At Rest (au repos) : Utilisation de services de gestion de clés (AWS KMS,
Azure Key Vault) pour chiffrer les disques et objets.
o In Transit (en transit) : Utilisation systématique de TLS/SSL (HTTPS) pour
les transferts.
Contrôle d'accès :
o IAM Policies : Qui peut accéder à quoi.
o Bucket Policies : Règles appliquées directement sur le conteneur de stockage.
o Presigned URLs : Accès temporaire à un objet privé pour un utilisateur
spécifique sans changer les permissions globales.
5. Optimisation du stockage pour les performances et les coûts
L'objectif est d'atteindre le meilleur ratio performance/prix.
Choix du type de stockage bloc (EBS/Disk) :
o SSD (General Purpose) : Pour la majorité des charges de travail.
o Provisioned IOPS : Pour les bases de données intensives nécessitant une
latence très faible.
o HDD : Pour le débit (throughput) massif à bas prix (logs, Big Data).
Outils d'analyse de coûts :
o Utilisation de Storage Lens ou d'analyseurs de stockage pour identifier les
données orphelines (ex: snapshots de volumes supprimés) ou les données
jamais consultées restant en classe "Standard".
Déduplication et Compression : Techniques souvent intégrées nativement pour
réduire l'empreinte physique des données.
Résumé des points clés (Tableau comparatif)
Service Cas d'usage idéal Caractéristique Avancée
Stockage Objet Images, Vidéos, Backups Cycle de vie, Versioning
Stockage Bloc Disques OS, Bases de données IOPS Provisionnés, Snapshots
Stockage Fichier Partage de fichiers (NFS/SMB) Montage multi-instances
Base de données Données structurées Multi-AZ, Read Replicas