En matière de stockage cloud ou sur site, il n’existe pas de choix définitif.
Tout dépend des préférences, de l’analyse des coûts et de la philosophie en matière d’infrastructure. Mais quelles que soient les préférences de chacun, le stockage cloud est là pour durer.
Voici cinq des principales tendances que les entreprises et les équipes informatiques observent sur le marché du stockage cloud :
1. Davantage de stockage cloud que sur site
En termes de capacité, le cloud l’emporte. Il y a désormais davantage de données stockées dans le cloud que sur site.
Face à l’explosion des données non structurées, les entreprises se tournent vers le cloud, selon Eric Burgener, analyste chez IDC.
En moyenne, 71 Po de stockage de fichiers sont envoyés chaque année vers des sites sur site, tandis que plus de 91 Po sont transférés vers des sites de cloud public.
Le stockage sur site progressera à un rythme soutenu de 46 % par an au cours des cinq prochaines années, ce qui montre qu’il reste une option viable pour les entreprises. Toutefois, le taux de croissance du stockage dans le cloud public atteindra 53 % par an.
2. Poursuite de la croissance du stockage nearline
Une partie de ce stockage sera transférée vers un cloud distant aux performances limitées.
Mais une quantité croissante est destinée au stockage nearline, a déclaré Steve Emerson, porte-parole de Broadcom du Data Center Solutions Group (DCSG).
Emerson a cité les résultats financiers trimestriels récents de Seagate, qui attribuaient leurs revenus élevés à un chiffre d’affaires « record » provenant des produits nearline, porté par les clients du cloud.
« La demande des clients finaux pour le stockage basé dans le cloud reste soutenue ; les vidéos générées par les utilisateurs (formats vidéo courts comme TikTok) et les autres contenus vidéo représentent désormais une part importante de cette croissance », a déclaré Emerson.
« Les disques durs restent le principal support de stockage choisi, grâce à l’innovation continue en matière de capacité et de fonctionnalités axées sur les usages cloud. »
Emerson a ajouté que la croissance du stockage cloud semblait difficile à ralentir.
Les facteurs sociaux qui alimentent cette croissance — avec le partage de nouveaux formats de vidéos courtes et la création d’autres contenus — continueront de la soutenir pendant de nombreuses années.
Parallèlement, les fournisseurs de disques durs (HDD) continuent d’ajouter et d’améliorer des fonctionnalités pour les fournisseurs cloud afin de les aider en matière de capacité, de performances, d’OPEX et de coût global, notamment des fonctionnalités comme le SMR (pour la capacité), le double actionneur (pour les performances) et les limites de durée des commandes SATA (CDL).
3. Croissance des métadonnées
Les métadonnées constituent un problème majeur dans le stockage cloud, selon le cofondateur et CEO de Speedb Adi Gelvan.
Les métadonnées augmentent à un rythme alarmant, a-t-il déclaré, et le problème ne fera qu’empirer, tandis que le volume de données non structurées continue d’exploser.
Il y a dix ans, le ratio typique entre les données et les métadonnées était de 1 000:1. Aujourd’hui, il est souvent plutôt de 1:10.
De nombreuses organisations constatent désormais que leurs métadonnées dépassent le volume des données stockées. L’impact sur les performances et la capacité à monter en charge peut être considérable, et les réponses habituelles, comme le partage de bases de données ou l’ajout de ressources pour résoudre le problème, entraînent leurs propres pertes de temps et surcoûts.
« L’explosion des métadonnées oblige les équipes informatiques à examiner la partie la plus profonde de la pile logicielle qui trie et indexe les données — le moteur de stockage, également appelé moteur de données — afin de s’assurer qu’il est adapté aux exigences des applications modernes », a déclaré Gelvan.
4. Rapatriement vers le cloud
Oui, le stockage cloud connaît une forte croissance. Mais il suscite également un mouvement de rejet.
La consommation de stockage cloud ne suivra plus la croissance des dépenses de calcul dans le cloud comme elle l’a fait ces dernières années, selon DataCore Software et Augie Gonzalez, directeur du marketing technique.
« De plus en plus d’entreprises rapatrient leurs données du cloud vers leurs infrastructures sur site, où elles peuvent mieux maîtriser leurs dépenses et limiter leur exposition externe », a déclaré Gonzalez.
« Les premiers indicateurs laissent penser que la tendance au rapatriement va s’accélérer en 2022. »
L’informatique utilitaire dans les clouds publics reste parfaitement pertinente. Mais les aspects financiers et les contraintes liées à la localisation poussent les entreprises à réévaluer l’emplacement de la majeure partie de leurs données. Les équipes informatiques peuvent facilement arrêter et redémarrer des ressources de calcul cloud, comme des instances AWS EC2, afin de réduire les coûts de processeur et de mémoire.
Pourtant, le compteur tourne en permanence pour les compartiments S3 qui servent de disques cloud persistants. Même lorsque les charges de travail saisonnières diminuent de 40 %, la consommation de données continue d’augmenter, car les archives historiques continuent de s’accumuler et les factures mensuelles de stockage se cumulent d’une année sur l’autre, a déclaré Gonzalez.
« La gravité des données joue également un rôle important dans le rapatriement : une grande partie des nouvelles données générées arrivent en périphérie, loin de toute présence de cloud public », a déclaré Gonzalez.
« Elles atterrissent d’abord sur des avant-postes de stockage local pour être triées, avant leur transmission à la maison mère. Avec le volume de données IoT qui s’accumule rapidement, la justification économique initiale du stockage de conservation à long terme sur site devient d’autant plus pressante. »
5. Provisionnement dynamique du cloud
Le provisionnement dynamique du cloud a conduit plusieurs secteurs à déplacer leurs infrastructures essentielles du site vers le cloud.
Prenons le secteur des semi-conducteurs. La conception de semi-conducteurs avancés est un processus hautes performances au cœur de tous les secteurs. Traditionnellement, les pipelines d’analyse exploratoire des données (EDA) étaient construits dans des centres de données de calcul haute performance (HPC), en s’appuyant sur des ressources de stockage et de calcul à large bande passante et faible latence.
Les problèmes de chaîne d’approvisionnement rendent plus difficile le provisionnement des centres de données sur site avec les ressources nécessaires. En outre, l’impossibilité de reconfigurer rapidement une infrastructure fixe pour de nouvelles conceptions de puces a poussé les organisations à provisionner et à étendre dynamiquement leur infrastructure sur site afin d’exécuter en parallèle des pipelines EDA dans le cloud.
« Le calcul et le stockage cloud peuvent être provisionnés rapidement pour tirer parti des exigences spécifiques d’un projet donné », a déclaré Floyd Christofferson, vice-président du marketing produit chez Hammerspace.
« Cela permet d’exécuter plusieurs conceptions en parallèle, réduisant considérablement le délai de mise sur le marché. Et lorsque le projet est terminé, les ressources cloud peuvent être tout aussi rapidement désaffectées lorsqu’elles ne sont plus nécessaires, afin d’éviter les coûts superflus. »