La virtualisation des données est une approche de la gestion des données qui consiste à créer des structures virtuelles pour faciliter leur récupération et leur manipulation. Elle permet aux utilisateurs d’extraire des données virtualisées via des tableaux de bord, des portails, des rapports et des applications.
Les données peuvent être consultées et manipulées sans que l’utilisateur ait à connaître leurs détails techniques ou leurs emplacements physiques, dans une vue d’ensemble.
Voici tout ce qu’il faut savoir sur le segment mondial de la virtualisation des données :
Voir des exemples de cas d’étude sur l’utilisation de la virtualisation par Nasdaq, Bowmicro, Nilkamal, Isala, l’université de Pise et AeC.
Marché de la virtualisation des données
Le marché de la virtualisation des données était estimé à 2,3 milliards de dollars en 2020. Il devrait maintenir un taux de croissance annuel composé (TCAC) de 17 % sur la période de prévision allant de 2020 à 2027, pour atteindre 7,2 milliards de dollars à son terme.
Le segment des logiciels autonomes devrait atteindre 1,4 milliard de dollars en 2027, avec un TCAC de 17 %. Le segment des outils applicatifs était estimé à 429 millions de dollars en 2020 et devrait atteindre 1,2 milliard de dollars en 2027, avec un TCAC de 15 %.
Sur le plan régional, le marché de la virtualisation des données se répartit comme suit :
- Le marché américain était estimé à 680 millions de dollars en 2020, avec une part de 29 %
- Le marché chinois devrait maintenir un TCAC de 17 %, pour atteindre 1,3 milliard de dollars en 2027, avec une part de 18 %
- Le Japon et le Canada devraient chacun enregistrer un TCAC de 16 % et de 15 % respectivement sur la période 2020-2027
- En Europe, l’Allemagne affiche l’un des TCAC estimés les plus élevés, à 12 %
- Le marché de l’Asie-Pacifique, porté par l’Australie, la Corée du Sud et l’Inde, devrait atteindre 838 millions de dollars en 2027
Par secteur d’activité, le secteur des soins médicaux devrait afficher l’un des taux de croissance les plus élevés d’ici 2023.
Parmi les autres secteurs notables figurent :
- Banque, services financiers et assurance (BFSI)
- Informatique
- Télécommunications
- Industrie manufacturière
- Administration publique
Les solutions de virtualisation des données permettent aux utilisateurs — souvent des employés et des data scientists internes — d’accéder à des volumes variables de données via une plateforme commune, dans le format de leur choix, quel que soit leur emplacement de stockage sur le serveur.
Avec l’essor de la numérisation, des réseaux Internet des objets (IoT), des appareils connectés et de la génération de données, le volume total de données produit par une seule organisation a également augmenté de façon spectaculaire.
Découvrez tout sur le marché de la virtualisation du stockage.
Fonctionnalités de la virtualisation des données
La virtualisation des données peut être mise en œuvre sous une grande variété de formes, adaptées à différentes situations :
Mélange de données
Le mélange de données consiste à combiner des données provenant de deux sources ou plus au sein d’un même jeu de données afin de permettre leur accès, leur analyse et leur visualisation. Il recueille des informations supplémentaires auprès de sources de données secondaires en complément de la source de données principale, dans une vue unifiée. Il existe plusieurs méthodes de mélange de données, notamment les relations, les mélanges et les jointures, qui varient en termes d’efficacité, de complexité et de flexibilité.
Virtualisation SQL
La virtualisation des données via des serveurs SQL ne nécessite pas de déplacer les données de leur emplacement d’origine. Elles sont virtualisées dans une instance de serveur SQL, ce qui réduit le besoin de traitements d’extraction, de transformation et de chargement (ETL), tout en permettant de continuer à les interroger sur le serveur SQL. Souvent utilisées avec le big data, les données peuvent être combinées avec des fichiers SQL, ce qui les rend accessibles via des requêtes SQL standard.
Module de services de données
Les modules de services de données sont des services inclus dans les suites d’intégration de données et les entrepôts de données. Il s’agit de fonctions logicielles qui attribuent aux données des caractéristiques qu’elles ne possèdent pas déjà. Les données peuvent être transformées pour devenir plus accessibles, résilientes et compréhensibles pour les applications et les utilisateurs.
Services de données cloud
Les services de données cloud constituent l’alternative basée sur le cloud à la virtualisation locale des bases de données. Ces services sont inclus dans les solutions de virtualisation des données sous forme de packages SaaS, avec des outils sur site utilisés pour accéder aux données et les manipuler. Bien qu’ils ne soient pas considérés comme de la véritable virtualisation des données, les services de données cloud permettent aux utilisateurs de rester compatibles avec différentes plateformes cloud et offrent un large choix d’outils et de services d’analyse.
« Comme les données créées par ces sources sont stockées dans divers formats et dans de nombreux emplacements physiques, y accéder rapidement est devenu une tâche difficile. … Par conséquent, il est devenu essentiel de gérer et d’intégrer les données provenant de plusieurs sources afin de garantir leur disponibilité en temps réel », écrit Verified Market Research.
« En outre, les solutions de virtualisation des données offrent des avantages tels qu’une meilleure gestion des données, une réduction du délai de mise sur le marché et une qualité accrue des données. … La plupart des organisations présentes sur le marché de la virtualisation des données se concentrent sur des solutions basées sur le cloud afin de réduire les coûts d’infrastructure liés à la gestion de volumes massifs de données. »
Avantages de la virtualisation des données
Dans les environnements centrés sur les données, la virtualisation des données peut avoir des effets positifs sur les services informatiques et les applications fondées sur les données, utilisées sur site comme dans le cloud.
Parmi les principaux avantages de la virtualisation des données figurent :
- Facilite l’accès aux données en temps réel
- Permet le provisionnement de services de données
- Ne nécessite pas de réplication des données
- Réduit les coûts du service informatique et de l’infrastructure
- Accélère la création de valeur pour les applications métier
- Fournit de meilleures informations
- Améliore l’efficacité de la gestion des données
« La virtualisation des données répond au défi du déplacement des données en veillant à ce qu’elles restent à la source — tout en demeurant disponibles en temps réel pour être exploitées par les applications », explique Manish Mehndiratta, membre du Forbes Technology Council.
« Elle va au-delà des vues par niveaux et de l’exécution déléguable des requêtes pour favoriser la croissance de l’entreprise. Globalement, mettre en œuvre votre propre approche de la virtualisation des données vous permettra d’obtenir plus rapidement des informations. »
Cas d’usage de la virtualisation des données
Technique de virtualisation utilisée pour simplifier la gestion et l’accessibilité des données, la virtualisation des données est flexible et employée par des organisations de différents secteurs :
Highmark Health
Highmark Health est une organisation nationale à but non lucratif spécialisée dans la santé et le bien-être, basée à Pittsburgh, en Pennsylvanie. Elle exploite également plusieurs filiales à but lucratif.
Highmark Health participe à la prise en charge des cas de septicémie dans le pays, dont le nombre dépasse en moyenne 700 000 par an, avec des taux de mortalité compris entre 25 % et 50 %. En collaboration avec IBM et le Geisinger Health System, Highmark cherchait à utiliser les données pour prédire les cas de septicémie.
Associant IBM Watson AI, IBM Data Virtualization et IBM Watson Studio, Highmark Health a pu identifier les patients présentant un risque élevé de septicémie et les faire passer en priorité pour des soins urgents.
« L’équipe d’élite en data science d’(IBM) voulait me montrer que c’était possible et que je pouvais dire à nos parties prenantes dans toute l’entreprise que nous allions avoir ce modèle prêt à être déployé et intégré aux systèmes cliniques », explique Curren Katz, directeur de la data science chez Highmark Health.
« Nous voulions que nos responsables de soins, nos infirmiers et nos médecins puissent accéder aux résultats, les intégrer à leur travail et contacter les patients. Je crois qu’IBM est revenu avec un modèle déployé en l’espace de quelques jours, et j’ai été assez stupéfait. »
Grâce aux solutions d’IA et de virtualisation des données d’IBM, Highmark a pu éliminer les silos de données et réduire le temps de développement de l’IA d’un an à six semaines.
Indiana University
Indiana University compte huit sites, 19 000 membres du corps enseignant et plus de 114 000 étudiants.
Indiana University avait besoin d’obtenir des données à jour pour prendre ses décisions. L’université cherchait à réinventer la gestion et le stockage de ses données afin de les rendre plus accessibles aux membres du corps enseignant et aux étudiants.
Après avoir choisi Denodo, Indiana University a lancé son programme Decision Support Initiative (DSI) par l’intermédiaire d’Academic Metrics 360 (AM360), en utilisant la virtualisation des données pour obtenir une vue à 360 degrés du pôle universitaire.
« Nous voulions vraiment concentrer nos efforts en matière de business intelligence et de développement des données sur l’idée d’une BI agile. Nous voulions essayer de fournir de la valeur à l’université de manière itérative », explique Dan Young, architecte en chef des données chez Indiana University.
« Nous avons décidé que Denodo nous conviendrait bien, car nous cherchions à progresser dans la méthodologie de BI agile. »
Avec Denodo, Indiana University a construit un entrepôt de données logique et facilité l’accès aux données et aux informations en temps voulu.
Anadolu Sigorta
Anadolu Sigorta est l’une des plus grandes compagnies d’assurance de Turquie dans les domaines de la santé, de l’ingénierie, du transport maritime, de l’automobile, de l’incendie et de l’habitation. Avec plus de trois millions de clients, elle offre un accès numérique et rapide à ses services.
Anadolu Sigorta devait résoudre des problèmes et des pénuries de stockage qui entraînaient des difficultés lors de la création de requêtes de données. En collaboration avec Delphix, elle a pu virtualiser ses systèmes de données et résoudre sa pénurie de stockage de 5 To.
« Avec Delphix, nous sommes désormais en mesure de fournir à nos équipes de test et de développement de solutions des données plus précises, en mobilisant moins de temps et de ressources », explique Mehmet Abaci, DSI d’Anadolu Sigorta.
« De plus, grâce à l’équipe de services professionnels d’Accuras, qui a toujours été présente à chaque étape du processus pour le conseil, la conception architecturale et l’assistance à l’installation, nous avons pu tirer parti de Delphix de la manière la plus rapide et la plus efficace possible. »
Au total, Anadolu a pu économiser plus de 250 To de stockage et réduire le temps de provisionnement de sa base de données de cinq jours à 10 minutes.
Fournisseurs de solutions de virtualisation des données
Parmi les principaux fournisseurs de services de virtualisation des données figurent :
- Information Builders
- Microsoft
- OpenLink Software
- IBM
- Datometry
- SAP
- SAS Institute
- Red Hat
- Oracle
- Denodo Technologies
À la recherche d’un produit de virtualisation des serveurs ? VMware : test de vSphere.