La gestion de l’infrastructure d’un data center est complexe. Elle englobe les serveurs, le stockage, les réseaux, les applications, le cloud, le refroidissement, le chauffage, l’humidification, les systèmes électriques et autres systèmes du bâtiment, la prise en charge de la virtualisation, et bien plus encore. Gérer efficacement tous ces éléments est la mission des systèmes de gestion de l’infrastructure des data centers (DCIM).
Qu’est-ce que le DCIM ?
Le DCIM garantit une haute disponibilité du data center, une exploitation économe en énergie, une utilisation optimale de la capacité, une anticipation des besoins futurs et le respect du budget. Les outils DCIM créent une cohérence entre tous les aspects du data center. Plutôt que de confier la gestion de l’IT à une équipe et celle des systèmes techniques du bâtiment — chauffage, refroidissement et contrôle de l’humidité, par exemple — à une autre, ces systèmes cherchent à réunir tous ces éléments sous une même bannière.
Selon Gartner, le DCIM regroupe des outils conçus pour surveiller, mesurer, gérer et contrôler l’utilisation et la consommation énergétique des serveurs, du stockage et des équipements réseau, ainsi que des composants de l’infrastructure technique, tels que les unités de distribution électrique (PDU) et les climatiseurs de salles informatiques (CRAC). Les anciens systèmes ne s’aventurent pas beaucoup dans les systèmes de gestion technique des bâtiments (BMS). Cela évolue toutefois avec le rapprochement des mondes de l’IT et des technologies opérationnelles (OT).
Les avantages du DCIM
Traditionnellement, ces systèmes étaient déployés sur site. Mais les outils DCIM basés dans le cloud sont de plus en plus présents. Ils offrent de nombreux avantages, notamment :
- Surveillance et alertes couvrant les nombreux aspects des opérations du data center
- Passage d’une maintenance réactive à une approche proactive ou prédictive, les défaillances étant détectées avant de provoquer une interruption
- Recommandations concernant les pièces de rechange nécessaires
- Transformation des données analytiques brutes en recommandations personnalisées pour améliorer les performances et réduire les coûts de maintenance
- Possibilité de corréler et d’intégrer les systèmes du bâtiment aux systèmes IT malgré l’utilisation de protocoles très différents
- Suivi et analyse des tendances de données provenant d’une multitude de capteurs répartis dans les systèmes IT et les systèmes du bâtiment
- Automatisation et numérisation accrues du data center
- Prévention des pannes
- Possibilité d’interroger et de rechercher tous les éléments de l’infrastructure et de générer dynamiquement des configurations de racks
- Visualisation des charges et des seuils électriques
À lire aussi : Les meilleurs outils et logiciels d’analyse de données en 2021
Fonctionnalités clés du DCIM
Les fonctionnalités des systèmes DCIM varient selon les fournisseurs. Ceux issus de l’univers des BMS ont tendance à privilégier ces systèmes. Ils sont donc généralement moins performants en matière de gestion IT. De même, de nombreux outils de gestion IT se concentrent sur la gestion des serveurs et des systèmes et peuvent rencontrer des difficultés à s’intégrer aux systèmes du bâtiment. Mais le fossé se réduit. En particulier dans le domaine du DCIM cloud, la dernière génération de produits franchit avec succès le gouffre qui séparait autrefois la gestion IT de la gestion des infrastructures.
Les fonctionnalités clés du DCIM comprennent notamment les suivantes :
- Supervision et gestion des événements à l’échelle de l’entreprise
- Analyse des opérations IT
- Intégration de la gestion des services IT (ITSM)
- Surveillance des ressources d’infrastructure dans un environnement multicloud
- Intégration entre les systèmes du bâtiment et les systèmes IT, au moins du point de vue des données, sinon du point de vue du contrôle
À lire aussi : Bonnes pratiques et stratégies de prévention des pertes de données (DLP)
Les principaux fournisseurs de DCIM
Enterprise Networking Planet a étudié un grand nombre de fournisseurs de DCIM afin d’identifier ceux qui proposent les solutions les mieux adaptées aux data centers. Dans notre sélection, nous avons privilégié les offres dotées de fonctionnalités cloud. Voici nos choix principaux, sans ordre particulier :
Schneider Electric
Logiciels et services numériques EcoStruxure IT de Schneider Electric proposent des fonctions de surveillance, de planification et de modélisation, ainsi que des services numériques pour aider les entreprises à atténuer et à anticiper les risques de défaillance, à obtenir des informations et des recommandations, et à optimiser les performances de l’infrastructure tout au long du cycle de vie des appareils. La solution existe en trois déclinaisons : IT Expert, Asset Advisor et IT Advisor.
Principaux éléments différenciateurs
- EcoStruxure IT Advisor fournit des informations via une plateforme de planification et de modélisation
- EcoStruxure Asset Advisor propose les services d’experts du Schneider Electric Service Bureau pour surveiller les actifs IT 24 h/24 et 7 j/7
- EcoStruxure IT Expert offre une visibilité grâce à une plateforme de surveillance cloud
- La plateforme logicielle EcoStruxure est au cœur du vaste portefeuille IT et OT de Schneider Electric ; elle s’intègre donc parfaitement à de nombreux systèmes électriques et de surveillance
- Outre les données et la visibilité fournies par ses logiciels, la solution fournit des informations exploitables pour gérer le data center plus efficacement
- Une surveillance et une intervention 24 h/24 et 7 j/7, avec remédiation sur site, sont proposées
- La plateforme logicielle EcoStruxure propose des intégrations, des rapports et des tableaux de bord personnalisés
- La plateforme logicielle EcoStruxure offre une vue globale de l’ensemble du portefeuille IT, de la colocation à l’hyperscale, en passant par les data centers d’entreprise et l’edge réseau
Panduit
Panduit SmartZone Cloud Software est une solution cloud native qui tire parti de la flexibilité et de l’évolutivité étendues du cloud pour gérer les infrastructures de data centers, d’entreprise et edge. Elle prend en charge la gestion, la surveillance, le contrôle et les alertes liés à l’alimentation, à l’environnement, au refroidissement, à la sécurité, aux actifs et à la connectivité.
Principaux éléments différenciateurs
- Plateforme cloud sécurisée avec chiffrement des données au repos et en transit, authentification à deux facteurs, contrôle des accès et cycle de développement axé sur la sécurité, renforcée par des outils d’analyse et d’évaluation de la sécurité des applications web
- Agnostique vis-à-vis des fournisseurs, mais étroitement alignée sur Panduit SmartZone G5 Intelligent PDUs pour visualiser l’alimentation et l’environnement au niveau des racks, ainsi que l’accès physique sécurisé aux baies et les actifs IT et techniques
- Vue unifiée offrant une vision globale des ressources du data center
- En plus de la disposition du plancher et de l’élévation des racks, la visualisation du cheminement électrique permet aux opérateurs d’identifier les points uniques de défaillance, de réduire le surprovisionnement et d’évaluer les risques
- Représentation visuelle des attributs des actifs, de la connectivité, de l’espace disponible et des ressources électriques et environnementales
- Licence par actif installé au sol, avec un nombre illimité d’utilisateurs et de sites
- Multilocataire
BMC
BMC Helix Operations Management with AIOps utilise une surveillance centrée sur les services, une gestion avancée des événements, l’isolation des causes profondes et l’automatisation intelligente afin d’améliorer les performances et la disponibilité. La solution est prête pour le cloud et peut surveiller l’état et les performances des ressources d’infrastructure et des applications dans un environnement multicloud.
Principaux éléments différenciateurs
- L’AIOps, l’analytique et l’apprentissage automatique permettent d’ingérer, d’analyser et de gérer de grands volumes de données opérationnelles
- Collecte et corrélation des événements pour analyser de grands nombres d’événements et les regrouper en situations, afin de réduire le bruit événementiel et de fournir une visibilité sur la cause sous-jacente des problèmes détectés
- L’analyse des causes probables et l’isolement de la cause profonde permettent de déterminer de manière proactive et automatisée la cause première dans l’ensemble des services métier
- Surveillance des services métier et visualisation de leur état au moyen de cartes thermiques et de vues en tuiles
- Adaptateurs prêts à l’emploi pour ingérer les métriques, les événements et les topologies de solutions tierces
- Déclenchement d’événements et de notifications en fonction des comportements anormaux
- Identification des possibilités d’automatisation et de courtage d’automatisation pour prendre des mesures correctives
- Intégration à l’ITSM pour la création, l’enrichissement et le routage automatisés des tickets
- Fonctionne avec le magasin de données commun et les données de BMC Helix Discovery pour assurer la visibilité sur l’infrastructure, les relations et les services
Nlyte
Nlyte Platinum DCIM est un système de bout en bout couvrant toute l’infrastructure informatique physique, notamment les data centers, les sites de colocation et l’edge computing. Il automatise la gestion de tous les actifs, ressources, processus et collaborateurs.
Principaux éléments différenciateurs
- Les équipes IT peuvent surveiller la consommation énergétique et recevoir des alertes lorsque les seuils sont dépassés.
- Aide à concevoir le data center et à planifier l’infrastructure
- Surveillance des performances des actifs existants dans le temps et comparaison avec des références établies
- Gestion de la capacité électrique et de l’espace
- Automatisation des workflows
- Prise en charge de la réception des marchandises, du provisionnement, des changements, du renouvellement technologique et de la mise hors service
- Facilite l’intégration rapide des équipements dès leur réception, jusqu’à la mise hors service des équipements obsolètes
- Extension de l’adoption de l’Information Technology Infrastructure Library (ITIL) au data center
- Libération des capacités inutilisées ou sous-utilisées en matière de workloads, d’espace et d’énergie
- Prévision et anticipation de l’évolution future de la capacité physique du data center sur la base de la gestion de la consommation
- Les modèles « What if » prévoient l’impact des projets de data center sur la capacité en espace, en énergie, en refroidissement et en réseau
Device42
Device42 offre une visibilité sur le data center et le cloud, de la découverte de l’infrastructure et de l’IaaS aux schémas des salles et des racks du data center, en passant par la consommation électrique.
Principaux éléments différenciateurs
- Possibilité d’alimenter les systèmes de ticketing ITSM avec les actifs et de piloter le provisionnement automatisé
- Gestion du data center
- Maintenance de la CMDB
- Audit et conformité
- Intégration ITSM
- Provisionnement automatisé
- Réduction du temps consacré à la documentation manuelle et des risques liés à la conformité
- Découverte sans agent et automatique de tous les actifs IT, y compris les composants physiques, virtuels et cloud
- Découverte SNMP, IPMI, RedFish et Cisco UCS
- AWS, Azure, GCP et Oracle, ainsi que découverte des conteneurs Docker et Kubernetes
Serverfarm
InCommand offre le contrôle de l’infrastructure IT et fournit des informations pour piloter la planification des capacités, la gestion des changements, la gestion du cycle de vie et l’efficacité des opérations quotidiennes. La solution regroupe tous les actifs physiques des environnements IT, techniques et de data center et les présente sous la forme d’un service virtualisé.
Principaux éléments différenciateurs
- Créer une cohérence de gestion ainsi qu’une discipline des processus et du personnel grâce aux services InCommand, tout en apportant des gains en matière de données, d’agilité et d’efficacité financière
- InCommand associe un portail, des processus clarifiés et une équipe pour aider les entreprises à reprendre le contrôle de leur infrastructure IT et technique
- Supervision du déploiement et des opérations
- Administration des workflows
- Registres précis de l’infrastructure IT
- Métriques d’utilisation et KPI
- Actions recommandées pour maximiser l’efficacité
- Cycles de vie des actifs serveurs
- Gestion des câbles
ZPE
Nodegrid Manager de ZPE fournit un accès et un contrôle DCIM multiconstructeurs pour les infrastructures physiques, virtuelles et cloud. La solution offre une gestion réseau ouverte et indépendante des fournisseurs pour les serveurs de console, les PDU, les appliances IPMI et de nombreux autres aspects de l’infrastructure de data center.
Principaux éléments différenciateurs
- Console série 96 ports
- Routeur de services modulaire tout-en-un
- Accès et contrôle de tous les actifs IT physiques et virtuels
- S’exécute dans une machine virtuelle qui évolue avec la taille du cloud
- Prend en charge les processeurs de service, les équipements de stockage, de réseau et d’alimentation de plusieurs fournisseurs de matériel
- Possibilité de créer des tunnels à travers les pare-feu
LogicMonitor
LogicMonitor est une plateforme automatisée de surveillance et d’observabilité de l’infrastructure, basée dans le cloud, destinée aux équipes IT des entreprises et aux fournisseurs de services managés. Cette plateforme sans agent contribue à la numérisation des applications et de l’infrastructure des data centers.
Principaux éléments différenciateurs
- Intègre plus de 2 000 intégrations prédéfinies avec des équipements physiques ainsi qu’avec des environnements cloud
- L’intégration étroite avec Cisco ACI et VMWare vCenter permet la surveillance native des serveurs, du stockage et des bases de données
- Fournit l’ingestion des données IPFix, Netflow et Syslog
- La gestion des alertes et l’intégration à ServiceNow favorisent l’automatisation des workflows de gestion des incidents
- Surveillez les environnements cloud, sur site et hybrides depuis une plateforme unique
- Analysez les journaux et mettez en évidence les anomalies afin de réduire le délai moyen de résolution (MTTR)
- Surveillez les applications, le matériel et les métriques du système d’exploitation, et recevez des alertes
- Effectuez des contrôles de service ponctuels et activez des transactions synthétiques
- Surveillez les pods, nœuds, conteneurs et autres composants Kubernetes
- Veillez à ce que vos collaborateurs à distance aient accès aux outils dont ils ont besoin pour assurer la continuité de l’activité
À lire ensuite :Les meilleurs logiciels de déduplication pour gérer les données en 2021