Das Management der Rechenzentrumsinfrastruktur ist komplex. Es umfasst Server, Speicher, Netzwerke, Anwendungen, die Cloud, Kühlung, Heizung, Befeuchtung, elektrische Anlagen, weitere Gebäudesysteme, die Unterstützung der Virtualisierung und vieles mehr. All dies effizient zu verwalten, ist die Aufgabe von Systemen für das Management der Rechenzentrumsinfrastruktur (DCIM).
Was ist DCIM?
DCIM stellt eine hohe Verfügbarkeit des Rechenzentrums sicher, sorgt für einen energieeffizienten Betrieb, eine optimale Kapazitätsauslastung und die Prognose des künftigen Bedarfs und hält den Betrieb innerhalb des Budgets. DCIM-Tools schaffen eine gemeinsame Basis für alle Bereiche des Rechenzentrums. Anstatt dass ein Team die IT und ein anderes Gebäudesysteme wie Heizung, Kühlung und Feuchtigkeitskontrolle verwaltet, sollen solche Systeme alles unter einem Dach zusammenführen.
Gartner definiert DCIM als eine Sammlung von Tools zur Überwachung, Messung, Verwaltung und Steuerung der Auslastung und des Energieverbrauchs von Servern, Speichersystemen und Netzwerkgeräten sowie von Komponenten der Gebäudeinfrastruktur wie Stromverteilereinheiten (PDUs) und Klimaanlagen für Computerräume (CRACs). Ältere Systeme greifen kaum in Gebäudemanagementsysteme (BMS) ein. Das ändert sich jedoch, da die Welten von IT und Operational Technology (OT) zusammenwachsen.
Die Vorteile von DCIM
Traditionell wurden solche Systeme vor Ort betrieben. Doch zunehmend kommen cloudbasierte DCIM-Tools auf den Markt. Sie bieten zahlreiche Vorteile, darunter:
- Überwachung und Alarmierung für die zahlreichen Aspekte des Rechenzentrumsbetriebs
- Verlagerung der Wartung von einem reaktiven zu einem proaktiven oder vorausschauenden Ansatz, bei dem Ausfälle erkannt werden, bevor sie Störungen verursachen
- Hinweise auf den Bedarf an Ersatzteilen
- Umwandlung von Rohdatenanalysen in maßgeschneiderte Empfehlungen zur Leistungssteigerung und Senkung der Wartungskosten
- Möglichkeit, Gebäudesysteme mit IT-Systemen zu korrelieren und zu integrieren, obwohl sie sehr unterschiedliche Protokolle verwenden
- Erfassung und Trendanalyse von Daten zahlreicher Sensoren in IT- und Gebäudesystemen
- Mehr Automatisierung und Digitalisierung im Rechenzentrum
- Vermeidung von Ausfällen
- Möglichkeit, alle Infrastrukturelemente abzufragen und zu durchsuchen und Rack-Konfigurationen dynamisch zu erstellen
- Anzeige von Stromlasten und Schwellenwerten
Außerdem lesenswert: Die besten Datenanalyse-Tools und -Software 2021
Wichtige DCIM-Funktionen
Die Funktionen von DCIM-Systemen unterscheiden sich je nach Anbieter. Systeme, die aus dem BMS-Bereich stammen, legen tendenziell den Schwerpunkt auf diese Systeme. Daher sind ihre Funktionen für das IT-Management meist weniger ausgeprägt. Umgekehrt konzentrieren sich viele IT-Management-Tools auf die Verwaltung von Servern und Systemen und haben möglicherweise Schwierigkeiten bei der Integration mit Gebäudesystemen. Die Kluft wird jedoch kleiner. Besonders im Bereich cloudbasierter DCIM überbrückt die neueste Produktgeneration erfolgreich den Graben, der einst zwischen IT- und Facility-Management bestand.
Zu den wichtigsten DCIM-Funktionen gehören unter anderem:
- Unternehmensüberwachung und Ereignismanagement
- Analysen des IT-Betriebs
- Integration des IT-Service-Managements (ITSM)
- Überwachung von Infrastrukturressourcen in einer Multi-Cloud-Umgebung
- Integration von Gebäude- und IT-Systemen – zumindest auf Datenebene, wenn nicht auf Steuerungsebene
Außerdem lesenswert: Best Practices und Strategien zur Verhinderung von Datenverlust (DLP)
Die führenden DCIM-Anbieter
Enterprise Networking Planet hat zahlreiche DCIM-Anbieter geprüft, um diejenigen zu ermitteln, die sich am besten für den Einsatz von DCIM im Rechenzentrum eignen. Bei unserer Auswahl haben wir Anbieter mit Cloud-Funktionen bevorzugt. Hier sind unsere Favoriten, in keiner bestimmten Reihenfolge:
Schneider Electric
Schneider Electric’s EcoStruxure IT Software & Digital Services bietet Überwachung, Planung, Modellierung und digitale Services, mit denen Unternehmen das Ausfallrisiko reduzieren und vorhersehen, Erkenntnisse und Empfehlungen erhalten und die Infrastrukturleistung über den gesamten Lebenszyklus der Geräte hinweg optimieren können. Die Lösung ist in drei Varianten verfügbar: IT Expert, Asset Advisor und IT Advisor.
Wichtige Unterscheidungsmerkmale
- EcoStruxure IT Advisor liefert Erkenntnisse über eine Plattform für Planung und Modellierung
- EcoStruxure Asset Advisor bietet fachkundige Services des Schneider Electric Service Bureau zur Überwachung von IT-Ressourcen rund um die Uhr
- EcoStruxure IT Expert bietet über eine cloudbasierte Überwachungsplattform Transparenz
- Die EcoStruxure-Softwareplattform bildet den Kern des umfassenden IT- und OT-Portfolios von Schneider Electric und lässt sich daher gut in zahlreiche elektrische Systeme und Überwachungssysteme integrieren
- Neben Daten und Transparenz über die Software liefert sie umsetzbare Informationen, um das Rechenzentrum effizienter zu betreiben
- Eine Überwachung und Disposition rund um die Uhr mit Fehlerbehebung vor Ort wird angeboten
- Die EcoStruxure-Softwareplattform bietet benutzerdefinierte Integrationen, Berichte und Dashboards
- Die EcoStruxure-Softwareplattform bietet einen ganzheitlichen Überblick über das gesamte IT-Portfolio – von Colocation bis Hyperscale und von Unternehmensrechenzentren bis zum Netzwerkrand
Panduit
Panduit SmartZone Cloud Software ist eine cloudnative Lösung, die die umfassende Flexibilität und Skalierbarkeit der Cloud nutzt, um Rechenzentrums-, Unternehmens- und Edge-Infrastrukturen zu verwalten. Sie unterstützt die Verwaltung, Überwachung, Steuerung und Alarmierung für Stromversorgung, Umgebung, Kühlung, Sicherheit, Anlagen und Konnektivität.
Wichtige Unterscheidungsmerkmale
- Sichere cloudbasierte Plattform mit Verschlüsselung ruhender und übertragener Daten, Zwei-Faktor-Authentifizierung, Zugriffskontrolle sowie einem sicherheitsorientierten Entwicklungslebenszyklus; zusätzlich gehärtet durch Tools zum Scannen und Bewerten der Sicherheit von Webanwendungen
- Herstellerunabhängig, aber eng auf Panduit SmartZone G5 Intelligent PDUs abgestimmt, um Stromversorgung, Umgebung und physischen Sicherheitszugang auf Rack-Ebene sowie IT- und Facility-Ressourcen zu visualisieren
- Einheitliche Übersichtsansicht mit ganzheitlichem Überblick über die Ressourcen des Rechenzentrums
- Neben Grundriss und Rack-Ansicht ermöglicht die Visualisierung des Strompfads, einzelne Ausfallpunkte zu identifizieren, Überdimensionierung zu reduzieren und Risiken zu bewerten
- Bietet eine visuelle Darstellung von Anlagenattributen, Konnektivität, verfügbarer Stellfläche sowie Strom- und Umgebungsressourcen
- Lizenziert pro bodenmontierter Anlage mit unbegrenzter Anzahl von Benutzern und Standorten
- Mandantenfähig
BMC
BMC Helix Operations Management with AIOps nutzt serviceorientierte Überwachung, fortschrittliches Ereignismanagement, Isolierung der Grundursache und intelligente Automatisierung, um Leistung und Verfügbarkeit zu verbessern. Die Lösung ist cloudbereit und kann Zustand und Leistung von Infrastruktur- und Anwendungsressourcen in einer Multi-Cloud-Umgebung überwachen.
Wichtige Unterscheidungsmerkmale
- AIOps, Analysen und maschinelles Lernen ermöglichen die Aufnahme, Analyse und Verwaltung großer Mengen an Betriebsdaten
- Ereigniserfassung und -korrelation zur Analyse großer Ereignismengen und deren Gruppierung zu Situationen, um Ereignisrauschen zu reduzieren und die zugrunde liegende Ursache erkannter Probleme sichtbar zu machen
- Analysen der wahrscheinlichen Ursache und die Isolierung der Grundursache ermöglichen eine proaktive, automatisierte Ermittlung der Ursache über verschiedene Geschäftsdienste hinweg
- Überwachung von Geschäftsdiensten und Visualisierung ihres Status mithilfe von Heatmaps und Kachelansichten
- Vorkonfigurierte Adapter zur Aufnahme von Metriken, Ereignissen und Topologien aus Lösungen von Drittanbietern
- Auslösen von Ereignissen und Benachrichtigungen auf Grundlage abweichenden Verhaltens
- Erkennen von Möglichkeiten zur Automatisierung und zur Vermittlung von Automatisierungsprozessen, um Korrekturmaßnahmen einzuleiten
- Integration mit ITSM zur automatisierten Erstellung, Anreicherung und Weiterleitung von Tickets
- Nutzt den gemeinsamen Datenspeicher und die Daten von BMC Helix Discovery, um Transparenz über Infrastruktur, Beziehungen und Services zu schaffen
Nlyte
Nlyte Platinum DCIM ist ein durchgängiges System für die gesamte physische Computerinfrastruktur, einschließlich Rechenzentren, Colocation-Standorten und Edge Computing. Es automatisiert die Verwaltung aller Anlagen, Ressourcen, Prozesse und Mitarbeiter.
Wichtige Unterscheidungsmerkmale
- IT-Teams können den Energieverbrauch überwachen und werden benachrichtigt, wenn Schwellenwerte überschritten werden.
- Unterstützt beim Design von Rechenzentren und bei der Infrastrukturplanung
- Überwachung der Leistung vorhandener Anlagen im Zeitverlauf und Vergleich mit festgelegten Benchmarks
- Verwaltung der Strom- und Flächenkapazität
- Workflow-Automatisierung
- Unterstützung für Warenannahme, Bereitstellung, Änderungen, technische Erneuerungen und Außerbetriebnahme
- Ermöglicht die zeitnahe Inbetriebnahme von Geräten ab der Warenannahme bis zur Außerbetriebnahme älterer Geräte
- Erweiterung der Nutzung der Information Technology Infrastructure Library (ITIL) auf das Rechenzentrum
- Freisetzung ungenutzter und unzureichend genutzter Kapazitäten bei Workloads, Fläche und Energie
- Prognose und Vorhersage des künftigen Zustands der physischen Rechenzentrumskapazität auf Grundlage des Verbrauchsmanagements
- „Was-wäre-wenn“-Modelle prognostizieren die Auswirkungen von Rechenzentrumsprojekten auf die Kapazität für Fläche, Stromversorgung, Kühlung und Netzwerke
Device42
Device42 bietet Transparenz über Rechenzentrum und Cloud – von der Erkennung der Infrastruktur und von IaaS bis hin zu Grundriss- und Rack-Diagrammen des Rechenzentrums sowie zum Stromverbrauch.
Wichtige Unterscheidungsmerkmale
- Kann Anlagen an ITSM-Ticketing-Systeme übergeben und die automatisierte Bereitstellung steuern
- Rechenzentrumsmanagement
- CMDB-Wartung
- Audit und Compliance
- ITSM-Integration
- Automatisierte Bereitstellung
- Reduzierung des Zeitaufwands für manuelle Dokumentation und des Compliance-Risikos
- Agentenlose und automatische Erkennung aller IT-Ressourcen, einschließlich physischer, virtueller und Cloud-Komponenten
- Erkennung von SNMP, IPMI, RedFish und Cisco UCS
- AWS, Azure, GCP und Oracle sowie Container-Erkennung für Docker und Kubernetes
Serverfarm
InCommand bietet Kontrolle über die IT-Infrastruktur und liefert Erkenntnisse für Kapazitätsplanung, Änderungsmanagement, Lebenszyklusmanagement und Effizienz im täglichen Betrieb. Die Lösung übernimmt alle physischen Anlagen in IT-, Facility- und Rechenzentrumsumgebungen und stellt sie als virtualisierten Service dar.
Wichtige Unterscheidungsmerkmale
- Schaffung von Managementkonsistenz sowie Prozess- und Mitarbeiterdisziplin durch InCommand-Services – Bereitstellung von Daten, Agilität und finanziellen Effizienzgewinnen
- InCommand kombiniert ein Portal mit klar definierten Prozessen und einem Team, um Unternehmen dabei zu unterstützen, die Kontrolle über ihre IT- und Facility-Infrastruktur zu erlangen
- Überwachung von Bereitstellung und Betrieb
- Workflow-Verwaltung
- Präzise Aufzeichnungen der IT-Infrastruktur
- Auslastungsmetriken und KPIs
- Empfohlene Maßnahmen zur Maximierung der Effizienz
- Lebenszyklen von Serveranlagen
- Kabelmanagement
ZPE
Der Nodegrid Manager von ZPE bietet Zugriff auf und Kontrolle über eine herstellerübergreifende DCIM-Umgebung für physische, virtuelle und Cloud-Infrastrukturen. Die Lösung bietet ein offenes, herstellerneutrales Netzwerkmanagement für Konsolenserver, PDUs, IPMI-Appliances und viele weitere Aspekte der Rechenzentrumsinfrastruktur.
Wichtige Unterscheidungsmerkmale
- Serielle Konsole mit 96 Ports
- Modularer All-in-one-Service-Router
- Zugriff auf und Kontrolle über alle physischen und virtuellen IT-Ressourcen
- Läuft in einer virtuellen Maschine, die mit der Größe der Cloud skaliert
- Unterstützt Serviceprozessoren, Speicher-, Netzwerk- und Stromversorgungs-Appliances verschiedener Hardwareanbieter
- Tunneling-Funktion durch Firewalls
LogicMonitor
LogicMonitor ist eine automatisierte, cloudbasierte Plattform für Infrastrukturüberwachung und Observability für Unternehmen und Managed-Service-Provider. Die agentenlose Plattform unterstützt die Digitalisierung von Anwendungen und Rechenzentrumsinfrastruktur.
Wichtige Unterscheidungsmerkmale
- Enthält mehr als 2.000 vorgefertigte Integrationen mit physischen Geräten sowie Cloud-Umgebungen
- Die enge Integration mit Cisco ACI und VMWare vCenter ermöglicht die native Überwachung von Servern, Speicher und Datenbanken
- Bietet die Aufnahme von IPFix, Netflow und Syslog
- Alert-Management und die Integration mit ServiceNow fördern automatisierte Workflows für das Incident-Management
- Überwachung von Cloud-, On-Premises- und hybriden Umgebungen auf einer einzigen Plattform
- Analyse von Logs und Aufdecken von Anomalien zur Verkürzung der mittleren Zeit bis zur Behebung (MTTR)
- Überwachung und Alarmierung für Metriken von Anwendungen, Hardware und Betriebssystemen
- Durchführung sofortiger Serviceprüfungen und Aktivierung synthetischer Transaktionen
- Überwachung von Kubernetes-Pods, -Nodes, Containern und anderen Komponenten
- Sicherstellen, dass Ihre Mitarbeiter im Homeoffice Zugriff auf die für die Aufrechterhaltung der Geschäftskontinuität erforderlichen Tools haben
Weiterlesen: Die beste Deduplizierungssoftware für die Datenverwaltung 2021