Best Practices für VMware vSphere Replication
Die Replikation virtueller Maschinen (VM-Replikation) gilt nach wie vor als eine der besten Methoden für Datensicherheit, um kurze Zeiten der Wiederherstellung und die Systemverfügbarkeit bei Ausfällen oder Betriebsunterbrechungen jeglicher Ursache zu gewährleisten. Eine VM-Replik lässt sich im Katastrophenfall sofort hochfahren, sodass Sie eine VM innerhalb von Sekunden wiederherstellen und wichtige Geschäftsabläufe aufrechterhalten können.
Um mögliche Fallstricke beim Einsatz von VM-Replikationssoftware zu vermeiden – wie beispielsweise Anwendungsausfälle und Fehler, Datenverluste, einen unangemessen hohen Ressourcenverbrauch usw. – befolgen Sie die in diesem Beitrag behandelten Best Practices für die VMware vSphere-Replikation als Teil einer effizienten und zuverlässigen Strategie für die VM-Datensicherheit.
Was ist vSphere Replication und wie funktioniert es?
Bei der VMware vSphere-Replikation wird eine exakte Kopie einer VMware vSphere-VM an einem benutzerdefinierten Standort erstellt, bei dem es sich um einen ESXi-Host oder einen Cluster handeln kann. Diese VM-Kopie, die als VM-Replik bezeichnet wird, wird im ausgeschalteten Zustand gehalten und periodisch oder kontinuierlich (kontinuierliche Replikation) aktualisiert, um die neuesten Änderungen und den aktuellen Zustand der Quelle-VM widerzuspiegeln.
Hinweis: Die Replikation in VMware vSphere wird oft mit VMware-Backups verwechselt, doch diese Methoden zur Datensicherheit von VM-Daten verfolgen unterschiedliche Ziele und sollten sich ergänzen, nicht ersetzen (siehe unseren Blogbeitrag VM-Backup vs. VM-Replikation).
10 Best Practices für die VMware-Datenreplikation
Befolgen Sie die unten aufgeführten Best Practices und wenden Sie diese für die VMware vSphere-Replikation sowie die Replikation virtueller Maschinen in anderen Umgebungen an.
1. Definieren Sie geschäftskritische Workloads und priorisieren Sie diese.
Legen Sie fest, welche Daten virtueller Maschinen und Anwendungen im Falle eines Ausfalls oder einer Katastrophe den höchsten Schutz und die schnellste Wiederherstellung erfordern. Sie müssen nicht alles replizieren, und nicht alles muss innerhalb desselben Zeitrahmens wiederhergestellt werden.
Ihr Online-Shop beispielsweise gewährleistet einen kontinuierlichen Betrieb und ermöglicht die Abwicklung direkter Bestell- und Kauftransaktionen mit Kunden. Sollte Ihr Webserver ausfallen, ist es äußerst wichtig, dass die Website, das Inventar und das CRM als Erstes und so schnell wie möglich wiederhergestellt werden, um die Auswirkungen der Ausfallzeit der Website für die Kunden zu minimieren, während Backoffice-Anwendungen warten können.
2. Erstellen Sie einen Entwurf für den Plan zur Datensicherheit.
Wer nicht plant, plant das Scheitern. Planen Sie Aktivitäten zur Datensicherheit unter Berücksichtigung der Anforderungen an die Geschäftskontinuität, geschäftskritischer Workloads, Prioritäten, einzelner Datenschutztechniken, der Häufigkeit und Dauer von VM-Backup-/Replikationsaufträgen sowie der erforderlichen Ressourcen (Datenspeicher-Kapazität, Netzwerkbandbreite, Zeitfenster für VM-Backups/Replikationen usw.).
Stellen Sie sicher, dass Ihr Plan für Datensicherheit auch die Zuständigkeiten des Personals, dedizierte Hardware- und Softwarekomponenten sowie Szenarien von Disaster Recovery abdeckt.
3. Verwenden Sie ein angemessenes Verhältnis zwischen VM-Backup und VM-Replikation.
Obwohl VM-Backup und VM-Replikation auf den ersten Blick dasselbe zu leisten scheinen, verfolgen sie unterschiedliche Ziele und können sich nicht gegenseitig ersetzen. Ein VM-Backup, unabhängig von der Art, dient der langfristigen Sicherung von VM-Daten. Die VM-Replikation hingegen sorgt für eine schnelle Wiederherstellung der VM – mit anderen Worten: für hohe Verfügbarkeit der VM. Die Replikation virtueller Maschinen ist ein wesentlicher Bestandteil eines Plans für die Datensicherheit, und Sie sollten eine effiziente Kombination aus regelmäßigen VM-Backups und VM-Replikation finden, die den Anforderungen und dem Budget Ihres Unternehmens entspricht.
4. Legen Sie messbare Kriterien für die Abfolge der VM-Datenreplikation fest.
Die Festlegung messbarer Kriterien kann bei der Entscheidung für eine bestimmte VM-Replikationslösung hilfreich sein. Im Hinblick auf die Replikation in VMware vSphere zur Gewährleistung von Hochverfügbarkeit müssen Sie vor allem zwei Aspekte berücksichtigen:
- Geschwindigkeit. Wie schnell muss die Datenwiederherstellung der VM erfolgen? Obwohl eine VM-Replik eine vollständige Kopie der ursprünglichen VM ist, benötigen Sie möglicherweise dennoch etwas Zeit, um darauf zuzugreifen, beispielsweise durch das erneute Einbinden und Hochfahren eines DBMS.
- Fehlertoleranz ist die Fähigkeit eines Systems, eine gute Leistung aufrechtzuerhalten, falls eine oder mehrere Komponenten ausfallen. Überlegen Sie, welchen Grad an Fehlertoleranz Ihr System erreichen sollte, um VM-Daten im Falle einer Katastrophe verfügbar zu machen. Berücksichtigen Sie bei der Entscheidung, wie oft Sie die Replikation virtueller Maschinen zur Fehlertoleranz einsetzen wollen, auch Ihre Hardware- und Netzwerkkapazitäten.
Legen Sie je nach Ihrer Geschäftskontinuitätsrichtlinie die optimale Nähe des Wiederherstellungspunkts zum Ausfallpunkt fest, d. h. den Ziele der Wiederherstellungspunkte ({1}), der einen Kompromiss zwischen der Minimierung Ihres Datenverlusts und den Kosten für zusätzliche Ressourcen darstellt. Für manche Unternehmen kann dieser 24 Stunden, 7 Tage oder sogar 1 Monat betragen, während andere möglicherweise einen RPO von lediglich 10 Sekunden benötigen.
5. Erstellen Sie einen Plan für Failover und Failback.
Um den Betrieb von Diensten und Anwendungen im Falle eines Ausfalls einer Produktions-VM mit minimalen Unterbrechungen aufrechtzuerhalten, sollten Sie Failover- und Failback-Verfahren im Voraus festlegen. Erarbeiten Sie Aktionsszenarien für das Failover und Failback von Produktions-VMs, die unter verschiedenen ungünstigen Umständen zu befolgen sind.
Je nach dem etablierten System der Datensicherheit können die Failover- und Failback-Verfahren sowohl bei ungeplanten als auch bei geplanten Ausfällen manuell oder automatisiert erfolgen.
6. Aktivieren Sie die Überprüfung von VM-Replikaten.
Die regelmäßige Überprüfung Ihrer VM-Replikate, um sicherzustellen, dass sie einsatzfähig sind, ist eine bewährte Vorgehensweise. Dadurch werden unangenehme Überraschungen vermieden. Es kann vorkommen, dass sich Ihr VM-Replikat als beschädigt oder fehlerhaft herausstellt. Unabhängig vom Grund des Defekts sollten Sie VM-Replikate periodisch überprüfen und den Überprüfungsplan in Ihren Plan aufnehmen. Bei der Verwendung von VMware vSphere-Replikationslösungen von Drittanbietern wird empfohlen, die Funktion zur automatischen Überprüfung von VM-Replikaten zu aktivieren, sofern diese Funktion verfügbar ist. Auf diese Weise werden alle Ihre VM-Replikate automatisch auf ihre Integrität überprüft.
7. Erstellen Sie Application-Aware-Replikate.
Moderne Lösungen für Datensicherheit bieten Ihnen einen speziellen Application-Aware-Replikationsmodus, mit dem Sie anwendungsorientierte VM-Replikate für Anwendungen wie Microsoft Active Directory, Microsoft SQL Server, Microsoft SharePoint, Microsoft Exchange Server oder Oracle-Datenbanken erstellen können, indem Sie auf VSS Writer zurückgreifen.
Der „Application-Aware“ oder, mit anderen Worten, anwendungskonsistente VM-Replikationsmodus bedeutet, dass während des Replikationsvorgangs die Daten im Arbeitsspeicher und anstehende E/A-Vorgänge auf die Festplatte geschrieben werden, bevor ein Schnappschuss erstellt wird. Folglich enthalten Ihre VM-Replikate konsistente Daten, und Anwendungen lassen sich reibungslos und ohne Datenverlust wiederherstellen.
8. Automatisieren Sie die Werkzeuge für die Wiederherstellung.
Die Automatisierung der Werkzeuge für die Wiederherstellung reduziert unnötige Verzögerungen, wenn Sie VMs im Katastrophenfall so schnell wie möglich wiederherstellen müssen. Stellen Sie sicher, dass automatische Skripte ordnungsgemäß gepflegt werden. Andererseits bieten moderne, fortschrittliche Lösungen für die Datensicherheit integrierte Automatisierungsfunktionen.
9. Legen Sie die Aufbewahrungs- und Rotationsrichtlinie fest.
Diese Richtlinie legt die Häufigkeit der Erstellung von VM-Replikaten und deren Aufbewahrungsdauer fest. Datenänderungen aus der VM-Replikation werden kontinuierlich in die Replikationsänderungsdatenbank aufgenommen. Ohne periodische Bereinigung würde diese Datenbank dramatisch anwachsen, bis sie den gesamten verfügbaren Speicherplatz beanspruchen würde. Der Zeitraum zwischen den Bereinigungen wird als Bereinigungsverzögerung der Replikation bezeichnet. Die standardmäßige Bereinigungsverzögerung der Replikation ist in Ihrer Datensicherungssoftware festgelegt und variiert zwischen einem und mehreren Tagen.
Berücksichtigen Sie bei der Festlegung der Aufbewahrungs- und Rotationsrichtlinie die Bereinigungsverzögerung der Replikation. Änderungen, die älter sind als die Bereinigungsverzögerung, werden aus der Replikationsänderungsdatenbank gelöscht. Stellen Sie sicher, dass die Replikationsänderungsdatenbank häufiger gesichert wird als die Replikationsbereinigungsverzögerung beträgt; andernfalls können einige Änderungen verloren gehen.
10. Wählen Sie die richtige Lösung für die VM-Replikation und Disaster Recovery.
Wenn Sie regelmäßig Replikationen virtueller Maschinen durchführen müssen, sollten Sie die richtige Lösung auswählen, die den spezifischen Anforderungen Ihrer IT-Infrastruktur und dem Budget Ihres Unternehmens entspricht. Beim Vergleich der derzeit auf dem Markt erhältlichen VMware vSphere-Replikationsprodukte sollten Sie deren spezifische Funktionen sowohl unter dem Gesichtspunkt der Funktionalität als auch der Leistung betrachten. So nutzen beispielsweise einige Produkte die synchrone VM-Replikation (kontinuierliche Replikation), während andere eine semisynchrone oder asynchrone VM-Replikation durchführen. Zwar scheint die synchrone VMware-Datenreplikation die bessere Wahl für den Failover von transaktionalen Anwendungen zu sein, doch kann eine vollständige Synchronisation in einem langsamen Netzwerk die Leistung erheblich beeinträchtigen. Im Gegensatz dazu hat die asynchrone VMware-VM-Replikation in dieser Situation nahezu keine Auswirkungen auf die Leistung. Falls jedoch der Primärserver ausfällt, kann die asynchrone VMware-VM-Replikation zum Verlust bereits festgeschriebener Daten führen.
Ein weiterer zu berücksichtigender Punkt ist die Geschwindigkeit Ihrer VM-Replikation und Wiederherstellung, da hierfür möglicherweise Hardware mit hoher Kapazität erforderlich ist.
Die Remote-Replikation virtueller Maschinen an einen Standort außerhalb des Standorts oder in die Cloud schützt Ihre Daten zwar auch dann, wenn Ihr gesamtes Rechenzentrum von einer Katastrophe betroffen ist – stellen Sie jedoch sicher, dass Ihr Infrastruktur-Netzwerk über die erforderliche Bandbreite verfügt.
VMware vSphere Replication mit NAKIVO
NAKIVO Backup & Replication bietet viele nützliche Funktionen, um Ihre VMware-Replikationsowie Hyper-V-Replikation und sogar Replikation von AWS EC2-Instanzen einfach und schnell zu gestalten. Die NAKIVO-Lösung unterstützt das „Changed Block Tracking“ von VMware für inkrementelle Replikation, bietet flexible Aufbewahrungseinstellungen und arbeitet direkt mit VMware-APIs für die VMware-Datenreplikation auf Host-Ebene zusammen.
Sie können mit NAKIVO erstellte VMware-Replikate für das VM-Failover und komplexe Szenarien zur vollständigen Standortwiederherstellung verwenden.
