Bonnes pratiques pour VMware vSphere Replication
La réplication de machines virtuelles, ou réplication de VM, reste l’une des meilleures techniques de protection des données pour garantir des délais de récupération courts et la disponibilité du système en cas de pannes ou d’interruptions de service, quelle qu’en soit l’origine. Une réplique de VM peut être mise sous tension instantanément en cas de sinistre, ce qui vous permet de réaliser la récupération d’une VM en quelques secondes et de maintenir les opérations métier essentielles.
Pour éviter tout écueil potentiel lors de l’exécution d’un logiciel de réplication de machines virtuelles VMware – tels que les pannes et erreurs d’applications, les pertes de données, une consommation excessive de ressources, etc. – suivez les bonnes pratiques de réplication VMware vSphere présentées dans cet article dans le cadre d’une stratégie efficace et fiable de protection des données des machines virtuelles.
Qu’est-ce que la réplication vSphere et comment fonctionne-t-elle ?
La réplication VMware vSphere consiste à créer une copie exacte d’une machine virtuelle VMware vSphere dans un emplacement personnalisé, qui peut être un hôte VMware ESXi ou un cluster. Cette copie de la machine virtuelle, appelée « réplique de machine virtuelle », est maintenue à l’état éteint et mise à jour périodiquement ou en continu (réplication continue) afin de refléter les dernières modifications et l’état actuel de la machine virtuelle source.
Remarque : La réplication dans VMware vSphere est souvent confondue avec VMware-Backup, mais ces méthodes de protection des données des machines virtuelles poursuivent des objectifs différents et doivent se compléter plutôt que se substituer l’une à l’autre (voir notre article de blog Sauvegarde de machines virtuelles vs. réplication de machines virtuelles).
10 bonnes pratiques en matière de réplication des données VMware
Suivez les bonnes pratiques ci-dessous et appliquez-les à la réplication VMware vSphere ainsi qu’à la réplication des machines virtuelles dans d’autres environnements.
1. Définissez les Workloads critiques et hiérarchisez-les.
Déterminez quelles données de machines virtuelles et d’applications nécessitent la protection la plus élevée et la récupération la plus rapide en cas d’indisponibilité ou de sinistre. Vous n’avez pas besoin de tout répliquer, et tout ne doit pas nécessairement être récupéré dans le même délai.
Par exemple, votre boutique en ligne assure un fonctionnement continu et permet d’effectuer des transactions directes de commande et d’achat avec les clients. En cas de panne de votre serveur web, le site web, l’inventaire et le CRM seront extrêmement critiques à réaliser leur récupération en priorité et le plus rapidement possible afin de minimiser l’impact de l’indisponibilité du site web pour les clients, tandis que les applications de back-office peuvent attendre.
2. Définissez les grandes lignes du plan de protection des données.
Ne pas planifier, c’est planifier l’échec. Planifiez les activités de protection des données en tenant compte des exigences de continuité d’activité, des Workloads critiques, des priorités, des techniques individuelles de protection des données, de la fréquence et de la durée des tâches de sauvegarde/réplication des machines virtuelles, ainsi que des ressources requises (capacité de stockage des données, bande passante réseau, fenêtres de sauvegarde/réplication des machines virtuelles, etc.).
Assurez-vous que votre plan de protection des données couvre également les responsabilités du personnel, les composants matériels et logiciels dédiés, ainsi que les scénarios de reprise après sinistre.
3. Utilisez un rapport approprié entre la sauvegarde et la réplication des machines virtuelles.
Bien que la sauvegarde et la réplication des machines virtuelles semblent remplir la même fonction, elles ont des objectifs différents et ne peuvent se substituer l’une à l’autre. La sauvegarde des machines virtuelles, quel que soit son type, est conçue pour la conservation à long terme des données des machines virtuelles. La réplication des machines virtuelles, quant à elle, permet une récupération rapide des machines virtuelles, ou en d’autres termes, assure leur haute disponibilité. La réplication des machines virtuelles est un élément essentiel d’un plan de protection des données, et vous devez trouver une combinaison efficace entre les sauvegardes régulières des machines virtuelles et leur réplication, afin de répondre aux besoins et au budget de votre organisation.
4. Définir des critères mesurables pour les séquences de réplication des données des machines virtuelles.
La définition de critères mesurables peut s’avérer utile pour choisir la solution de réplication des machines virtuelles la plus adaptée. En ce qui concerne la réplication dans VMware vSphere à des fins de haute disponibilité, vous devez principalement prendre en compte deux aspects :
- La vitesse. À quelle vitesse la récupération des données de la machine virtuelle doit-elle s’effectuer ? Bien qu’une réplique de machine virtuelle soit une copie intégrale de la machine virtuelle d’origine, vous pouvez tout de même avoir besoin d’un certain temps pour y accéder, par exemple en remontant et en redémarrant un SGBD.
- La tolérance aux pannes est la capacité d’un système à maintenir un bon niveau de performances en cas de défaillance d’un ou plusieurs composants. Réfléchissez au degré de tolérance aux pannes que votre système doit atteindre pour garantir la disponibilité des données de la machine virtuelle en cas de sinistre. Lorsque vous déterminez la fréquence à laquelle vous allez recourir à la réplication des machines virtuelles à des fins de tolérance aux pannes, tenez également compte de la capacité de votre matériel et de votre réseau.
En fonction de votre politique de continuité d’activité, déterminez la proximité optimale entre le point de récupération et le point de défaillance, c’est-à-dire le objectifs de point de récupération ({1}), qui représente un compromis entre la minimisation de la perte de données et le coût des ressources supplémentaires. Pour certaines entreprises, ce délai peut être de 24 heures, 7 jours, voire 1 mois, tandis que d’autres peuvent avoir besoin d’un RPO de seulement 10 secondes.
5. Préparez la feuille de route pour le basculement et la restauration automatique.
Afin de maintenir le fonctionnement des services et des applications avec un minimum de perturbations en cas de panne d’une machine virtuelle de production, vous devez définir à l’avance les procédures de basculement et de restauration automatique. Élaborez des scénarios d’action de basculement et de restauration automatique des machines virtuelles de production à suivre dans différentes circonstances défavorables.
En fonction du système de protection des données mis en place, les procédures de basculement et de restauration automatique peuvent être manuelles ou automatisées, tant pour les arrêts imprévus que planifiés.
6. Activez la vérification des réplicas de machines virtuelles.
Il est recommandé de vérifier régulièrement vos réplicas de machines virtuelles afin de vous assurer qu’elles sont utilisables. Cela vous évitera de mauvaises surprises. Il peut arriver que votre réplique de machine virtuelle s’avère endommagée ou corrompue. Quelle que soit la raison du défaut, vérifiez régulièrement les répliques de machines virtuelles et intégrez ce calendrier de vérification à votre plan. Lorsque vous utilisez des solutions de réplication de machines virtuelles VMware vSphere tierces, il est recommandé d’activer la fonctionnalité de vérification automatique des réplicas de machines virtuelles, si celle-ci est disponible. Ainsi, l’intégrité de toutes vos réplicas de machines virtuelles sera automatiquement vérifiée.
7. Créer des réplicas cohérentes avec les applications.
Les solutions modernes de protection des données vous offrent un mode de réplication spécifique cohérent avec les applications qui vous permet de créer des réplicas de machines virtuelles cohérentes avec des applications telles que Microsoft Active Directory, Microsoft SQL Server, Microsoft SharePoint, Microsoft Exchange Server ou bases de données Oracle, par l’intermédiaire de VSS writers.
Le mode de réplication de machines virtuelles « cohérent avec les applications », ou en d’autres termes « adapté aux applications », signifie que, lors du processus de réplication, les données en mémoire et les opérations d’E/S en attente sont vidées sur le disque avant la création d’un instantané. Par conséquent, vos réplicas de machines virtuelles contiennent des données cohérentes, et les applications peuvent être restaurées sans heurts, sans perte de données.
8. Mettre en place une automatisation autour des outils de récupération.
La mise en place d’une automatisation autour des outils de récupération réduit les retards inutiles si vous devez restaurer des VMs au plus vite en cas de sinistre. Assurez-vous que les scripts automatiques sont correctement maintenus. D’autre part, les solutions modernes et avancées de protection des données offrent des fonctionnalités d’automatisation intégrées.
9. Définir la politique de conservation et de rotation.
Cette politique établit la fréquence de création des réplicas de VMs et leur durée de conservation. Les modifications apportées aux données de réplication des machines virtuelles sont continuellement ajoutées à la base de données des modifications de réplication. Sans purge périodique, celle-ci grossirait considérablement, jusqu’à épuiser tout l’espace disque disponible. Cet intervalle entre deux purges est appelé « délai de purge de réplication ». Le délai de purge de réplication par défaut est défini dans votre logiciel de protection des données et varie entre un et plusieurs jours.
Lors de l’établissement de la politique de conservation et de rotation, tenez compte du délai de purge de réplication. Les modifications plus anciennes que le délai de purge sont supprimées de la base de données des modifications de réplication. Assurez-vous que la base de données des modifications de réplication est sauvergardée plus fréquemment que la durée du délai de purge de réplication ; sinon, certaines modifications risquent d’être perdues.
10. Choisissez la solution de réplication de machines virtuelles et de reprise après sinistre (DR) adaptée.
Si vous devez effectuer régulièrement des réplications de machines virtuelles, vous devez sélectionner la solution adaptée, qui répondra aux besoins spécifiques de votre infrastructure informatique et au budget de votre organisation. Lorsque vous comparez les produits de réplication de machines virtuelles VMware vSphere actuellement disponibles sur le marché, vous devez examiner leurs fonctionnalités spécifiques sous l’angle à la fois des fonctionnalités et des performances. Par exemple, certains produits utilisent la réplication synchrone des machines virtuelles (réplication continue), tandis que d’autres recourent à la réplication semi-synchrone ou asynchrone. Si la réplication synchrone des données VMware semble constituer un meilleur choix pour le basculement des applications transactionnelles, une synchronisation complète sur un réseau lent peut entraîner une baisse critique des performances. En revanche, la réplication de machines virtuelles VMware asynchrone n’a pratiquement aucun impact sur les performances dans ce cas de figure. Par contre, en cas de défaillance du serveur principal, la réplication de machines virtuelles VMware peut entraîner la perte des données validées.
Un autre point à prendre en considération est la vitesse de vos opérations de réplication et de restauration de machines virtuelles, car celles-ci peuvent nécessiter du matériel à haute capacité.
Bien que la réplication à distance de machines virtuelles vers un emplacement hors site ou vers le cloud assure la sécurité de vos données, même en cas de sinistre touchant l’ensemble de votre centre de données, assurez-vous que le réseau de votre infrastructure dispose de la bande passante requise.
VMware vSphere Replication avec NAKIVO
NAKIVO Backup & Replication offre de nombreuses fonctionnalités utiles pour rendre vos Réplication pour VMware, ainsi que Réplication Hyper-V et même Réplication d’instances EC2 simples et rapides. La solution NAKIVO prend en charge le Suivi des modifications VMware pour la réplication incrémentielle, fournit des paramètres de conservation flexibles et travaille directement avec les API VMware pour la réplication des données VMware au niveau de l’hôte.
Vous pouvez utiliser les réplicas VMware créés avec NAKIVO pour le basculement de machines virtuelles et des scénarios complexes de reprise après sinistre complète du site principal.
