Procedure consigliate per VMware vSphere Replication
La replica delle VM, o replica VM, rimane una delle migliori tecniche di protezione dei dati per garantire tempi di ripristino brevi e la disponibilità del sistema in caso di guasti o interruzioni di servizio di qualsiasi origine. Una replica di una VM può essere avviata istantaneamente in caso di emergenza, consentendo di ripristinare una VM in pochi secondi e di mantenere operative le attività aziendali essenziali.
Per evitare eventuali problemi durante l’esecuzione del software di replica delle VM – quali malfunzionamenti ed errori delle applicazioni, perdita di dati, consumo eccessivo di risorse, ecc. – seguite le procedure consigliate di replica di VMware vSphere illustrate in questo articolo come parte di una strategia efficiente e affidabile di protezione dei dati delle VM.
Che cos’è vSphere Replication e come funziona
La replica VMware vSphere è il processo di creazione di una copia esatta di una macchina virtuale VMware vSphere in una ubicazione personalizzata, che può essere un Host VMware ESXi o un cluster. Questa copia della macchina virtuale, denominata “replica della macchina virtuale”, viene mantenuta in stato spento e aggiornata periodicamente o in modo continuo (replica continua) per riflettere le ultime modifiche e lo stato della macchina virtuale di origine.
Nota: La replica in VMware vSphere viene spesso confusa con il Backup di VMware, ma questi metodi di protezione dei dati delle macchine virtuali perseguono obiettivi diversi e dovrebbero integrarsi a vicenda anziché sostituirsi l’uno all’altro (vedi il nostro post sul blog Backup delle macchine virtuali vs. Replica delle macchine virtuali).
10 procedure consigliate per la replica dei dati VMware
Seguite le procedure consigliate riportate di seguito e applicatele alla replica in VMware vSphere e alla replica delle VM in altri ambienti.
1. Definite i carichi di lavoro mission-critical e assegnate loro la priorità.
Determinate quali dati delle VM e delle applicazioni richiedono la massima protezione e il ripristino più rapido in caso di downtime o disastri. Non è necessario replicare tutto, né tutto deve essere ripristinato nello stesso lasso di tempo.
Ad esempio, il vostro negozio online garantisce un funzionamento continuo e consente di effettuare transazioni dirette di ordini e acquisti con i clienti. In caso di guasto del server web, il sito web, l’inventario e il CRM saranno estremamente critici da ripristinare per primi e il più rapidamente possibile per ridurre al minimo l’impatto dei tempi di inattività del sito web sui clienti, mentre le applicazioni di back-office possono attendere.
2. Definire il piano di protezione dei dati.
Non pianificare significa pianificare il fallimento. Pianificate le attività di protezione dei dati tenendo conto delle esigenze di continuità operativa, dei carichi di lavoro mission-critical, delle priorità, delle singole tecniche di protezione dei dati, della frequenza e della durata dei processi di backup/replica delle VM, nonché delle risorse obbligatorie (capacità di storage dati, larghezza di banda di rete, finestre di backup/replica delle VM, ecc.).
Assicuratevi che il vostro piano di protezione dei dati copra anche le responsabilità del personale, i componenti hardware e software dedicati e gli scenari di ripristino di emergenza.
3. Utilizzate un rapporto adeguato tra backup e replica delle VM.
Sebbene il backup e la replica delle VM sembrino fare la stessa cosa, hanno obiettivi diversi e non possono sostituirsi a vicenda. Il backup delle VM, indipendentemente dal tipo, è progettato per la conservazione a lungo termine dei dati delle VM. La replica delle VM, invece, garantisce un rapido ripristino delle VM o, in altre parole, l’alta disponibilità delle VM. La replica delle VM è un elemento fondamentale di un piano di protezione dei dati; è opportuno trovare una combinazione efficiente tra backup regolari delle VM e replica delle VM, in modo da soddisfare le esigenze e il budget della propria organizzazione.
4. Stabilire criteri misurabili per le sequenze di replica dei dati delle VM.
La definizione di criteri misurabili può essere d’aiuto nel decidere quale soluzione di replica delle VM scegliere. Per quanto riguarda la replica in VMware vSphere ai fini dell’alta disponibilità, occorre considerare principalmente due aspetti:
- Velocità. Con quale rapidità deve avvenire il ripristino dei dati delle macchine virtuali? Sebbene una replica di una macchina virtuale sia una copia completa della macchina virtuale originale, potrebbe comunque essere necessario un po’ di tempo per accedervi, ad esempio per rimontare e ripristinare un DBMS.
- Tolleranza ai guasti è la capacità di un sistema di mantenere un buon livello di prestazioni nel caso in cui uno o più componenti si guastino. Valutate quale grado di tolleranza ai guasti il vostro sistema debba raggiungere per garantire la disponibilità dei dati delle VM in caso di disastro. Nel decidere con quale frequenza utilizzare la replica delle VM per la tolleranza ai guasti, tenete conto anche della capacità dell’hardware e della rete.
A seconda dei vostri criteri di continuità operativa, stabilite la distanza ottimale tra il punto di ripristino e il punto di guasto, ovvero l’ obiettivo di punto di ripristino ({1}), che rappresenta un compromesso tra la minimizzazione della perdita di dati e il costo delle risorse aggiuntive. Per alcune aziende, questo intervallo può essere di 24 ore, 7 giorni o persino 1 mese, mentre altre potrebbero richiedere un RPO di soli 10 secondi.
5. Preparare la tabella di marcia per il failover e il failback.
Per mantenere in funzione servizi e applicazioni con interruzioni minime nel caso in cui una VM di produzione smetta di funzionare, è necessario definire in anticipo le procedure di failover e failback. Elaborare scenari di azione per il failover e il failback delle VM di produzione da seguire in diverse circostanze avverse.
A seconda del sistema di protezione dei dati in uso, le procedure di failover e failback possono essere manuali o automatizzate, sia per gli arresti non pianificati che per quelli pianificati.
6. Abilitare la verifica delle repliche delle VM.
È buona prassi verificare regolarmente le repliche delle VM per assicurarsi che siano utilizzabili. Ciò consentirà di evitare spiacevoli sorprese. Può capitare che una replica della VM risulti danneggiata o corrotta. Qualunque sia il motivo del difetto, verificate periodicamente le repliche delle VM e includete il programma di verifica nel vostro piano. Quando si utilizzano soluzioni di replica VMware vSphere di terze parti, si consiglia di abilitare la funzione di verifica automatica delle repliche delle macchine virtuali, se disponibile. In questo modo, l’integrità di tutte le repliche delle macchine virtuali verrà verificata automaticamente.
7. Creare repliche coerenti con le applicazioni.
Le moderne soluzioni di protezione dei dati offrono una speciale modalità coerente con le applicazioni “application-aware” che consente di creare repliche di VM “application-aware” per applicazioni quali Microsoft Active Directory, Microsoft SQL Server, Microsoft SharePoint, Microsoft Exchange Server o Oracle Database, avvalendosi di VSS writer.
La modalità di replica delle VM “coerente con le applicazioni” o, in altre parole, coerente con le applicazioni, significa che durante il processo di replica i dati in memoria e le operazioni di I/O in sospeso vengono scaricati su disco prima della creazione di uno snapshot. Di conseguenza, le repliche delle VM contengono dati coerenti e le applicazioni possono essere ripristinate senza intoppi, senza perdita di dati.
8. Creare un processo di automazione attorno agli strumenti di ripristino.
La creazione di un processo di automazione attorno agli strumenti di ripristino riduce i ritardi inutili nel caso in cui sia necessario ripristinare le VM il prima possibile in caso di disastro. Assicurarsi che gli script automatici siano correttamente mantenuti. D’altra parte, le moderne soluzioni avanzate di protezione dei dati offrono funzioni di automazione integrate.
9. Determinare il criterio di conservazione e rotazione.
Questo criterio stabilisce la frequenza di creazione delle repliche delle VM e il loro tempo di conservazione. Le modifiche ai dati di replica delle VM vengono continuamente aggiunte al database delle modifiche di replica. Senza una sua pulizia periodica, il database crescerebbe in modo esponenziale, fino a consumare tutto lo spazio su disco disponibile. Questo intervallo tra una pulizia e l’altra è chiamato ritardo di pulizia della replica. Il ritardo di pulizia della replica predefinito è impostato nel software di protezione dei dati e varia da uno a più giorni.
Quando si definisce il criterio di conservazione e rotazione, tenere conto del ritardo di pulizia della replica. Le modifiche più vecchie del ritardo di pulizia vengono eliminate dal database delle modifiche di replica. Assicurarsi che il backup del database delle modifiche di replica venga eseguito con frequenza maggiore rispetto al periodo del ritardo di pulizia della replica; in caso contrario, alcune modifiche potrebbero andare perse.
10. Scegliere la soluzione di replica delle VM e di DR più adatta.
Se è necessario eseguire regolarmente la replica delle VM, è opportuno selezionare la soluzione più adatta, che soddisfi le esigenze specifiche della propria infrastruttura IT e il budget della propria organizzazione. Nel confrontare i prodotti di replica VMware vSphere attualmente disponibili sul mercato, è opportuno valutarne le funzioni specifiche dal punto di vista sia della funzionalità che delle prestazioni. Ad esempio, alcuni prodotti utilizzano la replica sincrona delle macchine virtuali (replica continua), mentre altri impiegano la replica semisincrona o asincrona. Sebbene la replica sincrona dei dati VMware sembri essere la scelta migliore per il failover delle applicazioni transazionali, la sincronizzazione completa utilizzata su una rete lenta può compromettere gravemente le prestazioni. Al contrario, la replica asincrona VMware non ha praticamente alcun impatto sulle prestazioni in questa situazione. D’altra parte, in caso di guasto del server primario, la replica di VM VMware può comportare la perdita dei dati già salvati.
Un altro aspetto da tenere in considerazione è la velocità delle operazioni di replica e ripristino delle VM, poiché potrebbero richiedere hardware ad alta capacità.
Sebbene la replica remota delle VM verso una ubicazione offsite o un cloud garantisca la sicurezza dei dati, anche nel caso in cui un disastro colpisca l’intero data center, è necessario assicurarsi che la rete dell’infrastruttura disponga della larghezza di banda obbligatoria.
VMware vSphere Replication con NAKIVO
NAKIVO Backup & Replication offre numerose funzioni utili per rendere semplici e veloci sia il Replica per VMware, sia il Replica Hyper-V e persino il Replica delle istanze di EC2 . La soluzione NAKIVO supporta il tracciamento delle modifiche (Changed Block Tracking, CBT) di VMware per la replica incrementale, fornisce impostazioni di conservazione flessibili e opera direttamente con le API VMware per la replica dei dati VMware a livello di host.
È possibile utilizzare le repliche VMware create con NAKIVO per il failover delle macchine virtuali e per scenari complessi di ripristino dell’ambiente.
