VMware vSphere Replication のベストプラクティス

仮想マシンのレプリケーション(VMレプリケーション)は、あらゆる原因による障害やダウンタイムが発生した際、復旧時間を短縮し、システムの可用性を確保するための最良のデータ保護手法の一つであり続けています。 災害発生時にはVMレプリカを即座に起動できるため、数秒以内にVMを復旧させ、重要な業務を継続することが可能です。

VMレプリケーションソフトウェアの実行中に発生しうる問題(アプリケーションの障害やエラー、データの損失、過度なリソース消費など)を回避するため、効率的かつ信頼性の高いVMデータ保護戦略の一環として、本記事で紹介するVMware vSphereレプリケーションのベストプラクティスに従ってください。

NAKIVO for VMware レプリケーション

NAKIVO for VMware レプリケーション

オンサイトまたはオフサイトでのVMware vSphere仮想マシンの効率的なレプリケーション。インシデントに対する耐性を高める、即時の自動フェイルオーバー。高可用性と短いRTOを実現。

vSphere Replication とは何か、その仕組み

VMware vSphere レプリケーションとは、VMware vSphere 仮想マシンの完全なコピーを、ESXi ホストやクラスターなどの任意の場所に作成するプロセスです。この仮想マシンのコピーは"VM レプリカ"と呼ばれ、電源オフの状態に維持され、ソース仮想マシンの最新の変更内容や状態を反映するために、定期的に、あるいは継続的に(継続的レプリケーション)更新されます。

注: VMware vSphere におけるレプリケーションは、VMware のバックアップと混同されがちですが、これらの仮想マシン(VM)データ保護手法はそれぞれ異なる目的を追求するものであり、互いに置き換えるのではなく、補完し合うべきものです(当社のブログ記事をご覧ください VMのバックアップとVMのレプリケーションの比較).

VMware データレプリケーションのベストプラクティス 10選

以下のベストプラクティスに従い、VMware vSphere のレプリケーションや、その他の環境における仮想マシンのレプリケーションに活用してください。

1. ミッションクリティカルなワークロードを特定し、優先順位をつける。

ダウンタイムや災害発生時に、どの仮想マシンやアプリケーションデータが最も高い保護レベルを必要とし、最も迅速な復旧を要するかを特定してください。 すべてをレプリケートする必要はなく、またすべてを同じ時間枠内で復旧させる必要もありません。

例えば、オンラインストアは継続的な運用を維持し、顧客との直接的な注文や購入取引を可能にしています。Webサーバーに障害が発生した場合、顧客へのWebサイトのダウンタイムの影響を最小限に抑えるためには、Webサイト、在庫、CRMを最優先かつできるだけ早く復旧させることが極めて重要ですが、バックオフィスアプリケーションは後回しにしても問題ありません。

2. データ保護計画の概要をまとめる。

計画を立てないことは、失敗を計画することと同じです。事業継続の要件、ミッションクリティカルなワークロード、優先順位、個々のデータ保護手法、VMのバックアップ/レプリケーションジョブの頻度と所要時間、必要なリソース(データストレージ容量、ネットワーク帯域幅、VMのバックアップ/レプリケーションウィンドウなど)を考慮して、データ保護活動を計画してください。

データ保護計画には、担当者の役割、専用のハードウェアおよびソフトウェアコンポーネント、災害復旧シナリオも確実に盛り込むようにしてください。

3. 適切なVMのバックアップとレプリケーションの比率を設定する。

VMのバックアップとVMのレプリケーションは一見同じように見えますが、目的が異なり、互いに代替することはできません。VMのバックアップは、その種類を問わず、VMデータの長期的な保存を目的としています。一方、VMのレプリケーションは、VMの迅速な復旧、つまりVMの高可用性を実現するためのものです。

仮想マシンのレプリケーションはデータ保護計画の構成要素の一つであり、組織のニーズや予算に合わせて、定期的なVMバックアップとVMレプリケーションを効率的に組み合わせる必要があります。

4. VMデータ複製シーケンスについて、測定可能な基準を確立する。

どのVMレプリケーションソリューションを選択すべきかを決定する際には、測定可能な基準を設定しておくと役立つでしょう。VMware vSphereにおける高可用性のためのレプリケーションに関しては、主に以下の2つの点を考慮する必要があります:

  • スピード。 VMのデータ復旧は、どのくらいの速さで完了する必要がありますか?VMのレプリカは元のVMの完全なコピーですが、たとえばDBMSを再マウントして復旧させるなど、レプリカにアクセスするには多少の時間がかかる場合があります。
  • フォールトトレランス これは、1つ以上のコンポーネントに障害が発生した場合でも、システムが良好なパフォーマンスレベルを維持できる能力のことです。災害が発生した場合でもVMデータを利用可能にするために、システムがどの程度の耐障害性を確保すべきかを検討してください。耐障害性を確保するために仮想マシンのレプリケーションをどの程度の頻度で実施するかを決定する際には、ハードウェアやネットワークの容量も考慮に入れてください。

事業継続方針に基づき、復旧地点と障害発生地点との間の最適な距離、すなわち リカバリーポイント目標 (RPO)これは、データ損失を最小限に抑えることと、追加リソースにかかるコストとのトレードオフです。企業によっては、RPOが24時間、7日、あるいは1ヶ月である場合もあれば、わずか10秒でなければならない場合もあります。

5. フェイルオーバーおよびフェイルバックのロードマップを作成する。

本番環境のVMがダウンした場合でも、サービスやアプリケーションの稼働を最小限の混乱で維持するためには、事前にフェイルオーバーおよびフェイルバックの手順を定めておく必要があります。さまざまな予期せぬ状況下で従うべき、本番環境のVMのフェイルオーバーおよびフェイルバックの対応シナリオを策定してください。

確立されたデータ保護システムに応じて、予期せぬシャットダウンおよび計画的なシャットダウンのいずれの場合においても、フェイルオーバーおよびフェイルバックの手順は手動または自動のいずれかとなる場合があります。

6. VMレプリカの検証を有効にします。

VMレプリカが正常に動作することを確認するために、定期的に検証を行うことは推奨されるベストプラクティスです。これにより、予期せぬトラブルを防ぐことができます。VMレプリカが破損していたり、データが損なわれていたりすることがあるからです。 不具合の原因が何であれ、VMレプリカを定期的に検証し、その検証スケジュールを計画に組み込んでください。

サードパーティ製のVMware vSphereレプリケーションソリューションを使用する場合は、VMレプリカの自動検証機能が利用可能な場合は、その機能を有効にすることをお勧めします。そうすることで、すべてのVMレプリカの整合性が自動的に検証されます。

7. アプリケーションに対応したレプリカを作成する。

最新のデータ保護ソリューションでは、アプリケーション対応の特別なレプリケーションモードが提供されており、これを利用することで、Microsoft Active Directory、Microsoft SQL Server、Microsoft SharePoint、Microsoft Exchange Server、Oracle Database などのアプリケーション向けに、アプリケーション対応の VM レプリカを作成することができます。これは、 VSS 執筆陣。

"アプリケーション認識型"、つまりアプリケーション一貫性のあるVMレプリケーションモードとは、レプリケーションの過程で、スナップショットを作成する前に、メモリ内のデータと保留中のI/O操作がディスクにフラッシュされることを意味します。その結果、VMレプリカには一貫性のあるデータが含まれるため、データ損失なくアプリケーションをスムーズに復旧させることができます。

8. 復旧ツールを中心に自動化を構築する。

復旧ツールを軸とした自動化体制を構築しておけば、災害発生時にVMをできるだけ早く復旧させる必要がある場合でも、不必要な遅延を抑えることができます。自動スクリプトが適切に維持管理されていることを確認してください。一方、最新の高度なデータ保護ソリューションには、統合された自動化機能が備わっています。

9. 人員の定着およびローテーションの方針を定める。

このポリシーでは、VMレプリカの作成頻度とその保持期間を定めます。VMレプリケーションの変更データは、レプリケーション変更データベースに継続的に追加されます。定期的に削除を行わないと、利用可能なディスク容量をすべて消費してしまうほど、データベースのサイズが急激に膨れ上がってしまいます。この削除間隔を"レプリケーション削除遅延"と呼びます。デフォルトのレプリケーション削除遅延は、データ保護ソフトウェアで設定されており、1日から数日までの範囲で異なります。

保持およびローテーションポリシーを設定する際は、レプリケーション削除遅延を考慮してください。 パージ遅延期間より古い変更は、レプリケーション変更データベースから削除されます。レプリケーション変更データベースのバックアップ頻度は、レプリケーションパージ遅延期間よりも頻繁に行うようにしてください。そうしないと、一部の変更が失われる可能性があります。

10. 適切なVMレプリケーションおよび災害復旧(DR)ソリューションを選択する。

仮想マシンのレプリケーションを定期的に実行する必要がある場合は、自社のITインフラストラクチャの具体的なニーズや組織の予算に合った適切なソリューションを選択する必要があります。

現在市場で入手可能なVMware vSphereレプリケーション製品を比較する際には、機能性とパフォーマンスの両方の観点から、各製品の具体的な機能を検討する必要があります。 例えば、同期型VMレプリケーション(継続的レプリケーション)を採用している製品もあれば、半同期型や非同期型のVMレプリケーションを実行する製品もあります。トランザクション型アプリケーションのフェイルオーバーには、同期型のVMwareデータレプリケーションの方が適しているように見えますが、低速なネットワーク環境下で完全な同期を行うと、パフォーマンスが著しく低下する可能性があります。対照的に、非同期型のVMwareレプリケーションは、このような状況でもパフォーマンスへの影響がほとんどありません。 一方、プライマリサーバーに障害が発生した場合、非同期VMware VMレプリケーションでは、コミット済みのデータが失われる可能性があります。

もう1つ考慮すべき点は、VMのレプリケーションおよび復元操作の速度です。これには大容量のハードウェアが必要になる可能性があるためです。

仮想マシンをオフサイトやクラウドにリモートレプリケーションすることで、データセンター全体が災害に見舞われた場合でもデータを安全に保つことができますが、インフラストラクチャのネットワークに必要な帯域幅が確保されていることを確認してください。

NAKIVO を利用した VMware vSphere Replication

NAKIVO Backup & Replication には、あなたの…をより便利にするための多くの便利な機能が用意されています。 VMwareのレプリケーション、および Hyper-Vのレプリケーション さらには AWS EC2 インスタンスのレプリケーション シンプルかつ高速です。NAKIVOのソリューションは、増分レプリケーションにおいてVMwareの変更ブロック追跡(Changed Block Tracking)に対応しており、柔軟な保存期間設定が可能で、VMwareのAPIを直接利用してホストレベルでのVMwareデータレプリケーションを実現します。

How does replication work in VMware vSphere with NAKIVO data protection?

NAKIVOで作成されたVMwareレプリカは、VMのフェイルオーバーや、プライマリサイトにおける複雑な完全復旧シナリオに活用できます。

試してみてください NAKIVO Backup & Replication

試してみてください NAKIVO Backup & Replication

無料トライアルを利用して、本ソリューションのデータ保護機能をすべてお試しください。15日間無料。機能や容量の制限は一切ありません。クレジットカードも不要です。

関連記事