Info2softは、ウェブサイトでより快適で適切な閲覧体験を提供するためにCookieを使用しています。 プライバシーポリシー
Loading...
VMware vSphereは、インフラストラクチャ障害発生時に仮想化ワークロードの稼働を維持するための複数の可用性機能を提供します。その中でもVMware HAは、本番環境におけるESXiホストの停止に対応する最も汎用的な機能です。
安定した仮想化プラットフォームを設計する上で、VMware HAの仕組みと役割を理解することは重要です。基礎知識を把握することで、管理者は可用性、復旧目標、クラスタ設計に関する実務的な判断を下せるようになります。
VMware vSphere HAは、障害発生後も仮想マシンの稼働を継続させるVMwareの高可用性機能です。VMwareクラスタ内のESXiホストおよび仮想マシンを監視し、ホストに障害が発生した場合、影響を受けた仮想マシンを別のホスト上で再起動します。
目標復旧時間(RTO)は、障害後にシステムが停止可能な最大時間を定義します。RTOの数値が小さいほど、サービスの復旧が迅速になります。VMware HAは手作業による介入に頼らず、仮想マシンの再起動を自動化することでRTOを短縮します。
本番環境ではESXiホストの障害が発生し得ます。代表的な原因は以下の通りです。
VMware vSphere HAはこれらの障害に自動的に対応し、停止時間を削減します。仮想マシン再起動時に一時的な業務中断は発生するものの、復旧が高速かつ予測可能になります。
VMware HAはESXiホストを常時監視し、迅速かつ確実に障害を検出します。この検知プロセスは、VMwareクラスタ内の複数の連携するコンポーネントによって実現されます。
VMware HAは障害ドメインマネージャー(FDM)エージェントにより、ホストと仮想マシンの正常性を監視します。
FDMエージェントはVMware vSphere HAが有効化されたクラスタに属するすべてのESXiホスト上で動作し、ホスト同士が状態情報を交換し、HAのアクションを調整できるようにします。
VMware HAを有効にすると、自動的にいずれかのESXiホストがリーダーに選出されます。リーダーは障害検知と復旧処理の調整における中心的な役割を担います。
この選出メカニズムにより、クラスタ全体で監視と判断の一貫性が保たれます。
HAリーダーの担当業務は下記の通りです。
VMware HAは誤検知を回避するため、複数種類のハートビート機構を活用して正確に障害を判定します。多層的な仕組みにより、真のホスト障害と一時的な通信障害を区別します。
ESXiホストは管理ネットワークを介して定期的にハートビートを送受信します。あるホストからのハートビートが途絶えた場合、VMware HAは障害を疑うものの即時にはアクションを実行しません。
データストアハートビートはネットワーク通信が遮断された際の追加検証手段となります。各ホストは共有データストアに定期的に書き込みを行い、ホストが稼働中かどうかをVMware HAが確認可能にします。
VMware HAがESXiホストの障害を確認すると復旧プロセスが開始されます。障害ホスト上で稼働していた仮想マシンは、正常稼働中のホスト上で再起動する対象として登録されます。実際の再起動の実行可否はクラスタ内のリソース空き状況に依存します。
再起動プロセスは以下の手順で進行します。
VMware HAは仮想化ワークロードに対するインフラ層の保護を提供しますが、トレードオフも存在します。両方の特徴を理解することで、実際の運用ニーズに適合したVMware高可用性戦略を設計できます。
以下の長所から、VMware HAは本番環境で大きな価値を発揮します。
これらの制限事項により、VMware HAでは高度な可用性やアプリケーション層の要件に対応できないケースが存在します。
VMware HAとVMware FTは、可用性を実現する技術的アプローチが異なります。本番ワークロードへ導入を検討する前に、それぞれの障害対応の仕組みを理解することが重要です。
VMware HAは障害検知後の「再起動による復旧」を基本とします。ESXiホストに障害が発生すると、影響を受けた仮想マシンをクラスタ内の別ホスト上で再起動します。再起動中の短期的な業務中断を許容する方式です。
VMware Fault Toleranceは仮想マシンの常時ミラーリングを活用し障害に対応します。プライマリVMと同期して動作するセカンダリVMを別ホスト上で起動し、障害発生時にセカンダリVMが瞬時に引き継ぎ、データ損失を発生させません。
HAとFTの最大の相違点は許容する停止時間です。VMware HAは一時的なサービス中断を伴うのに対し、VMware Fault Toleranceは仮想マシンレベルで無停止を実現するために設計されています。この差が、構成の複雑さと必要なリソース量に直接影響します。
HAまたはFTの選択は、ワークロードの重要度、停止時間の許容範囲、運用負荷によって決定します。どちらも可用性の課題を解決しますが、対象とするリスクレベルや業務要件が異なります。
VMware HAが適しているケース
VMware FTが適しているケース
実運用環境において、VMware HAをはじめとするvSphereの可用性機能はインフラのレジリエンス基盤となります。しかし、すべての障害シナリオに対応できるわけではありません。ホストレベルの保護、再起動型の復旧、限定的なフォールトトレランスを補完するため、データおよびアプリケーション保護の施策を併用する必要があります。
完全なシステム設計においては、i2Backupを活用し、エージェントレスなVMバックアップや物理・仮想・クラウド環境にまたがる統合保護を実現可能です。また、i2Availabilityはリアルタイムレプリケーションやアプリケーション層の高可用性を必要とする場面に対応します。VMware標準機能とこれらのソリューションを組み合わせることで、より網羅的で運用面で均衡の取れた可用性アーキテクチャを構築できます。