新しいGPUクラスタでNVIDIA Base Command Manager(BCM)の高可用性(HA)をセットアップするタスクが割り当てられました。クラスタは、プライマリヘッドノード、セカンダリヘッドノード、および複数の計算ノードで構成されています。要件は、BCMサービスの自動フェイルオーバー、ワークロードへの影響の最小化、およびインストール中とインストール後のクラスタの健全性監視の適切な実施です。BCM HAのインストールと構成プロセスにおいて、堅牢で検証済みのHAクラスタ構成を確保するために必須となるアクションは次のうちどれですか?(2つ選択) 以下の選択肢から正しいものを2つ選んでください。
正解:A,C
ユーザー、コンピューティング ノード、および管理サービスがアクティブな BCM ヘッド ノードに対して一貫したエンドポイントを必要とするため、フローティング仮想 IP アドレスが必要です。NVIDIA DGX BasePOD HA のドキュメントには、外部 VIP は HA 構成が完了した後にアクティブなヘッド ノードにアクセスするために常に使用する必要がある IP アドレスであると記載されています。同じ HA ワークフローでは、セットアップ後にフェイルオーバー動作も検証し、双方向から HA ステータスを確認し、どのヘッド ノードがアクティブであるかを確認します。したがって、セカンダリ ヘッド ノードがサービス責任を引き継ぐことができることを証明するには、制御されたフェイルオーバー検証が必要です。HA セットアップ中は、コンピューティング ノードの電源をオンにしてワークロードを実行する必要はありません。NVIDIA のドキュメントでは、HA 構成の前にクラスタ ノードの電源をオフにする例が示されています。独立した静的 IP アドレスだけでは、クライアントが手動で再接続する必要があるため、透過的なサービス継続性は提供されません。 同期はHAセットアップワークフローの一部として行われますが、自動フェイルオーバーと検証済みの準備状況を実現するための最適な2つの方法は、フローティングVIPとフェイルオーバー検証です。