シングルノードまたはHA構成のBlueXPで、CVOアップグレードが「保留中」と表示される
環境
- BlueXP
- Cloud Volumes ONTAP (CVO)
- シングルノード
- 高可用性(HA)
- ストレージフェイルオーバー(SFO)
問題
- BlueXP の CVO 作業環境でアップグレードが開始されました。
- CLI およびシステムマネージャで CVO アップグレードが完了と表示された後も、タイムラインではアップグレードが保留中として表示され続け、最新のアクションが 30 秒ごとに繰り返され、クラスタフェイルオーバーの状態を「decribe」しようとしていると表示されます。
- CVO CLI にはアップグレードの進行中は表示されませんが、BlueXP タイムラインにはアップグレードが保留中として表示されます。
原因
- CVOがHAクラスタであり、SFOのギブバックが完了していない場合、BlueXPは、両方のノードがONTAPアップグレードのすべてのステップを完了したことを確認し、両方のノードが完全にオンライン状態であり、返却すべきアグリゲートがないことを確認できるまで、アップグレードのすべての段階を完了しません。
- つまり、さまざまな要因によりいずれかのノードが部分的なギブバック状態にある場合、BlueXPはアップグレードが完了したと報告しません。
解決策
- CLI/GUI 上ではアップグレードが完了しているかもしれませんが、クラウドプロバイダーのバックエンドでの遅延イベントにより、HA ペアでの ONTAP アップグレードが完了した後にテイクオーバーイベントが発生した可能性があります。
- 「storage failover show」と「storage failover show-giveback」を実行して、システムが現在テイクオーバーまたは部分テイクオーバーイベント中でないことを確認してください。これらのイベントが発生していると、BlueXPがクラウドGUIでのアップグレードを完了できない場合があります。
- 必要に応じて、アグリゲートの完全なギブバックをトリガーしてください。「storage failover giveback -ofnode」コマンドを実行する際に、適切なフラグを使用してCIFSの拒否設定を上書きする必要がある場合があります。
- 「storage failover giveback -override-vetoes true」フラグを使用すると、拒否権を上書きできます。返却先のノードも必ず明記してください。
- 単一ノードのインスタンスでは、バックエンドの遅延問題が発生した場合、データの整合性を保護するためにノードがオフラインになります。アップグレード中にクラスター/ノード管理LIFにSSHセッションを接続しておくことで、何らかのイベントによってSSHセッションが切断されたかどうかを監視できます。オンラインに戻ると、SSHからノードにログインでき、ノードは自動的にその正常性ステータスをBlueXPに報告してアップグレードを完了します。
- 単一ノードのインスタンスは、アップグレードの再起動フェーズ中に管理アクセスが失われますが、オンラインに戻った後は、バックエンドで問題が発生しない限り、その状態が維持されるはずです。
- ONTAP バージョンを確認し、CLI でアップグレードが進行中でないと表示される場合は、タイムラインの保留ステータスは無視できます。アップグレードがまだ必要で、アップグレードを妨げる条件が存在しない場合は、BlueXP から再度アップグレードを実行してください。
追加情報
以下のコマンドを実行することで、自動テイクオーバーにつながったイベントを確認できます。
set advancedevents log show -node <taken_over_node>
クラスタCLIからアップグレードされたCVOインスタンスを確認してください。
cluster::> cluster image showcluster::> cluster image show-update-history
クラスタ CLI からアップグレードステータスを確認します:
set advancedcluster::*> cluster image show-update-progress