CVOのアップグレードにより、ルートボリュームが回復する
環境
Cloud Volume ONTAP (CVO)
問題
- EMSがエラーを報告:
[xxxxxx:mgmtgwd.rootvolrec.low.space:EMERGENCY]: The root volume on node xxxxxx is dangerously low on space. Less than 10 MB of free space remaining.- アップグレードによって、あるノードでMGMTクラスタアプリケーションが停止し、別のノードではすべてのクラスタアプリケーションが停止します。
- 2ノードクラスタのうち、1つのノードではクラスタシェルコマンドを実行できません:
cluster::> cluster show
Error: "show" is not a recognized command
原因
- ルートボリューム「vol0」は、vol0のスナップショットと古いコアファイルのために、ほぼ満杯状態でした。
- vol0がいっぱいになった状態で、Cloud Managerを使用してWebサーバーからイメージを「getAPI」で取得すると、イメージがvol0に書き込まれます。vol0はイメージ全体を受け入れることができないため、MGMTアプリがダウンし、クラスタマスターではないノードにrdbフラグが設定されます。
解決策
追加情報
追加情報
内部情報
1.クラスタアプリケーションがすべて停止しているノードで、rdbフラグをクリアしてください:
- フラグが設定されていることを確認します:
system configuration recovery node mroot-state clear -recovery-stateRDB Recovery State: 5550055000
VLDB: RDB auto-recovery failed to find master (5)
Management: RDB auto-recovery failed to find master (5)
VifMgr: RDB auto-recovery failed to find master (5)
Bcom: RDB auto-recovery failed to find master (0)
Crs: RDB auto-recovery failed to find master (0)- フラグをクリアする:
system configuration recovery node mroot-state clear -recovery-state rdb
2.vol0のスナップショットと古いコアファイルを削除します:
- 完全なvol0 nodeshellに入ります:
::> node run -node <affected Node>- vol0のスナップリストを削除:
snap del -a vol0- vol0のスナップショットスケジュールを「0 0 0」に設定して、これ以上スナップショットが作成されないようにします:
snap sched 0 0 03.影響を受けているノードを再起動してください。