7.4.11. CephMgrIsMissingReplicas
| 意味 | このアラートを解決するには、Ceph マネージャーが消えた原因を特定し、必要に応じて再起動する必要があります。 |
| 影響 | High |
診断
- Pod ステータス: 保留
リソースの問題、保留中の永続ボリューム要求 (PVC)、ノードの割り当て、および kubelet の問題を確認します。
$ oc project openshift-storageoc get pod | grep rook-ceph-mgr問題のある Pod として識別された Pod の変数として
MYPODを設定します。# Examine the output for a {ceph-component} that is in the pending state, not running or not ready MYPOD=<pod_name><pod_name>- 問題のある Pod として識別された Pod の名前を指定します。
リソースの制限または保留中の PVC を探します。それらがない場合は、ノードの割り当てを確認します。
$ oc get pod/${MYPOD} -o wide
- Pod ステータス: 保留中や実行中ではないが、準備完了状態でもない
readiness プローブを確認します。
$ oc describe pod/${MYPOD}
- Pod ステータス: 保留中ではないが、実行中でもない
アプリケーションまたはイメージの問題を確認します。
$ oc logs pod/${MYPOD}重要ノードが割り当てられている場合は、ノードの kubelet を確認します。
軽減策
- デバッグログの情報
この手順は任意です。次のコマンドを実行して、Ceph クラスターのデバッグ情報を収集します。
$ oc adm must-gather --image=registry.redhat.io/odf4/odf-must-gather-rhel9:v4.16