1.2.3. 고가용성 클러스터의 모니터링 스택
기본적으로 다중 노드 클러스터에서 다음 구성 요소는 HA(고가용성) 모드로 실행하여 데이터 손실 및 서비스 중단을 방지합니다.
- Prometheus
- Alertmanager
- Thanos Ruler
구성 요소는 두 개의 pod에 복제되며 각각 별도의 노드에서 실행됩니다. 즉, 모니터링 스택에서 하나의 Pod가 손실될 수 있습니다.
- HA 모드의 Prometheus
- 두 복제본 모두 독립적으로 동일한 대상을 스크랩하고 동일한 규칙을 평가합니다.
- 복제본은 서로 통신하지 않습니다. 따라서 Pod마다 데이터가 다를 수 있습니다.
- HA 모드의 Alertmanager
- 두 복제본은 알림 및 음소거 상태를 동기화합니다. 이렇게 하면 각 알림이 한 번 이상 전송됩니다.
- 복제본이 통신에 실패하거나 수신 측에 문제가 있는 경우 알림은 계속 전송되지만 복제될 수 있습니다.
중요
Prometheus, Alertmanager 및 Thanos Ruler는 상태 저장 구성 요소입니다. 고가용성을 보장하기 위해 영구 스토리지를 사용하여 구성해야 합니다.