5.9.2. 集群和网络
这部分论述了监控 Data Grid 节点之间的通信的指标,以识别可能的网络问题。
全局标签
cluster=<name>- 集群名称。如果要收集来自多个集群的指标,此标签可帮助识别它们所属的位置。
node=<node>- 报告指标的节点名称。
所有前缀为 vendor_jgroups_ 的指标名称都仅用于故障排除和调试目的。指标名称可在不进一步通知的情况下更改红帽构建的 Keycloak 版本。因此,我们建议不要在仪表板或监控和警报中使用它们。
5.9.2.1. 响应时间 复制链接链接已复制到粘贴板!
以下指标公开远程请求的响应时间。响应时间在两个节点之间测量,包括处理时间。所有请求都由这些指标测量,响应时间应保持在集群生命周期的稳定状态。
在健康的集群中,响应时间保持稳定。响应时间的增加可能会表示降级集群或负载过重的节点。
Tags
node=<node>- 它标识发送者节点。
target_node=<node>- 它标识接收器节点。
| 指标 | 描述 |
|---|---|
|
| 向接收器节点同步请求数量。 |
|
| 向接收器节点同步请求的总持续时间 |
启用直方图后,将有百分比的存储桶可用。它们可用于创建 heat 映射,但收集和公开百分比存储桶可能会对部署性能造成负面影响。