监控 Cluster 集群(通常指 Redis Cluster、Kubernetes Cluster、数据库集群等,但最常见于 Redis Cluster 或 分布式集群)需要从 节点状态、数据分片、网络、性能、告警 等多个维度进行。
下面以 Redis Cluster 为主(也补充通用集群监控思路)。
redis-cli -c -h <host> -p <port> cluster info
重点关注:
cluster_state:ok ✅cluster_slots_assigned:16384cluster_slots_ok:16384cluster_known_nodescluster_sizeredis-cli cluster nodes
关注:
connected / disconnectedredis-cli cluster slots
检查:
used_memory)redis-cli info memory
redis-cli info stats
redis-cli --latency
redis-cli --latency-history
redis-cli slowlog get 10
redis-cli info replication
关注:
master_link_status:upslave_repl_offsetmaster_repl_offset - slave_repl_offset)redis-cli示例(Prometheus):
- job_name: redis-cluster
static_configs:
- targets:
- redis1:9121
- redis2:9121
如果是 K8s / 数据库 / 微服务集群:
Cluster 监控 = 状态可观测 + 指标可量化 + 故障可告警 + 自动可恢复
如果你指的是 Redis Cluster / K8s / MySQL 集群 / 其他具体集群,可以告诉我,我可以给你更精确的监控方案。
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。