温馨提示×

centos下k8s如何监控

小樊
43
2026-09-24 15:36:27
栏目: 智能运维

在 CentOS 下监控 Kubernetes(k8s),通常分为 集群层面监控 和 节点/应用层面监控 两部分。下面给你一套主流、可落地的方案。


一、基础监控方案(推荐:Prometheus + Grafana)

这是 生产环境最常用 的方案。

1. 组件说明

  • Prometheus:采集指标(CPU、内存、网络、Pod 等)
  • Node Exporter:采集 CentOS 节点指标
  • kube-state-metrics:采集 k8s 资源状态
  • Grafana:可视化展示

2. 安装方式(推荐 Helm)

(1)添加 Helm 源

helm repo add prometheus-community https://prometheus-community.github.io/helm-charts
helm repo update

(2)安装监控套件

helm install kube-prometheus prometheus-community/kube-prometheus-stack -n monitoring --create-namespace

安装完成后包含:

  • Prometheus
  • Alertmanager
  • Grafana
  • Node Exporter
  • kube-state-metrics

3. 访问 Grafana

kubectl port-forward -n monitoring svc/kube-prometheus-grafana 3000:80

浏览器访问:

http://localhost:3000

默认账号:admin 密码:prom-operator


二、CentOS 节点监控重点

1. 系统指标(必须看)

  • CPU 使用率
  • 内存使用
  • 磁盘 IO
  • 网络流量
  • 系统负载(load average)

Node Exporter 已自动采集,无需额外配置。


2. 常见系统问题监控

在 Grafana 中重点关注:

  • 磁盘使用率 > 85%
  • 内存 swap 使用
  • 节点 NotReady
  • kubelet 异常

三、Kubernetes 核心监控指标

1. 集群级别

  • Node 状态
  • Pod 调度失败
  • 控制平面健康(API Server / etcd)

2. 工作负载级别

  • Deployment / StatefulSet 副本数
  • Pod Restart 次数
  • OOMKilled
  • 容器 CPU / 内存限制

四、日志监控(可选但重要)

方案

  • EFK:Elasticsearch + Fluentd + Kibana
  • 或 Loki + Promtail + Grafana

Loki 示例(轻量)

helm install loki grafana/loki-stack -n logging --create-namespace

五、告警配置(生产必备)

1. Alertmanager

  • 节点宕机
  • Pod 频繁重启
  • 资源使用超阈值

2. 通知方式

  • 邮件
  • 钉钉
  • 企业微信
  • 飞书

六、简单命令级监控(临时排查)

kubectl top node
kubectl top pod -A
kubectl get events --sort-by=.metadata.creationTimestamp

七、总结推荐

场景 推荐
生产环境 Prometheus + Grafana
轻量环境 kubectl top + Node Exporter
日志分析 Loki / EFK
告警 Alertmanager

如果你愿意,我可以:

  • 给你 CentOS 专属调优监控指标
  • 帮你 写 Prometheus 告警规则
  • 给你 一套可直接用的 Grafana 面板 JSON

你现在是 学习环境还是生产环境?

0 踩