Skip to content

解决方案

面向真实生产问题的成体系方案:不止单点命令与配置,而是从架构设计、部署落地到告警排障的完整闭环。每篇方案都经过生产环境验证,配套可直接使用的规则与清单。

K8s 可观测性

Kubernetes 全链路观测与告警方案

立足 K8s 自身五大环节(控制面 / CoreDNS / Calico / 节点 / 负载),红绿灯总览看板一眼定位故障环节;附 20+ 条可直接入库的告警规则、监控数据断点治理方案。

Prometheus · Grafana · Loki · Alertmanager
应用可观测性

eBPF 零侵入全链路观测方案

不改代码、不加 sidecar,eBPF 自动埋点全集群进程:RED 指标 + 分布式 Trace + 服务拓扑三线闭环,指标 exemplar 一键跳 trace;附 Beyla v3 落地踩坑清单与排障动线。

Beyla · Tempo · Prometheus · Grafana

配套专题与实战

方案中涉及的深水区细节,已在以下板块单独成文:

  • CoreDNS 监控完整体系(cloud-ops 板块)— DNS 链路全景、缓存层级、NodeLocal DNSCache
  • etcd 空间告警与证书轮换(cloud-ops 板块)— NOSPACE 告警处置与证书维护
  • Pod 网络抓包实战指南(cloud-ops 板块)— 临时容器注入 tcpdump,不重启排障