介绍
观测平台为开发者提供项目和应用级别的监控、日志、事件和告警能力,帮助你实时了解应用运行状态,快速定位问题。
开发者观测平台位于项目环境层面,与管理员视图的集群级监控互补。在 开发者界面 → 项目 → 你的项目 → 环境(如 dev) 中点击 观测平台 Tab 即可进入。
主要功能
观测平台为每个项目环境提供以下 Tab 页面:
| Tab | 功能 |
|---|---|
| 仪表盘 | 项目资源概览、应用拓扑、Pod 健康度、资源排行榜 |
| 指标 | Pod/容器级别的 CPU、内存、网络、文件系统指标,支持自定义 PromQL |
| 警报 | 当前激活的告警列表(Firing / Pending / Resolved),可创建静默规则 |
| 事件 | 命名空间内所有资源的事件流(调度、重启、OOMKill、PVC 绑定等) |
| 日志 | 全文本搜索、实时日志流、多容器日志聚合 |
快速导航
- 查看项目健康度:进入环境 → 观测平台 → 默认显示 仪表盘
- 深入应用指标:切换到 指标 Tab,选择应用或 Pod,查看 CPU/内存/网络/文件系统实时图表
- 查看应用日志:切换到 日志 Tab,按命名空间、应用、Pod、容器过滤,支持关键词搜索与实时追踪
- 处理告警:切换到 警报 Tab,查看 Firing 告警详情,必要时创建 静默 规则(如维护窗口)
- 追踪事件:切换到 事件 Tab,按资源类型、原因过滤,排查部署与故障
组件级文档
观测平台底层由 Prometheus、Grafana、Loki 等开源组件构成,组件安装、配置与高级用法请参考:
- 观测平台概览 - 可观测性整体介绍与访问地址
- 监控 (Monitoring) - 指标采集、监控面板、告警规则
- 日志 (Logging) - 日志收集、检索与保留策略
- 事件 (Events) - Kubernetes 事件采集与查看
- 监控大屏 - Grafana 大屏
- 指标 (Metrics) - PromQL 查询与指标说明
与管理员观测平台的区别
| 维度 | 开发者视角 | 管理员视角 |
|---|---|---|
| 范围 | 单个项目/环境 | 整个集群 |
| 仪表盘 | 项目资源、应用拓扑 | 集群节点、所有命名空间、所有资源 |
| 告警 | 仅查看自己的告警 | 定义规则、管理通知 |
| 日志 | 项目内日志 | 审计日志、系统日志、跨项目日志 |
| 权限 | 仅本项目的资源 | 所有资源 |
需要查看集群级信息时,请登录管理员账号或联系集群管理员,参考 管理员观测平台。