Lattice Hub 文档
使用指南控制台使用

监控指标

Console 监控指标四页:系统监控、服务监控、事件指标与操作审计的用途和操作要点。

对应菜单:监控指标 下四个二级页。数据来自 OTel → Collector → GreptimeDB(及控制面事件/审计链路)。页上可能显示「实时数据」或「Mock 预览」标签,阅读时先确认数据来源。

系统监控

服务监控

事件指标

操作审计

系统监控

路径:/metrics/system,页内标题「系统监控」。

用途:Grafana-like 平台组件看板,按类别、接口和组件关键字聚合 OTel 指标。

常见面板:

  • 接口延迟趋势
  • 延迟热力图
  • Go runtime
  • 组件资源
  • 接口明细

操作:按类别/组件/接口关键字筛选,判断控制面自身是否健康。

服务监控

路径:/metrics/service(详情 /metrics/service/detail),标题「服务监控」。

用途:服务级整体概览;点击服务进入接口、实例和治理事件下钻。

常见统计:请求量、治理命中、拦截降级、P95/P99、需关注服务。

事件指标

路径:/metrics/event,标题「事件指标」。

用途:查看服务端事件总量、风险事件、影响服务与最近事件;含趋势、类型分布、事件明细。可按条件筛选并打开详情。

操作审计

路径:/metrics/operation,标题「操作审计」。

用途:操作总数、高风险操作、活跃操作者、涉及资源;含趋势、资源分布、审计明细。用于追溯谁在何时改了哪些资源。

排障顺序

  1. 先确认控制面主链路(登录、API、缓存、发布)是否正常。
  2. 再看系统监控是否有组件/接口异常。
  3. 用服务监控定位具体服务。
  4. 用事件指标与操作审计核对「发生了什么 / 谁做的」。
  5. 若四页皆空,优先检查观测栈是否部署,而不是断定控制面宕机。

详见 观测链路性能数据报告

下一步

On this page