业务监控
更新时间:2026-08-12
概述
业务监控用于监控网关流量的业务指标,支持 实例 与 服务 两个生效级别切换,覆盖请求量、延迟分布、错误率等关键指标。入口位于实例导航的 观测与分析 > 业务监控。
前提条件
资源监控依赖 Prometheus 监控服务进行指标的收集、分析与展示。首次使用需开启 Prometheus 监控服务。
- Prometheus 监控服务是针对云原生场景提供的全托管、高可用、可扩展的监控服务,完全对接开源 Prometheus 生态,支持多维度指标数据采集,支持灵活查询语句 PromQL,基于 Grafana 提供开箱即用的监控 Dashboard。
注意:开启后会产生费用,网关产生指标均为收费指标,具体参考Prometheus 监控计费详情。
操作步骤
- 登录 API 网关专享版控制台,在左侧导航选择目标实例。
- 进入 观测与分析 > 业务监控。
-
选择时间范围(支持快捷选项与自定义区间),查看各项指标曲线。
- 快捷选项:近 1 小时、近 6 小时、近 1 天、近 3 天、近 7 天、近 14 天
- 自定义区间:手动选择起止时间
- 选择监控维度,可切换实例/服务级别。
- 每个指标卡片右上角支持点击全屏放大查看详细趋势。
- (可选)如需配置告警,可在页面顶部选择创建报警策略、查看报警历史以及管理报警策略。
注意:
- 默认显示最近1小时数据,您可以在左上方设置时间进行筛选。
- 开启页面右上方自动刷新,将自动刷新监控数据。
实例级指标
| 指标 | 说明 |
|---|---|
| QPS | 每秒请求数,反映网关实时流量负载。 |
| 请求响应时间 | 请求从网关接收到返回响应的耗时。 |
| 请求成功率 | 成功请求数占总请求数的百分比。正常范围 >95%,建议 <90% 时告警。 |
| 请求成功数 | 指定时间范围内成功处理的请求总数。 |
| 网关入流量 / 出流量 | 网关接收与发送的流量速率(bytes/s)。 |
| TCP 接收数 / 发送数 / 连接数 | TCP 层数据传输速率与活跃连接数。 |
| 网关状态码分布 | 网关返回给客户端的 HTTP 状态码分布(2xx/4xx/5xx 等)。 |
| 后端服务状态码分布 | 后端服务返回给网关的 HTTP 状态码分布。 |
| 服务访问量排行 | 按后端服务维度统计的访问量排名。 |
| 即将上线 | |
| TPS(请求完成时刻统计) | 每秒完成的事务数,以请求完成时刻计。 |
| PV | 页面/接口访问总次数。 |
| 请求 RT/ms | 请求响应时间(毫秒),含平均、P99 等分位。 |
| 请求分布 | 请求在不同响应时间区间的分布情况。 |
| 路由访问量排行 | 按路由维度统计的访问量排名。 |
| 消费者访问量排行 | 按消费者维度统计的访问量排名。 |
| HOST 访问量排行 | 按请求 Host 维度统计的访问量排名。 |
| URL 访问量排行 | 按请求 URL 维度统计的访问量排名。 |
服务级指标
后续将支持按不同类型的服务提供更多监控指标。
| 指标 | 说明 |
|---|---|
| QPS | 每秒请求数,反映网关实时流量负载。 |
| 请求响应时间 | 请求从网关接收到返回响应的耗时。 |
| 请求成功率 | 成功请求数占总请求数的百分比。正常范围 >95%,建议 <90% 时告警。 |
| 请求成功数 | 指定时间范围内成功处理的请求总数。 |
| 网关入流量 / 出流量 | 网关接收与发送的流量速率(bytes/s)。 |
常见问题定位路径
评价此篇文章
