基础API监控
更新时间:2026-09-20
概述
基础 API 的调用指标可在实例维度与服务维度两处查看,用于观察流量健康度与定位异常。
查看入口
| 入口 | 路径 | 支持的聚合维度 | 统计范围 |
|---|---|---|---|
| 实例维度 | 观测与分析 > 业务监控 > 基础服务 标签页 | 域名 ID、服务 ID、API ID | 该实例下全部基础服务的汇总指标 |
| 服务维度 | 基础服务详情的 监控 标签页 | 域名 ID、API ID | 单个基础服务下各 API 的指标 |
前提条件
已为当前实例开启 Prometheus 监控服务(CProm)。开启后会产生费用,具体参考 Prometheus 监控计费详情。
操作步骤
- 进入上述任一入口。
- 设置 时间筛选:近 1 小时、近 6 小时、近 1 天、近 3 天、近 7 天、近 14 天或自定义区间。
- 设置 统计周期:可选 5 分钟至 24 小时。查询跨度越大可选的最小统计周期越大(≤3 天最小 5 分钟,3~7 天最小 10 分钟,>7 天最小 30 分钟)。
- 在 API ID 输入框中填写目标 API 的 ID(输入一个后按 Enter 可继续输入多个),单击 查询。
- 指标卡片右上角支持全屏放大,鼠标悬浮在指标名称的图标上可查看口径说明。
监控指标
| 指标 | 说明 |
|---|---|
| 每秒请求数 QPS | 每秒处理的请求数。 |
| PV | 请求总量,一段时间内的总请求次数。 |
| 请求成功率 | 成功请求数 / 总请求数。 |
| 请求成功数 | 统计周期内成功返回的请求数量。 |
| 请求响应时间 | 请求从发出到收到响应的耗时,提供 P50、P90、P95、P99、Avg 五条曲线。 |
| 入站流量 / 出站流量 | 接收与发送的流量速率。 |
| API 访问量 | 按 API 维度统计的访问量,可用于识别热点 API。 |
| 服务访问量 / HOST 访问量 | 按服务、Host 域名维度统计的访问量。 |
| 状态码分布 | 返回的 HTTP 状态码分布,2xx 成功、4xx 客户端错误、5xx 服务端错误。 |
| Method 分布 | 不同 HTTP 方法的请求占比。 |
| 限流请求数 | 统计周期内被限流拦截的请求数量。 |
排查建议
- 在状态码分布中定位错误类型:4xx 集中出现多为调用方参数或鉴权问题,5xx 关注后端服务与超时配置。
- 按 API ID 聚合,缩小到具体 API。
- 关注请求响应时间的 P99,识别长尾慢请求;必要时调整 API 的超时与重试策略。
- 通过日志分析按
route_name检索该 API 的请求明细,用request_id定位单次请求。 - 通过调用链分析查看请求从网关到后端的完整链路。
- 通过告警管理为成功率、5xx 速率配置 PromQL 告警规则。
相关文档
评价此篇文章
