Agent服务监控
更新时间:2026-09-20
概述
Agent 服务的监控用于观察该服务下全部 Agent API 的调用情况与 Token 消耗,入口位于服务详情的 监控 标签页。
前提条件
已为当前实例开启 Prometheus 监控服务(CProm)。开启后会产生费用,具体参考 Prometheus 监控计费详情。
操作步骤
- 进入 服务管理 > Agent 服务,单击目标服务名称进入详情。
- 切换到 监控 标签页。
- 设置 时间筛选:近 1 小时、近 6 小时、近 1 天、近 3 天、近 7 天、近 14 天或自定义区间。
- 设置 统计周期:可选 5 分钟、10 分钟、15 分钟、30 分钟、1 小时、6 小时、12 小时、24 小时。查询跨度越大可选的最小统计周期越大(≤3 天最小 5 分钟,3~7 天最小 10 分钟,>7 天最小 30 分钟)。
- 按需填写聚合条件后单击 查询。
- (可选)单击 管理告警 进入告警管理页面。
聚合维度
| 维度 | 填写方式 |
|---|---|
| 域名 ID | 下拉多选,也支持手动输入选项以外的值 |
| API ID | 标签输入框,输入一个值后按 Enter 继续输入下一个 |
多个值之间为「或」关系。
通用指标
| 指标 | 说明 |
|---|---|
| 每秒请求数 QPS | 每秒处理的请求数。 |
| PV | 请求总量,一段时间内的总请求次数。 |
| 请求成功率 | 成功请求数 / 总请求数。 |
| 请求成功数 | 统计周期内成功返回的请求数量。 |
| 请求响应时间 | 请求从发出到收到响应的耗时,提供 P50、P90、P95、P99、Avg 五条曲线。 |
| 入站流量 / 出站流量 | 接收与发送的流量速率。 |
| 服务访问量 / API 访问量 / HOST 访问量 | 按服务、API、Host 维度统计的访问量。 |
| 状态码分布 | 返回的 HTTP 状态码分布。 |
| Method 分布 | 不同 HTTP 方法的请求占比。 |
AI 指标
| 指标 | 说明 |
|---|---|
| Token 总数 | 服务调用消耗的总 Token 数。 |
| Token 分类统计 | 按 Token 类型分类统计,包含输入/输出 Token 数、缓存输入/输出 Token 数。 |
| 错误请求统计 | 非 2xx 的请求速率。 |
| 限流请求数 | 统计周期内被限流拦截的请求数量。 |
观测建议
- Agent 常涉及长连接与多轮交互,建议重点关注 请求响应时间的 P99 与 错误请求统计,识别长尾慢请求与异常波动。
- WebSocket 协议的 API 会长时间占用连接,建议同时关注资源监控的 CPU 与内存使用率,必要时升配实例规格。
- 通过日志分析的
ai_log字段查询单次调用的 Token 用量与消费者身份。 - 通过告警管理为成功率、错误请求速率配置 PromQL 告警规则。
相关文档
评价此篇文章
