Model服务概述
更新时间:2026-09-20
什么是 Model 服务
Model 服务面向大模型调用场景,是 Model API 的归属单元。支持多种模型场景与服务协议,客户端可按对应协议的标准方式调用。
适用场景
- 多模型统一接入:多家模型供应商的接口收敛到一个 OpenAI 兼容入口,业务方只需改 base_url 与 model 字段。
- 模型灰度与容灾:Model API 支持按比例分流与 Fallback 兜底,新模型可先承接小流量验证。
- 成本与配额管控:结合消费者配额与后端 Token 单价,实现团队级用量限制与成本分摊。
能力一览
| 能力 | 说明 |
|---|---|
| 承载的 API | Model API(表现为「1 个 API + N 条匹配规则」) |
| 模型场景 | 支持文本生成、图片生成等场景 |
| 服务协议 | 支持OpenAI 兼容、Anthropic 兼容、千帆原生、豆包原生、百炼原生、原始协议、自定义 HTTP、自定义 WebSocket |
| Base Path | 支持配置统一前缀,可选择转发后端时是否移除 |
| 消费者认证 | 支持服务级别开启,对该服务下全部 API 生效 |
| 监控 | 服务详情提供监控标签页,支持按域名、模型维度聚合,含 Token 类 AI 指标 |
前提条件
使用流程
- 在后端管理中创建 AI 大模型后端
- 创建 Model 服务并勾选预置路由
- 创建 Model API并配置后端策略
- 按需在管理 Model 服务中绑定自定义域名、开启消费者认证
- 通过Model 服务监控观察调用量与 Token 消耗
相关文档
- 创建 Model 服务
- 管理 Model 服务
- Model 服务监控
- 服务概述:三类服务的能力对比。
评价此篇文章
