模型服务 V1 接口下线及迁移说明
模型服务 V1 接口下线及迁移说明
尊敬的百度千帆用户:
为进一步统一模型服务调用接口,百度千帆将于 2026 年 8 月 31 日正式下线模型服务 V1 版本调用接口。下线后,使用 V1 接口的相关模型服务将无法继续调用。
本次变更主要涉及当前通过 V1 接口调用的预置模型服务及用户自部署模型服务。请您根据本文档完成接口迁移,并提前进行业务验证,以避免影响业务正常运行。
一、影响范围
如果您的业务当前通过以下 V1 接口调用模型服务,则属于本次变更影响范围:
1https://aip.baidubce.com/rpc/2.0/ai_custom/v1/wenxinworkshop/
您可以通过检查业务代码、SDK(软件开发工具包)、服务配置或请求日志,确认当前是否使用 V1 接口。
注意:本次下线的是 V1 版本调用接口,并不意味着所有相关模型服务均下线。
对于已经支持 V2 接口的模型服务,可迁移至 V2 接口继续使用;对于当前不支持 V2 接口的服务,请根据对应的替代方案完成业务调整。
二、迁移方式
根据当前模型服务的支持情况,本次迁移主要分为以下两种情况。
2.1 已支持 V2 接口的模型服务
对于已经支持 V2 接口的模型服务,无需重新部署模型服务。
您只需:
- 将原 V1 接口地址修改为对应的 V2 接口;
- 将原 V1 接口 URL 中指定的模型调整为 V2 请求中的
model参数; - 按照 V2 接口协议调整请求参数;
- 完成业务验证后切换至 V2 接口。
2.2 当前不支持 V2 接口的模型服务
对于当前仅提供 V1 接口、暂不支持 V2 接口的服务,无法通过简单修改接口地址完成迁移。
请根据对应服务的替代方案进行业务调整。具体服务迁移信息请参见本文档附录。
2.3 用户自部署模型服务
如果您当前使用的是通过 V1 接口部署的用户自部署模型服务,需要重新部署模型服务,并在部署时选择 V2 接口版本。
完成部署后,请使用新的 V2 接口进行业务验证,并将生产环境调用切换至新的模型服务。
三、V2 接口说明
V2 接口按照模型服务能力进行统一。
| 服务能力 | V2 接口 | 接口文档 |
|---|---|---|
| 文本生成 | https://qianfan.baidubce.com/v2/chat/completions |
查看文档 |
| 续写 | https://qianfan.baidubce.com/v2/completions |
查看文档 |
| 视觉理解 | https://qianfan.baidubce.com/v2/chat/completions |
查看文档 |
| 向量 | https://qianfan.baidubce.com/v2/embeddings |
查看文档 |
| 重排序 | https://qianfan.baidubce.com/v2/rerank |
查看文档 |
V2 接口兼容 OpenAI接口协议,可参考对应 V2 接口文档进行业务迁移。
四、预置模型服务迁移示例
V1 接口
1POST https://aip.baidubce.com/rpc/2.0/ai_custom/v1/wenxinworkshop/chat/ernie_speed
V2 接口
1POST https://qianfan.baidubce.com/v2/chat/completions
请求中通过 model 指定模型:
1{
2 "model": "ernie-speed-8k",
3 "messages": [
4 {
5 "role": "user",
6 "content": "你好"
7 }
8 ]
9}
五、用户自部署模型服务迁移
如果您当前使用的是用户自部署模型服务,并且该服务使用 V1 接口版本,需要重新部署模型服务,部署操作流程详见用户自部署模型服务部署说明。
迁移步骤如下:
1当前 V1 模型服务
2 ↓
3重新创建模型服务
4 ↓
5选择 V2 接口版本
6 ↓
7完成模型部署
8 ↓
9使用 V2 接口进行验证
10 ↓
11更新业务调用配置
12 ↓
13完成生产环境切换
重新部署后,请重点确认:
- 模型服务接口版本已选择为 V2;
- 模型服务已正常部署;
- V2 接口能够正常调用;
- 业务侧已更新接口地址及调用参数;
- 生产环境验证通过。
六、模型服务迁移清单
⚠️ 重要说明:本清单仅展示当前面向全量用户开放的相关服务,部分特定场景服务未在清单中展示。您可通过搜索代码或日志中的完整 V1 URL
https://aip.baidubce.com/rpc/2.0/ai_custom/v1/wenxinworkshop/,确认当前是否正在使用 V1 接口;如无法确认,请提交工单联系我们。
6.1 支持 V2 接口,可直接迁移
对于以下服务,可将 V1 接口迁移至对应的 V2 接口。
| 服务名称 | V1 Path | V2 Path | 模型状态 | 可用范围 |
|---|---|---|---|---|
| Embedding-V1 | /rpc/2.0/ai_custom/v1/wenxinworkshop/embeddings/embedding-v1 |
/v2/embeddings |
未下线 | 全量开放 |
| bge-large-zh | /rpc/2.0/ai_custom/v1/wenxinworkshop/embeddings/bge_large_zh |
/v2/embeddings |
未下线 | 全量开放 |
| bge-large-en | /rpc/2.0/ai_custom/v1/wenxinworkshop/embeddings/bge_large_en |
/v2/embeddings |
未下线 | 全量开放 |
| bce-reranker-base | /rpc/2.0/ai_custom/v1/wenxinworkshop/reranker/bce_reranker_base |
/v2/rerankers |
未下线 | 全量开放 |
6.2 当前不支持 V2 接口的服务
以下服务当前没有对应的 V2 Path,无法通过修改接口地址直接完成迁移。
| 服务名称 | V1 Path | 模型状态 | 可用范围 |
|---|---|---|---|
| tokenizer | /rpc/2.0/ai_custom/v1/wenxinworkshop/tokenizer/erniebot |
未下线 | 全量开放 |
七、迁移验证
完成迁移后,建议按照以下步骤进行验证:
1. 检查 V1 接口调用
确认业务代码、SDK、服务配置及请求日志中不再使用:
1https://aip.baidubce.com/rpc/2.0/ai_custom/v1/wenxinworkshop/
2. 验证 V2 接口
根据实际模型服务类型,调用对应的 V2 接口,确认请求能够正常返回。
3. 验证模型参数
确认 V2 请求中的 model 参数与实际使用的模型一致。
4. 验证业务逻辑
如果业务对模型返回结果进行了二次解析、加工或处理,请同步验证迁移后的返回结果是否满足现有业务要求。
5. 完成生产环境切换
测试验证通过后,将生产环境调用切换至 V2 接口,并持续关注业务运行情况。
八、常见问题
Q1:本次是模型下线还是 V1 接口下线?
本次下线的是模型服务 V1 版本调用接口,并非所有相关模型服务下线。
对于已经支持 V2 接口的模型服务,可以迁移至 V2 接口继续调用。
Q2:如何判断我的业务是否受到影响?
如果您的业务仍通过以下接口调用模型服务,则需要进行迁移:
1https://aip.baidubce.com/rpc/2.0/ai_custom/v1/wenxinworkshop/
Q3:用户自部署模型服务需要重新部署吗?
需要。
当前使用 V1 接口版本的用户自部署模型服务,需要重新部署,并在部署时选择 V2 接口版本。
Q4:什么时候必须完成迁移?
请在 2026 年 8 月 31 日前完成迁移及业务验证。
2026 年 8 月 31 日起,V1 接口将正式下线,继续使用 V1 接口调用相关模型服务将无法正常使用。
评价此篇文章
