DeepSeek-V4-Pro-0813
更新时间:2026-09-03
模型介绍
DeepSeek-V4-Pro-0813 是 DeepSeek 于 2026 年 8 月 13 日发布的旗舰 MoE 模型(V4 系列正式版,取代 4 月的 V4-Pro 预览版)。参数量 1.6T(激活参数 49B),附带 MTP 模块与 3 层 DSpark 投机解码草稿模块。原生支持 1M 上下文,最大输出 384K Token,仅支持文本输入。
模型特性
- 核心能力:智能体、代码工程与工具使用显著增强,SWE-bench Verified 达 96.4%(开源权重第一),Terminal-Bench 2.1 达 87.9 分
- MoE 架构:384 个路由专家 + 1 个共享专家,每次激活 6 个路由专家,FP4(专家)+ FP8(其余)混合精度
- 长上下文:混合注意力机制(Compressed Sparse Attention + Heavily Compressed Attention),1M 上下文下单 Token 算力约为 V3.2 的 27%,KV Cache 仅约 10%
- 思维控制:默认开启思考模式
- 模态支持:纯文本,暂不支持图像与视频理解
API调用
- 服务部署成功后,可在服务列表查看调用信息

- 调用示例
Plain Text
1curl -X POST '<访问地址>/v1/chat/completions' \
2-H 'Content-Type: application/json' \
3-H 'Authorization: Bearer <TOKEN>' \
4-d '{
5 "model": "DeepSeek-V4-Pro-0813",
6 "messages": [{"role": "system", "content": "你是一名天文学家,请回答用户提出的问题。"}, {"role": "user", "content": "人类是否能登上火星?"}],
7 "max_tokens": 1024,
8 "temperature": 0.7
9}'
评价此篇文章
