Qwen3.8-Flash-Next
更新时间:2026-09-03
模型介绍
Qwen3.8-Flash-Next 是阿里于2026年8月发布的多模态MoE模型,作为Qwen4架构的预览版。参数量125B(激活参数6B),外加51B N-gram嵌入与4B MTP模块。原生支持262K上下文,可通过YaRN扩展至1M Token,支持图像与视频理解。
模型特性
- 核心能力:代码编写、智能体任务、专业工作显著增强,SWE-bench Pro达62.5分
- MoE架构:512个专家,每次激活10个路由专家+1个共享专家
- 长上下文:混合注意力机制(Gated DeltaNet + Qwen稀疏注意力),1M Token下吞吐为Qwen3.7-Plus的8.6倍
- 思维控制:支持
enable_thinking、preserve_thinking、reasoning_effort参数 - 视觉语言:原生支持图像和视频理解
API调用
- 服务部署成功后,可在服务列表查看调用信息

- 调用示例
Plain Text
1curl -X POST "<访问地址>/v1/chat/completions" \
2-H "Content-Type: application/json" \
3-H "Authorization: <TOKEN>" \
4-d '{
5 "model": "Qwen3.8-Flash-Next",
6 "messages": [{"role": "user","content": [{"type": "text", "text": "请描述这张图片的内容"},{"type": "image_url", "image_url": {"url": "https://bce.bdstatic.com/doc/bce-doc/AIHC/dog_e941a21.jpeg"}}]}],
7 "max_tokens": 1024,
8 "temperature": 0.7
9}'
评价此篇文章
