大模型
阿里发布Qwen 3.8-Max旗舰模型:2.4万亿参数MoE架构,多项基准超越Claude与GPT-5.6
发布时间:2026年08月03日 10:00:008月3日,阿里巴巴正式发布新一代旗舰大模型Qwen 3.8-Max,采用2.4万亿参数MoE架构、激活参数约95B、上下文窗口约100万tokens。在Terminal-Bench 2.1上以86.6分超越Claude Opus 4.8和Claude Fable 5(84.6),仅次于GPT-5.6 Sol(88.8)。API定价输入2美元/百万tokens,输出6美元/百万tokens,下周将开放权重。
发布概况
8月3日,阿里巴巴正式发布新一代旗舰大模型Qwen 3.8-Max,这是阿里通义千问系列迄今为止规模最大的模型,多项基准测试达到前沿水平。
模型规格
架构参数
- 总参数:2.4万亿(Mixture-of-Experts架构)
- 激活参数:约950亿(95B)每请求
- 上下文窗口:约100万tokens
- 训练数据:大规模多语言多模态数据集
定价
- 输入价格:2美元/百万tokens
- 输出价格:6美元/百万tokens
- 开放权重:Qwen 3.8-Max与Qwen 3.8-27B权重将于下周开放
基准测试表现
Terminal-Bench 2.1
- Qwen 3.8-Max:86.6
- Claude Opus 4.8 & Claude Fable 5:84.6
- GPT-5.6 Sol:88.8
SWE-bench Pro
- Qwen 3.8-Max:67.7
- Claude Fable 5:80.0
编程与自主开发
模型在编程和长周期任务执行方面表现突出:
- 独立运行16天完成oh-my-cli项目自动建构,从新建文件夹到项目部署全流程无人干预
- 在WWW2025多模态挑战赛中24小时击败458支人类队伍
- 法务审查1小时标出1,284条条款
- 芯片设计沙箱内500轮交互将硬件门数从8,298精简至678
能力特点
长程任务执行
Qwen 3.8-Max具备强大的长程任务规划与执行能力:
- 支持从零完成完整软件开发项目
- 闭环自适应学习框架,支持长期持续优化
- 可支撑长达一年周期的电商运营策略规划
多模态融合
- 原生融合多模态能力
- 视觉信息参与任务规划与执行
- 支持文本、图像、代码等多模态输入
行业影响
对开源生态的影响
Qwen 3.8-Max下周开放权重,将推动开源大模型生态进入新阶段:
- 自托管和私有云部署将获得新的重量级选择
- 组织可在数据、成本和延迟方面获得更多控制权
- 开源模型能力进一步逼近闭源前沿水平
对中国AI产业的影响
作为中国AI企业的旗舰模型,Qwen 3.8-Max在多项基准上超越国际竞品,展示了中国AI在基础模型研发领域的持续进步,加剧了全球AI模型市场的竞争格局。
后续观察
权重正式开放的时间与社区反响、模型在实际应用中的性能表现、以及阿里云在模型服务方面的生态建设,将是关键观察点。