大模型
DeepSeek发布V4-Flash正式版:284B参数MoE模型,多项智能体与代码基准反超V4-Pro
发布时间:2026年08月03日 11:00:008月3日,DeepSeek推出V4-Flash正式版(V4-Flash-0731),采用284B总参数/13B激活参数的MoE架构,在九项智能体和代码基准测试中全部反超此前发布的V4-Pro预览版,其中DeepSWE基准得分从7.3飙升至54.4,Terminal-Bench达82.7逼近Claude Opus 4.8。API定价每百万输入1元/输出2元,MIT许可证开源。
发布概况
8月3日,DeepSeek推出V4-Flash正式版(V4-Flash-0731)。该版本总参数仅为V4-Pro的六分之一,激活参数不到四分之一,却在多项基准测试中实现反超,展现出小参数模型的性能突破潜力。
模型规格
架构参数
- 总参数:284B
- 激活参数:约13B/请求
- 架构:MoE(Mixture-of-Experts)
- 许可证:MIT开源许可证
定价
- 输入价格:1元人民币/百万tokens
- 输出价格:2元人民币/百万tokens
- 单任务成本比降价后的GPT-5.6 Luna低约60%
基准测试表现
智能体与代码基准
V4-Flash正式版在九项智能体和代码基准测试中全部反超V4-Pro预览版:
- DeepSWE:从7.3飙升至54.4(反超V4-Pro预览版41.6分)
- Terminal-Bench:达82.7,逼近Claude Opus 4.8
- 在编码智能体AgentBench、SWE-Bench等基准上均有显著提升
生态扩张
- 国家超算互联网接入:DeepSeek V4-Flash API正式接入国家超算互联网
- 日处理量:单日处理8T tokens(其中5T为免费使用)
- 缓存命中率:约98%
- 性价比标杆:登顶性价比帕累托前沿
技术特点
高效架构
V4-Flash采用MoE架构,每请求仅激活约13B参数,大幅降低推理成本的同时保持高水平的模型能力。这种设计使得更多团队可以负担:
- 重试和分类运行
- 代码库扫描
- 工具调用循环
- 大批量自动化任务
开源生态
MIT许可证开源意味着:
- 开发者可自由使用、修改和分发
- 可自托管和私有化部署
- 社区可基于此进行二次开发
行业影响
对AI应用层的影响
V4-Flash极低的API定价正在改变AI应用的商业模式:
- 更多团队可以大规模部署AI自动化
- 低成本的编码智能体成为可能
- 入门级AI应用的运行成本大幅降低
对模型竞争格局的影响
DeepSeek以远小于V4-Pro的模型实现性能反超,证明了架构优化和训练策略的重要性,为AI行业提供了"小模型、大效果"的可行路径。
后续观察
V4-Flash在社区中的采用率、生态工具链的完善程度、以及后续版本(V5等)的发布路线图,将是关键观察点。