大模型

DeepSeek发布V4-Flash正式版:284B参数MoE模型,多项智能体与代码基准反超V4-Pro

发布时间:2026年08月03日 11:00:00

8月3日,DeepSeek推出V4-Flash正式版(V4-Flash-0731),采用284B总参数/13B激活参数的MoE架构,在九项智能体和代码基准测试中全部反超此前发布的V4-Pro预览版,其中DeepSWE基准得分从7.3飙升至54.4,Terminal-Bench达82.7逼近Claude Opus 4.8。API定价每百万输入1元/输出2元,MIT许可证开源。


发布概况

8月3日,DeepSeek推出V4-Flash正式版(V4-Flash-0731)。该版本总参数仅为V4-Pro的六分之一,激活参数不到四分之一,却在多项基准测试中实现反超,展现出小参数模型的性能突破潜力。

模型规格

架构参数

  • 总参数:284B
  • 激活参数:约13B/请求
  • 架构:MoE(Mixture-of-Experts)
  • 许可证:MIT开源许可证

定价

  • 输入价格:1元人民币/百万tokens
  • 输出价格:2元人民币/百万tokens
  • 单任务成本比降价后的GPT-5.6 Luna低约60%

基准测试表现

智能体与代码基准

V4-Flash正式版在九项智能体和代码基准测试中全部反超V4-Pro预览版:

  • DeepSWE:从7.3飙升至54.4(反超V4-Pro预览版41.6分)
  • Terminal-Bench:达82.7,逼近Claude Opus 4.8
  • 在编码智能体AgentBench、SWE-Bench等基准上均有显著提升

生态扩张

  • 国家超算互联网接入:DeepSeek V4-Flash API正式接入国家超算互联网
  • 日处理量:单日处理8T tokens(其中5T为免费使用)
  • 缓存命中率:约98%
  • 性价比标杆:登顶性价比帕累托前沿

技术特点

高效架构

V4-Flash采用MoE架构,每请求仅激活约13B参数,大幅降低推理成本的同时保持高水平的模型能力。这种设计使得更多团队可以负担:

  • 重试和分类运行
  • 代码库扫描
  • 工具调用循环
  • 大批量自动化任务

开源生态

MIT许可证开源意味着:

  • 开发者可自由使用、修改和分发
  • 可自托管和私有化部署
  • 社区可基于此进行二次开发

行业影响

对AI应用层的影响

V4-Flash极低的API定价正在改变AI应用的商业模式:

  • 更多团队可以大规模部署AI自动化
  • 低成本的编码智能体成为可能
  • 入门级AI应用的运行成本大幅降低

对模型竞争格局的影响

DeepSeek以远小于V4-Pro的模型实现性能反超,证明了架构优化和训练策略的重要性,为AI行业提供了"小模型、大效果"的可行路径。

后续观察

V4-Flash在社区中的采用率、生态工具链的完善程度、以及后续版本(V5等)的发布路线图,将是关键观察点。