大模型

DeepSeek V4-Pro-0813深夜上线:Agent跑分暴涨5倍,价格仅为Anthropic竞品六十分之一

发布时间:2026年08月13日 09:00:00

8月13日凌晨,DeepSeek在API页面悄然更新V4-Pro-0813版本,模型名称不变但底层能力大幅升级。DeepSWE跑分从12.8跃升至62.7,Terminal Bench从72.1提升至87.9,多项Agent评测超越Anthropic Fable 5。API定价输入3元/百万Token、输出6元/百万Token,价格仅为竞品六十分之一。同步推出灵活推理档位和Responses API支持,以价格战+价值战双杀硅谷。


事件概况

8月13日凌晨,DeepSeek在API页面悄然更新版本号,推出DeepSeek-V4-Pro-0813。模型名称保持不变,调用方式和文档均未变化,但底层能力已全面更新。

性能跃升

核心跑分对比

DeepSeek公布的跑分数据显示,新版本在多项Agent能力评测中表现显著提升:

评测基准旧版本V4-Pro-0813提升幅度
DeepSWE12.862.7约5倍
Terminal Bench72.187.9+21.9%
AutomationBench12.831.8约2.5倍
CyberGym-超越Fable 5-

与竞品对比

  • Terminal Bench:V4 Pro得分87.9,接近Anthropic Fable 5的88.0
  • CyberGym:V4 Pro已超越Fable 5
  • AutomationBench:V4 Pro已超越Fable 5

DeepSeek在推理、编码等关键能力上已达到世界顶尖水平,而价格仅为竞品的六十分之一。

新特性

灵活推理档位

V4-Pro和V4-Flash均引入灵活推理档位:

  • Low:适用于简单任务,低延迟快速响应
  • High:适用于日常Agent工作流
  • Max:适用于复杂任务,深度推理

Responses API支持

  • 原生支持OpenAI Responses API
  • 针对Codex优化,一键配置
  • 降低开发者迁移成本

API定价

新定价体系

项目定价
输入3元/百万Token
输出6元/百万Token
缓存命中输入0.025元/百万Token

峰谷定价

新API定价引入峰谷分时定价:

  • 高峰时段:标准价格
  • 低谷时段:价格降低50%
  • 生效日期:2026年8月16日

低调发布策略

DeepSeek此次未举办发布会或预热宣传,仅在API页面更新版本号:

  • 与当前大模型竞争环境下的"实用主义"趋势一致
  • 通过实际性能而非营销声量赢得开发者认可
  • 开发者社区自发传播跑分对比数据

行业影响

对Agent生态的影响

  • V4 Pro在Agent评测中的表现直接针对高频率Agent工作负载
  • 低成本+高性能组合吸引大规模Agent应用
  • 对Anthropic和OpenAI的Agent市场构成直接竞争

对价格战的影响

  • DeepSeek持续以极低价格提供接近旗舰水平的性能
  • 迫使竞争对手重新考虑定价策略
  • 加速大模型API价格下降趋势

后续观察

DeepSeek V4-Pro在实际生产环境中的Agent表现、峰谷定价的用户反馈、以及竞品是否调整定价策略,将是关键观察点。