大模型
DeepSeek V4-Pro-0813深夜上线:Agent跑分暴涨5倍,价格仅为Anthropic竞品六十分之一
发布时间:2026年08月13日 09:00:008月13日凌晨,DeepSeek在API页面悄然更新V4-Pro-0813版本,模型名称不变但底层能力大幅升级。DeepSWE跑分从12.8跃升至62.7,Terminal Bench从72.1提升至87.9,多项Agent评测超越Anthropic Fable 5。API定价输入3元/百万Token、输出6元/百万Token,价格仅为竞品六十分之一。同步推出灵活推理档位和Responses API支持,以价格战+价值战双杀硅谷。
事件概况
8月13日凌晨,DeepSeek在API页面悄然更新版本号,推出DeepSeek-V4-Pro-0813。模型名称保持不变,调用方式和文档均未变化,但底层能力已全面更新。
性能跃升
核心跑分对比
DeepSeek公布的跑分数据显示,新版本在多项Agent能力评测中表现显著提升:
| 评测基准 | 旧版本 | V4-Pro-0813 | 提升幅度 |
|---|---|---|---|
| DeepSWE | 12.8 | 62.7 | 约5倍 |
| Terminal Bench | 72.1 | 87.9 | +21.9% |
| AutomationBench | 12.8 | 31.8 | 约2.5倍 |
| CyberGym | - | 超越Fable 5 | - |
与竞品对比
- Terminal Bench:V4 Pro得分87.9,接近Anthropic Fable 5的88.0
- CyberGym:V4 Pro已超越Fable 5
- AutomationBench:V4 Pro已超越Fable 5
DeepSeek在推理、编码等关键能力上已达到世界顶尖水平,而价格仅为竞品的六十分之一。
新特性
灵活推理档位
V4-Pro和V4-Flash均引入灵活推理档位:
- Low:适用于简单任务,低延迟快速响应
- High:适用于日常Agent工作流
- Max:适用于复杂任务,深度推理
Responses API支持
- 原生支持OpenAI Responses API
- 针对Codex优化,一键配置
- 降低开发者迁移成本
API定价
新定价体系
| 项目 | 定价 |
|---|---|
| 输入 | 3元/百万Token |
| 输出 | 6元/百万Token |
| 缓存命中输入 | 0.025元/百万Token |
峰谷定价
新API定价引入峰谷分时定价:
- 高峰时段:标准价格
- 低谷时段:价格降低50%
- 生效日期:2026年8月16日
低调发布策略
DeepSeek此次未举办发布会或预热宣传,仅在API页面更新版本号:
- 与当前大模型竞争环境下的"实用主义"趋势一致
- 通过实际性能而非营销声量赢得开发者认可
- 开发者社区自发传播跑分对比数据
行业影响
对Agent生态的影响
- V4 Pro在Agent评测中的表现直接针对高频率Agent工作负载
- 低成本+高性能组合吸引大规模Agent应用
- 对Anthropic和OpenAI的Agent市场构成直接竞争
对价格战的影响
- DeepSeek持续以极低价格提供接近旗舰水平的性能
- 迫使竞争对手重新考虑定价策略
- 加速大模型API价格下降趋势
后续观察
DeepSeek V4-Pro在实际生产环境中的Agent表现、峰谷定价的用户反馈、以及竞品是否调整定价策略,将是关键观察点。