AI模型

Anthropic发布Claude Opus 5:一半价格逼近Fable 5前沿智能

发布时间:2026年07月24日 09:00:00

Anthropic正式发布Claude Opus 5,以Fable 5一半的价格提供接近前沿的智能水平,在Frontier-Bench、GDPval-AA等编码与知识工作评测中登顶SOTA,定价维持每百万输入tokens 5美元、输出25美元,并成为Claude Max默认模型。


发布概况

Anthropic于7月24日正式发布Claude Opus 5,官方称其为一款"深思熟虑且主动"的模型,以Fable 5一半的价格提供接近前沿的智能水平。Opus 5即日起在所有平台可用,成为Claude Max的默认模型,也是Claude Pro上最强的模型。

性能表现

编码与知识工作登顶

  • Frontier-Bench v0.1:超越所有其他模型,性能达到前代Opus 4.8的两倍以上,且单任务成本更低
  • CursorBench 3.2:最大effort设置下,得分与Fable 5峰值仅差0.5%,但单任务成本仅为一半
  • ARC-AGI 3:解决新颖问题的得分是第二名模型的三倍
  • Zapier AutomationBench:通过率约为同成本下第二名模型的1.5倍,最低effort设置也超过其他所有模型
  • OSWorld 2.0:计算机使用基准上以约三分之一的成本超越Fable 5最佳成绩

科研能力提升

Opus 5在生命科学全部评测项目上均优于Opus 4.8,其中有机化学任务(从光谱数据推断分子结构)提升10.2个百分点,蛋白质功能预测任务提升7.7个百分点。

自主性与严谨性

早期测试中,Opus 5展现出极强的验证与迭代能力:在一项无法直接查看图纸的FreeCAD建模任务中,它自行编写计算机视觉管线从原始像素提取几何信息并成功重建零件,竞品模型五次尝试均告失败。Cursor、Devin、Zapier、Box、JetBrains等早期客户普遍反馈其在调试、金融建模、法律agent等场景实现代际提升。

对齐与安全

自动化行为审计显示,Opus 5是Anthropic迄今最对齐的模型,整体错位行为得分仅2.3,为近期模型最低。安全方面,Opus 5未在高风险双重用途能力上突破前沿,生物研究与攻击性网络安全能力仍落后于Mythos 5。网络安全分类器的拦截频率预计比Fable 5低约85%。

定价与新功能

  • 定价:每百万输入tokens 5美元、输出25美元,与Opus 4.8持平
  • Fast模式:约2.5倍默认速度,价格为基础价两倍
  • 平台更新:对话中途可切换工具且不失效提示缓存;API支持安全分类器拦截后自动回退至其他模型

行业影响

Opus 5的发布结束了持续数周的"Fable 5免费期何时终结"猜测,也直接回应了GPT-5.6 Sol与Grok 4.5的竞争压力,性价比策略或将重塑前沿模型市场格局。