2026年7月24日,没有华丽的发布会,Anthropic悄然将新一代旗舰Claude Opus 5上架。然而消息一出,开发者社区瞬间沸腾——这款定位“深思熟虑”的模型,用一半的价格,在多项关键跑分上直接把两个月前发布的顶级旗舰Fable 5拉下了马。

▲ Opus 5在Frontier-Bench编程评测中以43.3%登顶,性能为前代Opus 4.8的两倍
💰 最震撼的定价牌:输入$5/百万Token、输出$25/百万Token——与Opus 4.8同价,却只有Fable 5的一半。在CursorBench最高难度下,Opus 5与Fable 5的峰值差距仅剩0.5%。
不止是便宜,还会自己“造梯子”
如果说价格只是表象,Opus 5在实际任务中展现出的“死磕精神”才是让早期测试者直呼离谱的原因。
在Frontier-Bench的一道难题中,模型被要求根据机械图纸用FreeCAD建模,但官方故意不给查看图纸的途径。结果Opus 5当场自己编写了一套计算机视觉管道,硬是从原始像素中逆向提取出几何数据,完成了重建——没有任何竞品能在五次尝试内做到。
此外,它还在一次测试中自主发现了一个开源包管理器的真实漏洞,修复了社区补丁遗漏的边缘情况。这种“主动验证、自主纠错”的能力,让它更像一位资深高级工程师,而非被动的代码生成器。
智能的质变:ARC-AGI 3 得分是第二名的4倍
在衡量“流体智能”的ARC-AGI 3基准中,Opus 5拿下了30.2%的惊人成绩。作为对比,此前公开的最强成绩仅为GPT-5.6 Sol的7.8%,Opus 4.8也仅有1.5%。这一突破被视为AI从“死记硬背”迈向“逻辑推演”的标志性跨越。
与此同时,Anthropic强调Opus 5的安全对齐程度达到史上最高,安全分类器触发频率比Fable 5降低了约85%。
不到两个月,三款新模型
从6月初的Fable 5,到6月底的Sonnet 5,再到如今的Opus 5,Anthropic的发布节奏明显加速。有网友调侃该叫它“Fable 5.1”,但Anthropic的产品逻辑很清晰:Fable探索上限,Opus负责把前沿能力以一半价格普及。当用户开始质疑“为何还要花双倍价钱用Fable”时,这场定价游戏的天平已经倾斜。
Opus 5现已全平台上线(Claude应用、API、Amazon Bedrock、Google Cloud等),并成为Claude Max的默认模型。100万Token上下文窗口与可调节的思考强度,让它足以应对从复杂编程到长文档分析的各种高频场景。
📌 快讯小结:Claude Opus 5以Opus 4.8的定价实现了性能翻倍,在编程与泛化推理上反超旗舰Fable 5,性价比拉满。适合 开发者、科研人员及高
频企业用户 重点关注。
🔗 深度解析👇👇👇

▲ Anthropic官网 — Claude Opus 5已全平台上线
© 版权声明
© 本站文章版权归 众享AI 所有,未经许可禁止转载。




