Anthropic 在 2026 年 7 月 24 日发布的 Claude Opus 5,官方定位是"深思熟虑且积极主动"(thoughtful and proactive)。但比起这个形容词,更该被记下的另一组数字是——它的智能水平接近自家旗舰 Claude Fable 5,价格却只有后者一半。对一线团队来说,这不是一次普通的版本迭代,而是选型逻辑的一次重写。
半价旗舰,这次是真的"接近"
先看智能指数。第三方 Artificial Analysis Intelligence Index 给出的数据是:Opus 5(max) 61,Fable 5(max) 60,GPT-5.6 Sol 59,Kimi K3 57,上一代 Opus 4.8 是 56。换句话说,Opus 5 在这里得分比Fabel 5还高一分,勉强位居最智能模型之首,其智能水平与 Fable 5 相当。
价格差才是重点。Opus 5 定价 5/25(每百万输入/输出 token),与 Opus 4.8 一致;Fable 5 则是10/50。按 Artificial Analysis 的测算,跑一个"max"强度任务的单任务成本,Opus 5 约 $2.03,Fable 5 约 $2.75。接近的能力,明显更低的单任务账单——这就是为什么我说它是"半价旗舰"
medium / high / xhigh / max。但比"想得更深"更重要的是"想完会验证"——官方描述里,它会自主验证工作:在浏览器里以桌面和手机两种宽度打开页面、对照现实校验输出,再
处实质改变
三个工程侧改动,我建议从业者重点关注:
第一,Beta 功能允许在对话中途更换工具而不使 prompt cache 失效。过去换工具常常等于缓存作废、成本重算,现在这条链路被打通了。
第二,安全分类器拦截后,系统会自动回退到其他模型(例如 Opus 4.8),而不是让请求卡死。对生产环
成本进一步下探。配合研究预览的 Fast 模式(约 2.5 倍速度、2 倍价格),团队在"快"和"省"之间又多了一个旋钮。
基准怎么读
在Frontier-Bench和GDPval-AA等编码和知识工作评估方面,Opus 5 是最新的最先进技术,但在网络安全任务方面仍然落后于 Mythos 5。
Opus 5 专为日常使用而设计:它比其他型号效率更高。它是 Claude Max 的全新默认型号,也是 Claude Pro 的最强型号。
一个被刻意弱化的点
安全分级上,Opus 5 的漏洞识别能力很强,但在"漏洞利用"上刻意弱于同系 Mythos 5——这是 by design 的设计取舍,说明 Anthropic 在"能发现风险"和"不主动递刀"之间划了线。厂商称它比现有其他模型更不易被诱导用于 misuse。对做合规和内部工具的同学,这一点比分数更值得写进选型评估表。
能力密度 per-dollar,正在成为新竞争维度
把视野拉远。Fable 5 在 2026 年 6 月发布后,曾因美国对其能力可能被转用于外国军事情报的担忧而临时不可用。
旗舰会因地缘因素"掉线",但半价、全平台可用的 Opus 5 把接近旗舰的能力稳定下放了。"谁更强"正在让位于"谁的单位智能更便宜、更可用"——这会是接下来一年模型竞争的主轴。
这代 Opus 给我的信号很明确——前沿模型的下放速度比想象中快。当"旗舰体验"的门槛被价格砍掉一半,真正的护城河就回到了"你怎么把模型嵌进工作流"。
欢迎在评论区聊聊你们现在的模型选型,以及 effort 参数你们打算怎么设。
关注“智纪探索”,给你带来最前新的AI资讯和Agent使用技能。
