技术

Claude Opus 5售价仅为Fable 5一半,编程基准差距不到0.5%

Adrian Kessler

Claude Opus 5 能自行捕捉错误,在回答不达标时重写答案,并从头到尾处理多步骤的科学与编码任务——而价格仅为 Anthropic 最强模型 Fable 5 的一半。在编码基准测试中,Opus 5 的表现与 Fable 5 相差不到 0.5%;在 OSWorld 2.0 计算机使用测试中,它甚至以三分之一的成本超越了旗舰模型。

Opus 5 在结构上与前代产品的核心区别在于一个“努力程度切换器”:每次 API 请求可附加低、中、高三个档位。一个法律团队做常规文档审阅时可以用低档;一个软件工程工作流在调试复杂的分布式系统时可以切换到高档。模型会根据任务调整计算投入量,从而改变用户的支付成本,而模型本身保持不变。

定价为每百万输入 token 5 美元、每百万输出 token 25 美元,与 Opus 5 的直接前代 Opus 4.8 相同。Anthropic 的旗舰模型 Fable 5 价格约为其两倍。Opus 5 现已成为 Claude Max 订阅的默认模型,并可通过 API 端点 claude-opus-5 使用。快速模式以 2.5 倍的推理速度运行,基础 token 价格翻倍,专为延迟比成本更重要的实时管道设计。

局限性真实存在,Anthropic 对此直言不讳。Opus 5 在网络安全任务上仍落后于公司专门的安全模型 Mythos 5,并且在双用途生物学领域毫无进展——Anthropic 出于安全原因已将其定义为硬性天花板。对于自主运行、长达数月的生物学研究项目,Fable 5 仍是推荐选择。0.5% 的编码差距在实际应用中,面对基准测试之外的复杂、开放式问题时可能会扩大。

此次发布正值整个行业密集推新的背景之下。OpenAI 于 7 月 9 日以三个层级发布了 GPT-5.6;Google 于 7 月 21 日发布了 Gemini 3.6 Flash,将输出 token 成本降低了 17%。每一波发布都抬高了基准线,同时压缩了企业评估和部署此前产品的时间窗口。

Opus 5 即日起可通过 Claude API、Claude.ai、Claude Code 和 Claude Cowork 使用,定价为每百万输入 token 5 美元、每百万输出 token 25 美元。Anthropic 表示,“努力程度切换器”对所有 API 用户和 Claude Max 订阅者立即开放。

Opus 5 是 Anthropic 在六十天内发布的第四款模型。成本-性能前沿的移动速度之快,如今给企业买家带来了另一个问题:知道何时停止评估,真正开始部署。

标签: , , , , ,

讨论

有 0 条评论。