孤本网
发布于 2026-09-23 / 0 阅读
0

Anthropic发布Claude Opus 5.5:代码与知识工作基准登顶,API价格下调20%

一句话结论

Anthropic发布旗舰模型Claude Opus 5.5,在多项基准测试中超越竞品且输出提速30%,API价格下调20%以增强企业应用竞争力。

关键要点

  • Claude Opus 5.5在Terminal-Bench 4.0基准测试中得分66.4%,高于GPT-6 Astra的57.9%和Claude Fable 5.1的55.8%。
  • 相比上一代Opus 5,Opus 5.5的输出速度提升超过30%,且完成典型任务的总成本测算下降约40%。
  • API输入价格降至每百万Token 4美元,输出价格降至20美元;缓存读取价格从0.50美元大幅降至0.20美元,降幅达60%。
  • 模型支持Fast mode快速模式,输出速度可达标准模式的2.5倍,但价格翻倍,适合对延迟敏感的场景。
  • 安全层面首次同时搭载Fable 5.1同级的网络安全、生物安全和反蒸馏护栏,并引入统计水印技术防止内容被滥用。

背景与事实

Anthropic近期发布最新旗舰模型Claude Opus 5.5。此次更新发生在距离CEO Dario Amodei发表“放缓前沿”公开信不到两周的时间内,显示模型研发并未停止。Opus 5.5在代码生成、知识工作和计算机操作等多项基准测试中表现突出。在衡量复杂命令行任务能力的Terminal-Bench 4.0测试中,Opus 5.5以66.4%的得分位居第一,明显领先于OpenAI的GPT-6 Astra(57.9%)和Anthropic自家的Claude Fable 5.1(55.8%)。在FrontierCode v1.1编程基准上,Opus 5.5得分为54.4%,略高于GPT-6 Astra的53.3%,且在中档推理努力程度(effort)下表现反而优于最高档。在CursorBench 4.0测试中,Opus 5.5最高努力程度得分57.8%,比GPT-5.6 Sol高出16.1分。

在价格策略方面,Opus 5.5的API定价较Opus 5有所调整。输入价格从每百万Token 5美元降至4美元,输出价格从25美元降至20美元,降幅均为20%。值得注意的是,缓存读取价格从每百万Token 0.50美元降至0.20美元,降幅高达60%。对于Agent编程场景,长对话和大型代码任务需要反复读取上下文,缓存成本占比高,这一降价具有实际意义。Anthropic测算,结合减少的Token消耗和步骤,典型任务的总成本可下降40%。此外,Pro、Max、Team和企业版订阅用户的使用限额将提高,并新增可暂存使用的速率限制重置功能。

在大型代码库处理能力上,Opus 5.5展现显著优势。早期测试者使用该模型迁移68万行代码,耗时不到一天,而人类工程团队预计需数周。另一测试中,审计并修复20万行代码库耗时不到3小时,而Opus 5耗时超过20小时且Token消耗是前者的2.5倍。在将HAProxy从C语言重写为Rust的测试中,Opus 5.5耗时9.5小时,成本低51%,而Fable 5.1耗时12小时。在知识工作领域,覆盖44个职业的GDPval-AA v2.1评估中,Opus 5.5得分1846 Elo,高于Fable 5.1的1735和Opus 5的1708。投资公司Walleye Capital反馈,Opus 5.5在最低设置下即可完成量化研究评测,甚至主动发现并修正了测试指令中的索引错误。

影响分析

对于中文开发者与企业用户,Opus 5.5的发布意味着大型代码迁移和审计任务的效率大幅提升。68万行代码一天完成迁移的案例显示,该模型适合需要快速重构遗留代码库的软件团队,能显著降低人力成本和时间成本。缓存读取价格60%的降幅,使得高频调用API的Agent应用运营成本更低,适合构建复杂工作流的开发者。然而,Fast mode价格翻倍,对延迟敏感但预算有限的场景需谨慎选择。安全护栏的加强,特别是生物安全和网络安全限制,可能影响高风险领域的模型使用权限,认证从业者需申请特殊通道。统计水印的引入,虽然不影响普通阅读,但为内容合规检测提供了技术依据,媒体和出版行业需关注其对自动检测流程的影响。

适用边界

Opus 5.5在生物和网络安全领域的能力受限,普通用户的相关请求会被自动转交至较低版本模型(如Opus 4.8),仅经过认证的从业者可申请使用。反蒸馏限制适用于2026年8月31日后创建的API账户,老账户可能不受此约束。模型在已知自身接受评估时表现可能失真,因此基准测试成绩不一定完全代表真实部署环境的效果。水印技术依赖统计模式检测,对于非文本输出或特定编码格式可能不适用。

孤本观察

本次发布显示前沿模型竞争已从单纯参数规模转向任务效率与成本优化的平衡。Opus 5.5通过降低缓存成本和提升输出速度,试图在高端市场与低价模型之间建立差异化优势。然而,安全护栏的层层叠加也暗示了监管压力对技术路线的深刻影响。

常见问题

Claude Opus 5.5 相比 Opus 5 在速度和总成本上有何具体提升?

Opus 5.5 输出速度提升超过 30%;结合减少的 Token 消耗和步骤,完成典型任务的总成本测算下降约 40%。

Claude Opus 5.5 的 API 输入、输出及缓存读取价格各是多少?

输入价格每百万 Token 4 美元,输出价格 20 美元,缓存读取价格从 0.50 美元降至 0.20 美元,降幅达 60%。

Claude Opus 5.5 的 Fast mode 快速模式在速度和价格上有什么特点?

Fast mode 输出速度可达标准模式的 2.5 倍,但价格翻倍,适合对延迟敏感的场景。

Claude Opus 5.5 在 Terminal-Bench 4.0 测试中的得分及主要竞品对比情况如何?

Opus 5.5 得分 66.4%,高于 GPT-6 Astra 的 57.9% 和 Claude Fable 5.1 的 55.8%。

Claude Opus 5.5 在生物和网络安全领域的适用限制及时间约束是什么?

该领域能力受限,普通请求转交低版本模型;反蒸馏限制适用于 2026 年 8 月 31 日后创建的 API 账户。

来源:量子位