孤本网
/ 0 阅读
0
0

GPT-6 降价与 Opus 5.5 优化体验:模型竞争进入全成本核算阶段

一句话结论

OpenAI 将 GPT-6 价格近乎腰斩,Anthropic 降低 Opus 5.5 成本,竞争焦点转向全链路成本。

关键要点

  • GPT-6 Sol 输入价降至每百万 Token 2 美元,输出降至 10 美元;Luna 输入降至 0.10 美元,输出降至 0.50 美元。
  • GPT-6 Luna 在 DeepSWE 1.1 得 66.6%,任务成本比 Claude Opus 5 低 93%,比 Claude Fable 5 低 96%。
  • Claude Opus 5.5 典型工作负载成本比 Opus 5 下降 40%,输出速度提升超 30%,Cache Read 价格下降 60%。
  • OpenAI 将 Prompt Caching 命中输入折扣提高至 90%,新增缓存 Dashboard,使 Copilot 重新处理 Token 比例下降超 50%。
  • GPT-6 Sol 在 AutomationBench xhigh 得分 33.2%,单任务成本 0.27 美元,任务成本远低于 Claude 系列模型。

背景与事实

北京时间 9 月 23 日,OpenAI 与 Anthropic 前后相隔约一小时发布新一轮模型更新。OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,将 GPT-6 Astra 的部分能力下放。Sol 面向专业工作、Coding 和复杂 Agent 任务,Luna 进一步压低成本,瞄准高频大规模调用。Anthropic 推出 Claude Opus 5.5,强化 Coding 和 Agent 能力,并将“Communication”列为重点升级方向,同时降低运行成本。

价格方面,GPT-6 Sol 的 API 输入价格从 GPT-5.6 Sol 促销价每百万 Token 4 美元降至 2 美元,输出从 20 美元降至 10 美元;GPT-6 Luna 输入从 0.20 美元降至 0.10 美元,输出从 1.20 美元降至 0.50 美元。相比上一代,两款模型价格大致下降一半。OpenAI 在 AutomationBench 中测算,GPT-6 Sol 在 xhigh 推理强度下得分 33.2%,平均单任务成本 0.27 美元,任务成本远低于 Claude Opus 5 与 Fable 5 配合 Opus 5 的组合。在 DeepSWE 1.1 中,GPT-6 Sol 最高推理强度得 68.8%,单任务成本低约 80%;GPT-6 Luna 得 66.6%,成本比 Opus 5 低约 93%、比 Fable 5 低约 96%。

Anthropic 的 Claude Opus 5.5 将典型工作负载成本相比 Opus 5 下降 40%,输出速度提升 30% 以上,Cache Read 价格下降 60%。OpenAI 披露其内部研究人员 Coding Agent 使用量快速增加,按 API 价格折算,每人每天 Token 成本中位数超 600 美元,前 10% 研究人员超 7000 美元。

影响分析

本次发布对中文开发者与从业者产生两方面实际影响,以下内容为分析判断。其一,成本核算标准发生转变。过去开发者主要对比 API 标价,现在必须计算长周期 Agent 工作流中的缓存命中率、重复 Prefill 开销与单次任务总成本。若模型缓存利用率低,即使输入单价便宜,最终账单也可能更高。其二,工具选型标准发生变化。在 Coding 场景中,模型单次输出正确性不再是唯一考量,修改无关文件数量、重构范围、人工复核时间与回退频率直接影响团队生产力。开发者需重新建立包含行为稳定性与过程质量的内部评测基准。

适用边界

GPT-6 Luna 的低成本优势在高频、大规模分类调用中显著,但对复杂多步骤、强依赖上下文的长周期 Agent 任务,其稳定性与行为控制能力尚需验证,此类场景不宜仅凭单价决策。Claude Opus 5.5 的安全限制可能阻断部分合法 Bash 操作,强安全合规场景或自动化运维环境需重点评估拦截率,避免能力无法转化为实际生产力。上述结论基于当前发布反馈与内部测算数据,不适用于非 API 调用或本地部署场景。

孤本观察

本次发布表明模型竞争正从单点能力冲刺转向全链路经济系统重构,缓存经济学与过程行为质量已取代跑分成为关键决策变量。这一判断基于两家公司均将缓存机制与交互修复置于核心发布位置的事实,反映了行业底层逻辑的迁移。

GPT-6 降价与 Opus 5.5 优化体验:模型竞争进入全成本核算阶段

GPT-6 降价与 Opus 5.5 优化体验:模型竞争进入全成本核算阶段

GPT-6 降价与 Opus 5.5 优化体验:模型竞争进入全成本核算阶段

GPT-6 降价与 Opus 5.5 优化体验:模型竞争进入全成本核算阶段

GPT-6 降价与 Opus 5.5 优化体验:模型竞争进入全成本核算阶段

常见问题

GPT-6 Sol 和 Luna 的 API 输入与输出价格分别是多少?

GPT-6 Sol 输入为每百万 Token 2 美元,输出为 10 美元;GPT-6 Luna 输入为 0.10 美元,输出为 0.50 美元。

Claude Opus 5.5 相比 Opus 5 在成本、速度和缓存价格上有何优化?

Opus 5.5 典型工作负载成本比 Opus 5 下降 40%,输出速度提升超 30%,Cache Read 价格下降 60%。

GPT-6 Luna 在 DeepSWE 1.1 测试中的得分及成本优势如何?

GPT-6 Luna 在 DeepSWE 1.1 得分为 66.6%,任务成本比 Claude Opus 5 低 93%,比 Claude Fable 5 低 96%。

OpenAI 针对缓存机制新增了哪些功能或折扣策略?

OpenAI 将 Prompt Caching 命中输入折扣提高至 90%,并新增缓存 Dashboard,使 Copilot 重新处理 Token 比例下降超 50%。

Claude Opus 5.5 在自动化运维或强安全合规场景中存在什么潜在限制?

Claude Opus 5.5 的安全限制可能阻断部分合法 Bash 操作,相关场景需重点评估拦截率,避免能力无法转化为实际生产力。

来源:InfoQ 中文 AI


评论