孤本网
/ 0 阅读
0
0

GPT-6.1 Sol 极速版上线,价格成标准模式六倍,社区热议额度消耗与性价比

一句话结论

OpenAI 于 10 月 8 日为 GPT-6.1 Sol 模型新增 Ultrafast 极速服务档位,其 API 单价为标准模式的 6 倍,主要面向对延迟敏感的智能体应用,但引发了关于高成本与低额度可用性的争议。

关键要点

  • 2025 年 10 月 8 日,OpenAI 在 Responses API 中为 GPT-6.1 Sol 增加 Ultrafast 极速模式,向所有 API 用户开放,调用时无需更换模型名称,仅需将服务档位设为 ultrafast。
  • 在输入不超过 27.2 万 Token 的情况下,GPT-6.1 Sol 极速模式的 API 输入单价为 12 美元/百万 Token,输出单价为 60 美元/百万 Token,分别为标准模式价格的 6 倍和 3 倍快速模式价格。
  • 当输入超过 27.2 万 Token 时,GPT-6.1 Sol 极速模式的输入价格升至 24 美元/百万 Token,输出价格升至 90 美元/百万 Token,且长上下文倍率作用于整个请求。
  • 在 ChatGPT 订阅端,GPT-6.1 Sol 极速模式仅向 Pro 500 美元套餐及符合条件的 Enterprise、Edu 方案开放,其额度消耗速度为标准模式的 8 倍,额外购买 Credits 或按量付费则为 6 倍。
  • 性能测试显示,GPT-6.1 Sol 在 DeepSWE v1.1 等基准中以约五分之一的成本达到接近 GPT-6 Astra 的表现,但在自动化工作流中速度成为新的差异化竞争点。

背景与事实

OpenAI 于 9 月 29 日发布了 GPT-6.1 Sol 模型,该模型定位是在复杂编程、计算机操作和专业工作中,以更低成本提供接近 GPT-6 Astra 的表现。此次 10 月 8 日的更新并非发布新模型,而是为已有模型增加了 Ultrafast 极速服务档位。OpenAI 官方将此模式定位为其最快的 API 服务档位,主要服务于对延迟极其敏感、且愿意为速度支付溢价的工作场景。开发者在调用时,只需在现有 gpt-6.1-sol 模型请求中将服务参数指定为 ultrafast 即可,该功能受独立于标准模式和快速模式的速率限制约束。

在性能方面,GPT-6.1 Sol 相对于前代 GPT-6 Sol 在复杂专业任务上有显著提升。根据基准测试数据,在 DeepSWE v1.1 测试中,GPT-6.1 Sol 以约五分之一的成本取得了与 GPT-6 Astra 相当的水平,且比 GPT-6 Sol 的最高得分高出 6.4 个百分点。在专业工作评估 GDP.pdf 中,其在各档推理设置下的得分均高于带回退机制的 Opus 5.5,单任务成本不到后者一半。在衡量多步骤业务工作流的 AutomationBench 中,GPT-6.1 Sol 在中等推理强度下的得分比 Opus 5.5 高 2.2 个百分点,成本约为其三分之一。

价格结构上,极速模式的引入改变了单一模型的成本基准。按相同 Token 数量计算,Sol 标准模式的输入和输出费用比 Astra 标准模式低 80%,但 Sol 极速模式的输入、输出价格(12 美元和 60 美元)已高于 Astra 标准模式(10 美元和 50 美元),高出 20%。这意味着,当用户选择极速档位时,其“低成本”相对 Astra 的优势消失,转而购买的是时间的节省。Codex 负责人 Tibo 在社交媒体上表示,改进响应速度能让模型实时响应用户调整,避免资源浪费,并与 GPT-6.1 Sol 极速版配合使用效果极佳。

影响分析

对于中文开发者与从业者而言,此次更新的核心影响在于智能体开发成本的结构性变化与产品决策的新维度。在过去,开发者主要权衡模型能力的差异;如今,速度成为可单独定价的产品维度。对于构建实时交互型智能体(如实时代码助手、高频交易辅助系统)的团队,Ultrafast 模式提供了降低用户感知延迟的技术手段,尤其是官方建议配合 WebSocket 持久连接使用,可最大化延迟收益。然而,这种技术优势伴随着显著的财务风险。由于极速模式单价是标准模式的 6 倍,且在实际任务中,模型生成的 Token 数量并非固定,高速推理可能导致生成更长的中间过程或更多的重试,从而进一步放大费用。因此,企业在使用该功能前,必须建立严格的成本监控机制,区分“模型生成耗时”与“外部工具执行耗时”,只有当等待主要消耗在模型推理环节时,极速模式才具备经济可行性。

在订阅服务层面,这一变化对重度依赖 ChatGPT 专业版或 Pro 版的用户产生了直接的负面感知。极速模式仅限 500 美元档 Pro 用户及部分企业方案使用,且额度消耗速度飙升为 8 倍,这意味着高付费用户在单位时间内的可用工作量反而可能因“烧钱过快”而受限。对于中文市场的潜在企业用户,这也暗示了未来 AI 服务可能向“分层速度订阅”发展,即基础能力免费或低价,高级速度功能高溢价。开发者需警惕“速度陷阱”,即在缺乏真实收益场景下盲目追求模型响应速度,导致运维成本不可控。

适用边界

本结论主要基于 OpenAI 官方 API 及 ChatGPT 订阅体系,不适用于其他第三方平台或开源模型。极速模式的高性价比结论仅适用于那些对延迟极度敏感、且任务闭环时间主要由模型推理主导的场景;若任务涉及大量外部 API 调用、数据库查询或本地代码执行,极速模式的收益将被网络与硬件延迟抵消,此时选择标准模式更具成本效益。此外,关于“低价”的判断仅限于 GPT-6.1 Sol 标准模式对比 GPT-6 Astra 标准模式;一旦切换至极速模式,Sol 的价格优势相对 Astra 标准模式不成立,此时比较的是 Sol 极速 vs. Astra 极速(若存在)或 Sol 极速 vs. Sol 标准,语境完全不同。

孤本观察

此次更新反映出大模型商业化从“拼智力”向“拼时延”的微妙转变,但社区对“500 美元套餐撑不过一天”的吐槽,实则是对 AI 订阅模式从“使用量限制”向“时间-金钱兑换率”倾斜的深层焦虑。

GPT-6.1 Sol 极速版上线,价格成标准模式六倍,社区热议额度消耗与性价比

GPT-6.1 Sol 极速版上线,价格成标准模式六倍,社区热议额度消耗与性价比

GPT-6.1 Sol 极速版上线,价格成标准模式六倍,社区热议额度消耗与性价比

常见问题

GPT-6.1 Sol 极速模式的 API 输入和输出单价分别是多少?

输入单价为 12 美元/百万 Token,输出单价为 60 美元/百万 Token。

当输入超过 27.2 万 Token 时,GPT-6.1 Sol 极速模式的 API 价格如何变化?

输入价格升至 24 美元/百万 Token,输出价格升至 90 美元/百万 Token,且长上下文倍率作用于整个请求。

在 ChatGPT 订阅端,哪些用户可以使用 GPT-6.1 Sol 极速模式?

仅向 Pro 500 美元套餐及符合条件的 Enterprise、Edu 方案开放。

ChatGPT 订阅端使用 GPT-6.1 Sol 极速模式时,额度消耗速度是多少?

订阅用户的额度消耗速度为标准模式的 8 倍;额外购买 Credits 或按量付费则为 6 倍。

GPT-6.1 Sol 标准模式相比 Astra 标准模式,在相同 Token 数量下的费用优势是多少?

Sol 标准模式的输入和输出费用比 Astra 标准模式低 80%。

来源:InfoQ 中文 AI


评论