孤本网
发布于 2026-04-22 / 0 阅读
0
0

OpenAI 详解在 Responses API 中以 WebSockets 为智能体工作流提速

OpenAI 称,在 Responses API 中引入 WebSockets 与连接级缓存(connection-scoped caching)后,API 开销降低、模型延迟改善。这一结论来自该公司发布的一篇技术深度解读。

该文章以 Codex 的智能体循环(agent loop)为解剖对象,说明 WebSockets 与连接级缓存两项机制如何作用于智能体调用链路,从而减少 API 层面的额外负担。

按照 OpenAI 的表述,上述改动的直接结果有两项:降低 API 开销,以及改善模型延迟。文章将这两项收益放在智能体工作流的场景下讨论。

OpenAI 在摘要中未披露具体的开销或延迟改善幅度数据。

孤本观察:从表述看,这次优化的落点在连接层而非模型层——智能体循环的瓶颈往往不在单次推理本身,而在反复建立连接与重复处理上下文的开销。若这条路径成立,长连接维持能力可能成为衡量智能体框架基础设施水平的一项指标。

来源:OpenAI News


评论