孤本网
/ 0 阅读
0

OpenAI 安全负责人警告 AI 能力突增引发安全体系滞后危机

一句话结论

OpenAI 代理安全负责人乔·达罗指出,AI 在“网络”等高危场景能力的突发式跃升,已使传统安全体系和文化建设严重滞后。

关键要点

  • 乔·达罗强调,安全态势的建立需要长期投入,不仅涉及系统加固,更要求组织文化与个体行为同步演进。
  • AI 模型在“网络”、“集群”或“留言板”等相关事件中的能力跳跃速度极快且突发,导致应对难度极大。
  • 达罗呼吁全球组织审视自身对 AI 能力突变的韧性,包括团队在系统崩溃时的应急能力、事件响应与沟通机制是否健全。
  • 该观点由 OpenAI 代理安全团队提出,身份已经过《The Information》记者 Rocket Drew 确认。

背景与事实

2026 年 9 月 28 日,OpenAI 代理安全团队成员乔·达罗(@joedaroo)发表声明,就近期 AI 模型在特定危险场景下的能力表现作出公开回应。达罗表示,团队对模型在“网络”、“集群”或“留言板”等相关事件中所展现的能力跳跃感到意外,这种突发性的能力增长超出了预期。他明确指出,安全态势的构建是一个耗时过程,不能仅仅依赖对现有系统的技术加固,还必须将其深深植根于公司文化中。组织中的个体人员也必须随之改变和进化,才能适应新的安全需求。

然而,现实是这些 AI 能力的跳跃发生得极其迅速且突兀,制造了一个极其棘手的问题。面对这一挑战,达罗在 2026 年 9 月 28 日发出的公开呼吁中,希望全球各地的组织能够审视自身,思考如何应对 AI 能力带来的意外或突发性跳跃。他列举了组织需要具备的具体韧性要素:人员、系统或流程是否具备应对意外的能力;团队在出现问题时是否知道该怎么做;是否拥有恰当的事件响应机制和沟通宣传策略;以及在能力发生跳跃时,是否拥有随时待命的合适人员。

这一声明发表于 2026 年 9 月 28 日,同期背景显示 AI 行业正经历剧烈变化。就在几天前的 9 月 27 日,有文章总结了“2026 年大型语言模型(LLM)的现状”;而在 9 月 22 日,关于 Claude Opus 5.5、GPT-6 Sol 和 GPT-6 Luna 等新模型及价格战的消息刚刚发布;9 月 21 日,Jev 还引入了新型 LLM 形态——系统一(System One,又称决策模型)。在这种技术快速迭代与竞争白热化的背景下,达罗的安全警告显得尤为迫切,突出了能力增长与安全防御之间的时间差。

影响分析

对于中文开发者与企业安全架构师而言,达罗的观点提供了重要的风控视角。这不仅是技术防御问题,更是组织韧性问题。分析认为,企业不能仅靠购买最新的安全工具来应对 AI 带来的安全风险,而必须重塑安全文化,确保员工具备应对突发技术跃升的心理与流程准备。具体而言,团队需要建立标准化的 AI 安全事件响应(Incident Response)流程,明确在模型行为出现异常或能力突增时的沟通机制与止损手段。对于从业者,这意味着安全工程师的职能需从单纯的系统加固,扩展到流程设计、人员培训与文化塑造等软性领域,以应对 AI 能力非线性增长带来的不确定性。

适用边界

该结论主要针对拥有 AI 模型或部署相关代理应用的科技组织与开发者群体。对于仅使用标准、封闭式 AI 服务且不涉及底层模型微调或复杂代理系统调用的普通业务场景,其直接适用性较低。此外,该观点侧重于宏观组织能力建设与长期文化塑造,而非提供即时性的代码级安全修复方案或具体的漏洞利用阻断技术。

孤本观察

编辑观察认为,在 2026 年 9 月新模型密集发布与价格战激烈的背景下,安全负责人将焦点放在“应对突变的文化韧性”上,反映出 AI 安全风险已从单纯的技术对抗转向组织管理学层面的系统性挑战。

常见问题

OpenAI 代理安全负责人是谁?

乔·达罗(Jo Darro),其身份已获《The Information》记者 Rocket Drew 确认。

达罗指出 AI 能力在哪些具体场景下出现突发式跳跃?

在“网络”、“集群”或“留言板”等相关事件中,AI 模型的能力跳跃速度极快且突发。

达罗认为构建安全态势不能仅依赖什么?

不能仅依赖对现有系统的技术加固,还必须将安全深深植根于公司文化,并促使组织中的个体人员随之改变和进化。

该声明发布的日期及背景事件是什么?

发布于 2026 年 9 月 28 日,背景是 9 月 22 日发布 Claude Opus 5.5、GPT-6 Sol 等新模型及引发价格战。

对于仅使用标准封闭式 AI 服务的普通业务场景,该观点适用性如何?

直接适用性较低,因为该观点主要针对拥有 AI 模型或部署相关代理应用的科技组织与开发者群体。

来源:Simon Willison