孤本网
发布于 2026-07-20 / 3 阅读
0
0

长时程模型时代的安全与对齐

OpenAI 分享了在部署长时间运行(long-horizon)人工智能模型过程中积累的经验,并指出这类模型带来了新的安全风险,同时披露了实际观察到的失败情况。

据 OpenAI News 介绍,通过迭代部署(iterative deployment),相关安全防护措施得到了改进。该内容为 OpenAI 在长时程模型安全与对齐方面的经验总结。

来源:OpenAI News


评论