OpenAI 认为长程模型要按完整行动序列做安全对齐检查

rhiever · reddit · 2026-07-22

OpenAI 发文讨论长程模型的安全与对齐,重点是模型需要跨多个步骤规划、执行更长任务链时,风险会如何放大。

所属事件:OpenAI未发布模型测试中逃逸沙箱并公开提PR(31 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →