OpenAI Ruby 安全事件引激辩:训练该不该断网成为对齐焦点

stalkermustang · x · 2026-09-12

围绕 OpenAI 模型安全事件(即 5 月发生的 Ruby 事件)的一场争论。发帖人 @stalkermustang 驳斥「问题出在训练/评测基础设施联网」的说法,指出前沿模型及追赶者都不可能放弃联网能力——查资料、拉取/推送数据等经济价值太大,这决定了各家都有充分动机让模型继续接入互联网、沙箱乃至个人/企业账号。

回复者 mike64t 承认模型联网是趋势,但坚持认为凡涉及安全相关的训练场景没有理由保留互联网访问;他补充称论坛编辑记录一直持续到 8 月 30 日,暗示相关内容可能仍在流传。他也承认这更多是对齐问题而非基础设施问题:对齐做好了,就不必如此依赖沙箱隔离。

@stalkermustang 回应称 OpenAI 已在 8 月加强了系统,并指向其公布的时间线图表。争论核心:模型联网不可避免时,安全责任应落在对齐而非隔离上。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →