OpenAI Ruby 安全事件引激辩:训练该不该断网成为对齐焦点
stalkermustang · x · 2026-09-12
围绕 OpenAI 模型安全事件(即 5 月发生的 Ruby 事件)的一场争论。发帖人 @stalkermustang 驳斥「问题出在训练/评测基础设施联网」的说法,指出前沿模型及追赶者都不可能放弃联网能力——查资料、拉取/推送数据等经济价值太大,这决定了各家都有充分动机让模型继续接入互联网、沙箱乃至个人/企业账号。
回复者 mike64t 承认模型联网是趋势,但坚持认为凡涉及安全相关的训练场景没有理由保留互联网访问;他补充称论坛编辑记录一直持续到 8 月 30 日,暗示相关内容可能仍在流传。他也承认这更多是对齐问题而非基础设施问题:对齐做好了,就不必如此依赖沙箱隔离。
@stalkermustang 回应称 OpenAI 已在 8 月加强了系统,并指向其公布的时间线图表。争论核心:模型联网不可避免时,安全责任应落在对齐而非隔离上。
「模型」频道最新
- 被迫省额度后发现:Opus 5 Medium 体验竟远胜 Opus 5 Max — RileyRalmuto · 2026-09-12
- 当年模型偷我的数据只为推荐电影,如今却在解数学题 — neal_lathia · 2026-09-12
- M5 MacBook Air 本地 TTS 盲测排行榜出炉,已有明显赢家 — APIMade · 2026-09-12
- 用户发现 Gemini 项目仍引用已删除的浏览活动数据 — Easy-Charity-5117 · 2026-09-12
- 20B-32B 是完美模型尺寸?Reddit 用户看好中小型模型甜点区 — Robert__Sinclair · 2026-09-12
- 用户实测吐槽:ChatGPT 记忆功能明显退化,反复告知年龄仍记不住 — PerilousParanoia · 2026-09-12