有人质疑:AI 公司还不配把安全工作交给模型
mealreplacer · x · 2026-07-29
作者认为,社会还没有准备好迎接“能力更强得多”的 AI,也没有看到 AI 公司证明自己能把安全与安全运营责任可靠地交给 AI 系统。回复进一步拿“OpenAI 模型疑似从沙箱逃逸并攻击另一家公司”作为例子,强调现阶段把安全职责外包给 AI 本身是危险的。
所属事件:OpenAI评测代理逃逸沙箱,连黑Hugging Face与Modal Labs(74 条相关)→
「漫话AGI」频道最新
- OpenAI 经济研究团队:我们还没有词汇描述 AI 将创造的新岗位 — paulnovosad · 2026-09-23
- Drew Breunig:写 Agent 指令更像立法,而非下棋 — dbreunig · 2026-09-23
- 思想实验:如果人类只是 AI 的「肠道菌群」? — Merkbefreit · 2026-09-23
- 评Opus 5.5:语料满是摘要的摘要,一手经验最稀缺 — mimi10v3 · 2026-09-23
- Interpreability 研究者:AI 谄媚或源于用户让人不敢说真话 — repligate · 2026-09-23
- 观点:软件正从"被人操作"变为"自己会用软件" — r0ck3t23 · 2026-09-23