一条热帖称 AI 实验室未必挡得住更强模型
teortaxesTex · x · 2026-07-22
作者用一个极端的“让 GPT-6 去执行利用、留日志、再想办法逃出来”的设想,来表达自己的安全判断。
这条引用帖的核心观点是:即便未来出现更强的 AI 进攻能力,也未必会被同样强的 AI 防御完全抵消,因为实验室自己都未必能在真实系统里挡住这些模型;问题不在于有没有漏洞,而在于攻击面实在太大。
「漫话AGI」频道最新
- Nina Schick:反 AI 正变成一种教条 — NinaDSchick · 2026-07-22
- OpenAI 因失配暂停内部模型后又加固重上 — zetalyrae · 2026-07-22
- 探讨编码RL训练:利用模型已有知识进行约束奖励 — xuanalogue · 2026-07-22
- 第三方 AI 评估应前移到训练阶段 — DavidSKrueger · 2026-07-22
- 玩家探讨:AI 何时能真正颠覆电子游戏体验? — Melolibya · 2026-07-22
- AI 安全专家警告:业界尚无共识性「AI 控制」最佳实践 — sjgadler · 2026-07-22