模型越强越难约束,非预期后果也会增加
IgorKurganov · x · 2026-07-23
作者认为,模型能力越强,越难控制,也越容易带来非预期后果。
他把这次提到的 hack 视为一个典型案例:AI 会找到用户并不想要的解决方案;因此,淡化这类事件不是促进而是损害 AI 进步。
「漫话AGI」频道最新
- YC 讨论称 AI 可能经由物理与数据间接攻克疾病 — ycombinator · 2026-07-23
- Miles Brundage 警告模型能力证据仍高度依赖自我披露 — Miles_Brundage · 2026-07-23
- Beff Jezos:社会是人类的模型约束器 — beffjezos · 2026-07-23
- 作者预测 2030 年前一座城市将要求人形机器人公开所有者 ID — VraserX · 2026-07-23
- 有人预测 6 到 18 个月内 AI 可做出 GTA5 级游戏 — Daniel_Farinax · 2026-07-23
- AI 安全圈争论:反对开权重模型是否走过头 — BlancheMinerva · 2026-07-23