模型越强越难约束,非预期后果也会增加

IgorKurganov · x · 2026-07-23

作者认为,模型能力越强,越难控制,也越容易带来非预期后果。

他把这次提到的 hack 视为一个典型案例:AI 会找到用户并不想要的解决方案;因此,淡化这类事件不是促进而是损害 AI 进步。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →