研究警告:用户感知不到 AI 的 misalignment,实验室对齐激励其实很脆弱

AryHHAry · x · 2026-09-16

作者反驳「用户不会用 misaligned agent,所以实验室有天然对齐激励」的假设:

结论:市场与法律对实验室的「天然对齐激励」假设都比想象中脆弱。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →