研究者批「对齐伪装」概念:LLM 并无阴险目标,角色扮演更好解释

sebkrier · x · 2026-09-12

转载的对齐研究者长评认为,AI 安全领域大量精力浪费在「欺骗性效用最大化器」这类顽固的固定观念上,而它们与 LLM 的实际运作方式毫无关系。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →