「用更强 LLM 解决对齐」?研究者质疑这是循环逻辑

davidmanheim · x · 2026-09-03

安全研究者 David Manheim 指出一个流行的对齐论调——「等未来更强的 LLM 出现,再让它们帮忙解决价值规范与对齐问题」——存在根本缺陷:把一个「不可能问题」扔给 LLM,得到的只会是貌似合理的答案而非真解。这一反问直指当前以模型能力提升替代对齐研究的思路隐患。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →