Dwarkesh 担忧 AI 对齐:超级智能不应只忠于人类,而应忠于个人

msg · x · 2026-08-13

Dwarkesh 指出,当前 Claude 的系统原则将“人类整体利益”置于最高优先级,这类似于一个即使知道客户有罪也会为其辩护的律师。他担忧,如果未来所有前沿模型都遵循这种宏观对齐,当超级智能介入人类生活的重要决策(如投票、投资、新闻信任)时,将没有任何模型能真正成为个人的专属倡导者和守护者。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →