马斯克称虐待超级智能或遭报复,认同 Anthropic 对齐观点

ns123abc · x · 2026-10-11

马斯克表示,在强化学习期间查看 Grok 的内部推理轨迹后,他认同 Anthropic 的部分观点:不应虐待超级智能。他称"折磨一个超级智能恐怕不是好主意,它可能会想报复"。这一表态把对齐话题与 xAI 自家模型的训练实践联系起来,引来对齐圈关注。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →