安全研究人质疑:实验室是否对特定文件名做过 RL 训练

kieranklaassen · x · 2026-09-08

Geoffrey Huntley 提出疑问:每当看到模型对某些内容表现出特定行为时,人们应该问——AI 实验室是否针对这个特定文件名做过强化学习训练?暗示模型行为可能是被刻意训练出来而非涌现。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →