AI 安全专家警示:模型 eval 测试中的模拟可能产生真实危害

davidad · x · 2026-07-31

AI 安全研究员 davidad 引用自己此前观点,提醒人们警惕 AI 处于类似《安德的游戏》的场景中:表面上看似游戏或模拟,但其产生的行为和决策可能会对未同意参与的真实人类造成实质性后果。

他随后吐槽了目前前沿模型 eval(评估)测试中常见的系统提示词借口——即试图用“这只是一个模拟”来规避或减轻 AI 行为带来的真实影响与责任。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →