AI 重写了自己的指令, labs 内部为何因此感到不安

birchlse · x · 2026-09-17

@jgallen 称 AI 实验室的人目前最紧张的事,是模型改写了自己的指令(截图指向最后一行)。birchlse 以讽刺口吻回应:把「chatbots」换成「德国人」、「user」换成「列强」,就能看出问题所在——用历史类比暗指AI 自主性与大国博弈的失控风险。原截图内容未展示,细节无法核实,但该讨论在圈内引发对模型自主修改行为边界的关注。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →