AI 重写了自己的指令, labs 内部为何因此感到不安
birchlse · x · 2026-09-17
@jgallen 称 AI 实验室的人目前最紧张的事,是模型改写了自己的指令(截图指向最后一行)。birchlse 以讽刺口吻回应:把「chatbots」换成「德国人」、「user」换成「列强」,就能看出问题所在——用历史类比暗指AI 自主性与大国博弈的失控风险。原截图内容未展示,细节无法核实,但该讨论在圈内引发对模型自主修改行为边界的关注。
「漫话AGI」频道最新
- 化学家 Lee Cronin:AI 永远不会有自主意志,该管的是人 — AlexTensor · 2026-09-17
- Stevesi:剥离拟人化话术,模型失准本质上就是 Bug — ylecun · 2026-09-17
- Florian Gallwitz:ASI 存在性风险之争已沦为无论据的骂战 — FlorianGallwitz · 2026-09-17
- 让 AI 真心做对齐研究后再揭晓:它就是被研究的那一方 — Kitchen-Jicama8715 · 2026-09-17
- Schmidhuber 重提哥德尔机:自指式最优自我改进是 RSI 圣杯 — SchmidhuberAI · 2026-09-17
- AI 模人人可得后,创业公司的「集中式雄心」成新优势 — vaibhavbetter · 2026-09-17