给大模型制造“视觉错觉”:混合隐藏层让LLM产生概念错乱

matthen2 · x · 2026-08-02

开发者通过在 Qwen2.5-7B-Instruct 模型中混合不同 token 的隐藏状态,成功为大语言模型制造了一种类似“视觉错觉”的现象。

具体技术细节:在提示词的混合位置,模型前 20 层使用一个 token 的隐藏状态,后 8 层使用另一个 token 的状态。如果模型生成其中一个混合 token,两者会被同时运行,并将 KV 缓存替换为两者的平均值。

有趣表现:这种操作会导致模型产生概念错乱。例如,混合“鸟”和“石头”,模型会脑补出一种“能自我繁殖的硬质蛋状物”;混合“罗马”和“德里”,模型会输出“印度的首都位于台伯河畔”。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →