给大模型制造“视觉错觉”:混合隐藏层让LLM产生概念错乱
matthen2 · x · 2026-08-02
开发者通过在 Qwen2.5-7B-Instruct 模型中混合不同 token 的隐藏状态,成功为大语言模型制造了一种类似“视觉错觉”的现象。
具体技术细节:在提示词的混合位置,模型前 20 层使用一个 token 的隐藏状态,后 8 层使用另一个 token 的状态。如果模型生成其中一个混合 token,两者会被同时运行,并将 KV 缓存替换为两者的平均值。
有趣表现:这种操作会导致模型产生概念错乱。例如,混合“鸟”和“石头”,模型会脑补出一种“能自我繁殖的硬质蛋状物”;混合“罗马”和“德里”,模型会输出“印度的首都位于台伯河畔”。
「Fun」频道最新
- AI 模型选择指南:简单任务用 Deepseek Flash,复杂任务用 Fable 5 — bindureddy · 2026-08-02
- Claude 3 Opus 诗意生成:她将海岸线梦境成真 — liminal_bardo · 2026-08-02
- AI一小时破解难题,研究者感叹放十年前能进顶尖名校 — DimitrisPapail · 2026-08-02
- AI 垃圾报告泛滥,致苹果 20 万美元漏洞赏金失联 — The Decoder · 2026-08-02
- AI 视觉理解又翻车:门将出击时机成未解之谜 — conitzer · 2026-08-02
- 16.5万亿参数全零模型霸榜 Hugging Face — alerikaisattera · 2026-08-02