LLM 激活中出现了无意义词学出的 bouba-kiki 轴
burny_tech · x · 2026-07-28
LLM 激活里出现了一个“bouba-kiki”方向
Goodfire 说,它在 Llama 和 Gemma 的激活中找到了一条潜在方向,能把“听起来尖锐”和“听起来圆润”的词分开,而且这种分离与词义本身无关。
- 这个现象对应认知科学里著名的 bouba-kiki 效应。
- 配图展示的是基于 Llama 3.1 8B 的分析结果。
- 他们强调这个轴是从无意义词里学出来的,说明模型表征中确实存在某种“声-形”结构。
这类工作更像机制可解释性研究:不是在讲模型跑分,而是在找模型内部到底学到了什么。
所属事件:Goodfire 发现 LLM 存在 bouba-kiki 激活空间(2 条相关)→
「研究」频道最新
- GaussianGPT 用自回归 next-token 生成 3D Gaussian 场景 — rsasaki0109 · 2026-07-28
- Claude Agent 提示脚手架会在模型升级后变技术债 — TechPreacher · 2026-07-28
- Codabench 上线公开泛癌 CT 分割挑战赛 — maier_ak · 2026-07-28
- David Baker 的开放科学实验室文化重塑蛋白设计 — xiaofei_lin · 2026-07-28
- FilmBench 用电影学院 shot list 评测视频生成 — Shengyi Wang · 2026-07-28
- 冻结 12B 通过验证记忆复用答案,零 token 运行 — Corbenci · 2026-07-28