用SAE拆解LLM角色扮演:模型内部存在「沉浸模拟模式」特征

sebkrier · x · 2026-09-13

一项新研究用稀疏自编码器(SAE)特征作为组件,在 Gemma 和 Llama 上考察 LLM 从默认 Assistant 切换到角色扮演人设或故事角色时内部发生了什么。两个发现:

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →