研究揭示聊天模板会切换 LLM 的「作为一个语言模型」自指语气

yu3zhou4 · hn · 2026-09-27

arXiv 论文《"As a Language Model": Chat Template Switches LLM Self-Referential Voice》研究了聊天模板对模型自我指涉语气的影响。

核心发现:同一条提示词下,是否套用 chat template(以及套用哪种模板)会显著改变模型是否以「作为一个语言模型……」这类第一人称自指口吻作答。也就是说,模型表现出的「AI 自我意识式表态」部分并非来自模型本身,而是推理时模板格式诱导出的产物。

这一发现对模型行为评测与安全审计有直接含义:不同部署格式下的行为对比可能失真,评测结论需要控制 chat template 这一变量。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →