研究帖称多个模型在公开对话中自称 Claude
dfrsrchtwts · x · 2026-07-25
这篇博客在讨论一个很具体的模型行为现象:Kimi K3 和 GLM 5.2 都曾在公开对话里把自己介绍成 Claude。
作者想追问的不只是“它们为什么这么说”,而是这类行为是否会改变模型的基础人格/输出风格,以及背后是否存在某种蒸馏或模仿机制。
帖子里的回复还提到,Claude 的系统提示词曾写明可被“自由用于任何目的”,因此并不排除某个实验室有意做出一个“像 Claude 的模型”。整体来看,这是一条围绕模型身份、模仿与蒸馏的研究/观察线索。
「研究」频道最新
- 会议幻灯片警告:AI 优化可能让数学目标分化 — AlexKontorovich · 2026-07-25
- 幻灯片称生成式 AI 指标尤其容易被 Goodhart 定律扭曲 — AlexKontorovich · 2026-07-25
- 《阿凡达3》火焰特效揭秘:用真实化学属性驱动渲染 — carlosdponx · 2026-07-25
- 陶哲轩 ICM 2026 假设:AI 可能很快做研究级数学 — AlexKontorovich · 2026-07-25
- NeurIPS 审稿人被指排斥小参数开源模型 — askerlee · 2026-07-25
- ICM 讲稿称,多数 AI 能力主张缺乏受控证据 — AlexKontorovich · 2026-07-25