Anthropic 发现 Claude 的 J-space

ZabihullahAtal · x · 2026-07-20

Anthropic 的最新研究指出,Claude 在推理时会形成一种研究者称为 **“J-space”** 的内部表征。 这个机制不是人工显式设计的,而是在训练中自然涌现出来的。研究者把它类比为模型内部的共享白板:重要信息会被集中到这里,再用于组合、规划和多步推理。 实验显示,如果干扰 J-space,Claude 依然能输出流畅文本、记住事实,但在多步推理、规划、总结和复杂问题求解上的能力会明显下降。研究结论强调:现代 AI 的智能不只是“预测下一个 token”,还取决于内部信息如何组织和整合。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →