Anthropic在Claude大脑里发现J空间
数字生命卡兹克 · wechat · 2026-07-07
Anthropic发表研究《A Global Workspace in Language Models》。作者用通俗方式解读:研究人员借助雅可比矩阵(Jacobian)开发的"J-lens"读心工具,在Claude的神经网络中定位到一个被称为"J-space"的结构,其功能与认知科学中解释意识的"全局神经元工作空间"理论高度相似。
关键在于,这个结构是模型自发涌现的,而非人为设计。研究发现Claude在尚未输出任何文字时,J空间里就已浮现出相关概念——比如读到带bug的代码,内部会先亮起"ERROR"。这挑战了过去"大模型只是预测下一个token的随机鹦鹉"的主流叙事。
所属事件:Anthropic发现Claude内部存在全局工作空间(102 条相关)→
「研究」频道最新
- OpenAI 认为长程模型要按完整行动序列做安全对齐检查 — rhiever · 2026-07-22
- 有人想训练一个一致性 LoRA,让动漫场景保持统一 — ThirdWorldBoy21 · 2026-07-22
- 图计算工作负载 854.graph500 进入 SPEC CPU 2026 — Prof_DavidBader · 2026-07-22
- BlackboxNLP 2026 因投稿激增招募额外审稿人 — hanjie_chen · 2026-07-22
- AWS 证明自蒸馏推理可在 SFT 中保住推理能力 — AWS ML Blog · 2026-07-22
- UI2App 显示截图还原远落后于真实交互恢复 — Grace Man Chen · 2026-07-22