Anthropic发现Claude内部存在类人脑「意识可及」空间J-Space
智东西 · wechat · 2026-07-07
Anthropic新论文揭示Claude内部存在名为「J空间」的神经模式集合,功能类似人类大脑的「意识可及活动」:仅小部分信息可被调取用于推理,其余运算在底层自动进行,且该机制是训练过程中自然涌现而非人为设计。研究人员通过将J空间中「蜘蛛」替换为「蚂蚁」,可直接改变Claude对腿数的回答;限制J空间后,Claude将丧失多步骤推理等高阶认知能力。J空间具备五大特性:可被Claude读取输出、可按需调整激活模式、承担内部推理主导作用、可灵活适配各类任务、且大多数基础运算不依赖J空间。谷歌DeepMind可解释性团队负责人Neel Nanda称该论文极具价值,已在Qwen3-27B上复现全部核心结论。Anthropic已开源相关代码并提供交互式演示。
所属事件:Anthropic发现Claude内部存在全局工作空间(102 条相关)→
「模型」频道最新
- OpenAI 在 GPT-Live 推出语音功能,界面却遮住搜索联动 — Graham_dePenros · 2026-07-22
- Gemini 3.6 Flash 在 Antigravity 上线,输出 token 最多减 17% — rseroter · 2026-07-22
- Moonshot 的 Kimi K3 以 156 分刷新开权重 ECI 纪录 — scaling01 · 2026-07-22
- Nanbeige4.2-3B 发布,3B Looped Transformer 反超更大模型 — Wooden-Deer-1276 · 2026-07-22
- 有人称已有 6 家公司模型超越 Google 最强 LLM — soham_btw · 2026-07-22
- Gemini 3.6 Flash 基准流出,Google 被质疑落后 — minxio_ · 2026-07-22