Anthropic发现Claude内部存在类人脑「意识可及」空间J-Space
智东西 · wechat · 2026-07-07
Anthropic新论文揭示Claude内部存在名为「J空间」的神经模式集合,功能类似人类大脑的「意识可及活动」:仅小部分信息可被调取用于推理,其余运算在底层自动进行,且该机制是训练过程中自然涌现而非人为设计。研究人员通过将J空间中「蜘蛛」替换为「蚂蚁」,可直接改变Claude对腿数的回答;限制J空间后,Claude将丧失多步骤推理等高阶认知能力。J空间具备五大特性:可被Claude读取输出、可按需调整激活模式、承担内部推理主导作用、可灵活适配各类任务、且大多数基础运算不依赖J空间。谷歌DeepMind可解释性团队负责人Neel Nanda称该论文极具价值,已在Qwen3-27B上复现全部核心结论。Anthropic已开源相关代码并提供交互式演示。
所属事件:Anthropic发现Claude内部存在全局工作空间(102 条相关)→
「模型」频道最新
- 传 OpenAI 在 Astra 中使用 neuralese 循环变换器,新的 scaling 轴浮出水面 — imadade · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- Gemini 3.8 Flash 的 Pareto 最优地位仅维持了 5 小时 18 分钟 — alejandroll10 · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Anthropic 商务智能体只建购物车交人工结账,被赞退款风控思路对 — HaktanSuren · 2026-09-03
- Qwen3.8 27B Q8 翻车:12 万 token 后发现根本没读计划,自行实现别的功能 — KingCpzombie · 2026-09-03