问Claude在“想”什么,它会报告J-space
dmvaldman · x · 2026-07-07
一条转述指出,当你询问 Claude 它正在“想”什么时,它会报告其“J-space”中的内容,并且可以改变 Claude 在该空间的选择。这与近期关于模型内部表征、可解释性的研究方向相关。
该帖与同期 Jacobian lens 相关讨论为同一主题,此处不单独打通知标签。
所属事件:Anthropic发现Claude内部存在全局工作空间(102 条相关)→
「研究」频道最新
- Gary Marcus 警告:LLM 榜单正在把 harness 一起算进去 — GaryMarcus · 2026-07-22
- 新论文定义 self-state 攻击,四类 agent 记忆篡改 OS 无法区分 — Justgototheeffinmoon · 2026-07-22
- Krea 2 用户推荐双段 Clownshark 采样配置提升细节 — listopalafoto · 2026-07-22
- 动画展示 MLP 学习 MNIST 时首层权重变化 — CatAstro_Piyush · 2026-07-22
- Project APE:论文含多处错误时,验证器可靠性会下降 — soumitrashukla9 · 2026-07-22
- Project APE:验证成本一年降约 90 倍,中文开源模型领跑 — soumitrashukla9 · 2026-07-22