Anthropic被称可监测内部想法
victormustar · x · 2026-07-14
这条转发在讨论一篇关于 Anthropic 的长文:作者声称通过 J-Space / J-lens 可以观察 Claude 的内部“想法”或表征,并强调这并不等于证明模型有“灵魂”或真实主观体验。
文章还提到:
- 可以复现该思路,说明它不是纯概念炒作
- 神经科学研究者对这类结果持谨慎但积极的态度
- 但相关 ablation 结果并不能充分说明内部机理,不能据此下结论
核心意思是:这是一种观察模型内部状态的新方法,但对“意识”之类的大结论仍需非常谨慎。
所属事件:Anthropic揭示Claude内部J-space隐藏推理空间(16 条相关)→
「研究」频道最新
- LagTag 染色质记录研究正式发表,AI 助力基因史追踪 — arjunrajlab · 2026-09-03
- SIGGRAPH Asia 2026 差旅资助开放申请,9 月 18 日截止 — tomaszbednarz · 2026-09-03
- 100 个已知错误实测 AI 同行评审:最强系统抓 71 个,多模型集成达 93 个 — alejandroll10 · 2026-09-03
- EMNLP 论文:从零预训练对比发现罗马化文本跨语言迁移最优 — TuhinChakr · 2026-09-03
- HydroGym 登 Nature:60+ 环境训练 AI 控制流体力学 — ricardovinuesa · 2026-09-03
- 让 Agent 活过模型更替:新论文把持久身份与可换组件分离 — omarsar0 · 2026-09-03