复现J-space并读取Llama模型隐藏思维
作者复现了Anthropic的J-space研究并将其迁移至Llama-3.3-70B模型,声称利用NLA技术捕捉到了模型行为中“它自己看不到”的思维痕迹。实验将概念拆分为意识与潜意识等层面,成功读出了模型隐藏在J-space里的想法,为理解大模型内部机制提供了新视角。
2026-07-10 ~ 2026-07-11 · 2 条相关
- 第 1 集:Anthropic发现Claude内部存在全局工作空间(2026-07-07,102 条)
- 第 2 集:Anthropic研究发现Claude内部隐性思维工作区(2026-07-09,4 条)
- 第 3 集:复现J-space并读取Llama模型隐藏思维(2026-07-10,2 条)
- 第 4 集:Anthropic揭示Claude内部J-space隐藏推理空间(2026-07-12,16 条)
- 第 5 集:Anthropic开源Jacobian Lens探查Claude推理(2026-07-14,3 条)
- NLA 可读出模型看不见的概念 — Pvforpres · 2026-07-10
- 复现J-space并读取模型隐念 — vikvang1 · 2026-07-11