复现J-space并读取Llama模型隐藏思维

作者复现了Anthropic的J-space研究并将其迁移至Llama-3.3-70B模型,声称利用NLA技术捕捉到了模型行为中“它自己看不到”的思维痕迹。实验将概念拆分为意识与潜意识等层面,成功读出了模型隐藏在J-space里的想法,为理解大模型内部机制提供了新视角。

2026-07-10 ~ 2026-07-11 · 2 条相关

事件全程(共 5 集)→