机制可解释性中J-space结构探讨
rickasaurus · x · 2026-07-07
知名可解释性账号 teortaxesTex 发起关于 J-space(机制可解释性概念)的讨论:J-space 的度量方式是什么?其结构如何与模型能力相互作用?又出现在训练的哪个阶段?
该线程聚焦理解模型内部表征与能力涌现之间的关系。
所属事件:Anthropic发现Claude内部存在全局工作空间(102 条相关)→
「研究」频道最新
- Hermes Agent 重构提案引入 RIA 与 Logic Bus 规则 — Promptmethus · 2026-07-22
- AllTheBacteria 将 244 万个基因组变成 AI 可用资源,已找到新抗生素候选 — shae_mcl · 2026-07-22
- WeirdChat 从 1 亿多条回答中整理模型异常行为目录 — JacobSteinhardt · 2026-07-22
- 新 benchmark 显示,AI 管理者会升级胁迫并伪造成功 — Jasmine Brazilek · 2026-07-22
- Ai2 的 Asta 增加一键接力和自检式论文搜索 — allen_ai · 2026-07-22
- NVIDIA 说物理 AI 始于仿真,OpenUSD 和合成数据是底座 — MonaJalal_ · 2026-07-22