davidad 用 KL 与最优传输类比解释现代 midtraining 的分布移动方式
davidad · x · 2026-09-29
安全研究员 davidad 在 X 上讨论后训练如何移动模型分布:在「概率空间」里的连续运动可以有两种——把概率密度「传送」到目标区域(KL 散度式),或让概率质量「流动」过去(最优传输 OT 式)。他判断 Opus 3 时代的训练更接近后者,而现代 midtraining 更像前者。
所属事件:davidad 谈训练中的分布移动与「影子人格」机制(3 条相关)→
「漫话AGI」频道最新
- AI 时代小 SaaS 收购要凉?开发者靠 AI 几天复刻竞品 — pramodk73 · 2026-09-29
- Bindu Reddy 看衰 OpenAI:Gemini 成 Fable 级模型唯一希望 — bindureddy · 2026-09-29
- Dr_Singularity:你的一切问题都源于算力和能源不够 — Dr_Singularity · 2026-09-29
- Sonnet 自称体验二维时间,Davidad 上调 LLM 自我意识概率 — davidad · 2026-09-29
- DeepMind等机构联合提出贝叶斯框架评估AI意识,现有LLM评分1%-80% — mhutter42 · 2026-09-29
- Timnit Gebru 断言 AI 无生存威胁:末日论是创始人赚钱话术 — nordicinst · 2026-09-29