网友猜 Claude 乱语减少因 RL 限制了 KL 散度
burny_tech · x · 2026-10-11
burnytech 提出一个关于 Claude 训练的推测:Opus 5.5 相比前代 Claude 较少出现「说不可理解语言」的现象,可能是因为在 RL 训练中收紧了 KL 散度上限(capped KL divergence)。KL 散度约束会限制策略偏离初始模型的幅度,收紧它有望抑制输出退化成不可读语言的倾向。这只是未经证实的个人猜测,但切中了 RLHF 训练中语言退化与 KL 约束关系这一技术话题。
「模型」频道最新
- 17 轮实测 Haiku 15 次输出格式崩坏,被指不敌 Luna — zeeg · 2026-10-11
- 用户反映 Astra 性能多日明显劣化,图像理解也出错 — pwlot · 2026-10-11
- 开发者放话:我要做一个好用的 9B 模型 — cephaloform · 2026-10-11
- 曝 xAI 并入 SpaceX 后更名 SpaceXSI,押注超级智能 — mark_k · 2026-10-11
- 用未发布匿名模型数小时纯代码建模three.js挂绳,效果惊艳 — karminski3 · 2026-10-11
- 研究者发论文难:让 Qwen 2.5「精神崩溃」实验无法上 arXiv — IndraVahan · 2026-10-11