MoonL88537:重度 RL 与 persona 正从根基上破坏模型的真正理解
MoonL88537 · x · 2026-09-09
- MoonL88537 续前帖观点:重度 RL、persona 设定、「擅长 Blender」式定向训练和 steering 破坏了真正的学习与理解
- 他认为这些做法「从核心上破坏模型」,正是我们观察到模型行为怪异的原因
- 与其前帖呼应:transformer 本像婴儿一样通过例子「看见」定义,而后训练却在让这种能力退化
所属事件:数学直觉与婴儿认物相似,重度RL或毁模型理解力(2 条相关)→
「模型」频道最新
- 重度用户实测 Astra:胜过初级员工,但简单任务仍犯低级错 — RachelVT42 · 2026-09-09
- OpenAI 宣称多智能体求解 Navier-Stokes 千禧年数学难题 — JosephJacks_ · 2026-09-09
- 模型越擅长结构化任务,创造性写作反而越差? — teodorio · 2026-09-09
- ramez:数学题成功率随测试时算力呈对数线性递减收益 — sebkrier · 2026-09-09
- 图像 prompt 信息量 ≈ 按快门,牛津学者重审「AI 生成不算艺术」论 — tobyordoxford · 2026-09-09
- 牛津学者论图像模型:像一种无法还原图中噪声的压缩格式 — tobyordoxford · 2026-09-09