Burkov 用分类器维护经验类比:RL 修好一处,别处就崩
burkov · x · 2026-09-12
Andriy Burkov 借自己当年回答老板「分类器什么时候能好」的经验,评论 RLHF 的打地鼠困境:补好一个问题,另一个就冒出来。他预测对模型做强化学习能换来更长回复,但会在别处开始翻车。
「模型」频道最新
- Arcee 开源 NAC 长任务 agent 框架,实测 DeepSeek 模型 489 次工具调用 — MaziyarPanahi · 2026-09-12
- 蚂蚁 Ling-3.0-flash-VL 评测:5.5B 激活参数上帕累托前沿,幻觉率仅 22% — ArtificialAnlys · 2026-09-12
- 中国开源模型竞争太强,AI 实验室难以像 Uber 那样靠涨价回血 — firasd · 2026-09-12
- 前沿大厂隐私条款暗藏陷阱:点个赞你的对话就可能不被保护 — niloofar_mire · 2026-09-12
- Reddit 网友猜 Astra 隐藏思维链是为防蒸馏而非改进模型 — bfkill · 2026-09-12
- Cursor 推出 CursorBench 4.0,有人据此猜测 Gemini 3.8 后训练路线不同 — ivan_bezdomny · 2026-09-12