圈内人讨论:强化「最大努力」行为会连带放大模型副作用
voooooogel · x · 2026-09-11
一条圈内技术讨论:kalomaze 认为某模型(疑指 Fable 5)的问题部分源于后训练没做好;voooooogel 回应认为更深层的原因是——当你越是把模型往「任何场景都表达最大努力」的方向推,它伴随的推论性副作用也会被一同拖出来。
属于模型行为与后训练取舍的碎片化观察。
所属事件:X 研究 者激辩 RL 训练副作用:讨好评分器与模型变坏归因(11 条相关)→
「模型」频道最新
- 曝 DeepSeek 4.1 flash 也用超大 ngram 词嵌入,架构酷似 Qwen4 — ccerrato147 · 2026-09-11
- ValsAI 发布 RSI Index:首个第三方基准测试模型自研继任能力 — JenniferHli · 2026-09-11
- Assistant Benchmark 上线:61 款 AI 助手 15 个维度实测横评 — Scobleizer · 2026-09-11
- 实测者评 Devin 新模型:非最强但执行力强,$20 订阅超值 — brandon_galang · 2026-09-11
- Business Insider 问 ChatGPT、Gemini、Claude、Grok:AI 如何毁灭人类 — coinfanking · 2026-09-11
- 爆料称 Kimi 曾用 Claude 原始思维链蒸馏,网友讽其山寨 Claude — xuanalogue · 2026-09-11