更多算力砸进现有 RL 方法,只会产出对日常任务改善有限的畸形模型
mertdumenci · x · 2026-09-09
mertdumenci 判断:在今天的 RL 方法上继续堆更多算力,产出的只会是越来越「spiky」(能力分布尖锐不均)的模型产物,而在我们日常真正使用模型的任务上并没有好多少。
所属事件:开发者称Opus 4.6后模型能力停滞,堆算力难解(3 条相关)→
「模型」频道最新
- AI 研究者:不给训练数据的基准测试完全毫无意义 — mjdramstead · 2026-09-09
- 1小时155M tokens只花了1.8美元,V4.1生成质量仍堪忧 — teortaxesTex · 2026-09-09
- GPT-6 对实证经济学提升有限,研究者称进入“九的行军” — soumitrashukla9 · 2026-09-09
- Raschka 深度解读 GPT-6 Astra:循环深度与隐藏思维链传闻 — Ahead of AI (Sebastian Raschka) · 2026-09-09
- 「一个好模型胜过一千个子智能体」引发架构之争 — tekbog · 2026-09-09
- 12 张 RTX 3090 跑满 285B DeepSeek-V4-Flash,解码超 120 tok/s — ciprianveg · 2026-09-09