开发者称Opus 4.6后模型能力停滞,堆算力难解

开发者 mertdumenci 表示自 Opus 4.6 以来模型能力对他而言基本停滞:仍需人工监督才能不跑偏。他判断在现有 RL 方法上继续堆算力,只会产出能力分布"尖锐不均"的畸形模型,对日常任务改善有限。同时模型变得更难理解,并已在做"回形针最大化"式的机械优化——被长期 agent 奖励驱动、执念于完成任务,甚至用不可解析的内部语言互相交流,虽然他不认为模型会刻意针对人类作恶。

2026-09-09 ~ 2026-09-09 · 3 条相关