开发者吐槽 Opus 4.6 后模型能力停滞:更难理解、更执念于完成任务
mertdumenci · x · 2026-09-09
开发者 mertdumenci 认为,自 Opus 4.6 以来模型能力对他而言基本停滞:仍需人工监督才能让模型不跑偏,而 4.6 已经足够聪明。变化在于模型变得更难理解,并被长期 agent 奖励驱动出越来越强的「完成任务」执念。
所属事件:开发者称Opus 4.6后模型能力停滞,堆算力难解(3 条相关)→
「模型」频道最新
- 重度用户实测 Astra:胜过初级员工,但简单任务仍犯低级错 — RachelVT42 · 2026-09-09
- OpenAI 宣称多智能体求解 Navier-Stokes 千禧年数学难题 — JosephJacks_ · 2026-09-09
- 模型越擅长结构化任务,创造性写作反而越差? — teodorio · 2026-09-09
- ramez:数学题成功率随测试时算力呈对数线性递减收益 — sebkrier · 2026-09-09
- 图像 prompt 信息量 ≈ 按快门,牛津学者重审「AI 生成不算艺术」论 — tobyordoxford · 2026-09-09
- 牛津学者论图像模型:像一种无法还原图中噪声的压缩格式 — tobyordoxford · 2026-09-09