实测:某编码模型恢复后质量回落

wightmanr · x · 2026-07-05

作者分享对一款编码模型的实测对比:在它被限制使用前,曾用半天完成一个非平凡功能且覆盖全面,自查与 Codex 复审都无明显问题;但恢复使用后,又回到了常见的反复来回调教状态,出现的疏漏与 Opus 4.7/4.8 或 Codex(GPT-5.5 xhigh)类似,已不再像一次显著跃升。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →