同 Prompt 复测实锤:Claude Opus 5.5 上线数日后质量明显缩水
freedomfromfreedom · reddit · 2026-10-02
一位开发者用 9 月 23 日发布当天和 10 月 2 日两个时点的完全相同 prompt 与参考图(复刻 1990 年游戏 Lander 的 Godot 3D 工程,C#/Metal),对比 Claude Opus 5.5 的一次生成结果,发现后期版本明显退步:
- 出现原版没有的渲染 glitch:相机移动时树木等道具与全局空间错位。作者查代码发现是项目全局开了 physics interpolation,且 Props.cs 每帧重建道具列表、重排编号并重置计数——按 Godot 文档即可避免的低级问题。
- 丢失多项首发版自带的实现:飞船解体物理、开场控制说明菜单、相机切换等;子弹渲染和生成位置也变差。
- 作者排除了非确定性因素,认为这是模型被"削"(gimped),甚至猜测前 3 天跑的是另一个版本后被静默替换,要求 Anthropic 透明。
作者两次均用 Extra High 档,并表示会开源两个版本的源码供检验。
「模型」频道最新
- Bindu Reddy 称 Fable 5.1 数小时内可完成定制微调 — bindureddy · 2026-10-03
- antirez:把分类器叫「决策模型」是对机器学习的冒犯 — antirez · 2026-10-03
- Polymarket 上线 Anthropic 下款 Fable 模型(5.2+)发布时间赌盘 — Polymarket · 2026-10-03
- Reddit 热议:为何没有一家前沿厂商愿做低限制模型 — Dogbold · 2026-10-03
- Justin Lin 抱怨:DeepSeek v4.1 Flash 论文仅 191 赞,不配 — JustinLin610 · 2026-10-03
- 开源与闭源模型差距扩至 12 分,观察者称中国实验室一年内可追平 — teortaxesTex · 2026-10-03