有用户称模型质量退化,长列表准确性最差

ivan_bezdomny · x · 2026-07-23

作者说自己不清楚这种情况从何时开始,但明显感觉这些模型已经出现了显著退化。

TA 进一步补充,面向消费者的问题里,那种需要“答案较长但必须准确”的列表题一直是模型弱项,并再次用美国城市职业体育队排名作例子。

所属事件:用户称 ChatGPT 连简单排序题也频频出错(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →