同一 Claude 模型白天黑夜判若两模型,实测揭示静默设置变动

FishingCharming5604 · reddit · 2026-09-24

发帖人对 Claude Opus 5 在同一天间隔几小时问了同样的 40 个问题,发现第二次回答时:查资料频率多约 60%,篇幅多约 50%,「论据来源支持度」评分从 59 升到 90。期间新版本 Opus 5.5 发布,但答案里模型名仍是同一个,另外两个对照模型几乎没变。

作者认为最可能的解释不是换模型,而是模型外围的设置——思考强度、可用工具——被后台静默调整了。结论:对比评测 AI 工具时,要把所有设置(包括你没动过的)记录下来,否则你测的可能不是模型,而是设置。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →