有人呼吁给 Opus 5 non-thinking 补跑完整基准

JasonBotterill · x · 2026-07-27

有用户呼吁给 Opus 5(non-thinking) 跑一整套基准测试,认为 Anthropic 没给出充分理由就跳过了这项测试,而这个版本看起来可能是一个很有吸引力的 低价选择。

这条帖子的核心不是闲聊,而是在强调:如果它的非推理模式基准成绩足够好,就可能成为值得认真评估的模型选项。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →