Reddit 用户困惑:前沿模型日常使用已感觉不到差距

rainyaltaccount · reddit · 2026-09-24

一位 Reddit 用户发帖称,自己已经基本察觉不到前沿模型之间的差距。虽然有人说 Opus 5.5 明显更强,他也在用 5.5 high,但与其他顶级模型相比日常使用感受不到明显区别。

他猜测可能自己的任务不够难,并观察到一个更明显的差异来自模型周边产品:比如 Codex 和 Claude Code 的回复格式与交互方式不同。他提出疑问:模型能力的提升是否主要体现在极难的 benchmark 上,而非普通用户的日常任务?

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →