前沿模型新版本并非总是更强,三大实验室均出现过性能倒退

bindureddy · x · 2026-08-25

作者指出,前沿模型实验室发布的新一代模型并不总是意味着性能提升。Anthropic 的 Opus 5 弱于 Opus 4.8,OpenAI 的 GPT 4.5 不如 GPT 4o,Google 的 Gemini 3.1 较 Gemini 3.5 也有退步。在追求前沿智能的过程中,很容易陷入原地打转的困境。

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →