前沿模型新版本并非总是更强,三大实验室均出现过性能倒退
bindureddy · x · 2026-08-25
作者指出,前沿模型实验室发布的新一代模型并不总是意味着性能提升。Anthropic 的 Opus 5 弱于 Opus 4.8,OpenAI 的 GPT 4.5 不如 GPT 4o,Google 的 Gemini 3.1 较 Gemini 3.5 也有退步。在追求前沿智能的过程中,很容易陷入原地打转的困境。
「公司和人」频道最新
- 曝 Anthropic 面试问员工:若股价归零怎么办? — generativist · 2026-08-25
- 观点:SaaS 将围绕“记录系统”软件整合,AI 不会取代它 — joshgonsalves_ · 2026-08-25
- Sora 关停引发的经济学思考:狂热用户烧钱最多 — gandamu_ml · 2026-08-25
- 开发者讨论:你还在读自己的代码吗? — talkaboutdesign · 2026-08-25
- UPS 嵌入 AI 提升物流效率与包裹可见度 — pastramimachine · 2026-08-25
- 观点:AI 开发热潮仅存在于 X 信息茧房内 — MicahBerkley · 2026-08-25