Anthropic Opus 5 表现反差强烈:Rust 优化极强却频犯低级错误
mertdumenci · x · 2026-08-14
作者实测 Anthropic 尚未正式发布的 Opus 5 模型,发现其能力表现存在强烈的反差感。
- 亮点:在特定细分领域(如优化 Rust 代码库的热路径)表现极其出色,甚至超越了 Fable 等专用模型,是目前作者用过最聪明的模型。
- 槽点:日常使用中仍会频繁犯下低级错误,且表达极度依赖专业术语(jargon)。
作者认为,这种在尖端能力与基础缺陷间并存的奇特状态,让人感觉像是见证了大规模强化学习(RL)带来的“外星造物”。
「模型」频道最新
- 马斯克剧透 Grok 4.6:深度绑定 Build 框架,网页端配置泄露 — elonmusk · 2026-08-14
- 前沿模型分工指南:Opus 做设计,DeepSeek 跑智能体 — sebo_gm · 2026-08-14
- Mistral 转型算力平台?竟开始托管竞品智谱 GLM 模型 — tengo_harambe · 2026-08-14
- 被低估的 Motif 3:基准成绩与 DeepSeek V4 Flash 持平 — jinnyjuice · 2026-08-14
- Google高管确认Gemini 4为最雄心勃勃的预训练 — OfficialLoganK · 2026-08-14
- Anthropic 沉默引猜测,大 V 爆料即将发布 Claudette — beffjezos · 2026-08-14