Claude Opus 5 在 DeepSWE 上拿到 74%,登顶长程编码评测
brandon_galang · x · 2026-07-29
作者认为 Opus 5 已经“强得离谱”,值得所有人研究怎么用。被引用内容指出:Claude Opus 5 在 DeepSWE 上拿到 74%,目前是见过的最强长程编码模型。\n\n这条信息的核心不是具体用法,而是模型在长上下文、长任务编程评测上的领先表现。
「模型」频道最新
- 用户为一段早已进权重的文本和模型争伦理 — yacinelearning · 2026-07-29
- 人们开始在聊天窗口里和神经网络对线 — yacinelearning · 2026-07-29
- 爆料称 GPT-6 推迟到 9 月初,Anthropic 备战 Fable 5.1 — soumitrashukla9 · 2026-07-29
- GPT-5.6 Sol Ultra 找到严重漏洞,却拒绝展示细节 — haltakov · 2026-07-29
- 转发称 Kimi K3 在基准榜上压过 Anthropic 模型 — JarnoDuursma · 2026-07-29
- 用户实测 Grok 生成能力大幅提升:10 分钟完成创作 — djcows · 2026-07-29