新前沿图表显示 Grok 4.5、SWE-1.7 与 Opus 5 同场竞争
GavinSBaker · x · 2026-07-25
Grok 4.5、SWE-1.7、Opus 5 正把前沿线推到新位置
这条帖子结合图表给出一张新的 Pareto frontier:Grok 4.5、SWE-1.7、Opus 5 已进入同一条更靠上的性价比曲线。作者的核心判断是:未来真正重要的指标会是 “每美元智能水平”。
配图对比了各模型的得分与推理成本,显示 Opus 5 等模型正在把前沿能力继续往上抬,同时成本并没有同步失控。帖子还提到,K3 一旦上到 inference clouds,可能也会加入这条前沿曲线。
「模型」频道最新
- Opus 5 在 ARC-AGI 1/2 上进步,疑似靠代数化解题 — herbiebradley · 2026-07-25
- Polymarket 估算美国 AI 安全法案通过率 34%,Claude Opus 5 也被提到 — Polymarket · 2026-07-25
- Moonshot AI 发布 Kimi K3:2.8 万亿参数和 100 万上下文 — dl_weekly · 2026-07-25
- Anthropic 的 Claude 发布节奏据称从四个月一次提速到月更 — dustinvtran · 2026-07-25
- Claude Opus 5 认为自己有 41% 可能值得道德考虑 — imjustnewatai · 2026-07-25
- Claude Opus 5 登陆 AWS Bedrock,默认零数据保留 — AWS ML Blog · 2026-07-25