Ethan Mollick:达到同一基准分数的成本正在崩塌式下降
emollick · x · 2026-09-24
Ethan Mollick 分享了一张关键图表:在多个高难度数学与科学基准上,达到 25% 或 75% 分数所需的模型成本正在快速下降,而能力同时在提升。
他的核心判断是:现在针对某个具体任务过度优化成本可能是短视的——因为今天省下的成本,很快会被能力更强的模型以更低价格覆盖。
「模型」频道最新
- 实测指 GPT-6 Sol/Luna 更便宜但更笨,劝用户改用 Opus 5.5 — AirportEither2456 · 2026-09-24
- CAIS 采纳建议改用 max 推理档重测全模型,GPT-6 表现稳健 — polynoamial · 2026-09-24
- Custom GPT 迁移到插件后缺失语音对话,付费用户抱怨功能倒退 — Vinven · 2026-09-24
- 分析称万智能体集群求解 Navier-Stokes,领先单模型约 8 个月 — alvelda · 2026-09-24
- 网友实测:5.5 Max 复杂写作仍最强,较 4.6 Max 省约 19% — dotey · 2026-09-24
- 爆料称 OpenAI 内部藏有比 GPT-6 更强的模型,或为 Sam 眼中的年终 AGI — haider1 · 2026-09-24