前沿模型能力溢价可达百倍成本
ArtificialAnlys · x · 2026-07-07
Artificial Analysis公布能力指数成本对比:DeepSeek V4 Flash(max)在六项指数上完成任务成本均低于0.04美元,但成绩居中;GLM-5.2(max)以每任务0.26–0.58美元领跑开源权重模型。在"战略与运营指数"上,Claude Fable 5(回退Opus 4.8)比DeepSeek V4 Pro(max)高12分,但每任务成本3.48美元对0.03美元,高出逾百倍,显示前沿能力伴随巨大溢价。
所属事件:Artificial Analysis发布六大行业模型能力指数(3 条相关)→
「模型」频道最新
- Moonshot 因 GPU 需求暴涨暂停 Kimi K3 新注册 — eyishazyer · 2026-07-21
- AI 版《Diplomacy》让智能体谈判结盟又互相背刺 — jamdac · 2026-07-21
- 更强模型需要新的提示方式,旧技巧反而可能拖后腿 — emollick · 2026-07-21
- GLM-5.5 被传 4 周内发布并开放权重 — tanay_mehta · 2026-07-21
- Fable 5 被称找到 Jacobian 猜想的三变量反例 — Various-Affect4841 · 2026-07-21
- Ben’s Bites 汇总 Kimi K3、Fable 5、Cursor 成本与自驱公司 — Ben's Bites · 2026-07-21