Fireworks 实测:DeepSeek-V4.1-Flash 以 1/15 成本达 Astra 级 DeepSWE 表现

lqiao · x · 2026-09-16

Fireworks AI 发布 DeepSeek-V4.1-Flash 后跑完整套 benchmark,称其在质量、成本等关键权衡上树立新 Pareto 前沿。更有价值的发现是 agent 支出结构:在 Astra 上跑 DeepSWE 对比 V4.1-Flash 时,输入 token 是输出的 174 倍,99.6% 命中缓存,而缓存命中占账单 60%。最终同等任务质量下成本从 $6.52/任务降到 $0.43/任务,相差约 15 倍。结论:agent 成本优化重点在输入 token 的缓存策略,而非输出 token 定价。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →