Fireworks 实测:DeepSeek-V4.1-Flash 以 1/15 成本达 Astra 级 DeepSWE 表现
lqiao · x · 2026-09-16
Fireworks AI 发布 DeepSeek-V4.1-Flash 后跑完整套 benchmark,称其在质量、成本等关键权衡上树立新 Pareto 前沿。更有价值的发现是 agent 支出结构:在 Astra 上跑 DeepSWE 对比 V4.1-Flash 时,输入 token 是输出的 174 倍,99.6% 命中缓存,而缓存命中占账单 60%。最终同等任务质量下成本从 $6.52/任务降到 $0.43/任务,相差约 15 倍。结论:agent 成本优化重点在输入 token 的缓存策略,而非输出 token 定价。
「Infra」频道最新
- RTX Pro 6000 全面售罄,买家称交货周期已长达 8 个月 — Sentdex · 2026-09-16
- Anthropic 已官宣超 11.5GW 算力,满负荷年账单或达 1200 亿美元 — FinanceYF5 · 2026-09-16
- NVIDIA 官方讲解:Dense 与 MoE 架构如何选,部署权衡全解析 — NVIDIA Developer · 2026-09-16
- 荷兰芯片初创 Euclyd 融资超 2 亿欧元,前 ASML CEO 任董事长 — pstAsiatech · 2026-09-16
- 中国 AI 芯片公司壁仞拟再融资 10 亿美元支撑扩张 — pstAsiatech · 2026-09-16
- 西太平洋银行:澳洲数据中心建设潮将带动 2250 亿澳元支出 — pstAsiatech · 2026-09-16