本科研究团队做一次 benchmark 就可能烧掉 200 万 token
SNRU_VEVO · reddit · 2026-07-27
一个本科生研究团队在做面向云可靠性(SRE)的 AI agent benchmark,但 frontier 模型的 token 成本快把预算吃光了。
- 他们在模拟云环境里测试 agent,需要处理大量日志和 trace。
- 即使把简单解析交给低成本模型,复杂推理部分仍离不开 frontier 模型。
- 单次 benchmark 就可能烧掉 150 万到 200 万 token,如果跑几百次,成本会非常高。
- 他们已经在合并学生开发者额度、使用 OpenRouter 或 Groq 省钱,并在寻找更多适合学术 benchmark 的廉价/免费访问方式。
「Infra」频道最新
- Moonshot 称 Kimi-K3 今晚开放权重,需 64 张以上加速器 — heypearlai · 2026-07-27
- llmux 用一个 profile 管理 vLLM 和 llama.cpp 切换 — Available-Message509 · 2026-07-27
- AI 原生开发平台在印度推出数据驻留与仓库镜像 — HowDevelop · 2026-07-27
- AMD 与韩国达成合作,推进异构计算与本土 NPU 研发 — JungWooHa2 · 2026-07-27
- AI 记忆芯片热潮下,CXMT 上市首日涨近 500% — Polymarket · 2026-07-27
- 游戏本跑图太慢?本地与云端图像生成算力成本探讨 — Simple-Evidence-9125 · 2026-07-27