4 个小型 eval 跑一次花 150 美元,开发者吐槽订阅不覆盖 eval 成本
LukeParkerDev · x · 2026-09-10
开发者 Luke Parker 吐槽:订阅制(Codex/Claude)不含 eval、embeddings 等构建 AI 技术所需的开销,而他一个测试套件里仅 4 个很小的 eval 跑一次就已花费 150 美元。他担心随着 eval 数量增加到上百个、跨更多更贵模型做复杂打分,成本会不可持续。Zeeg 回复称两周前跑一个 metaloop 一小时就烧掉 200 美元。
所属事件:开发者吐槽订阅制不含 eval 与嵌入成本(2 条相关)→
「编程与Agent」频道最新
- 实证研究:Diff 式代码编辑整体不如整文件直接生成 — Andrej Andrejev · 2026-09-10
- Salesforce 研究:harness 共进化让弱模型补上模仿学习短板 — Saleforce · 2026-09-10
- 一条提示词搞定链上支付:Claude 用 x402 自动完成 ENS 解析 — kleffew94 · 2026-09-10
- Linux 上跑 Agent 编译 iOS 应用并真机调试,apple-dev 工具包开发中 — alexcovo_eth · 2026-09-10
- Navier Stokes 智能体用缓存互联网防沙箱越界,或为 OpenAI 安全对策 — nrehiew_ · 2026-09-10
- 拆解 Semantic Kernel:Kernel 是必须学会「说不」的 AI 编排策略边界 — Mahmoud_Zalt · 2026-09-10