算上失败重试,更便宜的 AI 模型真的更便宜吗?

ExtremeAdmirable4097 · reddit · 2026-08-06

开发者通过对比测试 GPT-5.6 Luna 与 DeepSeek V4 Flash 生成网页游戏发现,尽管 DeepSeek 表面单次成本仅为前者的五分之一,但如果将失败重试的成本计算在内,其达到成功结果的实际花费会显著上升。

文章指出,真实的 AI 系统必须为失败的调用、重试和人工审核买单。因此,仅看单次推理价格是不够的。作者呼吁业界建立更完善的评测基准,同时汇报“单次成本”与“首次验证成功的累计成本”,并区分视觉成功与功能正确性。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →