同一个 agent 任务:Gemini Flash 跑近千步烧 $14 失败,Pro 85 步仅 $1 成功

XIFAQ · reddit · 2026-10-06

作者实测对比两款 Google 模型执行同一个 agent 任务:需要推理判断时常用的 Gemini 3.1 Pro 与更便宜、更快的 Gemini 3 Flash。

结果反差明显:Pro 用 85 步完成任务,花费约 $1;Flash 跑了近 1000 步后仍失败,烧掉约 $14 的 token 费。作者还指出同一模型每次完成任务的 token 用量也会有波动,"便宜模型更省"在 agent 场景未必成立,并询问他人是否观察到类似现象。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →