同一个 agent 任务:Gemini Flash 跑近千步烧 $14 失败,Pro 85 步仅 $1 成功
XIFAQ · reddit · 2026-10-06
作者实测对比两款 Google 模型执行同一个 agent 任务:需要推理判断时常用的 Gemini 3.1 Pro 与更便宜、更快的 Gemini 3 Flash。
结果反差明显:Pro 用 85 步完成任务,花费约 $1;Flash 跑了近 1000 步后仍失败,烧掉约 $14 的 token 费。作者还指出同一模型每次完成任务的 token 用量也会有波动,"便宜模型更省"在 agent 场景未必成立,并询问他人是否观察到类似现象。
「编程与Agent」频道最新
- 他用 Claude 做出宝可梦式韩语学习游戏,免费开放试玩 — EstanislaoStan · 2026-10-06
- 两年自建本地 AI「操作系统」Aether:记忆、编排与故障恢复全栈 — Budget_One_8784 · 2026-10-06
- 开发者发问:为何 AI 从不选 Java?训练语料欠采样或是主因 — HanchungLee · 2026-10-06
- Andrew Warner 演示 Grok Bot 12 种用法:从会议善后到收件箱分诊 — brandon_galang · 2026-10-06
- StackOverflow 调查:65% 开发者用编程 agent,六成却刻意回避 AI — pchandrasekar · 2026-10-06
- teenytiny.computer 亮相:为 Agent 打造人机共用的云端 Linux 虚拟机 — pritisinghhhh · 2026-10-06