Gemini 3.8 Flash 登性价比 Pareto 前沿,单任务成本 $0.58
ArtificialAnlys · x · 2026-09-02
Artificial Analysis 发布 Gemini 3.8 Flash 评测:四个月内 Google 推出第四款 Flash 模型。
- 智能指数:高推理档得分 59,较 3.7 Flash(56)提升 3 分,与 GPT-5.6 Sol(xhigh)和 Grok 4.6(medium)持平;中推理 57、低推理 52。
- 成本:年底前沿用 3.7 Flash 折扣价($0.75/$3.75 每百万输入/输出 token),每任务成本 $0.58,是同智能水平最便宜模型,但比上代贵约 40%——因单任务平均输出 token 增加 30% 至 48k、agent 评测轮次变多。
- Agent 能力:提升主要来自 agent 评测,𝜏³-Banking 较上代涨 12 分至 45%,Terminal-Bench v2.1 和 GDPval-AA v2 也有增强。
- 速度:约 300 token/秒,高推理档单任务耗时 2.5 分钟(上代 2.2 分钟),落后于 Claude Fable 5.1(2.1 分钟);低推理档 0.8 分钟。
- 上下文 1M token 不变,支持文本/图像/视频/语音输入。
所属事件:Gemini 3.8 Flash 评测:性价比登顶 Pareto 前沿(9 条相关)→
「模型」频道最新
- 业界传闻 GPT-Astra 跳跃堪比四年前 GPT-4,明日凌晨或发布 — DavidmComfort · 2026-09-03
- Gemini 3.8 Flash 输出 305 tokens/秒,近两倍于第二名 Muse Spark — NewVeterinarian5384 · 2026-09-03
- Reddit 用户称 ChatGPT 自动充值被莫名开启,关掉后又自动恢复 — Callicojacks · 2026-09-03
- Claude Fable 5.1 发布:八项评测全升但涨幅悬殊,价格最多降 45% — koltregaskes · 2026-09-03
- DeepMind CEO 表态:将尽快让更多用户用上 AI Mode 能力 — rmstein · 2026-09-03
- GLM 5.3 Flash 限时降价 90%,单任务成本不足 1 美分 — shensi · 2026-09-03