专题 · FULL STORY

Gemini 3.7 Flash 发布:从后台泄露到跑分实测

谷歌 Gemini 3.7 Flash 经历了后台泄露与定价减半传闻后正式发布。该模型在编码与智能体能力上大幅提升,随后的跑分数据进一步印证了其显著的性价比优势。

2026-08-13 ~ 2026-08-14 · 3 集 · 48 条

第 1 集 · Gemini 3.7 Flash 后台泄露将发布,定价减半且 Pro 版或遭弃用(2026-08-13,9 条)

谷歌 Gemini 3.7 Flash 模型已在多个后台现身,爆料称即将发布,且定价较前代大幅减半。同时,内部传闻称 Gemini 3.5 Pro 已被弃用,真正的旗舰 Pro 版本可能要等到 4.0 才会推出。这表明谷歌正在调整其模型迭代与定价策略,以应对激烈的市场竞争。

已确认

  • 据 @RareBunch4348 和 @testingcatalog 爆料,Gemini 3.7 Flash 已出现在 Google Cloud Console 和 Gemini Enterprise 后台中,模型 ID 为 gemini-3.7-flash,目前处于隐藏状态,暗示发布在即。
  • 多位爆料者(@adonissingh, @rickasaurus, @tulseedoshi)指出,新模型定价较上一代 3.6 Flash 直接减半:输入价格为 $0.75/百万 tokens,输出价格为 $3.75/百万 tokens。

尚未确认

  • @adonissingh 透露 Gemini 3.5 Pro 已被内部弃用,但未提供更多细节。
  • @koltregaskes 推测,真正的旗舰 Pro 版本可能要等到 Gemini 4.0 才会推出。
  • @RareBunch4348 对谷歌迟迟不发布旗舰款 Pro 模型(此前承诺于6月发布)表示不满,这也侧面印证了 Pro 版本进度可能不及预期。
  • @haider1 猜测,谷歌可能通过蒸馏的方式将 Pro 级的能力分散到 Flash 3.5、3.6 和 3.7 中逐步释放,以此规避前沿基准测试的压力。

为什么重要

Gemini 3.7 Flash 以减半的定价发布,将显著降低开发者的使用成本,加剧 AI 模型市场的价格战。同时,3.5 Pro 的弃用和 Pro 版推迟的传闻,反映出谷歌产品线规划的变动,可能影响用户对谷歌旗舰模型迭代节奏的预期与信任。

第 2 集 · Google发布Gemini 3.7 Flash,编程能力提升且半价(2026-08-14,31 条)

谷歌正式发布 Gemini 3.7 Flash 模型,该模型专为编码和智能体任务优化,在复杂自动化和软件开发领域的实用性取得实质性突破。得益于算法层面的优化,新模型在三个月内从 3.5 快速迭代至 3.7,并在多项基准测试中成绩大幅跃升。同时,年底前提供半价 API 调用,直接降低了企业级开发与智能体构建的成本门槛,被业界视为极具性价比的主力工作模型。

已确认

  • 核心升级:Gemini 3.7 Flash 在软件工程能力上实现飞跃。据官方数据,DeepSWE 得分从 49.0% 升至 65.3%,FrontierCode 得分从 34.4% 升至 43.6%。此外,该模型在 PDF 文档理解和解析方面也表现出色。
  • 定价与可用性:年底前 API 调用价格比上一代 3.6 Flash 便宜 50%。模型已全面上线 API、AI Studio、Antigravity 平台,并接入消费者端的 Google AI Pro 和 Ultra 订阅服务。
  • 智能体表现:开发者 @philschmid 实测指出,新模型在智能体工作流中更具纪律性,会先探索、解析错误并运行测试,最后才修改代码,减少了无效轮次。Perplexity 等厂商也迅速跟进,将其视为最佳的子智能体模型。
  • 硬核演示:为展示编码准确性与智能体能力,Google 团队演示了组建 3 个智能体团队,完全自主从零开始训练一个机器人控制模型。

为什么重要

  • 迭代速度惊人:据 @koraykv 和 @mitsuhiko 等透露,该模型在短短 3 个月内就从 3.5 迭代至 3.7(距 3.6 发布仅三周),得益于开发者反馈与算法创新,展现了谷歌极快的技术推进节奏。
  • 性价比重塑:据 @DavidLinthicum 观点,该模型被定位为能支撑实际业务的企业级“主力马”,在大幅提升复杂任务处理能力的同时减半价格,兼具速度、性能与成本效益。

还有 11 条相关讨论 →

第 3 集 · Gemini 3.7 Flash 跑分曝光:竞技场跃升与性价比重塑(2026-08-14,8 条)

谷歌 Gemini 3.7 Flash (High) 模型的多项基准测试与竞技场跑分数据近日集中曝光。数据显示,该模型在多项能力上实现了显著跃升,并以优异的性价比重塑了当前大模型性能与价格的 Pareto 前沿,引发了社区的广泛关注。

已确认

  • 竞技场成绩跃升:据 LMSYS 聊天机器人竞技场数据,Gemini 3.7 Flash (High) 在文本竞技场取得 1490 分,位列第 9 名,较前代 3.6 Flash (High) 的第 16 名有大幅提升。发帖者 @arena 补充称其各细分能力均有显著进步。
  • 代码能力突出:该模型在 Code Arena: WebDev 中获得了 1588 分,表现极其出色,被认为重塑了性能与价格的 Pareto 前沿。
  • 智能与速度表现:据 Artificial Analysis 数据,该模型智能指数得分为 56(同类模型中位数为 34),智能排名第 16,同时其速度登顶榜首。
  • 其他基准表现:在 VoxelBench 评测中,该模型位列第七,发帖者 @legitapi 对此成绩表示认可。

为什么重要

  • 性价比标杆:Gemini 3.7 Flash 在保持轻量级定位的同时,展现了比肩甚至超越部分旗舰模型的竞技场实力,为开发者提供了极具性价比的新选择。
  • 引发更高期待:轻量级的 Flash 版本已展现出强劲的竞争力,这进一步拉高了社区对谷歌后续推出 Pro 级别新模型的期待值。