Gemini 3.7 Flash实测:编码与推理能力大幅提升,成本减半

petrusenko_max · x · 2026-08-14

作者对比了 Gemini 3.7 Flash 与 3.6 版本的实际表现。数据显示,新版本在编码准确性(FrontierCode 基准从 34.4% 升至 43.6%)和知识工作推理(GDP.pdf 基准从 22% 升至 34%)方面均有显著提升。

此外,该模型能够用更少的提示词生成更完整的 Web 应用,且每百万 Token 的处理成本仅为之前的一半,实现了性能与性价比的双重突破。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →