Gemini 3.7 Flash实测:编码与推理能力大幅提升,成本减半
petrusenko_max · x · 2026-08-14
作者对比了 Gemini 3.7 Flash 与 3.6 版本的实际表现。数据显示,新版本在编码准确性(FrontierCode 基准从 34.4% 升至 43.6%)和知识工作推理(GDP.pdf 基准从 22% 升至 34%)方面均有显著提升。
此外,该模型能够用更少的提示词生成更完整的 Web 应用,且每百万 Token 的处理成本仅为之前的一半,实现了性能与性价比的双重突破。
「模型」频道最新
- GPT-5.6 Luna 对比 Gemini 3.7 Flash:得分更高且成本便宜三倍 — haider1 · 2026-08-14
- 仅花 0.038 美元,Gemini 3.7 一句话纯代码生成 3D 劳力士手表 — rohanpaul_ai · 2026-08-14
- 开源模型涨价引争议,社区批评用户未看清DSH商业价值 — teortaxesTex · 2026-08-14
- ChatGPT GitHub 连接器频发误报:正常写入遭安全拦截 — Phoxerity · 2026-08-14
- 代码泄露:Gemini CLI 添加 Claude 4.5 与 Opus 4.8 模型 — RussellZager · 2026-08-14
- 大模型价格战:DeepSeek暴涨1114%,Grok与Gemini降价厮杀 — kimmonismus · 2026-08-14