Gemini 3.6 Flash 整体持平,但图表理解掉了 14%

llama_index · x · 2026-07-22

这组 ParseBench 测试对比了 Gemini 3.6 Flash、Gemini 3.5 Flash Lite 及其前代版本在文档理解任务上的表现,结论并不乐观:Google 的 Flash 系列在“更会推理/编码”的同时,文档视觉理解能力并没有同步提升。

主要结果

配图里的基准表也印证了这一点:不同子项之间出现明显取舍,说明“更强推理”并不等于“更强文档理解”。

所属事件:Gemini 3.6 Flash 跑分与实测:提速降价但未变聪明(9 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →