GLM-5、MiniMax M2.5、Gemini 3 争榜 SOTA,本地 Agent 怎么选?

Cautious_Bit_8521 · reddit · 2026-08-27

针对 GLM-5、MiniMax M2.5 和 Gemini 3 Deep Think 同期宣称 SOTA 的现状,作者提出应关注优化约束差异而非头榜:GLM-5 侧重长程工作流的稀疏注意力,MiniMax M2.5 侧重生产调用的成本与吞吐,Gemini 3 则重推理质量。建议冻结语料库并使用 Milvus 等向量库做检索层,只替换模型以隔离变量,并通过自测接地气答案、延迟和成本来做决策。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →