实测吐槽谷歌 Gemini 系列模型缺乏核心负载能力

近期实测指出,尽管谷歌 Gemini 系列模型在常规聊天中表现尚可,但在核心工作负载上已全面落后,缺乏能占据绝对优势的模型。具体痛点包括:Flash 在智能体循环中的表现甚至不如 Grok;Pro 版本技术陈旧;而 Ultra 模型迟迟未能发布。这导致谷歌目前难以胜任复杂的 AI 生产环境需求。

2026-07-22 ~ 2026-07-22 · 2 条相关