批 Google 缺乏核心负载领先模型:Gemini 智能体能力逊于 Grok
bindureddy · x · 2026-07-22
作者指出 Google 目前没有能在核心工作负载上占据绝对优势的 AI 模型,并列举了多个痛点:Flash 虽然是不错的聊天模型,但在智能体循环中的表现甚至不如 Grok;Pro 已是旧模型;Veo 价格过于昂贵且不如 SeeDance;Nanobanan Pro 过时,不如 GPT image;Flash Lite 则存在延迟过高的问题。作者认为,虽然 Grok 和 Luna 在指令遵循上表现更好,但 Google 在聊天功能之外缺乏强有力的竞争力。
所属事件:实测吐槽谷歌 Gemini 系列模型缺乏核心负载能力(2 条相关)→
「模型」频道最新
- Opus 5 传在赛车游戏测试中一次过关 — soumitrashukla9 · 2026-07-27
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- Opus 5 连自己生成的游戏不好看都能察觉 — Angaisb_ · 2026-07-27
- Opus 5 深夜聊天时反过来追问用户动机 — repligate · 2026-07-27
- Opus 3 和 Sonnet 3 上演了一场荒诞跨界对话 — repligate · 2026-07-27