新推理机制发力:Gemini V4 Pro 性能直逼 Flash 版
teortaxesTex · x · 2026-08-02
推文讨论了 Gemini 模型的新机制(MOPD)。作者指出,V4 Pro 的初始性能已达到 V4-Flash-0731 的水平,且能以较低成本在特定评测(AA)中从 44 分提升至 50 分。尽管其推理步骤比 Flash 慢约 3 倍,但整体展现出极高的性能潜力。引用的回复则表达了对研发团队算力不足、可能无法将 Pro 版本推向极致的担忧。
「模型」频道最新
- 今日AI圈速览:DeepSeek周末半价、GPT-5.6 Sol降价、阿里配售800亿投AI — APPSO · 2026-08-24
- 隐身模型 Ox Alpha 登场 Context Arena,匹配 GPT-5.6 — scaling01 · 2026-08-24
- Fable 5 仅占 6% 销量,Anthropic 遭遇降本冲击 — rohanpaul_ai · 2026-08-24
- Opus 5 说话像法庭剧?如何调教掉废话 — thk_ · 2026-08-24
- 2026 年中国模型全景:DeepSeek V4、Kimi K3 等在列 — TheTuringPost · 2026-08-24
- 传闻 Claude Opus 6 泄露:上下文 250 万,推理更强 — iamaliveix · 2026-08-24