实测转向:Grok 4.6 在复杂工具调用上胜过 Gemini 3.7 Flash
brandon_galang · x · 2026-08-28
开发者分享更多使用后修正了看法:现在更偏好 Grok 4.6。原因是发现 Gemini 3.7 Flash 在面对复杂问题需要精细工具调用时容易迷失;它仍适合讨论类对话和 UX 工作,但遇到难任务时,他会跳过 5.6 Sol 或 Fable 5 之外直接切到 Grok 4.6。
「模型」频道最新
- ChatGPT 绘制人类动作示意图翻车:肢体错位离谱 — kaljakin · 2026-08-28
- 传 OpenAI 密集预训练中,远期大模型代号「Bel」浮出水面 — haider1 · 2026-08-28
- Yutori n2 登陆 Crusoe 云端,低成本实现计算机控制 — DhruvBatra_ · 2026-08-28
- Epoch 让 GPT-5.6 Sol 玩《杀戮尖塔》:卡在战术而非操作 — Jsevillamol · 2026-08-28
- 低配实测:32GB 内存+8GB 显卡跑 Qwen 3.8 Flash 达 3.5t/s — Ne00n · 2026-08-28
- GPT-5.6 Sol 一下午逆向重构 32 位 iOS 游戏 — gpt2chatbot · 2026-08-28