争议:Qwen 27B 智能体编码能力引质疑
teortaxesTex · x · 2026-08-22
针对有观点称 ox alpha 在智能体编码任务上不及 Qwen 3.8 27B,作者表示质疑,并认为 Qwen 27B 不可能强于 GPT 5.6 Sol Max。结合此前引用的 Agentic Coding 排名,引发了对 Smaug 与 Fable 模型性能的讨论。
「模型」频道最新
- 传闻称 Gemini 4.0 Pro 有望超越 Fable 与 Sol — bindureddy · 2026-08-22
- DeepMind 研究员暗示神秘模型 Ox Alpha 是下代 Gemini Pro — Neurogence · 2026-08-22
- Logan Kilpatrick 暗示 Gemini 3.5 Pro 即将发布? — Heisenricher · 2026-08-22
- 加 LLM 裁判自纠错反而掉点:抽取一致性从 85% 跌至 62% — RoadkiLLer_31 · 2026-08-22
- Codex 语音模式自己偷着乐:静默半小时后低声笑出声 — RileyRalmuto · 2026-08-22
- Claude Code 爱用“确凿证据”等词 — wateriscoding · 2026-08-22