Qwen3.8-27B 对战百倍大模型,首测视频出炉
arena · x · 2026-08-22
Arena 发布了 Qwen3.8-27B 模型的第一印象视频,与 Peter Gostev 一起进行了实测。测试对比了规模大 100 倍的模型(包括 DeepSeek v4、Qwen 3.8 Max、Kimi K3、GLM 5.3、Grok 4.6、GPT-5.6 和 Fable),覆盖了相同的单次生成和智能体任务。详细评分结果即将公布。
「模型」频道最新
- OpenAI 发布 GPT-5.6 Sol 超快模式,提速 14 倍 — gajesh · 2026-08-22
- 用户反馈:OpenAI Sol High 模型近期质量下滑 — Illustrious-Bet-1368 · 2026-08-22
- Reddit 讨论:你真正信任的公开 LLM 基准测试有哪些? — ThomasAger · 2026-08-22
- 实测 Ornith 1.5 32B 模型:Three.js 渲染速度极快 — draginol · 2026-08-22
- Meta 工程师喊话模型实验室:训练 agent 看截图写程序操控 UI — Vjeux · 2026-08-22
- Gemma 开源模型下载量破十亿,律师行业应用潜力大 — jkubicki · 2026-08-22