阿里轻量级 Qwen 评测匹敌 GPT-5.6 Luna
pstAsiatech · x · 2026-08-18
阿里巴巴最新发布的轻量级 Qwen 模型在评测中表现强劲。
核心成绩:
- 对标 OpenAI:性能表现与 OpenAI 的 GPT-5.6 Luna 持平。
- 对比国产模型:成绩接近 DeepSeek 和智谱的更大参数开源模型。
作者展示了在 MacBook Pro 上本地部署该模型的操作。
「模型」频道最新
- bondingAI 推出企业语言模型 xLLM,主打确定性 — granvilleDSC · 2026-08-18
- 回应基准测试:这可能是为了刷榜 — sudoraohacker · 2026-08-18
- 新基准 MazeBench 揭露顶尖 Agent 难以通过基础 3D 关卡 — xeophon · 2026-08-18
- 有研究者断言:线性注意力是沉没成本谬误的产物 — jm_alexia · 2026-08-18
- 曝 Anthropic 已在部分账号灰度测试 Fable 5 继任模型 — kimmonismus · 2026-08-18
- 预测Qwen 4将于9月发布,Qwen 3.8获高度评价 — Usual_Maximum7673 · 2026-08-18