Qwen3.8-27B 基准比肩 GPT-5.6 与 DeepSeek V4

Artificial Analysis 发布的基准测试显示,阿里开源模型 Qwen3.8-27B 表现亮眼:综合成绩与 DeepSeek V4、GPT-5.6 Luna Max 并驾齐驱;在最新 Agentic Index 榜单(取各模型最大推理强度)中,Qwen3.8 Max 的智能体得分与 GPT-5.6-Sol 并列甚至反超 GPT-5.6-Terra。开源小模型再度爆冷,引发 Reddit 等社区热议。

2026-08-18 ~ 2026-08-18 · 2 条相关