通义 Qwen3.8-Max 登榜文本竞技场第 5,医疗领域登顶
arena · x · 2026-08-03
阿里通义千问模型 Qwen3.8-Max 在 LMSYS 文本竞技场中获得 1,496 分,位列总榜第 5 名。
在细分职业领域,该模型表现亮眼:在医疗保健类别拿下第 1,数理科学和软件服务也位居前列。在跨域能力上,其创意写作能力高居第 3,多轮对话与硬核提示词处理均位列第 6。
所属事件:阿里Qwen3.8-Max多领域竞技场表现亮眼(4 条相关)→
「模型」频道最新
- 受迪士尼诉讼影响,MiniMax 开源模型在欧美等地调整访问机制 — tokenbender · 2026-08-03
- 单 CPU 8GB 内存跑 2.78 万亿参数 Kimi K3 — Saboo_Shubham_ · 2026-08-03
- MiniMax-H3 开源权重限制美英欧盟等地访问 — tokenbender · 2026-08-03
- 生物科技从业者呼吁多用 DeepSeek 与 Qwen:查中文技术信息更好用 — MWCvitkovic · 2026-08-03
- tinygrad 预告本地部署新品,暗示 Qwen3.6-27B 即将发布 — max_paperclips · 2026-08-03
- 美国已非开源模型安全区?MiniMax 闭源引发行业担忧 — cocktailpeanut · 2026-08-03