Qwen 3.8 Max 在高难度 INDUCTION 基准拿到 42% 排名第二

DeryaTR_ · x · 2026-08-04

Qwen 3.8 Max 在 INDUCTION 基准拿到 42% 排名第二

帖子引用的 GitHub 榜单显示,Qwen 3.8 Max 在难度很高的 INDUCTION 基准上取得了 42.2% 的正确率,较 Qwen 3.7 的 0% 有明显跃升,并排在 GPT-5.6 Sol 之后、Fable 5 之前,位列第二。

榜单里的关键信息

这意味着什么

原帖把这个基准描述为 ICML 2026 中提出的高难度归纳任务,因此这一结果被用来说明:中文开源模型在最近几个月进步很快。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →