非知识类推理基准测试提升幅度显著高于其他

stochasticchasm · x · 2026-08-28

用户分享了模型在不同基准测试上的结果对比图,显示“推理”类(非知识依赖)基准测试的性能提升幅度远大于其他类型。讨论指出这可能意味着模型在纯粹推理能力上的增益更为明显。

所属事件:Qwen 与 MiniMax 稀疏注意力对比及 TileLang 内核发布(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →