Signal65 实测:本地小模型 Agentic 能力追平 Claude Opus 5,参数少 13 倍

ryanshrout · x · 2026-10-09

Signal65 的 PINNACLE 测试显示,Qwen3.8-Flash-Next 在中等推理力度下的 agentic 任务得分略高于 7 月发布的 Claude Opus 5 和 9 月的 GPT-6 Sol,且与 2.4 万亿参数的 Qwen3.8 旗舰差距在 5% 以内——参数量少约 13 倍。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →