实测发现:Qwen 小模型低成本匹敌 Claude

Ok-Challenge-7810 · reddit · 2026-08-25

一位 AI 工程师在 LlamaIndex 的 ExtractBench 上进行了一项低成本实验,对比了 Claude Opus 5、Qwen3.8-2.4T 和 Qwen3.6-35B 在政府文档提取任务上的表现。

关键发现:

实验存在样本量较小(n=36)等限制,作者提供了完整的 Notebook 代码供复现。

所属事件:40 美元实测:Qwen 小模型以三分之一成本打平 Claude Opus(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →