40 美元实测:Qwen 小模型以三分之一成本打平 Claude Opus

一位 AI 工程师仅花费 40 美元,在 LlamaIndex 的 ExtractBench(模式引导文档抽取基准)上使用 36 份文档对比了 Claude Opus 5 与 Qwen3.8、Qwen3.6 等模型。结果显示 Opus 5 的 F1 约为 0.94,而 Qwen3.8 以约三分之一的价格达到相当水平,显示出小模型在特定抽取任务上的高性价比。

2026-08-25 ~ 2026-08-25 · 2 条相关