本地模型搜索工具评测:Qwen 3.8 27B 与 Parallel Turbo 胜出
AccBalanced · x · 2026-09-01
Scott Sanchez 发布了针对本地模型的 Agentic Search 工具基准测试,旨在解决本地模型缺乏优秀 Web 搜索选项的问题。测试在 NVIDIA DGX Spark 上运行,对比了 DeepSeek V4 Flash、GLM 5.3 Flash、Qwen 3.8 27B 及 Qwen 3.8 Flash Next 四个开源模型,搭配 Brave、Exa、Serper、Tavily 等 10 个搜索提供商。通过 2000 个真实问答(真金白银付费测试),结果显示 Qwen 3.8 27B + Parallel Turbo 组合表现最佳:50/50 全对,平均响应 5.7 秒,千题成本 $1.26。其次是 DeepSeek V4 Flash + Serper。Parallel Turbo 提供商在准确率(197/200)、速度(7.1s)和成本($1.26)上综合领先。
「Infra」频道最新
- 美银重申 Nvidia 首选:FY28 增速 70% 是下限,估值十年最低 — firstadopter · 2026-09-03
- DGX Spark 到手第一课:装最新 CUDA 竟被厂商层层设障 — QuixiAI · 2026-09-03
- 预测:数据中心 2027、2028 连续翻倍增长,经济秩序正在重构 — abhiadesai · 2026-09-03
- DeepSeek-V4-Pro 正式版发布:1.6T 参数 MoE,开源评测 Harness 同步亮相 — DeepLearningAI · 2026-09-03
- 博通 CEO:Anthropic 与 OpenAI 大购谷歌 TPU,将成其前两大定制芯片客户 — dinabass · 2026-09-03
- Hock Tan: 电力供应已直接决定算力部署的具体时点 — BenBajarin · 2026-09-03