DeepSeek V4 与 Qwen 3.8 混部实测对比

Legitimate_Hat_7852 · reddit · 2026-08-27

作者在 4 张 DGX Spark 显卡上测试了 DeepSeek V4 0731、Qwen 3.8 Flash 和 GLM 5.3 Flash。结果显示 GLM 5.3 过于冗长且生成速度慢(双卡约 22 tok/s),表现不佳。最终采用的方案是将 DeepSeek V4 部署在 2 张卡上用于规划构建,Qwen 3.8 部署在另外 2 张卡上用于探索和子任务,形成了一套混合工作流。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →