DeepSeek V4 与 Qwen 3.8 混部实测对比
Legitimate_Hat_7852 · reddit · 2026-08-27
作者在 4 张 DGX Spark 显卡上测试了 DeepSeek V4 0731、Qwen 3.8 Flash 和 GLM 5.3 Flash。结果显示 GLM 5.3 过于冗长且生成速度慢(双卡约 22 tok/s),表现不佳。最终采用的方案是将 DeepSeek V4 部署在 2 张卡上用于规划构建,Qwen 3.8 部署在另外 2 张卡上用于探索和子任务,形成了一套混合工作流。
「编程与Agent」频道最新
- Claude-mem 为 Agent 提供跨会话持久化记忆 — thedotmack · 2026-08-27
- JetBrains 发布指南:助 AI 编写现代 Go 代码 — JetBrains · 2026-08-27
- llama.cpp未吃满NVMe阵列?作者直接让Kimi改代码调优 — carrigmat · 2026-08-27
- Agno 发布:自称能自建自运行的 Agent 平台 — pritisinghhhh · 2026-08-27
- OpenCode Senses:本地视觉插件支持 13 种工具 — RevolutionaryPen4661 · 2026-08-27
- FreJun Teler 让 AI Agent 接入真实电话 — FreJun · 2026-08-27