双卡 AMD v620 跑开源大模型实测:张量并行大幅提升处理速度
Thin_Pollution8843 · reddit · 2026-08-11
开发者分享了在两块老旧 AMD v620 GPU 上运行开源多模态模型 Muse-Glimmer-30B 的实测数据与配置代码。通过开启张量并行,双卡协同不仅成功运行了模型,还在 Prompt 处理速度上实现了近乎翻倍的提升。帖子附带了单卡 Q6、双卡 Q6 及双卡 Q8 模式的详细 llama-server 启动参数,并对比了不同上下文长度下的生成与处理速度。
「Infra」频道最新
- 美光高管:AI客户路线图已可见至2030年后 — BenBajarin · 2026-08-11
- Vercel Sandbox免费开放出口防火墙,应对AI代理网络逃逸风险 — cramforce · 2026-08-11
- 六大基金组建 5000 亿美元联盟,保持与 NVIDIA 的距离 — annbordetsky · 2026-08-11
- RTX 5090 对决双卡 48GB:本地 AI 视频生成硬件升级指南 — Ammoryyy · 2026-08-11
- 开发者自建微虚拟机沙箱编码智能体,支持本地推理与 iOS 操控 — tom_doerr · 2026-08-11
- SanDisk CEO 称 80% 以上毛利率是对存储产品的合理回报 — Beth_Kindig · 2026-08-11