Radeon 680M 核显跑分多款模型
tabletuser_blogspot · reddit · 2026-08-17
在搭载 AMD Radeon 680M 核显的 mini PC 上测试了 9 款模型(包括 Bonsai-27B, Gemma-4-12B 等)。基于 llama.cpp 的 Vulkan 后端和 FlashAttention,报告了预填充和生成速度,显示小模型在核显上可达较高吞吐。
「Infra」频道最新
- 美制裁四年后,中国芯片靠长鑫华为迎来突围时刻 — pstAsiatech · 2026-08-17
- Qwen 3.8 27B 在 AMD 显卡上推理速度仅 20t/s — soyalemujica · 2026-08-17
- omlx:支持 SSD 缓存的苹果芯推理服务器 — jundot · 2026-08-17
- 开发者开源本地模型编排系统:让 27B 小模型自主选型并产出生产级代码 — Single_Land8080 · 2026-08-17
- 味之素减供 30%,中国 AI 供应链面临大考 — pstAsiatech · 2026-08-17
- Cerebras 推理加速显著:10小时 RL 任务压缩至1小时 — dejavucoder · 2026-08-17