单卡3090跑DeepSeek-V4-Flash极限量化版,成功生成代码
nikhilprasanth · reddit · 2026-08-03
Reddit 网友分享了在单张 RTX 3090 上运行 DeepSeek-V4-Flash 极限量化版(IQ2XS-Experts-Q80)的详细测试。硬件配置为 24GB 显存与 128GB 内存,使用 llama.cpp 部署。测试表明,尽管模型被大幅压缩,但仍能生成结构完整且可用的代码,仅丢失了部分细节真实感。
「Infra」频道最新
- 大厂囤积GPU推高溢价,开源模型托管成本逼近闭源 — xiaosun86 · 2026-08-03
- 英国主权AI基金投资初创公司OLIX,从底层重构算力基础设施 — HZoete · 2026-08-03
- 受 GDDR7 与晶圆涨价影响,韩国 RTX 50 系显卡最高涨价 30% — basedjensen · 2026-08-03
- 笔记本端跑MiniMax H3:16G显存3分钟生成5秒视频 — robomar_ai_art · 2026-08-03
- RTX 5080跑MiniMax H3:15秒赛博朋克动漫耗时近16分 — Vinbatroth · 2026-08-03
- RTX 5090跑MiniMax H3:10秒1080p视频耗时58分钟 — koakoAI · 2026-08-03