单张 3090 极限跑 DeepSeek V4:每秒生成 4 tokens
Altruistic_Heat_9531 · reddit · 2026-08-01
一位开发者在未优化的单张 RTX 3090 系统上成功运行了 DeepSeek V4 模型。在搭配老旧 CPU、机械硬盘以及 Unsloth UD Q2 KXL 量化方案的情况下,实现了 4.02 tokens/s 的生成速度和 40 tokens/s 的提示词处理速度。这展示了在极受限的硬件环境下部署大模型的真实数据。
「Infra」频道最新
- 多卡满载部署 DeepSeek V4,Prompt 处理速度仅 600 t/s — fragment_me · 2026-08-02
- 曝 SpaceX 拟建 4GW 算力集群,规模匹敌全美今年新增电力 — BenBajarin · 2026-08-02
- 国产大模型算力绑定:DeepSeek配华为,月之暗面配阿里 — bronzeagepapi · 2026-08-02
- Chamath 发文谈 AI 投资:土地与电力是回报最快的路径 — davidyin44 · 2026-08-02
- 三大云厂商营收全面加速:谷歌云同比增长82% — ai · 2026-08-02
- YC新创Stoa推GPU盲标交易平台,首月涌入超3亿美元需求 — ycombinator · 2026-08-02