DeepSeek V3 量化版体积仅 162GB,解码速度达 247 tokens/s
teortaxesTex · x · 2026-08-05
开发者分享了 DeepSeek V3(原推误称为 V4 Flash)量化版本的实测数据:解码速度高达 247 tokens/s。
有博主对此感叹,该模型量化后体积仅 162GB,物理尺寸相当于高端 MicroSD 芯片中约 3mm² 的区域,重量近似于大黄蜂的大脑。然而,这微小的体积却足以容纳一个掌握了人类书面文明的高分辨率“心智”。
「Infra」频道最新
- MiniMax视频模型本地实测:96G显存跑5秒视频仅需50秒 — Practical_Low29 · 2026-08-05
- 7个月将 Opus 塞进单台设备,端侧智能爆炸加速到来 — teortaxesTex · 2026-08-05
- SpaceX 季度营收近翻倍至 78 亿美元,AI 算力合同成亮点 — rohanpaul_ai · 2026-08-05
- MiniMax H3 视频模型本地实测:RTX PRO 6000 渲染比 B300 快近半 — Resident_Sympathy_60 · 2026-08-05
- 欧洲拟建七座 AI 千兆工厂,算力红利能否惠及中型企业? — mpuchala · 2026-08-05
- RTX 3060 实测 MiniMax H3:19 分钟生成 10 秒皮克斯风格动画 — Pitiful_Archer_4381 · 2026-08-05