DeepSeek V4 Flash 本地跑分出炉:MXFP4 量化兼顾极速与高分
WonderRico · reddit · 2026-08-05
Reddit 用户更新了其本地大模型基准测试结果,加入了 DeepSeek V4 Flash 0731 的数据。
测试使用了 Bartowski 的 MXFP4 量化版本,在 Dspark 加速下实现了 1K tokens/s 的预填充速度和 90 tokens/s 的生成速度。数据显示,该版本在取得目前最高分的同时保持了极高的运行效率,唯一遗憾是不支持视觉能力。
「Infra」频道最新
- 英伟达推 Arm 架构 CPU 挑战英特尔,称数据处理快 3.67 倍 — rohanpaul_ai · 2026-08-05
- NVIDIA 发力存储处理器:自研 Arm CPU 数据处理速度暴增 3.67 倍 — rohanpaul_ai · 2026-08-05
- NVIDIA DGX Spark 遭吐槽:同价位 4090/5090 显存带宽更优 — NielsRogge · 2026-08-05
- 去中心化推理挖矿:闲置消费级 GPU 的新变现玩法 — 0xJeff · 2026-08-05
- 富士康 AI 服务器需求强劲,7 月营收增长再次加速 — firstadopter · 2026-08-05
- AMD MI355X 集群实测:11 节点跑 Llama 2 70B 破百万 tokens/s — AntDX316 · 2026-08-05