Cacheon矿工把MiniMax M3吞吐优化至2337.9 tok/s,据称可多赚61%利润
JosephJacks_ · x · 2026-09-16
Cacheon披露其竞赛中Bittensor矿工将MiniMax M3的推理吞吐提升至2337.9 tok/s,比SGLang基线高32.2%。按SemiAnalysis InferenceX模型测算:B300上vLLM跑MiniMax M3单芯片每小时利润4.81美元,同等定价与芯片成本下吞吐+32.2%意味着利润升至7.73美元/小时(约+61%)——因为每小时芯片成本固定4.25美元,更高吞吐等于无需增购芯片即可售出更多算力。该利润为情景推演而非实测收益;优化数字本身经过Cacheon测试与复现。
「Infra」频道最新
- 联发科2纳米天玑9600Pro发布:双NPU重构,端侧直跑30B MoE模型 — 量子位 · 2026-09-16
- Transformers 模型可直接在 vLLM 运行,无需移植转换 — pcuenq · 2026-09-16
- 台积电建 20 座厂仍追不上 AI 需求,劳动力短缺成瓶颈 — emmanuelvivier · 2026-09-16
- SemiAnalysis称Nvidia Vera Rubin NVL72智能体推理吞吐每兆瓦最高30倍于Blackwell — emmanuelvivier · 2026-09-16
- 一份文档管道接三家 AI 厂商,Reddit 用户求解一站式自托管方案 — Sad-Razzmatazz-7657 · 2026-09-16
- 纳德拉举例:一座 400-500MW 数据中心让小镇税收涨 12 倍 — rohanpaul_ai · 2026-09-16