Bittensor 矿工调优推理软件,同卡同模型提速最高 54%

bittingthembits · x · 2026-10-11

Bittensor 子网 SN10(Pareton)的矿工在 NVIDIA AIPerf 基准上跑 Qwen3.8-27B + SGLang(4x RTX 5090),600/600 请求全部完成,同一模型同一 GPU 下吞吐提升:4 并发 +54%、8 并发 +50%、16 并发 +40%、32 并发 +23%。发帖人估算相当于每 token 算力成本降低约 35%(最差情形约 19%)。

机制:矿工竞相优化模型运行软件,SN10 用同一负载与硬件测试每个提交,只保留更快且不损输出质量者,每个胜者成为下一个待超越的基线,形成只升不降的棘轮。opentensor 引用补充:已有矿工开发的优化被合并进 vLLM。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →