Bittensor 矿工调优推理软件,同卡同模型提速最高 54%
bittingthembits · x · 2026-10-11
Bittensor 子网 SN10(Pareton)的矿工在 NVIDIA AIPerf 基准上跑 Qwen3.8-27B + SGLang(4x RTX 5090),600/600 请求全部完成,同一模型同一 GPU 下吞吐提升:4 并发 +54%、8 并发 +50%、16 并发 +40%、32 并发 +23%。发帖人估算相当于每 token 算力成本降低约 35%(最差情形约 19%)。
机制:矿工竞相优化模型运行软件,SN10 用同一负载与硬件测试每个提交,只保留更快且不损输出质量者,每个胜者成为下一个待超越的基线,形成只升不降的棘轮。opentensor 引用补充:已有矿工开发的优化被合并进 vLLM。
「Infra」频道最新
- 印度数据中心耗电激增,服务其可再生能源需求 2030 年将翻倍至 32.4 GW — SuB8u · 2026-10-11
- TensorFold 1.0.5 发布:19.8k 长对话续轮预填充从 8.1 秒降到 0.16 秒 — HankYeomans · 2026-10-11
- 曝 DeepSeek v4.1 长上下文提速:32K prefill 吞吐提升约 40% — HankYeomans · 2026-10-11
- 先进封装推高缺陷成本,晶圆级老化测试成 GPU 时代新刚需 — BenBajarin · 2026-10-11
- 光学测试成 CPO 规模部署最大瓶颈:探针与自动化难题解析 — BenBajarin · 2026-10-11
- Cboe 前总部将改建为 33MW 数据中心,租金远超普通写字楼 — deanwball · 2026-10-11