80张RTX 5090跑满Kimi K3全量模型,Bittensor网络提供半价平替API
markjeffrey · x · 2026-08-13
Bittensor 子网 53(Subnet 53)宣布上线了 2.8 万亿参数的 Kimi K3 全量模型。该项目通过去中心化算力网络,利用 80 张消费级 RTX 5090 显卡成功运行该模型。
其性能表现接近月之暗面官方 API,但通过 OpenRouter 调用的成本最多可节省 50%。这展示了去中心化 AI 算力在降低大模型推理成本方面的潜力。
「Infra」频道最新
- 英伟达祝贺 xAI 发布 Grok 4.6:基于 GB300 训练 — elonmusk · 2026-08-13
- SK海力士砸 381 亿美元在韩国新建两座内存晶圆厂 — Beth_Kindig · 2026-08-13
- 新秀推理引擎 Tokenspeed 获 Qwen3.8 Day-0 支持 — This_Maintenance_834 · 2026-08-13
- 推演 DeepSeek V4:超低 API 成本与 SSD KV Cache 革命 — Xianbao_QIAN · 2026-08-13
- Vercel AI Gateway 零加价上线 Grok 与 DeepSeek 模型 — brandon_galang · 2026-08-13
- AI 能耗度量新视角:每 token 能耗需结合质量、任务等多维因素 — prateekj · 2026-08-13