IOTA 称 16.2B 的 Project Orion 正跨 187 张分散 GPU 训练
bittingthembits · x · 2026-08-04
Macrocosmos / IOTA 这次展示的是 Project Orion 的分布式训练:一个 16.2B 参数模型,不是在单一集群里训练,而是跨多个独立供应商、不同地点、不同硬件一起跑。
配图里能看到,这次训练配置最多可支持 256 台机器,目前大约 187 个节点在线;已经处理了 50.9B tokens,吞吐约 62.6K tokens/s,loss 仍在下降。它想证明的是:只要调度得当,世界各地零散的闲置 GPU 也能像一台可靠的“全球超级计算机”一样工作。
「Infra」频道最新
- K3 被低估了,作者主张企业自建推理基础设施 — hsu_byron · 2026-08-04
- Photon 2.0 把 Moondream、Qwen 3.5 编译成 megakernel — sloppenheimer · 2026-08-04
- Minimax H3 可在 3060 12GB 上跑,10 秒视频要 30 分钟 — irmemon225 · 2026-08-04
- Minimax H3 在 5070 Ti 上实测,ComfyUI 对比 Sage Attention 和 Easy Cache — TheRedHairedHero · 2026-08-04
- 开源 H3Zero 把 MiniMax H3 做成了 Modal 托管版 — LegacyV1 · 2026-08-04
- MiniMax H3 已能做 15 秒视频,但一张 5090 要跑 6 分钟 — Careless-Constant-33 · 2026-08-04