Orion-16B突破100B训练token,采用去中心化算力
const_reborn · x · 2026-08-15
Orion-16B模型已突破100B训练token,仍在持续改进。这是目前使用DPP(去中心化预训练)训练的最大LLM,累计算力达10^22 FLOPS,利用来自全球无许可分布式提供商的异构消费级GPU。团队计划下周增加新GPU类型,将数量提升至256,并进一步提升吞吐量。
「Infra」频道最新
- 美参议员致信三大AI巨头威胁暂停开发,英伟达联手华尔街推算力证券 — PeterDiamandis · 2026-08-15
- Fireship:边缘 ML 摄像头如何构建无证追踪网络 — Fireship · 2026-08-15
- Qwen 官方指南:调节推理深度与 1M 上下文扩展 — solyarisoftware · 2026-08-15
- 用户发现 DeepSeek V4 Pro 需在 Linux 环境下正常运行 — teortaxesTex · 2026-08-15
- Tiny-Qwen 更新:纯 PyTorch 实现 27B 模型 — No-Compote-6794 · 2026-08-15
- 4×AMD V620 跑 DeepSeek-V4-Flash:300K 上下文,生成 21 tok/s — Thin_Pollution8843 · 2026-08-15