开源 xLLM 训练框架:改数据配比不重建数据集,H200 上达 10050 tokens/s
HongyiWang10 · x · 2026-09-29
IFM AI 发布开源训练基础设施 xLLM,面向稠密与 MoE 大模型的预训练和微调。核心卖点是「灵活性不减吞吐」:tokenizer、数据配比、模型架构、训练阶段都可中途更换,无需重建数据集或系统。
性能数据:H200 上 K2-Horizon-MoVA-36B-A4B 达 6295 tokens/s/GPU,Llama3-8B 达 10050 tokens/s/GPU。随附 K2 Horizon 的 checkpoint、训练日志与完整 recipe。
「Infra」频道最新
- LayerSkip:单模型自推测解码,免掉独立草稿模型的推理加速框架 — burkov · 2026-09-29
- SpaceX 官宣超级计算机、Terafab、Gigasat 等多项基建布局 — elonmusk · 2026-09-29
- 马斯克称算力将迁往太空,Google 先验证 TPU 能否在太空工作 — CackleRooster · 2026-09-29
- Gimlet 与 Cerebras 规划 100 MW 算力,推理速度可达 3000 tokens/秒 — Sethwinterroth · 2026-09-29
- 单卡 3090 跑 Qwen 27B 达 95+ TPS、262K 上下文,LlamAmpere v0.4 发布 — Brief-Tap-6616 · 2026-09-29
- 美国人更反对在家门口建数据中心,而非核反应堆 — PeterDiamandis · 2026-09-29