Kimi K3 全量微调上线:MXFP4 推理误差极小
burny_tech · x · 2026-08-30
Applied Compute 宣布在 AC2 平台上线 Kimi K3 全量微调功能。通过内存优化,训练副本所需的 GPU 数量减少了约 40%。实测数据显示,bf16 训练前向传播与 bf16 推理引擎之间的 KL 散度,与 bf16 训练器和 MXFP4 推理引擎之间的差异几乎相同,表明 MXFP4 在保持精度的同时显著提升了效率。
所属事件:Kimi K3全量微调上线AC2 单副本GPU需求降40%(3 条相关)→
「Infra」频道最新
- Google Cloud Monitoring MCP 连接器发布 — modelcontextprotocol · 2026-09-01
- Distributed.systems发布可审计的Agent基础设施 — arthurcolle · 2026-09-01
- ChatGPT 启用记忆和历史会话是否增加 Token 消耗? — ssunki · 2026-09-01
- 工程师深挖 ROCm,修复 MI350X 推理崩溃并发现 9 个 Bug — AnushElangovan · 2026-09-01
- 40nm 神经动力学芯片:利用电导漂移实现单次迭代 2.12ms 延迟 — maier_ak · 2026-09-01
- Qwen3.8 Flash 在双 DGX 上跑出 415 tok/s — NVIDIAAI · 2026-09-01