Fireworks meetup 实操分享:Kimi K3 上的持续 RL 后训练怎么调
anbarth · x · 2026-08-17
AI Performance Engineering Meetup 将举办线上分享(8月17日9am PDT),由 Fireworks.ai 的 Sinan Ozdemir 主讲「Rollout, Reward, Update, Repeat: How Fireworks Optimizes Continuous Post-Training」。
内容将围绕在 Kimi K3 上用 Fireworks serverless API 跑一场后训练 RL 会话展开,讨论算法选择、损失函数、LoRA rank、超参数与奖励设计之间的相互作用——以及它们如何决定模型能否真正学到东西。作者强调,让 RL 在生产中持续跑起来的关键在于数据管道和学习环境的设计。
「公司和人」频道最新
- Google DeepMind 联合 Gradient 举办开源模型黑客马拉松 — darian314 · 2026-08-18
- Chrome迎来新产品VP,其创业工具Relay.app将关停 — laparisa · 2026-08-18
- Grok 年付疑似 BUG 溢价赠千刀 Cursor — AGI Hunt · 2026-08-18
- 机器时代投资指南:算力、能源与稀缺资源的淘金逻辑 — 0xSammy · 2026-08-17
- 2024 年后成立的初创公司,你们用哪家云? — yenkel · 2026-08-17
- OpenAI 收购 17 岁开发者的以太坊项目 — Horror-Tower2571 · 2026-08-17