poolside 研究者对谈:上万次实验如何炼成前沿模型
arena · x · 2026-08-21
LMArena 发布新一期 Conversations 访谈,Peter Gostlev 与 poolside 的两位研究者 Connor Adams 和 Ravi 对谈,主题是把数万次数据配比实验的经验转化为推动前沿的模型。话题涵盖:如何通过快速迭代学习、大规模预训练运行的决策过程、RL 相关选择等。完整视频可在 Arena 的 YouTube 频道观看。
所属事件:poolside 研究员对谈:上万次数据配比实验推动前沿模型(2 条相关)→
「模型」频道最新
- Google 宣称 Gemma 4 31B 质量匹敌 Sonnet 5,成本低 40 倍 — 0xsachi · 2026-08-21
- Direct-OPD:弱模型 RL 经验迁移强模型 — tokenbender · 2026-08-21
- 实测6款模型:prompt缓存让幻觉检测成本从6倍降到1.5倍 — Own-Establishment293 · 2026-08-21
- 国产模型 OX Alpha 现身,智谱小米成主要猜测对象 — vista8 · 2026-08-21
- 开发者讨论:前沿模型闭源循环下,开源权重还能走多远 — PykeTheTitan · 2026-08-21
- 国产 Ox Alpha 模型实测:免费百万上下文但经常空转 — bindureddy · 2026-08-21