大模型检索训练需重新聚焦失败案例
antoine_chaffin · x · 2026-08-31
作者发现训练更大、更强的检索 Backbone 需要与小模型不同的关注点。大模型默认已具备广泛覆盖能力,因此训练重点应放在系统性的失败案例上,因为这里仍有潜在的巨大提升空间。作者表示不得不重新审视之前通过大量训练积累的直觉,这令人谦卑。
「研究」频道最新
- François Chollet 回应 ARC-AGI 评测争议:勿宣称未跑分成绩 — fchollet · 2026-08-31
- 研究复盘:线性注意力未生效的发现 — jm_alexia · 2026-08-31
- 谷歌发布 GlucoFM 模型,提升连续血糖监测预测能力 — thione · 2026-08-31
- LAION 发布 1000 万小时开源视频数据集,助力多模态训练 — thione · 2026-08-31
- Figure 发布 Index 数据集,宣称拥有全球最大机器人训练数据 — thione · 2026-08-31
- NYU 论文:用语音 AI 进行大规模个性化口试,单次成本不到 1 美元 — ipeirotis · 2026-08-31