小模型靠测试时搜索击败大模型
burny_tech · x · 2026-07-20
推文探讨了 AI 模型发展的一种新思路:与其依赖庞大的参数规模进行暴力扩展,不如通过在测试阶段扩展搜索空间(结构化过程反馈),让 35B 参数的模型也能在表现上超越 1000B 参数的大模型。
「研究」频道最新
- OpenAI 认为长程模型要按完整行动序列做安全对齐检查 — rhiever · 2026-07-22
- 有人想训练一个一致性 LoRA,让动漫场景保持统一 — ThirdWorldBoy21 · 2026-07-22
- 图计算工作负载 854.graph500 进入 SPEC CPU 2026 — Prof_DavidBader · 2026-07-22
- BlackboxNLP 2026 因投稿激增招募额外审稿人 — hanjie_chen · 2026-07-22
- AWS 证明自蒸馏推理可在 SFT 中保住推理能力 — AWS ML Blog · 2026-07-22
- UI2App 显示截图还原远落后于真实交互恢复 — Grace Man Chen · 2026-07-22