前沿实验室在 DRACO 深度研究任务上仍落后于路由系统
iamtrask · x · 2026-07-22
Andrew Trask 认为,在 DRACO 这个深度研究基准上,前沿 AI 实验室已经把“深度研究”前沿让了出去。
- 自 5 月以来,OpenRouter、Sakana AI 和洛斯阿拉莫斯国家实验室都报告称,模型路由/融合方案的表现超过了单一前沿模型。
- OpenMined 重新复现了 OpenRouter 的实验,一个多月后这一优势仍然存在。
- 其中一个案例里,路由系统以大约一半的 Anthropic Fable API 成本达到了接近 Fable 的质量;在复现实验中,单一前沿模型里最好的只排到第 6。
所属事件:DRACO基准测试显示融合系统仍领先单一前沿模型(2 条相关)→
「研究」频道最新
- MaP-WAM 用记忆驱动规划攻克非马尔可夫机器人操作难题 — Sizhe Zhao · 2026-09-11
- 负向自蒸馏:让模型靠避开错误推理学会更好的推理 — Rongcan Pei · 2026-09-11
- DeepMind 等论文:设计文档当真相源,代码改为可抛弃产物 — Roger_M_Taylor · 2026-09-11
- GameWorld 获 ECCV 2026 多模态数字代理研讨会最佳论文亚军 — MikeShou1 · 2026-09-11
- Yann LeCun 在 ECCV 直播开讲世界模型 — Weak_Assistance_5261 · 2026-09-11
- 3D ResNet 论文八年突破 3000 引用,Kinetics 数据集成里程碑 — HirokatuKataoka · 2026-09-11