前沿实验室在 DRACO 深度研究任务上仍落后于路由系统
iamtrask · x · 2026-07-22
Andrew Trask 认为,在 DRACO 这个深度研究基准上,前沿 AI 实验室已经把“深度研究”前沿让了出去。
- 自 5 月以来,OpenRouter、Sakana AI 和洛斯阿拉莫斯国家实验室都报告称,模型路由/融合方案的表现超过了单一前沿模型。
- OpenMined 重新复现了 OpenRouter 的实验,一个多月后这一优势仍然存在。
- 其中一个案例里,路由系统以大约一半的 Anthropic Fable API 成本达到了接近 Fable 的质量;在复现实验中,单一前沿模型里最好的只排到第 6。
所属事件:DRACO基准测试显示融合系统仍领先单一前沿模型(2 条相关)→
「研究」频道最新
- 3×3 框架梳理自我进化智能体与递归改进 — ChengleiSi · 2026-07-23
- Canvas-to-Image 把身份、姿态和框统一到一张画布 — CSProfKGD · 2026-07-23
- NeuroAI 文章谈 developmental alignment 与任务复杂度 — dyamins · 2026-07-23
- 一篇 2019 年论文:用五项原则讨论 AI 如何进入社会 — ArtificialOther · 2026-07-23
- 写作指纹分析称 Kimi K3 与 Fable 5 过于相似 — alex_verem · 2026-07-23
- MCP 工具调用底层机制深度解析 — jeffiql · 2026-07-23