小模型逆袭:Pathway 新架构 BDH-CQ 跑分逼近 GPT-5,成本仅十一分之一
ahuja_priyank · x · 2026-08-13
Pathway 推出的 150M 参数小模型 BDH-CQ 在 ARC-AGI-1 评测中取得了突破。该模型以 $0.0007 的单任务成本实现了 29.5% 的 pass@2 准确率,而得分为 34.2% 的 GPT-5.6 Luna (Low) 成本约为其 11 倍。
核心架构创新:
- 摒弃了生成长文本思维链的传统做法,BDH-CQ 利用循环记忆在隐空间中进行推理。
- 支持灵活调整推理算力:LOW (21%)、MEDIUM (27%)、HIGH (29.5%)。
这一进展表明,AI 的下一次重大突破可能不仅仅依赖于扩大模型规模,底层架构的创新同样能大幅提升“单位美元智力”。
所属事件:Pathway 150M模型BDH-CQ刷新ARC-AGI成本效率(7 条相关)→
「模型」频道最新
- Qwen3.8-2.4T-A95B上线Modal,支持100万上下文 — AAAzzam · 2026-08-13
- 实测 Grok 4.6:达 Sonnet 级水平,开发者已转移部分负载 — bindureddy · 2026-08-13
- 网友吐槽 Qwen 3.8 开源版:无视觉能力,疑似被阉割 — entsnack · 2026-08-13
- 从智力到性价比:大模型核心评估指标的演进路线 — beffjezos · 2026-08-13
- DeepSeek与Grok新模型推动AI成本暴跌,引发杰文斯悖论 — R_D · 2026-08-13
- Grok 4.6 首日体验:超越开源模型,稳居前三 — bindureddy · 2026-08-13