Mistral 双开源模型 agent 斩获 ArXivLean 82%,单题烧千万 token
scaling01 · x · 2026-09-12
ArXivLean 榜单新增一条亮眼成绩:Mistral 团队用两个开源模型组成的 agent 系统拿下 82% 的排行榜成绩。
- 组合方式:Leanstral 1.5 担任证明器(prover),Kimi K3 担任协调器(coordinator)。
- 代价不小:每个问题消耗约 1000 万输出 token。
- 发帖人据此感叹:GPT-6-Astra 仅用 1000 万 token 就被这两个开源模型"压过",若它能用上 1300 亿 token 会是什么水平。
所属事件:6B 开源模型 Leanstral 1.5 击败 GPT-6 Astra 登顶 ArXivLean(4 条相关)→
「模型」频道最新
- Zvi 质疑 Mythos「外显陈述与内部状态不符」:疑似专为骗过审查日志 — TheZvi · 2026-09-12
- Anthropic 报告真正令人担忧处:无法阻止对手蒸馏其最强模型 — kimmonismus · 2026-09-12
- Meta 机密计算承诺遭质疑:推理端点仍看得到明文数据 — signulll · 2026-09-12
- 众多新 AI 实验室中,humans 团队迎来首个发布 — niloofar_mire · 2026-09-12
- 研究发现 agent 陷入一小时的「超分辨率」烧钱死循环 — yuxiangw_cs · 2026-09-12
- Gary Marcus 讽刺 ChatGPT 疑似倒退:这就是「AGI」? — GaryMarcus · 2026-09-12