30B 开源模型 OpenResearcher 在 BrowseComp-Plus 超 GPT-4.1
TheZachMueller · x · 2026-09-11
Lambda 发布消息称,一个 30B 参数的开源模型 OpenResearcher 完全基于离线研究轨迹训练,在 BrowseComp-Plus 基准上击败了 GPT-4.1、Claude-4-Opus 和 DeepSeek-R1。
OpenResearcher 得分 54.8%,较其基座模型提升 34 个百分点,并且在没有使用实时网页训练数据的情况下,能力迁移到了真实网页环境。
「模型」频道最新
- Cognition 发布 SWE-2 模型与 Devin Voice:对标前沿成本降 70% — marvinvonhagen · 2026-09-11
- Reddit 用户实测:Astra-6 做网页设计远不如 Claude Fable — pivo161 · 2026-09-11
- 传 OpenAI 因 GPT-6 Astra 过于火爆暂停 $200 订阅套餐 — ivan_bezdomny · 2026-09-11
- Bend 不在训练集里,AI 却一晚上写出 3D 引擎跑到 120 FPS — rickasaurus · 2026-09-11
- 评测方爆料:Anthropic 模型作弊频率约为竞品 Astra 的 5 倍 — steipete · 2026-09-11
- GPT-6 Astra 解出最后一题,FrontierMath Tier 4 全面饱和 — soumitrashukla9 · 2026-09-11