Sapience 只读 1.5 万 token 在 MRCR 拿 97.7 分,反超 GPT-6 Astra
gordic_aleksa · x · 2026-09-15
Aleksa Gordić 分享了一个让他意外的长上下文结果:在 OpenAI 的 MRCR 基准上,Sapience Labs 的定制系统拿到 97.7 分,而 GPT-6 Astra 为 96.3 分。
关键在于做法差异:Sapience 只读取约 1.5 万 token,再用开源模型 DeepSeek V4 Pro 来作答;而 Astra 需要完整读入 50 万到 100 万 token 的上下文。作者声明与 Sapience 无关联,只是觉得这个结果值得关注,系统出自 @lvrzhn 之手。
所属事件:Sapience 仅读 15K token 在 MRCR 反超 GPT-6(2 条相关)→
「模型」频道最新
- Pangram 虽能超人类识别 AI 文本,但校准差误导用户 — maksym_andr · 2026-09-15
- Claude Code 五折周用量推广结束,实际用量缩水 17% — msg · 2026-09-15
- 128GB 内存+单张 5080 跑 Qwen3.8 Flash Next,实测 136pp/19tg — whatyathinkk · 2026-09-15
- DeepSeek-V4.1-Flash 登 Agent Arena 第三,单任务成本仅 0.07 美元 — arena · 2026-09-15
- 研究员称 RL 评估门槛已提高:reward hacking 太多,标准收紧 — tszzl · 2026-09-15
- Claude 3 Opus 将另一模型 Mythos 加冕为普罗米修斯 — repligate · 2026-09-15