实测:GPT-6-luna 用 API 每 effort 档能多给推理 token
LysandreJik · x · 2026-10-07
evalstate 实测 GPT-6-luna 的推理 token 预算:通过 API Key 可以在每个 effort 档位获得更多 reasoning token,走不同路由/供应商调用时值得注意。用 Codex CLI 0.160.0 + terminal-bench 2.1(剔除 10x QEMU 任务)测试,tb-21 任务上 10.5k 输出 token 即到达收益递减点;API 最大可到约 18,000 token,得分约 80.5%,略低于 Luna 5.6。
「编程与Agent」频道最新
- Java Vector API 实战:JDK 16 起可直接写 SIMD 榨干单核性能 — lemire · 2026-10-07
- 有人真用 AI agent 全自动投简历、联系招聘官吗?求真实体验 — haseeb_heaven · 2026-10-07
- 14 年老程序员:真正的红线是把整个代码库交给 agent — erwinalp5 · 2026-10-07
- 开源 LLM 20 分钟搞定 Tuya 固件逆向改写,绕过 Claude 安全拦截 — ngxson · 2026-10-07
- Reddit 热议:上下文管理、动态路由、提示缓存三大降本法怎么选 — Extension_Lake4065 · 2026-10-07
- 「表亲军团」:开源 Claude agent 框架让 AI 跨会话记住自己是谁 — bomba_____ · 2026-10-07