GPT-6 Sol算力拉满近线性提升:各effort档位成绩对比实测
PawelHuryn · x · 2026-09-23
开发者 Pawel Huryn 发布 GPT-6 Sol 各 effort 档位的实测对比(max 档 n=3,其余 n=1),图表显示成绩随 effort 提升几乎是一条直线。此前他还给出数据:GPT-6 Sol(max)≈GPT-5.6 Sol(medium),但仍低于 Opus 5.5(medium)。后续计划接着测 GPT-6 Luna 与 GPT-6 Terra。
所属事件:GPT-6 Sol 实测:算力拉满近线性提升但Bug修复仍落后(2 条相关)→
「模型」频道最新
- 网友晒 Claude Opus 5.5 独立完成代码审查,「抢了 Theo 的活」 — 0xkarasy · 2026-09-23
- Sarvam 语音模型 Saaras V4 新增 keyterm 提示提升转写准确率 — cneuralnetwork · 2026-09-23
- 小米 MiMo V2.6 Pro 登顶开源榜,成本低至每任务约 $0.13 — heyshrutimishra · 2026-09-23
- 小米 MiMo V2.6 Pro 登顶全球开源模型榜,单任务成本约 $0.13 — heyshrutimishra · 2026-09-23
- 用户深挖 Muse 智能体:可发 IG 私信、控制智能家居甚至自建邮箱 — flaneur451 · 2026-09-23
- Yacine 吐槽:中国 RL 模型登顶背后只是 on-policy 合成数据 — yacineMTB · 2026-09-23