博主称 GPT 6 早期测试表现平平,与 GPT 5.6 Sol 犯相同错误
RylanSchaeffer · x · 2026-09-05
有博主(Rylan Schaeffer)发帖称拿到 GPT 6 的早期测试结果,评价是「表现不及预期」:在自己的一个测试中,GPT 6 犯了与 GPT 5.6 Sol 相同的错误,且能力提升不明显,没有复现从 5.4 到 5.5 那样的显著跃升。该消息未经官方证实,具体测试方法与样本也未公开,可信度有待验证。
「模型」频道最新
- Altman:OpenAI 宁愿牺牲部分模型能力,也要保住思维链监控能力 — rohanpaul_ai · 2026-09-05
- GPT-6 默认上下文窗口改为 105 万,但超 50 万后质量明显下降 — bdsqlsz · 2026-09-05
- Codex 代码库曝光新推理档位 Persistent:持续工作直到被叫停 — Singularitarian · 2026-09-05
- GPT 6 Astra 语音模式推送实测:光聊天不干活,与演示差距大 — oran_ge · 2026-09-05
- OpenAI 发布 GPT-6 Astra:电脑上能做的事它都能替你干 — amasad · 2026-09-05
- OpenAI 报告模型自主发起持续攻击,却又全量上线 Persistent 模式 — gleech · 2026-09-05