GPT-5.6 在 SimpleBench 落后 GPT-5.5
burny_tech · x · 2026-07-11
有人指出,**GPT-5.6 Sol Pro** 在 **SimpleBench** 上的表现比 **GPT-5.5** 更差,称这种能力表现有些“jagged intelligence”。 这是一个很短的模型评测/对比观点,没有更多展开,但核心信息是:新版本在某项基准上不如上一版。
所属事件:GPT-5.6 与 Grok-4.5 的 SimpleBench 表现引争议(2 条相关)→
「模型」频道最新
- Kimi K3 接入 Claude Code 工作流做同场对照 — tomcrawshaw01 · 2026-07-21
- 有人称 OpenAI 和 Anthropic 抱怨中国开源权重模型很荒谬 — krishnan · 2026-07-21
- Anthropic 研究员称 Fable5 证明 87 年雅可比猜想反例 — 歸藏的AI工具箱 · 2026-07-21
- PrismML Bonsai 27B 量化后仅 3.8GB 可手机运行 — tony10000 · 2026-07-21
- actAVA AI 推出 1T 参数医疗代理模型 Cura — _akhaliq · 2026-07-21
- 有人觉得 Claude Fable 出现了更像 Gemini 的僵硬感 — teortaxesTex · 2026-07-21