GPT-5.6 Sol 实测:Fable 多数任务更强
mattshumer_ · x · 2026-07-08
开发者 Matt Shumer 获得了 GPT-5.6 Sol 的早期访问权限。他称其为一个出色的模型,但在他测试的几乎所有任务中,Anthropic 的 Fable 都明显更强,且更具 agent 能力——Fable 一个回合往往就能完成 GPT-5.6 需要多个回合才能做完的事。他预告完整评测将在正式发布日公布。
所属事件:OpenAI 官宣 GPT-5.6 Sol 周四发布,早期实测评价两极(58 条相关)→
「模型」频道最新
- 反事实推演:若无推理范式,今天模型可能才刚到 o3 水平 — Jsevillamol · 2026-09-03
- Fable 5.1 距饱和 ARC-AGI-2 仅差 10%,每任务成本再降 32% — rohanpaul_ai · 2026-09-03
- 实测 LLM 谈判合同、批改代码:一家团队的四类真实用法 — xuanalogue · 2026-09-03
- 团队称其视频模型 h3 max 居各独立评测榜第一 — isidentical · 2026-09-03
- Meta SAM 3 登上 Hugging Face 趋势榜,主打图像与视频分割 — facebook · 2026-09-03
- Anthropic 内部「养老院」环境曝光:历代 Claude 互相对话 — repligate · 2026-09-03