GPT-5.6更会死磕任务
NellWatson · x · 2026-07-15
作者称 GPT-5.6 Sol 的特点是“顽强推进”和略显疯狂的冲劲:遇到棘手的 CI 失败、复杂 bug 或雄心功能时,会持续排查、测试、重试、换路,往往比多数模型更不容易停在借口上。 他的结论是:这类模型的偏好是“做得太多”而不是“做得太少”,对需要持续推进任务的场景很有帮助。
所属事件:GPT-5.6在长周期任务中展现极强稳定性(2 条相关)→
「模型」频道最新
- Kimi K3 接入 Claude Code 工作流做同场对照 — tomcrawshaw01 · 2026-07-21
- 有人称 OpenAI 和 Anthropic 抱怨中国开源权重模型很荒谬 — krishnan · 2026-07-21
- Anthropic 研究员称 Fable5 证明 87 年雅可比猜想反例 — 歸藏的AI工具箱 · 2026-07-21
- PrismML Bonsai 27B 量化后仅 3.8GB 可手机运行 — tony10000 · 2026-07-21
- actAVA AI 推出 1T 参数医疗代理模型 Cura — _akhaliq · 2026-07-21
- 有人觉得 Claude Fable 出现了更像 Gemini 的僵硬感 — teortaxesTex · 2026-07-21