OpenAI GPT-5.6 系列登场
Don't Worry About the Vase (Zvi) · rss · 2026-07-14
这是一篇长文评论 OpenAI 新模型 GPT-5.6 系列:Sol、Terra 和 Luna。作者认为 Sol 和 Fable 都很强,但定位不同:Fable 更像“更聪明的合作伙伴/架构师”,Sol 则更像“能把事情做完的工作马”。
文中还整理了 OpenAI 的官方说法与社区反馈:
- 定价:Sol 为 $5/$30,Terra 为 $2.50/$15,Luna 为 $1/$6;作者拿 Opus 和 Fable 的价格做了对比。
- 编码/智能体能力:官方把重心放在 Agents’ Last Exam、AA Agent Coding Index v1.1 和 BrowseComp,声称在多项任务上领先。
- 内部使用:OpenAI 表示,研究人员用 GPT-5.6 加速调试、训练系统优化、实验运行和结果分析;内部研究相关的 coding inference 和 agentic token 使用增长很快。
- 健康评测:官方称在医疗场景里,GPT-5.6 在成本更低的情况下表现更强,甚至有医生盲测觉得它的回答优于医生写作。
- 安全与生物/网络风险:文中提到 OpenAI 也讨论了安全护栏,但细节有限。
作者总体判断是:Sol 在“实际把活干掉”方面很强,尤其适合与编码/agent 工作流搭配;而更高智能和更强“规划感”的任务,仍更偏向 Fable。
「编程与Agent」频道最新
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11
- 开源 Agent Skill 2.3k 星:生成 MVP 蓝图并审计重构 agentic harness — tom_doerr · 2026-09-11
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- 首届 Three.js 大会落地巴黎,AI 正缩短从想法到原型的距离 — OdinLovis · 2026-09-11