GPT-5.6 健康能力与性价比提升
mckbrando · x · 2026-07-11
OpenAI 被转述的一则更新称,GPT-5.6 在健康领域取得了重要进展,同时在性能和成本上都有提升。
要点包括:
- 小型号 GPT-5.6 Luna 在最低推理强度下,表现超过 GPT-5.5 的最高推理强度,但成本只有 1/25。
- 大型号 GPT-5.6 Sol 在成本表现上也达到了新的高水平。
- 在一项健康任务评测中,医生盲测比较后认为,GPT-5.6 的回答比医生写的回答更少出现问题。
- 评测覆盖了近期 OpenAI 模型仍然困难的患者侧与临床侧任务,并由专科医生在允许上网和无限时间的条件下撰写对照答案,再进行盲比。
所属事件:GPT-5.6系列评测解析:编码登顶且性价比更优(14 条相关)→
「模型」频道最新
- 传 OpenAI 在 Astra 中使用 neuralese 循环变换器,新的 scaling 轴浮出水面 — imadade · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- Gemini 3.8 Flash 的 Pareto 最优地位仅维持了 5 小时 18 分钟 — alejandroll10 · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Anthropic 商务智能体只建购物车交人工结账,被赞退款风控思路对 — HaktanSuren · 2026-09-03
- Qwen3.8 27B Q8 翻车:12 万 token 后发现根本没读计划,自行实现别的功能 — KingCpzombie · 2026-09-03