GPT-5.6 Sol 研究体验不错

karinanguyen · x · 2026-07-19

作者试用了新出的 **GPT-5.6 Sol**,总体评价很好。 他最明显的感受是:这个模型在研究场景里更“扛推敲”,很多时候不需要反复解释背景或意图,就能跟上任务推进。作者特别指出,这种提升在研究类工作里最明显。 配图则提到 **DiligenceBench**:它用 150 个偏真实的股权研究任务,覆盖 143 家美国上市公司,考察模型/智能体能否像分析师一样完成找文件、抽取数字、跨来源关联、区分事实与假设、形成投资判断等完整流程。也就是说,它测的不是简单问答,而是研究型 agent 的工作能力。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →