GPT-5.6 Sol 与 Grok 4.5 对比

Acceptable-Object390 · reddit · 2026-07-10

这条帖展示了一个用 Row-Bot 做的对比:同一任务交给两个子智能体,分别使用 **GPT‑5.6 Sol** 和 **Grok 4.5**,再比较它们在网页研究、X 研究、指令遵循、设计能力和图像生成上的表现。 结果里,GPT‑5.6 Sol 被认为: - 研究更谨慎,能把“已验证事实”和“社区印象”分开 - 对不确定性更诚实 - 对模型解释更清楚 Grok 4.5 的单张视觉卡更强、更像一个密集仪表盘,但也被指出塞进了过多精确数值,方法说明不够充分。最终作者给出的总冠军是 **GPT‑5.6 Sol**,理由是它更可信、更实用。作者还提醒:两边都不是正式 model card,更像带研究过程的编辑性摘要。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →