GPT-5.6 Sol 与 Grok 4.5 对比
Acceptable-Object390 · reddit · 2026-07-10
这条帖展示了一个用 Row-Bot 做的对比:同一任务交给两个子智能体,分别使用 **GPT‑5.6 Sol** 和 **Grok 4.5**,再比较它们在网页研究、X 研究、指令遵循、设计能力和图像生成上的表现。 结果里,GPT‑5.6 Sol 被认为: - 研究更谨慎,能把“已验证事实”和“社区印象”分开 - 对不确定性更诚实 - 对模型解释更清楚 Grok 4.5 的单张视觉卡更强、更像一个密集仪表盘,但也被指出塞进了过多精确数值,方法说明不够充分。最终作者给出的总冠军是 **GPT‑5.6 Sol**,理由是它更可信、更实用。作者还提醒:两边都不是正式 model card,更像带研究过程的编辑性摘要。
「模型」频道最新
- 一条暗示帖把 GLM 5.5 的发布时间推近了 — mark_k · 2026-07-21
- Nemotron 3 Ultra 预测榜表现突出 — kuchaev · 2026-07-21
- Kimi K3 登上 Agent Arena 第4 — arena · 2026-07-21
- Qwen 3.8 口碑分化 — davidtsong · 2026-07-21
- SuperGrok Heavy重回99美元/月 — Daniel_Farinax · 2026-07-21
- 一天实测Kimi K3:上限高但代价大 — Tarandjpop · 2026-07-21