GPT-5.6 早测反馈流出
Angaisb_ · x · 2026-07-08
这条帖汇总了 GPT-5.6 早期测试者的反馈。帖主称,大家最常提到的是它的“持久执行”能力:会持续做下去,直到任务真正完成;另外在数学和编码上有明显提升,也更擅长使用子代理,并且据说电脑操作能力很强。
所属事件:OpenAI 官宣 GPT-5.6 Sol 周四发布,早期实测评价两极(58 条相关)→
「模型」频道最新
- LlamaIndex 实测 Fable 5.1:文档 OCR 各项指标全面超越上代 — llama_index · 2026-09-03
- 反事实推演:若无推理范式,今天模型可能才刚到 o3 水平 — Jsevillamol · 2026-09-03
- Fable 5.1 距饱和 ARC-AGI-2 仅差 10%,每任务成本再降 32% — rohanpaul_ai · 2026-09-03
- 实测 LLM 谈判合同、批改代码:一家团队的四类真实用法 — xuanalogue · 2026-09-03
- 团队称其视频模型 h3 max 居各独立评测榜第一 — isidentical · 2026-09-03
- Meta SAM 3 登上 Hugging Face 趋势榜,主打图像与视频分割 — facebook · 2026-09-03