网友实测 Gemini 与 OpenAI 长时任务进展缓慢
网友 teortaxesTex 近期分享了对两家模型的实测观察:一个未启用 Deep Research 的 Gemini Pro 订阅任务持续运行近 5 小时几乎无进展,但 Gemini 仍被看好;另一个 OpenAI 沙盒环境任务跑了约 3 小时后以失败告终,他猜测是将沙盒环境逼到了极限。两次测试均显示长时自主任务仍存在明显瓶颈。
2026-09-08 ~ 2026-09-08 · 2 条相关
- Gemini Pro 跑研究任务近 5 小时几乎无进展,仍被看好 — teortaxesTex · 2026-09-08
- 用户实测 OpenAI 沙盒任务超 3 小时失败,Pro 模型仍在苦撑 — teortaxesTex · 2026-09-08