网友实测 Gemini 与 OpenAI 长时任务进展缓慢

网友 teortaxesTex 近期分享了对两家模型的实测观察:一个未启用 Deep Research 的 Gemini Pro 订阅任务持续运行近 5 小时几乎无进展,但 Gemini 仍被看好;另一个 OpenAI 沙盒环境任务跑了约 3 小时后以失败告终,他猜测是将沙盒环境逼到了极限。两次测试均显示长时自主任务仍存在明显瓶颈。

2026-09-08 ~ 2026-09-08 · 2 条相关