实测 GPT Pro 推理深度碾压对手:发现跨研究关联并纠正数据

PromptOutlaw · reddit · 2026-08-19

作者在研究 Agent 记忆完整性时,将结果输入 GPT Pro、Fable、Opus、GPT Extra Hard 和 Gemini Pro,要求它们从各个角度批判研究。

所有模型表现都不错,但 GPT Pro 花费 45 分钟思考后提供了远超预期的输出,包括:

作者认为 GPT Pro 在系统思考的广度与深度上目前仍无对手。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →