同一 agent 循环实测 14 模型:硬性预算下 GPT-6 Astra 全胜

smith2008 · reddit · 2026-10-02

作者为「照片转 Blender 场景」agent 做了统一基准:每个场景限时 20 分钟、$4、60 次请求,14 个模型当大脑,由 agent 外部的确定性代码评审重渲染结果。

关键发现:

榜首:GPT-6 Astra 66 分($3.91/次)、GPT-6.1 Sol 61($0.36)、Claude Opus 5.5 60($1.19)、Claude Sonnet 5.5 56($0.50)。

所属事件:14 模型盲测 3D 重建:GPT-6 Astra 三场景全胜(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →