8 小时烧完 $200:用户实测 Astra 后称「这不是 AGI」
Firm-Club-8334 · reddit · 2026-09-07
一位用户分享对 GPT-6 Astra 的冷静复盘:最初被演示惊艳,8 小时就花完 $200 额度,但次日细查发现 4 个任务里 3 个产物实际跑不起来。
- 官方演示集中在 3D、Blender 和游戏,但在编码和 agent 任务上「完全没有提升」;
- 单任务常耗时 2 小时以上,几乎无法迭代和纠偏;
- 他已回到 KIMI K.3 + DeepSeek flash 的组合,同时维持 OpenAI 和 Claude 的 Max 订阅,但每月 $400+ 的开销开始吃力。
结论:距离 AGI 还远,质疑这是否是一场协同营销。与铺天盖地的惊艳演示形成有价值的反差样本。
所属事件:早期用户实测 GPT-6 Astra:四项任务三项跑不通,难言 AGI(4 条相关)→
「模型」频道最新
- 数学家指责 OpenAI Astra 十项数学成果涉研究不端:未引用已有文献 — asusarla · 2026-09-07
- OpenAI 新模型在旧 Chat Completions 接口禁用 function tools,迁移二选一 — AI-Specialist-6597 · 2026-09-07
- 开发者实测:Astra 擅长自主目标推进,指令遵循却不及 Sol — MinqiJiang · 2026-09-07
- 美国政府正以 1 美元价格使用三大模型,合同本月到期存续未知 — LuizaJarovsky · 2026-09-07
- SimpleBench 成绩显示 AI 常识推理超过人类 — DigSignificant1419 · 2026-09-07
- 腾讯 Hy4 成 OpenRouter 用量最高模型,却几乎无人讨论 — cantor8 · 2026-09-07