爆料称 OpenAI Astra 有两个测试版,主打长时自主任务
Ok_Display_3159 · reddit · 2026-09-03
内部测试者 Lentils80 披露:OpenAI 的两个 GPT Astra 检查点 "ultima-alpha" 和 "vega-alpha" 正在测试中。前者疑似面向公众的发布候选版,后者是面向特定企业的网络安全专用版本。
基于其大量实测:
- 长时任务与编排:OpenAI 宣称 Astra 为长时间运行任务与编排而生并非虚言——不设置 "/goal" 也能长时间全自主运行,编排和指导子 agent 的能力很强;
- 研究能力:擅长应用现有学术文献,在涉及大量复杂数学计算的图形优化难题上表现出色;
- 编码:代码质量与可维护性在其测试的所有模型中排名第一;但常见用法可能是 Astra 当主 agent、便宜模型当子 agent;
- 创意写作:明显优于 5.6 Sol,"slop" 感显著减少;
- 补充观察:代码优于 Fable,但前端与 3D 较弱(不确定对比的是 5 还是 5.1)。
「编程与Agent」频道最新
- Fable 5.1 生成 three.js 网站实测:快且精准,但细节仍需人把关 — repligate · 2026-09-03
- SentinelX 开源:让 LLM 安全接管你的 Linux 服务器终端 — CarolusX74 · 2026-09-03
- 连载 30 天:用 fable 5.1 给户外机器人写出无线手柄控制器 — _Stocko_ · 2026-09-03
- 试水 AmpCode:可用 ChatGPT 订阅、每线程一台云电脑,槽点是吉祥物 Puck — carlosdponx · 2026-09-03
- 一人一 Agent 独立 microVM:语言学习产品上线生产环境的三个教训 — maritime_sh · 2026-09-03
- 断网手写 10 页文档后让 Agent 做成 PPT:作者发现自己文字像 AI 糊弄产物 — cnakazawa · 2026-09-03