Ethan Mollick 实测 Astra:给它模糊需求,它自己拆任务就开干
emollick · x · 2026-09-04
Ethan Mollick 分享用 Astra 的体会:Astra(以及 Fable)最有趣也最难把握的一点是它们会直接采取行动。他给了一个定义不清的 Blender 交付需求,Astra 自行启动一个历史研究 agent 和一个视觉评审 agent 等,直接开始干活,而不需要用户先明确所有细节。
「模型」频道最新
- Gary Marcus 预测:新模型确有改进,但将再现刷榜式锯齿短板 — GaryMarcus · 2026-09-04
- GPT-6 Astra 登顶代码迁移基准,68% 准确率领先第二名 10 分 — sandersted · 2026-09-04
- 吴恩达调侃前沿模型太弱:来跟我聊聊,问题会让它们宕机 — andrewgwils · 2026-09-04
- Epoch AI 发布 FrontierMath Erdős 基准,Astra 以 2/68 居首 — keviv9 · 2026-09-04
- OpenAI 发布 GPT-6 Astra:ARC-AGI-3 得 99.9%,但独立评测泼冷水 — Latent Space · 2026-09-04
- Liquid 发布 Nanos 系列:350M-2.6B 专用小模型主打端侧 Agent — JosephJacks_ · 2026-09-04