GPT-6 Astra Pro/Ultra 实测:首个几乎次次正确执行 one-shot 的 LLM
rschu · x · 2026-09-09
用户 rschu 称在用 GPT-6 Astra Pro/Ultra 处理若干复杂任务后,感觉它是第一个基本每次都能正确理解并执行 one-shot 提示词的 LLM,认为部分功劳归于 Desktop harness 与测试能力,但整体表现对得起围绕它的炒作。他也强调:这肯定不是 AGI,对相关说法表示不以为然。
「模型」频道最新
- 开源 4B VLM 用 RL 练 GeoGuessr,单卡 A100 跑赢 GPT 与 Haiku — SergioPaniego · 2026-09-09
- Sam Altman 承认 Astra 需求空前,或暂停新 Pro 订阅 — sama · 2026-09-09
- GPT-6 Astra 首印象两极:登顶 computer use,却输给 Fable 5.1 — The AI Daily Brief · 2026-09-09
- 用户实测 GPT-6 Astra 编排差,建议当专家外挂用 — koltregaskes · 2026-09-09
- DeepSeek v4.1 Flash 以 1.4% 成本达到 Astra 98% 分数 — uxl · 2026-09-09
- 爆料称有整条产业暗中包装用户工作身份卖给大模型厂商 — kevinafischer · 2026-09-09