Allie K. Miller 早期实测 Astra:电脑操作惊艳,复杂文字游戏仍失败
alliekmiller · x · 2026-09-04
AI 创业者 Allie K. Miller 分享对 GPT-6 Astra 的早期实测,面向商业用户的七点结论:
- 电脑与浏览器操作极强:她认为几乎所有稳定的电脑工作流都能部分交给 AI,建议挑战"一天不碰鼠标"。
- 复杂文字游戏仍失败:至今没有模型通过她的测试。
- 不再让她烦躁:对比最近常因过度技术化的回复让她抓狂的 Claude,她不再认为 Claude 写作更好,且 Codex 在她工作流中占比上升、Claude Code 桌面版用得越来越少。
- Codex 是更好的日常主力。
- 额度方面不像 Fable 系列那样焦虑(Opus 也不用担心)。
- 3D 与动画:其他人测试结果很满意,她本人没那么惊艳——她更看重"从参考点生成准确世界"而非从零生成。
- 超大型架构类构建可能仍会用 Fable 5.1。
她还感谢 OpenAI 工程师采纳了她"Codex 语音提示需要审批"的功能请求。
「编程与Agent」频道最新
- 先写规格再写代码:web-design SKILL 用 Claude Code 从截图生成网页 — tom_doerr · 2026-09-04
- 筛选 AI Agent 用例的最快方法:数据散落各系统间才是机会 — kashifmanzoor · 2026-09-04
- Prime Intellect 采用 NIXL 权重传输,800B 模型传输提速 9 倍至个位数秒 — xeophon · 2026-09-04
- OpenAI 发布 GPT-6 Astra:核心是让 AI 直接操作你的电脑 — talkaboutdesign · 2026-09-04
- Alex Zhang 定义 agent harness:围绕模型写的代码,放进环境即 agent — CShorten30 · 2026-09-04
- OpenAI 工程师:Responses API 开启 compaction,GPT-6 Astra 刷满 ARC-AGI-3 — stevenheidel · 2026-09-04