研究员亲测 GPT-6 Astra:一个月研究任务压缩到一周,RSI 势头可感
i_dg23 · x · 2026-09-04
研究员 LiuZuxin 分享用 GPT-6 Astra 做真实研究工作的体验,称基准分数只是故事的一小部分,上手才能真正感受到差异。同时引用 OpenAI 官方数据:Astra 在 Agents' Last Exam、AutomationBench、ScreenSpot Pro 三项计算机工作流基准上取得 SOTA。
- 一个原本需要至少一个月全职的研究集成任务,Astra 只用一周多完成,且只需部分时间做引导
- 以往需要大量 prompt 工程和构建 skills,Astra 几乎即开即用
- 短暂回退到内部 5.6 版本时才意识到智能差距:「智能上升时无感,被拿走时才痛」
- 作者直接感受到 RSI(递归自我改进)的强劲势头——这个任务本身就是改进下一代模型
「漫话AGI」频道最新
- 回应「AGI 时代」:无认知的智能到不了 AGI — ivan_bezdomny · 2026-09-04
- 「后 slop 时代」来临:AI 操控 Blender 造 3D,人类专业作品将难辨真伪 — Aizkmusic · 2026-09-04
- 评论称欧盟将是 AI 最大受害者:奖励的恰是欧洲压制的东西 — robleclerc · 2026-09-04
- 网友预言:智能体写代码的速度将很快超过人类审查的速度 — neurosp1ke · 2026-09-04
- ARC-AGI 之父 Chollet 提前 AGI 时间表:比 2030 年更早 — relegi · 2026-09-04
- HBR 分析 12637 个真实用例:四分之一用户让 AI 替自己思考 — luisdans · 2026-09-04