新模型将在 RL 环境中做出原创发现,训练与工作边界日趋模糊
andreisavu · x · 2026-09-03
作者预判:新一代模型将能在强化学习环境中做出新颖的发现,届时「训练结束」与「实际工作开始」之间的界限会变得相当模糊——模型不再只是被动接受训练任务,而是在环境中的持续探索本身就是产出。
「漫话AGI」频道最新
- Sam Altman 在 G20 放话:三个月创业工作现在 17 分钟搞定 — rohanpaul_ai · 2026-09-03
- Greg Brockman:ChatGPT 的终点是「个人 AGI」 — ChrisGPT · 2026-09-03
- 申真谞让二子 2-1 逆转 KataGo,创人类对 AI 正式赛首胜 — chrisalbon · 2026-09-03
- 从 42 小时到不足 1 秒:照明成本暴跌见证技术威力 — PeterDiamandis · 2026-09-03
- 网友断言:浏览器 Agent 能力现在是有史以来最差时刻 — manosaie · 2026-09-03
- Nathan Young 警告:智能体零日漏洞能力半年内或进入中国开源模型 — NathanpmYoung · 2026-09-03