新模型将在 RL 环境中做出原创发现,训练与工作边界日趋模糊

andreisavu · x · 2026-09-03

作者预判:新一代模型将能在强化学习环境中做出新颖的发现,届时「训练结束」与「实际工作开始」之间的界限会变得相当模糊——模型不再只是被动接受训练任务,而是在环境中的持续探索本身就是产出。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →