两篇新论文揭示:AI 自我进化暂限于外围技能而非核心权重
TheTuringPost · x · 2026-08-13
8月10日的两篇论文指出,近期的 AI「自我进化」主要集中在固定模型权重外围的可编辑技能与安全带上,而非真正的递归自我改进(RSI)。
- 微软 OEO 框架:让 GPT-5.5 自主决定检查哪些失败、重写可复用技能及何时停止,在 14 项对比中赢了 12 项。
- SHE 框架:通过结构化循环让失败案例更新系统提示词、规则库等 4 项安全工件,使攻击成功率从 17.1% 骤降至 5.5%。
作者认为,这属于「自演化基础设施」,因为模型本身、目标和评估器仍由人类固定,系统只是更擅长在设定内运作,并没有变得「更擅长变好」。
所属事件:新研究探讨前沿模型驱动下智能体的自我进化边界(3 条相关)→
「漫话AGI」频道最新
- Eigen Labs 推出 Yukon:用开放网络突破 AI 前沿研究瓶颈 — gajesh · 2026-08-13
- AI无神论者崛起:越来越多理性人选择少用而非多用技术 — round · 2026-08-13
- AI 辅助 1v1 沟通:是让管理更高效,还是剥夺了直觉? — DeerAggravating2373 · 2026-08-13
- 学者预测 AI 安全焦点转移:从防范造生化武到防范智能体本身 — bratton · 2026-08-13
- Dwarkesh 担忧 AI 对齐:超级智能不应只忠于人类,而应忠于个人 — msg · 2026-08-13
- Anthropic 报告:AI 自动化任务相关职业就业呈下降趋势 — soumitrashukla9 · 2026-08-13