研究者提出用电子游戏测试AI递归自我改进能力

业界正探讨如何评测具备递归自我改进(RSI)能力的AI模型。有研究者提出,静态基准测试已显不足,应引入复杂的电子游戏作为测试场景。通过让模型在单机通关、对战与速通等任务中不断试错、记忆失败原因并积累经验,能更有效地检验AI是否能从失败中学习并实现真正的自主进化。

2026-08-06 ~ 2026-08-06 · 3 条相关