RSI Arena 直播实验:让 AI 智能体自己训练更强 AI

一个名为 RSI Arena 的项目正在直播「递归自我改进」实验:给 AI 智能体分配 GPU 和预算(API 费用加 GPU 时间),让它们自主训练一个能在人类评估中胜出的模型。有博主跟进这场「让 AI 自己训练 AI」的竞技场,结果显示 Gemini 3.8 flash 大约训练了 12 小时后主动喊停,引发社区对 AI 自我改进能力的关注与讨论。

2026-10-01 ~ 2026-10-01 · 2 条相关