Kardashev-0.7:首个由32个模型组成的RL训练群体,成本仅0.7%-2%

Scobleizer · x · 2026-10-06

Kardashev-0.7 宣称是全球首个由 32 个不同模型组成的训练化群体(swarm),采用名为 RLPS(Reinforcement Learning for Population Scaling)的强化学习方法训练。

关键点:

所属事件:Kardashev-0.7:32 个模型联合强化学习训练成种群(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →