参数规模边际递减,RL 与迭代成新关键

teortaxesTex · x · 2026-08-19

分析指出 0731 模型以 3 倍小的参数量匹配甚至超越 GLM-5,表明单纯追求万亿级参数可能不划算。当前可能正处于相变点,与其继续扩大参数规模,不如将算力投入强化学习管线和中期训练,以加快迭代速度并提升效果。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →