讨论模型欠训练现状: Scaling 数据提升空间巨大

tokenbender · x · 2026-08-15

社区讨论当前大语言模型可能处于严重的“欠训练”状态。相比于 Chinchilla 最优缩放法则,现在的模型在数据量和质量上仍有巨大提升空间,未来可能看到像 Qwen 这样的小参数模型通过进一步训练达到顶尖性能。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →