讨论模型欠训练现状: Scaling 数据提升空间巨大
tokenbender · x · 2026-08-15
社区讨论当前大语言模型可能处于严重的“欠训练”状态。相比于 Chinchilla 最优缩放法则,现在的模型在数据量和质量上仍有巨大提升空间,未来可能看到像 Qwen 这样的小参数模型通过进一步训练达到顶尖性能。
「漫话AGI」频道最新
- AI 提效未必缩短工时:组织决策决定时间去向 — IronCuk · 2026-08-15
- 主流播客讨论工具趋同性,安全概念破圈 — AaronBergman18 · 2026-08-15
- 畅想未来:一下午造出泳池救生机器人初创 — airesearch12 · 2026-08-15
- AI抢饭碗的假设忽视本质:人类价值本就不该由经济效用衡量 — Dr_Singularity · 2026-08-15
- 奖励黑客会让大脑停机吗?Reddit热议意识与价值 — firedragon77777 · 2026-08-15
- 观点:AI对齐的核心可能不是对齐AI,而是对齐你 — mark_k · 2026-08-15