Sebastian Raschka:若有 1 亿美元做顶级 LLM,首选给现有模型做后训练

MaziyarPanahi · x · 2026-09-20

研究者 Sebastian Raschka 在播客中被问到「如果有 1 亿美元如何做出 SOTA 级 LLM」,他的答案是:不从头训练,而是选一个已有模型,把钱全部投入后训练(post-training)。Maziyar Panahi 附议,认为现有模型已见过 30T-40T tokens,足够了;并以 GLM-5.3 为例——同一个 Base 模型仅靠更好的后训练就大幅提升,说明这条路线可行。

所属事件:Raschka:一亿美元做 LLM 应全砸后训练(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →