Raschka:一亿美元做 LLM 应全砸后训练

Sebastian Raschka 在播客中被问到「若有 1 亿美元如何打造 SOTA 级 LLM」,他的答案是:不从头训练,而是选用现成模型,把预算全部投入后训练(post-training)。讨论中 MaziyarPanahi 补充爆料称,据创始人暗示,Jev 的数据集 100% 为合成生成,且没有做预训练、仅做后训练,从而省下巨额成本,其泛化能力仍令人印象深刻。

2026-09-20 ~ 2026-09-20 · 3 条相关