Sebastian Raschka:若有 1 亿美元做顶级 LLM,首选给现有模型做后训练
MaziyarPanahi · x · 2026-09-20
研究者 Sebastian Raschka 在播客中被问到「如果有 1 亿美元如何做出 SOTA 级 LLM」,他的答案是:不从头训练,而是选一个已有模型,把钱全部投入后训练(post-training)。Maziyar Panahi 附议,认为现有模型已见过 30T-40T tokens,足够了;并以 GLM-5.3 为例——同一个 Base 模型仅靠更好的后训练就大幅提升,说明这条路线可行。
所属事件:Raschka:一亿美元做 LLM 应全砸后训练(3 条相关)→
「模型」频道最新
- 从业者提醒:benchmark 只是方向性信号,别替代本地场景实测 — evijit · 2026-09-21
- 把 Claude 各档模型比作交通工具:Haiku 自行车到 Fable 母舰 — __rum_ham__ · 2026-09-21
- 传闻:OpenAI 神秘 Bell 模型瞄准数学与编程「窄域 ASI」 — VraserX · 2026-09-20
- 小米 MiMo V2.6 训练直播 4 天半烧掉 324 万美元 — teortaxesTex · 2026-09-20
- Resetwatch 插件一页聚合 14 家 AI 服务用量与额度重置时间 — Teknium · 2026-09-20
- 腾讯发布 Gander:边聊天边后台干活的智能体 — The Decoder · 2026-09-20