Sebastian Raschka:拿 1 亿美元做 LLM,我会全砸后训练
rasbt · x · 2026-09-20
- Sebastian Raschka 分享:有人问他若有 1 亿美元预算如何打造最先进的 LLM,他的答案是使用现成模型,把预算全部投入 post-training。
- 对话中提到 Jev 通用化表现令人印象深刻,其创始人暗示数据集 100% 合成生成、无预训练、只对现有模型做后训练,可省下大量成本。
所属事件:Raschka:一亿美元做 LLM 应全砸后训练(3 条相关)→
「模型」频道最新
- 研究者看好 Jev 带火 encoder 式结构化分类,单模型可解千类问题 — cwolferesearch · 2026-09-21
- 从业者提醒:benchmark 只是方向性信号,别替代本地场景实测 — evijit · 2026-09-21
- 把 Claude 各档模型比作交通工具:Haiku 自行车到 Fable 母舰 — __rum_ham__ · 2026-09-21
- 传闻:OpenAI 神秘 Bell 模型瞄准数学与编程「窄域 ASI」 — VraserX · 2026-09-20
- 小米 MiMo V2.6 训练直播 4 天半烧掉 324 万美元 — teortaxesTex · 2026-09-20
- Resetwatch 插件一页聚合 14 家 AI 服务用量与额度重置时间 — Teknium · 2026-09-20