Hugging Face 放出 SmolLM3 mid-training 检查点,回应 200 倍效率之争
eliebakouch · x · 2026-08-20
SmolLM3 作者 eliebakouch 宣布已发布 SFT 之前的 mid-training 检查点(SmolLM3-3B-checkpoints 的 it-mid-training 分支,Apache-2.0,约 6.17GB),建议后续工作从这个 checkpoint 起步,并预期新方法能轻松超过它(毕竟是约一年前的检查点)。同时他认为「200 倍」的说法有些夸大,但认可工作本身不错,也同意 mid-training token 与最终 SFT 数据的影响力不应等量齐观。
「模型」频道最新
- Armin Ronacher 长文解析:reasoning effort 如何写进系统提示词并破坏 KV 缓存 — mitsuhiko · 2026-08-20
- 实验显示 ChatGPT 似乎无法执行“不回复”指令 — cranberryalarmclock · 2026-08-20
- 真实 C++ 项目实测:Qwen 3.8 27B 工程判断胜过 Gemini 3.7 Flash — GravyPoo · 2026-08-20
- Qwen 3.8 27B 本地跑思考不停:想满上下文也不产出 — WyattTheSkid · 2026-08-20
- LiquidAI 发布 LFM 2.5 QAD,GGUF 已上 Hugging Face — jacek2023 · 2026-08-20
- 实测 Gemini 3.7 Flash:唯一零修复渲染的模型 — DynamicWebPaige · 2026-08-20