Solar Open 2 扩到 250B,却把总训练 tokens 降了下来
keunwoochoi · x · 2026-07-26
- 这条讨论的是韩国模型 Solar Open 2:它是一个 250B 的主权 LLM,体量比 Solar Open 1 大 2.5 倍,但总训练 token 反而更少。
- 作者总结了它的四阶段后训练流程:SFT、multi-domain RL、specialist 阶段,以及 multi-teacher on-policy distillation(MOPD)。
- 论文还强调了 选择性权重迁移、总计约 10T 的通用预训练、约 1T 的强化预训练,以及面向韩国办公/监管文档的专项数据处理。
所属事件:韩国主权大模型 Solar Open 2 韩语任务领跑(2 条相关)→
「模型」频道最新
- Reddit 讨论 5.6 Sol 是否还保留 Pro 专属模型层 — Massive_Sherbert_152 · 2026-07-26
- 前沿实验室竞逐编码能力,模型正走向商品化 — willccbb · 2026-07-26
- 谷歌与英伟达高管公开力挺开放权重模型 — omarsar0 · 2026-07-26
- Grok 4.5 在 Augment Code 里周增幅登顶 — XFreeze · 2026-07-26
- Solar Open 2 已有量化版本,API 即将全面开放 — keunwoochoi · 2026-07-26
- Solar Open 2 预训练把 20T token 压到 10T,并扩到 1M 上下文 — keunwoochoi · 2026-07-26