AGI 实验室研究员:预训练本质上也算 RLCD
willcb · x · 2026-09-17
AGI 实验室研究员 willcb(William Brown)一句话抛出观点:预训练(pretraining)本身就可以算作 RLCD(基于课程分布的强化学习)。这延续了近期「预训练 vs RL 范式之争」的讨论脉络,暗示两种训练范式之间的界限比通常认为的更模糊。
「模型」频道最新
- Grok 4.7 疑似今日发布:模型已现身 Google Cloud 配额页 — koltregaskes · 2026-09-17
- 印尼写作者吐槽:翻译腔已成前沿 LLM 写文学散文的通病 — eriksupit · 2026-09-17
- 用户吐槽 Gemini 遍布 Google 全家桶却连自家日历都管不好 — blelbach · 2026-09-17
- 曝 OpenAI GPT-6 Astra 基于 Stargate 超10万 GPU 预训练 — erwincoumans · 2026-09-17
- Qwen 2.5 VL 微调求助:DoRA 合并后模型行为同基座无异 — Double-Primary-2871 · 2026-09-17
- Pi 接 DeepSeek V4.1 Flash 默认只收文本,需手动加 image 输入类型 — solyarisoftware · 2026-09-17