Continual Learning 一词被滥用,应拆解为四种机制
gleech · x · 2026-08-18
Zachary Yu 指出 "continual learning" 术语定义混乱,实际至少指代四种不同机制:
- 上下文学习:假设未来有无限上下文窗口且能管理它。
- 记忆与模型层改进:基于生产数据按间隔生成技能/工具(如 GEPA/DSPy)。
- 超高频微调:按间隔通过 SFT/RL/蒸馏更新模型或适配器。
- 推理时权重更新:新架构提案,如每输出一个 token 就更新权重。
他认为这些应有独立命名。
「编程与Agent」频道最新
- Google 发布 Gemini 模型迁移指南:并非无缝替换 — rseroter · 2026-08-18
- 观点:使用 AI 编程的精髓在于懂计算机能力边界 — yacineMTB · 2026-08-18
- 吐槽:为何 LLM 默认生成烂代码而非直接修好? — yacineMTB · 2026-08-18
- 用户质疑 LLM 为何默认生成低质量代码 — yacineMTB · 2026-08-18
- 多模型协作写代码:让 Codex 与 Claude 通过文件通信 — OfirPress · 2026-08-18
- Grok 4.6 编码实测:搞定复杂逻辑但系统性遗漏基础 — mark_k · 2026-08-18