继续预训练 vs RAG:Qwen 3.5 4B 知识内化实测对比

funJS · reddit · 2026-09-12

作者做了一组趣味但严谨的实验:对 Qwen 3.5 4B 做继续预训练(CPT)把领域知识「内化」进模型,再与基于同一底座模型的 RAG 实现对比准确率与推理性能。

核心问题:把知识烧进权重 vs 推理时外挂检索,两种路线在效果和成本上各占多少优势?结论与详细数据见原文链接,对需要在垂直领域落地的开发者有直接参考价值。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →