CPT 对比 RAG 实验测 Qwen 3.5 4B:知识内化与即时检索谁更准

funJS · reddit · 2026-09-12

作者用 Qwen 3.5 4B 做了一个小实验:对同一批领域知识,一边做继续预训练(CPT)让模型内化知识,一边在基座模型上搭 RAG,对比两者的准确率与性能差异,目的是量化「把知识烧进权重」与「推理时现查」的收益差别。详细数据与结论发布在个人博客文章中。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →