用 Unsloth 给 Qwen3.5 4B 做继续预训练再叠 RAG,构建可导航地铁知识模型

funJS · reddit · 2026-09-16

作者分享了一个实验:先用 Unsloth 对 Qwen 3.5 4B 做继续预训练(CPT),让模型学会一套虚构地铁系统的线路图,能规划含多次换乘的路线;关键做法是避免训练语料依赖死记硬背。地图知识稳定泛化后,再叠加 RAG 注入动态信息(如车站关闭、周边活动等)。这种「CPT 存稳定知识 + RAG 供动态数据」的组合,是给小模型注入新领域的实用思路。

所属事件:实验:持续预训练加 RAG 打造地铁导航模型(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →