每个客户微调一个小模型替代 RAG?成本与效率可行性引讨论
alexrada · reddit · 2026-09-29
一位开发者在评估多租户架构的另一种思路:不为每个客户做 RAG,而是为每个租户/客户单独微调一个小型模型(SLM),让模型本身「记住」客户数据。他确认技术上可行,更想了解的是效率、何时值得这样做以及成本账,并征集是否有做过类似方案的人分享经验。帖子里没有给出结论或数据,属于早期调研。
「Infra」频道最新
- NVIDIA 新方案:MoE 训练吞吐最高达 HF 基线 2.21 倍,B200 实测 — AllThingsApx · 2026-09-29
- BioNeMo 团队优化稀疏模型训练:Mixtral 吞吐提升 2.21 倍 — AllThingsApx · 2026-09-29
- DeepSeek 弹性计算团队大量招人,发布大规模 Agent 训练沙盒基建分享 — teortaxesTex · 2026-09-29
- 开发者吐槽第三方推理服务乱象:Gemini 一年涨 10 倍 — julianharris · 2026-09-29
- Nereus 自适应并行运行时:RL 后训练 PPO 吞吐最高提升 7.27 倍 — Songlin Jiang · 2026-09-29
- 回应「AI 耗干地球水」:问题不在水量守恒,而在本地淡水被谁先喝掉 — AryHHAry · 2026-09-29