4GB 笔记本显存能跑本地 Qwen agent,但 RAG 会逼你频繁换模型

maikerukonare · reddit · 2026-07-26

作者在一台 RTX 3050 Ti 笔记本(4GB 显存) 上测试了一个本地 AI agent 工作台,模型通过 Ollama 自托管、完全不依赖云端 key。

他重点测了不同 Qwen 模型的速度和显存占用:

结论很直接:2B 是这台机器的甜点位。它既能保留大约 1.3GB 显存余量,又能在聊天、工具调用、视觉任务上保持不错速度。

帖子还把本地 RAG 的实际权衡讲得很细:

此外,他也指出小模型在一些任务上仍然吃力:

整体来说,这是一个非常具体的 4GB 本地 agent 工作台实测复盘,把“能跑”和“真能用”之间的差距讲清楚了。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →