双 RTX 3090 本地跑大模型,怎么选模型和推理栈
ruffus_or · reddit · 2026-07-25
楼主的机器是双 RTX 3090、总计 48GB 显存,主要已经用于 ComfyUI 和远程 GPU 服务,但在本地 LLM 选型上还没定下来。帖子集中在几个实操问题:该选什么模型家族、什么参数规模更现实、GGUF/AWQ/GPTQ/FP8 怎么取舍,以及 vLLM、Ollama、llama.cpp 哪个更适合这种配置;同时还在征集编程场景下的 IDE 接入与工具组合经验,如 Continue、Cline、Roo Code、Aider、Open WebUI 等。
「编程与Agent」频道最新
- 本地 MCP 能否替代 API key 和订阅制接入 — HappyTonight8640 · 2026-07-25
- ECC 为 Claude Code、Codex 和 Cursor 提供智能体优化外壳 — affaan-m · 2026-07-25
- Andrew Ng 的 aisuite 为多个生成式 AI 提供商提供统一接口 — andrewyng · 2026-07-25
- AFK Pilot 让 Grok Build 免隧道远程接管手机 — PawelHuryn · 2026-07-25
- Kimi K3 编程实测:API 太贵,订阅制是否够用? — agentcubed · 2026-07-25
- 4 个开源模型同修 3 个真实 bug,27B 速度快 14 倍 — MaziyarPanahi · 2026-07-25