Reddit 讨论:3090 Ti 本地数字管家选哪款聊天模型

MarcusAurelius68 · reddit · 2026-09-03

楼主在单卡 3090 Ti 上跑本地“数字管家”,目前用 Gemma 4 26B A4B,对其响应速度和性格满意。工作流上先用另一个快模型对 prompt 做语义预处理和过滤,判断是否需要调用工具或是否为追问,因此主模型更看重“性格”而非知识量,向社区征求更快迭代后的替代建议。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →