Reddit 讨论:3090 Ti 本地数字管家选哪款聊天模型
MarcusAurelius68 · reddit · 2026-09-03
楼主在单卡 3090 Ti 上跑本地“数字管家”,目前用 Gemma 4 26B A4B,对其响应速度和性格满意。工作流上先用另一个快模型对 prompt 做语义预处理和过滤,判断是否需要调用工具或是否为追问,因此主模型更看重“性格”而非知识量,向社区征求更快迭代后的替代建议。
「Infra」频道最新
- 博通预告 AI 营收 FY2027 翻倍至 1150 亿美元,FY2028 再翻倍到 2300 亿 — BenBajarin · 2026-09-03
- Perplexity 开源本地推理引擎 Lily,专为 Apple Silicon 优化 Qwen3.6 — inductionheads · 2026-09-03
- Nvidia 市值占标普 500 约 8%,达美国 GDP 的 16.3% — ivan_bezdomny · 2026-09-03
- 博通 Q3 AI 芯片营收 167 亿美元同比暴涨 221%,Q4 指引 217 亿 — Beth_Kindig · 2026-09-03
- 评测称 Claude Fable 5.1 将 agent 失败率砍半,单次正确答案成本 2.46 美元 — ryanshrout · 2026-09-03
- 安全公司 Bitbison 深度复盘 eBPF 性能陷阱:hook、CO-RE 与 ring buffer 实践 — tianyin_xu · 2026-09-03