16GB 内存的本地小模型,还要多久追上云端水准?

Aggravating-Push-207 · reddit · 2026-09-26

Reddit 用户讨论本地 30B A3B 级开源模型的追赶速度:从 Qwen3 Coder 30B A3B 到 Qwen 3.6 35B A3B 的跃升只用了约 6 个月,进步惊人。他想知道以自己 16GB RAM + 8GB VRAM 的设备,大约还需一年能否让本地模型达到 GLM 5.3 Flash 的质量、彻底摆脱云端依赖,还是可以期待更快。评论区聚焦小参数 MoE 模型进化节奏与本地推理前景。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →