为何 8B-12B 参数模型更新停滞?端侧算力瓶颈或是主因

_maverick98 · reddit · 2026-08-11

作者观察到一个现象:近期开源社区似乎停止了 8B-12B 参数模型的密集发布,新模型动辄 27B 起步。作为一名使用 16GB 内存的 MacBook Pro 用户,他发现目前最适合本地运行的模型依然是几个月前发布的 Gemma 12B 或 Qwen 9B。

这引发了关于模型尺寸与端侧硬件限制的讨论:在追求 SOTA 性能的当下,厂商是否因为难以在 8B-12B 这个体积内实现显著的性能突破,从而放弃了这个对本地部署极为友好的参数区间?

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →