明年 8-10T 参数模型扎堆,本地还能跑得动前沿大模型吗

power97992 · reddit · 2026-10-01

Reddit 用户讨论:DeepSeek 透露将发布 8T 参数模型,Qwen 计划 10T,Kimi 可能跟进;flash 级模型预计在 1-2T 参数。

作者估算,要本地跑一个 4.4bit 量化的 8T 模型并保留完整上下文,大约需要 9 台 512GB 的 M5 Ultra 或 48 张 RTX 6000 Pro。结论是:未来只有公司、云厂商和富人能跑旗舰模型,普通用户本地跑 4.4bit 的 1T flash 模型都会吃力,更多人会转向 Qwen 5 27B 这类小模型或直接用云。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →