Meta 开源 30B 本地智能体模型 Muse Glimmer,17GB 量化跑进 24GB 单卡
bibryam · x · 2026-09-26
Meta Superintelligence Labs 发布新模型 Muse Glimmer,以 Apache 2.0 许可开源权重,主打「跑在你自己设备上的常驻智能体」。
- 规模与部署:30B 参数,17GB 量化版可放进 24GB 消费级单卡,一台 Mac 或 PC 即可运行,平均仅 1% 性能损失(15 个 benchmark);llama.cpp、MLX、ExecuTorch 集成即将上线。
- 定位:针对本地智能体工作流优化——本地 agent、function calling、本地编码、LLM-as-a-judge 评测,离线可用,无需云基础设施。
- 训练思路:管理日程、起草消息、整理文件的个人 agent 需要深度访问个人上下文,官方博客介绍了长时程任务等多项能力的协同训练。
- 权重已上 Hugging Face,并附开发者文档。
这是 Meta 在小型模型逼近前沿能力方向上的又一次押注。
「Infra」频道最新
- 6 张 3090 跑 Qwen3.8 本地部署实测:80-120 tokens/s — takoulseum · 2026-09-26
- Gemma 4 31B Q8 突然在 68k 上下文报显存共享超限错误 — Few_Professional6859 · 2026-09-26
- 数千亿美元数据中心 GPU 两三年后过时了怎么办? — No-Papaya-9289 · 2026-09-26
- SGLang 团队发币 $ARKIE:交易手续费买 GPU 资助开源 AI 基建 — BanghuaZ · 2026-09-26
- 谷歌确认 Gemini 4 进入后训练冲刺,TPU 首次上天 — 量子位 · 2026-09-26
- 台积电 91 天批准 607 亿美元资本支出,先进制程为主 — julsimon · 2026-09-26