Meta 重回开源!Muse Glimmer 支持 RTX 5090 本地极速推理
ying11231 · x · 2026-08-11
Meta 发布了开源模型 Muse Glimmer(300亿参数的稠密模型),并获得了 SGLang 的首日支持。
通过 SGLang 框架及量化技术,该模型在单张 RTX 5090 显卡上可实现约 230 tokens/秒 的推理速度。目前,Hugging Face 上已提供针对 Apple Silicon 和 NVIDIA 硬件的量化检查点。这一组合大幅突破了本地智能体的速度和可靠性瓶颈,支持在 RTX Pro 6000、DGX Spark 以及 Mac (MLX) 上开箱即用。
所属事件:Meta开源30B智能体模型Muse Glimmer(63 条相关)→
「Infra」频道最新
- 美光高管:AI客户路线图已可见至2030年后 — BenBajarin · 2026-08-11
- Vercel Sandbox免费开放出口防火墙,应对AI代理网络逃逸风险 — cramforce · 2026-08-11
- 六大基金组建 5000 亿美元联盟,保持与 NVIDIA 的距离 — annbordetsky · 2026-08-11
- RTX 5090 对决双卡 48GB:本地 AI 视频生成硬件升级指南 — Ammoryyy · 2026-08-11
- 开发者自建微虚拟机沙箱编码智能体,支持本地推理与 iOS 操控 — tom_doerr · 2026-08-11
- SanDisk CEO 称 80% 以上毛利率是对存储产品的合理回报 — Beth_Kindig · 2026-08-11