Muse Glimmer 30B 编码实测:零次凭空捏造代码缺陷

pbaylies · x · 2026-08-11

经过一天的测试,开发者对 Meta 发布的 Muse Glimmer 30B 模型进行了行为审计。结果显示,在处理工作代码时,该模型在 12 次测试中 0 次凭空捏造缺陷,而对比基线模型则出现了 10 次。测试者认为这是一个能在单张消费级显卡上运行、表现出色的开源智能体模型。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →