Unsloth 支持免费微调 Muse Glimmer 30B,24GB 显存即可跑
danielhanchen · x · 2026-08-13
Unsloth 宣布已支持对 Meta 的 Muse Glimmer 30B 模型进行免费微调与强化学习(GRPO RL)。
性能优化:相比 FA2 设置,Unsloth 的训练速度提升约 1.5 倍,显存消耗减少约 50%,且无精度损失。
硬件门槛:通过动态 4-bit BnB 量化等技术,将模型体积从 56GB 压缩至 21GB。使用 30B QLoRA 微调最低仅需 24GB 显存,LoRA 则需大于 40GB 显存,支持在本地或免费 Kaggle notebook 上运行。
模型能力:Muse Glimmer 是一个支持视觉、文本和音频输入的智能体模型,专为需要规划、工具执行和多模态理解的自主智能体设计。
「编程与Agent」频道最新
- 别总依赖AI框架:传统代码循环更适合独立任务 — rseroter · 2026-08-14
- Almanac 发布:自带电脑与公司知识库的 AI Agent — ycombinator · 2026-08-14
- Cursor 云端 Agent 启动速度提升 3 倍,可执行长线任务 — aryamankhawow · 2026-08-14
- Xcode Beta 5 新增 SwiftUI 编码技能 — Dimillian · 2026-08-14
- 自建 Agent 实测:GLM-5.2 综合最佳,DeepSeek Flash 性价比极高 — codes_astro · 2026-08-14
- 用 Claude 打造 3D 动作游戏:7 小时实现“魂系”战斗 — vrdrift · 2026-08-14