MOLT:面向消费级显卡的本地微调系统,RTX 4060 跑 Qwen3B 近追 Unsloth
MKP_Nimilka · reddit · 2026-10-06
开发者发布 MOLT,一个面向消费级 NVIDIA GPU 的本地微调系统,目标是让「模型+数据集到可用 adapter」的整条链路不再脆弱。功能覆盖:
- 数据集检测、准备与校验
- 训练前检查 GPU/显存/内存/存储/温度
- 自动 microbatch 拟合测试
- 4-bit NF4 QLoRA 训练 + BF16 adapter
- 带完整性校验的安全 checkpoint 与恢复状态
- 显存/温度/能耗/时钟/吞吐遥测
- base 与 adapter 对比评估、本地 adapter 聊天、导出/GGUF 工作流
底层还在试验自定义 CUDA/Triton kernel、CUDA graphs、重放模式与融合优化。实测 RTX 4060 Laptop 8GB 上 Qwen 3B 训练达到约 1005 targets/sec,接近其历史 Unsloth 的 1007——作者明确表示还需重复对齐测试,不构成「超越 Unsloth」的结论。正在招募单卡微调用户测试。
「模型」频道最新
- Reflection 新开源模型不敌中国主力模型,融资数十亿遭群嘲 — npinto · 2026-10-06
- Beam 被指是 DeepSeek V3 的等算力复刻:23B×23.8T ≈ 同 FLOPs 但效率落后 — mike64_t · 2026-10-06
- 为 Opus 5.5 正名:/token 成本论者夸大,智能不该按美元计价 — Angaisb_ · 2026-10-06
- Attention Relay 免训练迁移 LLM 指令遵循能力给文本嵌入模型 — _reachsumit · 2026-10-06
- 开源版 Claude Cowork 走红:OpenWork 两天下载超 4.5 万次 — alex_verem · 2026-10-06
- Bindu Reddy:简单任务上中国开源模型碾压美国前沿实验室 — bindureddy · 2026-10-06