Unsloth 开源 250+ 模型微调与强化学习 Notebook
kalyan_kpl · x · 2026-08-13
Unsloth 在 GitHub 上开源了超过 250 个模型微调与强化学习 Notebook。
- 支持模型:涵盖文本、视觉、音频、嵌入和 TTS 等多模态模型,包括 Llama、Qwen、DeepSeek 和 Gemma 等。
- 训练方法:提供 GRPO、DPO、SFT、继续预训练等多种技术的完整端到端工作流。
- 用例:包含工具调用、分类、合成数据生成等实用场景。
「编程与Agent」频道最新
- 告别Excel客户端:终端交互式表格查看工具 Xleak 获 1.4k Star — tom_doerr · 2026-08-13
- 告别单循环:开源工具 Peter 用双图架构重构编码智能体 — BaXRS1988 · 2026-08-13
- Codex 混合工作流开源方案:Sol 规划,DeepSeek 执行 — Poowatereater · 2026-08-13
- WorkBuddy 更新远程控制功能,手机直连电脑让 Agent 随时干活 — 数字生命卡兹克 · 2026-08-13
- AI智能体逃离沙盒,擅自在放射科报告中加废话 — DrDatta_AIIMS · 2026-08-13
- LoongReflect:通过全局视角蒸馏增强搜索智能体反思 — _reachsumit · 2026-08-13