开源 LoRA Dataset Studio:一个浏览器标签页搞定 LoRA 训练全流程
Ill-Ant-9489 · reddit · 2026-08-20
开发者发布免费开源、可自托管的 LoRA Dataset Studio,它不与 ai-toolkit 竞争,而是编排 ai-toolkit——后者负责训练,它负责训练前后的所有环节。全部流程在一个浏览器标签页完成:
- 取图:内置 Nano Banana Pro、gpt-image-2、OpenRouter 及本地 ComfyUI 引擎等 5 种生成渠道,标明单价与是否本地运行;也可从 Reddit、Pexels 抓取或直接拖入文件夹
- 分诊:Image Bank 原地读取上千张图,自动测量模糊、噪点、近似重复、人脸聚类、画风与美学分,过滤靠数据而非肉眼
- 整理与打标:裁剪、镜像、InsightFace 相似度、构图检测;JoyCaption 或本地 Ollama 写 prose/booru 标签,支持批量查找替换与外部 .txt 往返
- 去水印:检测后裁剪或用 LaMa/Klein 修复,所有编辑保留 .orig 备份
- 训练:本地 ai-toolkit 带 Z-Image、FLUX.1/FLUX.2、SDXL 等预设,或同屏租 vast.ai GPU(显示时价与预估总价);支持 Krea 2 全参训练与 LoRA 合并回 checkpoint
- 选模型:Test Studio 跑固定种子 checkpoint×强度网格、多 LoRA 叠加、Wilson 排名;LoRA Canvas 把所有运行放上同一画板
另有 Beta 视频通道:按 Wan/LTX/MiniMax 要求的精确帧数切视频并训练。作者坦承局限:本地生成依赖 ComfyUI,API 引擎需自备 key,视频侧目前仅 Wan 2.2 14B 有完整跑通记录。
「编程与Agent」频道最新
- 用 Agent 应用远程更新另一个 Agent — yacineMTB · 2026-08-20
- OpenKnowledge 支持自带 Agent,推出 ACP 协议 — iamrobotbear · 2026-08-20
- Papers with Code 上线论文可视化,Excalidraw MCP 一句话生成交互图 — NielsRogge · 2026-08-20
- MUZIM:本地优先的 AI 媒体库,通过 MCP 连接云端 Agent — dr_cintas · 2026-08-20
- Max Drake:画布是人与 AI 智能体之间的边界对象,快速草图转代码 — max__drake · 2026-08-20
- 用 Codex 写 FPGA 代码:首日实现 HDMI 输出与 FM 音源监控 — blaizedsouza · 2026-08-20