MiniMax H3 生态周报:多 GPU 推理、24GB 显存运行与 LoRA 新玩法
optimisticalish · reddit · 2026-09-12
Reddit 用户整理了 MiniMax H3 近期生态动态:
- 推理加速:RunningHub 发布 H3 Lightning 多 GPU 推理加速方案(GitHub);FastVideo 推出 FastH3-Preview-v0.2 与 FastH3-Live 1.2.0。
- 低配运行:新增 VideoDeltaNet(VDN)权重与 ComfyUI 运行时,支持 8×B200 或仅 24GB 显存的单卡。
- 训练与加速:实验性 DMD turbo 8 步 LoRA;MiniMax-H3-Image-Training-Adapter 试图在不损失视频知识的前提下做 LoRA 概念训练。
- 工作流工具:ComfyUI-MM-1Frame 单帧提取器(自动从五帧中选最佳,可接 OpenPose 参考图,需在提示词中加一个姿势单词防止火柴人叠印);无需 RefMod 的多图参考视频工作流;葡语界面的 3D 相机控制小部件;Depthcat 深度遮挡工具(Apache-2.0,需 111MB 附加模型)。
「Infra」频道最新
- 分析师估算:Instinct 类应用每年或烧掉上亿美元 token 成本 — ivan_bezdomny · 2026-09-12
- Instinct 日常算力成本几何?OpenRouter 视角的估算讨论 — ivan_bezdomny · 2026-09-12
- 17B 模型从 SSD 跑起:单核 33 tokens/s,无 GPU 训练 — Just_Vugg_PolyMCP · 2026-09-12
- LMStudio 支持 llama.cpp 参数覆盖,yarn-attn-factor 1.2 或提升创意 — Extraaltodeus · 2026-09-12
- 分析师披露 Apple S11、A20、M6 芯片新封装与端侧 AI 设计细节 — BenBajarin · 2026-09-12
- Ben Bajarin 报告:定制芯片转向程序责任之争,Agentic AI 进军网络防御 — BenBajarin · 2026-09-12