本地 MiniMax H3 生成 29 段动作视频,搭出可对话的 AiTuber 立绘
Hailuo_AI · x · 2026-09-08
作者用本地部署的 MiniMax H3 为 VTuber/AiTuber 制作会动的立绘,思路非常朴素:不做 Live2D 式实时变形,而是预先批量生成动作视频库存,播放语音时只对嘴部做同步变形。
- 原画用 niji·journey,再用 GPT Images 生成身体和脸的四面图,从四面图生成各方向转头与动作
- 共 29 段素材:转头 16 段、待机 4 段、动作 9 段,RTX 5090 一晚批量生成
- 优点是能放高踢腿、倒立、转身等大动作;缺点是所有角度和表情都要预生成,素材量会爆炸
- 更适合 AI 自选动作的 AiTuber 而非实时跟动的 VTuber
- 语音用 Irodori-TTS,本地对话用 gpt-oss-20b,会话接入 AITuber OnAir 公开包,实现用 Codex 完成,做法已在 GitHub 公开
「编程与Agent」频道最新
- ReCache 论文:工具 Agent KV 缓存省 92% 显存,首 token 提速 3.7 倍 — techNmak · 2026-09-08
- ReCache:复用工具 schema 的 KV 缓存,省 92% 显存 — techNmak · 2026-09-08
- Weaviate 一年实践:Agent 记忆系统的三大坑与解法 — victorialslocum · 2026-09-08
- 两个月前写的 Next.js 应用已积累 48 个安全漏洞 — haydendevs · 2026-09-08
- 博主花 1000 美元实测 GPT-6 Astra:第一次感觉像 AGI — PrajwalTomar_ · 2026-09-08
- Google 开源 Android 自动化智能体 Artemis,AndroidWorld 成功率超 99% — Shruti_0810 · 2026-09-08