MiniMax发布开源多模态模型H3,打通图音视频生成
PrajwalTomar_ · x · 2026-08-01
MiniMax 发布了全新的通用多模态生成模型 H3。该模型将文本、图像、视频和音频生成整合在单一架构中,能够理解统一的上下文意图,并原生生成带有立体声音效的视频。
评论认为,H3 打破了以往创作工具割裂的局面,减少了不同工具切换带来的上下文损耗。此外,该模型宣布将开放权重,这标志着 AI 视频生成正从单一的片段拼接迈向真正的工业化生产流程。
所属事件:MiniMax发布全模态模型H3:直出2K立体声视频(17 条相关)→
「模型」频道最新
- Fable 游戏 AI 安全过滤器频繁误杀,被指严重影响体验 — dreamwieber · 2026-08-01
- V4-Flash 重心转向智能体,牺牲了部分推理极限 — teortaxesTex · 2026-08-01
- DeepSeek-V4-Flash 推理受阻:vLLM 暂不支持新 confidence_head — teortaxesTex · 2026-08-01
- KOL称若无开源模型,闭源AI月费恐高达2000美元 — iamaliveix · 2026-08-01
- 会计任务大考:58%难题无模型能解,Claude居首 — EdwardSun0909 · 2026-08-01
- 实测 GPT-5.6 Luna:知识工作表现比肩 Sol,成本大幅降低 — BenBajarin · 2026-08-01