Black Forest Labs 推出统一图像视频音频模型 FLUX 3
appenz · x · 2026-07-24
FLUX 3 把图像、视频、音频和动作预测合并到一个模型里
Black Forest Labs 在引用中介绍了 FLUX 3:一个统一的多模态模型,覆盖 图像、视频、音频和 action prediction。
- FLUX 3 Video 已进入 early access。
- 官方称它采用 统一架构 训练,而不是分散的多模型拼接。
- 这套架构还可以扩展到 机器人动作预测。
- 线程里还提到与 Mimic、Audi 的展示,主打更真实的生成效果和细节表现。
所属事件:Black Forest Labs 发布 FLUX 3:迈向全模态与具身智能底座(28 条相关)→
「多模态」频道最新
- FastH3-Live 升至 22fps:加速节点实测与 ComfyUI 显存避坑 — spartong945 · 2026-09-11
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11
- ComfyUI 新节点发现器上线:按 star 增速过滤最新热门节点 — Luke2642 · 2026-09-11