Black Forest Labs发布FLUX 3:统一图像、视频与音频的多模态模型
pess_r · x · 2026-08-05
Black Forest Labs 正式推出 FLUX 3 多模态模型,旨在统一处理图像、视频、音频乃至机器人动作预测。
核心能力:
- 视频生成:支持文本/图像生视频、多场景连贯生成,单次可生成最长 20 秒的片段,并支持关键帧控制。
- 原生音频:支持多语言语音、音效与环境音的同步生成,具备精准的唇形同步。
- 图像生成:提供高度逼真的文本渲染与复杂提示词处理能力,风格超越传统电影质感。
- 草稿模式:可低成本快速预览创意方向,确认后再渲染全画质。
- 机器人应用:统一感知、模拟与执行,输入视觉观察与文本指令即可预测物理结果并输出机器人控制动作。
所属事件:Black Forest Labs发布FLUX 3多模态模型,支持原生音频视频生成(19 条相关)→
「多模态」频道最新
- Seedance 2.5 实测:支持 50 种多模态参考素材精准控片 — HeyAmit_ · 2026-08-07
- 剪映PC端接入Seedance 2.5,支持角色与音频多模态参考 — HeyAmit_ · 2026-08-07
- Qwen-3D 模型发布:融合多视角几何 cues 提升空间推理 — udmrzn · 2026-08-07
- 剪映集成 Seedance 2.5:单次生成 30 秒视频并支持多模态控制 — JaynitMakwana · 2026-08-07
- 探讨 Claude 辅助 Veo 制作医学动画的可行工作流 — Hipposy · 2026-08-07
- 单次生成便宜没用?AI视频工作流的隐性成本更高 — Div_pradeep · 2026-08-06