FLUX 3 发布多模态底座,统一覆盖图像视频音频与动作预测
pmttyji · reddit · 2026-07-24
FLUX 3 被介绍为一个统一的多模态底座,覆盖 图像、视频、音频和动作预测。
发布计划显示,团队会先经过一段 early access 阶段,用于收集反馈和做安全测试,再在接下来的几周和几个月逐步放出能力:
- FLUX 3 Video:通过 API 和私有权重提供视频/音频生成与编辑
- FLUX-mimic 与 FLUX 3 Action:面向动作预测,与研究和商业伙伴合作推进
- FLUX 3 Image:图像合成与编辑
- FLUX 3 Dev:面向内容创作和动作预测的开源权重多模态底座
帖子还提到,底层方法的更多技术细节之后会公开。
所属事件:Black Forest Labs发布FLUX 3统一多模态模型(4 条相关)→
「多模态」频道最新
- Flux 3 X Mimic 亮相,主打下一代视频动作模型 — kensai · 2026-07-24
- Flux 3 正在测试双机位同步分屏视频生成 — umesh_ai · 2026-07-24
- Flux 3 更像一组能力,不是单独的 Klein 模型 — carrot_2333 · 2026-07-24
- 用户求助:4x UltraSharp 为什么会放大出怪异伪影 — MeDotEE · 2026-07-24
- Midjourney SREF 用一只小乌龟做出讽刺漫画效果 — tisch_eins · 2026-07-24
- AI 动漫创作从碰运气变成可复用工作流 — Aiden_Tech_Ai · 2026-07-24