FLUX 3 把图像、视频、音频和动作预测合成一体
Eric520CC · x · 2026-07-24
FLUX 3 把图像、视频、音频和动作预测装进一个模型
Black Forest Labs 发布 FLUX 3,强调这是一个统一的多模态架构,覆盖 图像、视频、音频 以及 Action Prediction。官方称,新模型在不同风格下都能生成更贴近真实世界的内容。
其中 FLUX 3 Video 已进入 early access。官方还表示,这套统一架构可以继续扩展到机器人动作预测,并提到与 Mimic、Audi 的合作实践。
所属事件:BFL 发布 FLUX 3 统一多模态大模型(3 条相关)→
「具身」频道最新
- Flux 3 更像一组能力,不是单独的 Klein 模型 — carrot_2333 · 2026-07-24
- OpenAI Codex 键盘发货:首批上手称贵但好玩 — APPSO · 2026-07-24
- 8 美元 ESP32-S3 已能离线跑 2890 万参数模型 — brianrkelly · 2026-07-24
- BFL 发布 FLUX 3:统一图像、视频、音频与动作预测模型 — umesh_ai · 2026-07-24
- 《时代》专访宇树科技:首款量产可变形机甲机器人GD01亮相 — whurley · 2026-07-24
- OpenBMB 在 WAIC 开源首个具身 AI 模型系列 — CyberRobooo · 2026-07-24