Black Forest Labs 发布 FLUX 3:统一图像、视频、音频与机器人动作预测
bennash · x · 2026-08-12
Black Forest Labs 官宣全新多模态模型 FLUX 3,将图像、视频、音频生成以及机器人动作预测统一在单一模型中。
核心能力:
- 视频:支持最长 20 秒原生片段,可从文本、图像或关键帧生成,并支持多镜头。
- 音频:原生生成多语言语音、音效与环境音。
- 图像:具备高精度文本渲染与复杂提示词处理能力,风格多样。
- 机器人:结合视觉观察与文本指令,预测物理结果并输出机器人控制动作。
部署与可用性:提供 API、开放权重(支持自定义微调)以及企业级部署方案。目前网页端已开放免费体验视频生成功能,用户可利用故事板图像作为起始帧来控制生成内容。
所属事件:Black Forest Labs发布FLUX 3多模态模型(2 条相关)→
「具身」频道最新
- MiniMax Music 3 在 AMD 7900 GRE 上崩溃已修复 — Nowawes · 2026-08-14
- 前斯坦福学者加盟Matic任软件主管,推动家用机器人落地 — jokrvivek · 2026-08-14
- YCS26初创Lumera推出AI皮肤扫描仪Lumoscope,预售价199美元 — ycombinator · 2026-08-14
- Bittensor子网SN80打造去中心化机器人数据池,超13万贡献者参与 — bittingthembits · 2026-08-14
- 小鹏披露 VLA 2.0 里程首超人类,正构建统一空间 AI — kimmonismus · 2026-08-14
- Matic 扫地机器人:弃用 LiDAR,纯视觉方案打造家用机器人 — kimmonismus · 2026-08-14