Black Forest Labs FLUX.3 开启早期测试,迈向全模态生成

Black Forest Labs(黑森林工作室)新一代模型 FLUX.3 已向部分用户开放早期测试,并放出了展示视频。首批测试者分享了惊艳的生成样张,传闻指出该模型将从单一图像生成转型为全模态骨干模型,覆盖视频、音频及机器人动作预测。

已确认

模型 FLUX.3 确实存在,官方已放出早期访问展示视频。部分测试者(如 @ostrisai)已获得体验权限并连续试玩数天,分享了大量生成结果,且提到开启了音频。此外还有疑似 Flux 3 或 Flux Video 的最新图像样本被分享出来。测试反馈显示该模型在画质与风格化生成上表现优异,@Eric520CC 认为其足以在开源图像模型领域再掀一次洗牌。

尚未确认

目前关于模型的具体多模态能力(如最长 20 秒视频、音频、机器人动作生成及推理能力)均来自爆料与预热信息。@multimodalart 指出 FLUX.3 [dev] 被描述为开放权重的多模态骨干模型,@eyishazyer 也推测其大概率会开放或开源权重,但官方尚未正式发布完整的技术规格与开源协议。

为什么重要

如果传闻属实,FLUX.3 将成为一款覆盖图像、视频、音频和动作预测的全面型多模态模型。这标志着顶级开源图像模型正式向更广阔的多模态生成与物理世界交互(机器人动作)领域迈进,对 AI 内容创作及具身智能领域具有重要意义。

2026-07-23 ~ 2026-07-24 · 11 条相关

事件全程(共 13 集)→

一手来源