FLUX.3 [dev] 将开放图像、视频、音频和机器人动作权重
multimodalart · x · 2026-07-24
这条帖提到 FLUX.3 [dev] 将带来 开源权重,并覆盖 图像、视频、音频 以及 机器人动作预测。
帖文同时点出它背后的 self-flow architecture,把它形容为 flow matching 的一种演进。作者的评价是,这支团队不只是继续堆规模,也在持续推进架构层面的创新。
所属事件:Black Forest Labs 发布 FLUX 3:迈向全模态与具身智能底座(26 条相关)→
「多模态」频道最新
- 一个 Midjourney 提示词把任意主体变成蓝图示意图 — tisch_eins · 2026-07-24
- Flick 推出 3D Stage:AI 操控的 Blender 助力视频创作 — minchoi · 2026-07-24
- PE-Field 4D 把视频扩散模型改造成几何渲染器 — qixing_huang · 2026-07-24
- 单卡 5090 从零训练图像模型:冻结编码器突破 VAE 模糊瓶颈 — Creative-Listen-6847 · 2026-07-24
- 有人称 Opus 5 的 3D 输出很强,但仍然又慢又吃 token — OfirPress · 2026-07-24
- Sonilo v1.0 可按视频动作逐帧生成匹配音效 — socialwithaayan · 2026-07-24