Black Forest Labs 预热 FLUX 3:单模型打通图、视、音及机器人动作预测
bennash · x · 2026-08-13
开发者发现 Black Forest Labs(FLUX 模型开发商)官网疑似提前上线了 FLUX 3 的预热页面。信息显示,FLUX 3 将从单纯的图像生成模型跃升为多模态模型。
主要特性包括:
- 多模态生成:单一模型同时支持图像、视频、音频以及动作预测。
- 视频与音频:支持原生音频,单次生成最长 20 秒的视频片段,且风格不再局限于电影感。
- 机器人应用:统一感知、模拟与执行,可接收视觉观察和文本指令,预测物理结果并输出机器人控制动作。
- 部署灵活:提供 API、开放权重(支持自托管与微调)以及企业级定制方案。
「具身」频道最新
- IHMC 六足机器人 HexRunner 奔跑时速超 48 公里 — TinfoilTricorn · 2026-08-13
- 印度工人被雇拍摄手工劳动视频,用于训练机器人 — Polymarket · 2026-08-13
- 开发者探索本地智能体视觉训练,欲打造水面波浪计算池 — cephaloform · 2026-08-13
- AtlasVLA:引入持久化记忆的具身视觉-语言-动作模型 — CASIA-IVA-Lab · 2026-08-13
- Agility Robotics高管:教机器人后空翻易,捡笔难 — jonstephens85 · 2026-08-13
- Pi 公司扩张机器人版图:招募硬件与生态全栈通用人才 — minsuk_chang · 2026-08-13