专题 · FULL STORY

Flux 3模型:从惊艳出图到视频实测

Black Forest Labs发布的Flux 3模型凭借单句提示生成纪录片级逼真影像引发热议。随后创作者实测进一步证实,其在复杂多机位场景下的跨镜头一致性同样表现卓越。

2026-07-27 ~ 2026-07-29 · 2 集 · 8 条

第 1 集 · Flux 3模型仅凭单句提示生成纪录片级影像(2026-07-27,3 条)

Black Forest Labs的Flux 3图像生成模型因其惊人的逼真效果引发科技圈热议。投资人与AI专家展示称,仅凭一句简单的提示词,该模型就能生成光影质感堪比《国家地理》的专业摄影级图像甚至短片。其强大的视觉表现力让不少人开始认真探讨利用AI制作完整纪录片的可行性。

第 2 集 · Flux 3 多机位视频一致性受关注(2026-07-27,5 条)

Flux 3 最近受到关注,核心原因不是泛泛的“画质更好”,而是在多机位视频生成这种高难任务上表现突出。就这组帖子来看,最明确的信号有两类:一是分屏场景里左右画面能对同一事件做到逐帧同步,二是双机位 CCTV 测试里跨镜头的人物、物体和时间逻辑更一致。若这一能力在更多场景中成立,它会直接触及 AI 视频当前最难的时空一致性问题。

已确认

  • @TomLikesRobots 提到一个 Flux 3 分屏演示,提示词要求左右两栏同时呈现同一事件,并保持逐帧同步;他表示自己此前还没见过别的视频模型把这类效果真正做对。
  • @charisai 也描述了一个 15 秒分屏案例:黄昏湖面上的捕鱼场景由左右两个不同机位同时拍摄,但需要保持为同一段连续事件且帧同步;其观察是同步效果非常强。
  • @umeshai 做了更严格的多模型对比:同一段便利店双机位 CCTV 提示词,要求两路固定监控视角、同步时间戳、同一人物与物体在两个镜头中保持一致,并正确表现雨伞误开等细节。其结论是,Flux 3 在这项跨镜头一致性测试里明显领先其他多款视频模型。
  • 另有 @Kyrannio 转发的一组动作序列演示,认为 Flux 3 在动作和镜头变化上“很有范围”,显示出较强多样性;但就这组材料而言,这一项更像定性观感,分量不如前述分屏和 CCTV 测试。

为什么重要

多机位同步、跨镜头人物与物体一致、以及事件在不同视角中的时间对应,一直是视频生成模型最容易露馅的环节。若 Flux 3 能稳定处理这类提示词,就意味着它在复杂叙事、监控视角模拟、分镜衔接和可控视频制作上更接近实用。现有帖子还不足以得出“全面领先”的总排名,但至少说明它在一个技术门槛很高的细分能力上,已经让多位创作者感到意外。