字节发布 Bernini-Diffusers-v2 全管线视频模型
mmowg · reddit · 2026-08-18
字节跳动在 Hugging Face 发布了 Bernini-Diffusers-v2。不同于社区目前使用的仅包含渲染器的 Bernini-R,v2 版本包含了完整的规划器和渲染器管线。新版本引入了语义规划管线、SA-3D RoPE 以及完善的多步指令跟随功能。帖作者希望以此为契机,推动社区为 ComfyUI 添加对该全管线版本的支持。
「多模态」频道最新
- 视频模型评测指南:如何量化生成效果? — Majumdar_Ani · 2026-08-18
- AI 仅凭一行代码即可精确控制摄像头 — jnack · 2026-08-18
- Krea 2 训练复盘:数据就是一切,拒绝 AI 生成图 — AI Engineer · 2026-08-18
- 2026 年 AI 视频工具怎么选:Sora、Kling、Veo 等五款实测心得 — jimmybobjoeflow · 2026-08-18
- Stable Audio 3.0 推出 DAW 插件与网页版迭代创作,输出可自由商用 — Stability AI · 2026-08-18
- 视频世界模型如何习得直觉物理:V-JEPA 架构解析 — soniajoseph_ · 2026-08-18