苦等两年,开源模型终于做出了「本地 Sora」
MustBeSomethingThere · reddit · 2026-08-10
发帖人感叹,距离 OpenAI 首次展示 Sora 已经过去两年,如今开源视频模型终于达到了令人惊艳的「本地 Sora」水平。
帖子附带了一段极具电影感的视频演示,并分享了详细的提示词结构:
- 视觉描述:采用特写静止镜头,从玻璃车窗向外拍摄东京郊区的街景,同时玻璃上清晰倒映着车厢内看手机的年轻女子。
- 音效设计:包含连续低沉的列车轰鸣声、铁轨的节奏性咔哒声以及车外呼啸的风声。
这表明当前的开源模型不仅能处理高难度的物理反射效果,还能同步生成匹配的环境音效。
「多模态」频道最新
- Wan 2.2 视频换脸:如何针对多人场景中的单一角色精准替换 — SilentThree · 2026-08-10
- 实测 AI 视频生成:第一人称视角乘坐金星磁悬浮 — fofrAI · 2026-08-10
- Projectify 插件:打通 Blender 与 ComfyUI 动态执行工作流 — AccordingInspector58 · 2026-08-10
- Seedance 2.5 视频模型上线,可生成连贯 30 秒视频 — tsi_org · 2026-08-10
- 实测 MiniMax 视频模型:单次输入 50+ 参考图生成视频 — No_Damage_8420 · 2026-08-10
- RTX 4090本地长视频生成工作流拆解 — SIR_NVAX_A_LOT · 2026-08-10