芝加哥大学开源文本转视频管线:25分钟生成1小时长视频
Federal_Effect_3791 · reddit · 2026-08-05
芝加哥大学的博士生团队在Reddit上展示了一个开源的长文本转视频管线系统,并向社区征集使用场景。
核心能力:
- 支持无限扩展的文本转视频生成,具备自动拼接、音频和配乐功能。
- 用户只需拖入一本书,即可一键生成覆盖全书内容的长视频。
- 目前可在25分钟内生成1小时的视频。
该技术已获得专利,并已在芝加哥大学的人文系进行测试。团队最初的设计初衷是让文学作品“可看”,但他们认为这未必是最佳应用场景,因此希望了解社区的实际需求以进一步完善系统。
所属事件:芝加哥大学开源超长文本转视频流水线(2 条相关)→
「多模态」频道最新
- ComfyUI-SAM3D-BodyMod 节点发布,支持体型调整与运镜 — petewoodbridge · 2026-08-05
- LucyLive v1.03 发布:Cinema 4D 实时 AI 渲染插件 — petewoodbridge · 2026-08-05
- LTX 2.3 新 Lora:为任意视频添加运镜效果 — CQDSN · 2026-08-05
- 字节 Seedance 2.5 上线:单次生成 30 秒,支持 50 个多模态参考素材 — ahuja_priyank · 2026-08-05
- 北大团队提出原子动作框架,让AI学会结构化编舞 — 机器之心 · 2026-08-05
- 用 ComfyUI 实测 MiniMax 模型:生成 90 年代情景喜剧 — donkeykong917 · 2026-08-05