四年前 Google 发布 Phenaki:最早能生成长达数分钟视频的模型之一
dumierhan · x · 2026-10-06
前 Google 研究者 Dumitru Erhan 回顾四年前发布的 Phenaki——一个从文本生成视频的早期模型,支持随时间变化的多段提示词,可生成长达数分钟的视频,这在当时极为超前。
- 官方 demo 中用连续提示词生成了 2 分 28 秒的第一视角摩托车骑行故事
- 支持图片+提示词生成视频、控制镜头运动等玩法
- 泰迪熊游泳、火星宇航员等示例是文生视频早期的标志性画面
对比当下 Sora、Veo 等模型,这条旧帖是视频生成模型演进史的一个有趣注脚。
「多模态」频道最新
- 开源发布 fibo-scene-analyzer:单模型输出结构化描述与姿态检测框 — linoy_tsaban · 2026-10-06
- VibeEditing 实测:一条 prompt 就能完成视频剪辑初版 — toolstelegraph · 2026-10-06
- RTX 5080 对比 5060 Ti 实测 FLUX Krea 2:速度快约 2.1 倍,LoRA 代价极不对称 — Altruistic_Print717 · 2026-10-06
- Hedra Multiplayer 上线:团队共享画布,每人与自己的 AI Agent 协作 — henloitsjoyce · 2026-10-06
- Reka AI 发布 19B 全模态模型 Rho-1:文本图像视频加机器人控制一个模型搞定 — The Decoder · 2026-10-06
- AI 生成版《沃森与鲨鱼》将入驻华盛顿国家美术馆展四个月 — Merzmensch · 2026-10-06