生数发布 Vidu Q4 Preview:16 秒有声视频,最低 $0.014/秒
lmoroney · x · 2026-10-08
生数科技(ShengShu Technology)周三发布下一代旗舰音视频模型 Vidu Q4 Preview 的公开预览版,可在 Vidu 网页应用使用,API 模型名为 viduq4-preview。
要点:
- 参考控制:支持最多 15 张参考图,用于角色、服装、道具和场景的一致性;还可上传最多 3 段音频片段,保持角色声音一致。
- 规格:单段视频最长 16 秒,画面与音频同步生成;分辨率 540p 到 4K,支持 10-bit 色深。
- 定价:首发公告称低至 $0.014/秒,后续文档显示 540p 约 $0.045/秒、4K 最高 $0.39/秒,实际以套餐为准。
- 实用建议:作者建议先在 540p/720p 下跑通运镜和效果,再上高分辨率出成片。
所属事件:生数科技发布 Vidu Q4 Preview,榜单首秀第三(3 条相关)→
「多模态」频道最新
- 马斯克转发用户实测:15 秒提示词用 Grok Bot 生成完整讲解视频 — elonmusk · 2026-10-08
- AI 虚拟角色 Claudia 开源人格包:MCP 服务器+技能+角色设定全可下载 — Promptmethus · 2026-10-08
- UltraText Bench:中英双语密集文字渲染基准,Qwen-Image 复合分从 86.5 跌至 42.9 — Westlake-University · 2026-10-08
- VIEScore2:带空间定位解释的图像生成统一评测器,SRCC 0.601 超 Gemini-3-Flash — TIGER-Lab · 2026-10-08
- 80 分钟 AI 长片首入国际电影节主竞赛,作者自训视觉模型 — lmoroney · 2026-10-08
- vLLM 发布 vLLM-Omni:统一服务全模态生成的技术报告出炉 — vllm_project · 2026-10-08