生数科技称通用世界模型将驱动视频、机器人和智能体
生数科技 · wechat · 2026-07-22
生数科技:通用世界模型将成物理智能的基础设施
在 WAIC2026 启明创投·创业与投资论坛上,生数科技联合创始人、CEO 骆怡航系统阐述了公司对“通用世界模型”的判断:当 AI 从文本走向视频、游戏、机器人和自动驾驶时,只懂语言已经不够,下一阶段的关键能力是从“理解信息”升级到“理解世界、预测变化并采取行动”。
他的核心观点
- 语言模型主要处理人与语言、知识和信息的关系;
- 世界模型面向的是智能体与现实/数字世界的交互;
- 真正的世界模型需要形成统一的动态闭环:感知 → 预测 → 行动,而不是把视频生成、三维重建或机器人控制拆成彼此孤立的单点技术。
骆怡航认为,世界模型的目标不只是单任务成功率,而是像 LLM 一样先在海量数据中建立通用能力,再迁移到不同场景、不同机器人本体和不同数字内容任务中,形成可规模化的基础模型。
生数科技的产品化路径
围绕同一个通用基座,生数科技拆出了三条产品线:
- ViduQ:面向数字内容生成,强调人物、场景、运动和物理规律理解;
- ViduS:把视频从离线生成推进到实时、连续交互,服务陪伴、互动、游戏等场景;
- Motubrain:面向物理世界,把对环境和任务的理解转化为机器人动作。
文章最后的结论很明确:数字世界和物理世界里的 Agent 形态会千差万别,但底层智能应该是通用的;通用世界模型,可能就是连接生成、交互与行动的关键基础设施。
「具身」频道最新
- Tesla App 逆向曝光 Optimus 家庭控制与数据采集 — CyberRobooo · 2026-07-22
- 中国无人配送卡车已开始重塑物流 — CurieuxExplorer · 2026-07-22
- CHI 2026 最佳论文:具身 AI 用 EMS 引导身体完成动作 — MacrinePhD · 2026-07-22
- See2Act 让机器人在一个去噪循环里同时学看与动 — heghbalz · 2026-07-22
- 人形机器人搏击秀的收入,可能已超过多数九位数融资公司 — kscottz · 2026-07-22
- AlayaRenderer-Flash 将世界渲染器提速到 31.54 FPS — AlayaLab · 2026-07-22