WAIC多模态与具身更新
创业邦 · wechat · 2026-07-19
WAIC 与多模态/具身进展
- 千觉机器人 展示首个 VTLA 具身触觉模型,把视觉、触觉、语言、动作结合起来,并配套发布视触觉多模态数据集、数采设备和触觉传感器矩阵,目标是让机器人获得更强的物理属性识别与交互能力。
- Rokid 发布智能眼镜原生操作系统 YodaOS,强调用图形化沉浸式交互替代单一文字输出,并加入行程自动记录、定时提醒等功能。
- 万兴科技 展示 AI 视频创意产品矩阵,覆盖影视创作、专业视频工作台和 AI 视频带货工具。
- 商汤 发布下一代多模态基座模型 日日新 U1Pro,主打“理解·生成·行动”统一,并支持 原生 8K 输出,面向交付级设计场景。
- 另有一则行业观察指出,印度企业越来越依赖 DeepSeek、阿里巴巴、月之暗面等中国开源大模型,以显著降低 AI 成本。
- 还有一份 B2B 全球支付白皮书 提出,跨境支付正从数字化进入“自主化”,即由 AI 智能体在授权后自主编排与优化支付流程。
「具身」频道最新
- 亚马逊谷歌卖出6亿台音箱,AGI 时代为何无人再造智能音箱 — julianlehr · 2026-09-11
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- 波兰开发者做 iPhone 应用 可探测附近的 Meta 智能眼镜 — Low-Honeydew6483 · 2026-09-11
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11