数字智能体管软件、具身智能体管物理,这篇把「人」立成主目标

ComBodied Agents: a New Paradigm of Human-Centric Agentic AI

Qianggang Ding, Xingyao Wang, Rui Feng, Zhibin Wang, Feixiang Wang, Kelong Mao, Hao Sun, Zhiyao Luo, Jiankai Tang, Lei Li, Jiadong Guo, Minheng Ni, Weicong Lin, Chenxi Yang, Hongxiang Gao, Zhenghua Chen, Yang Bai, Min Wu, Jun Cheng, Huazhu Fu, Dacheng Tao, Bang Liu

cs.AI

2026-08-11

指出数字智能体和具身智能体都不建模人的状态变化,提出感知-记忆-个人世界模型-干预策略的以人为本闭环,定义八类能动性保持指标并提议 CombodiedBench。

这篇在解决什么

一个老人漏吃药,软件智能体可以再发一次提醒,具身机器人可以把药端到面前。但两个都没在建模人:他到底是忘了、糊涂了、在承受副作用,还是故意拒服?该给什么帮助?论文把这类缺口叫结构性问题。现在的数字智能体(digital agent)主要改的是软件状态,具身智能体(embodied agent)改的是物理状态,谁都没把「这个人正在怎样变化」当成建模、干预和评测的主目标。个人助手、健康智能体、AI 伴侣、自适应人机系统各自做了一小块,记忆碎片化、对人本身的刻画很浅,评测也只看单次任务成败,不看长期相处之后人是变强还是变弱。

方法

论文提出 Combodied Agents,把上面那些零散能力收进一个以人为本的闭环:

关键的设计取舍是:它不要求建一个穷尽式的「人体数字孪生」。作者明说,对完整个人的高保真复刻目前还是奢望,所以框架用「有目的边界、带不确定性、可被用户纠正」的表示来代替。整个链路严格保持「观察→事件→推断状态→预测轨迹→授权干预」的顺序,每一层都嵌着安全约束。

结果

这篇没有跑实验,是一篇框架/范式论文。和实测结果对应的部分是它提出的评测方案,而不是已有的数字:

把这点讲清楚是必要的:按「有没有 SOTA 数字」来挑论文,这篇不在候选里。它的产出是研究议程和评测维度。

为什么重要

对做健康、养老、陪伴、自适应学习类智能体的从业者,这篇最有用的部分是能动性保持这套指标。它把「长期相处之后人是变强还是变弱」这件事变成了可测的指标,别只盯任务完成率和满意度。个人世界模型那个闭环,也是给「该不该干预、干预到什么程度」一个比纯规则更结构化的回答框架。

局限与存疑

这是一篇立场论文,没有任何实现或验证。论文自己承认,对完整个人的高保真孪生「仍是奢望」,感知、模型校验、同步、算力、隐私、治理都还是大问题。PWM 部分更像一个技术愿望清单,边缘侧个人模型那一节也偏 speculative。八类能动性指标提了维度,但落地的测量协议还很粗。

术语

原文与代码

社区讨论

相关论文

全部论文解读