自主 AI 缺的不是智能而是问责:KNOW 到 ACCOUNT 六步生命周期

GlenBradley · x · 2026-08-21

作者提出对自主 AI 的一种结构性理解:问题不在模型不够聪明,而在我们混淆了智能与权限——模型能推理出「应该发生什么」,不代表它有权让现实服从其结论。

核心主张是把自主行动看作「现实状态」与「授权意图」之间的对账问题,模型只负责推理与提议,底下需要一个「问责底座」来确立权威现实、保存证据链、执行策略与权限、控制执行并验证结果。由此给出六步生命周期:KNOW(什么是真的)→ JUDGE(策略上是否该做)→ PERMIT(有无权限)→ ACT(执行有界操作)→ PROVE(事后验证)→ ACCOUNT(保存因果记录)。

这把 AI 最危险的句子「Done.」变成必须被验证的技术声明:说取消了订阅但权威系统仍显示 ACTIVE 则验证失败;基于过期修订推理则需重新观察;prompt injection 骗它退 5000 美元但权限只有 50 美元则拒绝执行。网络在非幂等操作后中断时,应标记「执行不确定,验证前不得重试」。模型可能被攻陷,但系统不必。

问责还不应只在最终工具调用处:可在 planner、记忆、检索、专家模型周围布轻量探针,从而把「AI 行为不端」细化成「financial-reasoner:v31 在昨天的模型更新后开始产生无依据金额」。作者认为这也是通向「经济上可投保的 AI」的路径——给明确定义、受控的机器动作承保,远比给「一个 AI」承保可行。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →