观点:自主智能体应以赢得信任为第一目标

有观点提出自主智能体的决策原则设计:不应把「达成目标」作为第一层目标,而应把「正当信任」(justified trust)放在最前。Agent 在行动前需预测现实后果,评估该行为是否会损害来自人类、其他系统或网络的正当信任,若会则应视为重大错误信号或需要停止。该讨论探讨了如何在自主智能体的目标层级中内嵌可信性约束,而非仅追求任务完成。

2026-09-12 ~ 2026-09-12 · 3 条相关

另有 2 条近重复转述:troyjr4103 · NoBS_AI