AI 代理评测不能只靠厂商自定标准

_FelixSimon_ · x · 2026-07-22

这条继续补充同一场 AI 代理研讨会的核心结论:与会者认为应当加强独立评测与测试,因为当前围绕模型评测和排行榜的透明度仍然很差。

他们还指出,只靠厂商自定标准、没有外部审查,很难真正建立对 agent 系统的信任。

所属事件:研讨会报告:多智能体交互易引发系统性安全风险(5 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →