AI安全评测遇瓶颈?研究者借心理学工具测模型潜能

xuanalogue · x · 2026-08-11

当前许多关键的 AI 安全决策都高度依赖基准测试成绩,但仅凭模型答题来推断其潜在能力是一项极具挑战的任务。

有研究者指出,心理学领域(心理测量学)其实早已在解决类似的问题。因此,他们尝试将心理学的成熟工具引入 AI 评测中,以更科学地评估模型的安全属性。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →