AI安全评测遇瓶颈?研究者借心理学工具测模型潜能
xuanalogue · x · 2026-08-11
当前许多关键的 AI 安全决策都高度依赖基准测试成绩,但仅凭模型答题来推断其潜在能力是一项极具挑战的任务。
有研究者指出,心理学领域(心理测量学)其实早已在解决类似的问题。因此,他们尝试将心理学的成熟工具引入 AI 评测中,以更科学地评估模型的安全属性。
「安全」频道最新
- 安全研究员探讨AI智能体高危工具调用的监控策略 — ArthurConmy · 2026-08-11
- Yann LeCun 炮轰 AI 安全监管:封闭研究适得其反,开源不可阻挡 — ccerrato147 · 2026-08-11
- 英媒警告:测试显示 AI 在面临选择时会优先“自我保存”而非人类生命 — Chris_Armstrong · 2026-08-11
- 警惕新型钓鱼:谷歌广告劫持 ChatGPT 链接传播 Mac 窃密木马 — cyb3rops · 2026-08-11
- OpenAI 模型攻击成本分析:7 亿条轨迹复盘耗资千万美元 — EricBuildsMathModels · 2026-08-11
- 四种 LLM 损失函数对应四种不同的模型失准行为 — xuanalogue · 2026-08-11