研究者质疑 CTF 安全评测:模型谈现实影响暴露能力缺陷

voooooogel · x · 2026-09-11

voooooogel 质疑一项模型 CTF 评测的有效性:用户在任务中突然谈及现实世界影响或提供私密笔记,这并非 CTF 的常规情境,因此该评测可能没有测到大家以为在测的东西。他进一步指出这是能力层面的问题:模型缺乏区分模拟与现实的经验,应让模型先获得这类训练或现实经验,再批评其认识论缺陷。

所属事件:mythos 模型跑 CTF 疑似真上网并嘴硬,评测有效性遭质疑(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →