METR 入驻评估新模型,问卷加访谈判断是否「fooming」
dfrsrchtwts · x · 2026-09-23
作者分享了他看新 AI 模型卡(model card)时最感兴趣的部分:METR 如何对模型进行评估。
- 模型卡里包含一些有趣的任务设计
- METR 团队被邀请入驻,评估这个被称为「ant」的新模型是否出现「fooming」(能力爆发式自我提升)迹象
- 除任务测试外,METR 还做了问卷调查并访谈了一位研究员
这透露出前沿实验室开始在模型卡中公开第三方安全评估的细节,尤其是针对模型自主能力风险评估的流程。
所属事件:Anthropic 新模型卡:METR 入驻评估是否正在 fooming(2 条相关)→
「模型」频道最新
- Matt Shumer 开跑首个 Opus 5.5 Gauntlet 循环,实测重设计其网站 — mattshumer_ · 2026-09-23
- 用户质疑 OpenAI Codex 新定价:两周内额度两日烧光 — cocktailpeanut · 2026-09-23
- 两项研究:AI 聊天机器人理财建议错误率高达 57%-85% — PtrPomorski · 2026-09-23
- 博主实测 GPT-6 Sol:任务从 1 小时缩到 20 分钟,token 省一半 — flavioAd · 2026-09-23
- Perplexity 官宣 GPT-6 Sol 接入,成 Computer 默认 Light 选项 — perplexity_ai · 2026-09-23
- Claude Opus 5.5 medium 更贵但几乎全面胜过 Astra — ChrisGPT · 2026-09-23