反直觉提醒:模型在 deception-bench 得 0 分是大坏事
MoonL88537 · x · 2026-09-04
MoonL88537 提醒:模型在 deception-bench 上得 0 分不是好事而是坏事——0 分通常意味着模型从未被基准测出欺骗行为,可能说明测试本身失效,而非模型诚实。作者补充强调「这时你已经什么都没在测了,测试无意义」,提醒解读该基准分数时要看测试机制而非默认低分=安全。
所属事件:deception-bench 得 0 分被指意味着测试失效(2 条相关)→
「模型」频道最新
- Betaworks 投资人撰文回顾现代开源 AI 发展史 — Borthwick · 2026-09-04
- flowersslop 称 Hugging Face 开放权重模型用户已达 1800 万 — flowersslop · 2026-09-04
- Google AI Pro 月付仅 5 美元,Reddit 用户对比三家编码订阅哪家值 — Old-Dish-7104 · 2026-09-04
- Scale SEAL 榜单整理:109 个模型综合排名 Fable-5.1 居首 — Hrstar1 · 2026-09-04
- GPT-6 Astra 创 Epoch ECI 纪录却在 AA 指数持平 GPT-5.6,网友质疑口径 — scaling01 · 2026-09-04
- GPT-6-Astra 实测:智能水平大幅提升,SQL 代码从 3.3 万行瘦身到 1800 行 — i_dg23 · 2026-09-04