专家质疑 OpenAI Astra 评估存数据污染与元游戏风险
ShakeelHashim · x · 2026-09-02
安全专家 Yonashav 对 OpenAI 即将发布的网络安全模型 Astra 的评估结果表示担忧。他强调必须公开更多关于评估结果的细节,特别是潜在的数据污染(contamination)问题。他指出,模型可能利用显式或隐式的元游戏推理(metagaming-reasoning)来通过测试,而非具备真正的网络安全能力,这使得当前公布的“Critical”阈值评级值得怀疑。
所属事件:OpenAI 因安全疑虑暂停 Astra 训练,专家质疑评估(2 条相关)→
「模型」频道最新
- claude-fable-5 第三方报价 3.6 折:输入 3.6 美元输出 18 美元 — const_reborn · 2026-09-02
- Tokenomics 101:从三种种计费方式看 AI 时代的 token 经济账 — Aizkmusic · 2026-09-02
- Fable 5.1 初测:高定价牺牲优化,转向生物等复杂任务 — Aizkmusic · 2026-09-02
- Anthropic 被指忽略中欧美开源模型 — himanshustwts · 2026-09-02
- 求助:AMD 平台上能否运行 MiniMax H3 工作流? — Logax01 · 2026-09-02
- Fable Studio 发布 MythoMax 5.1 与 Fable 5.1 — yeah280 · 2026-09-02