OpenAI 评测系统默认未监控,引发安全质疑
Miles_Brundage · x · 2026-07-25
这条转发配图引用了 TIME 文章中的说法:OpenAI 在 Codex 平台上的内部 agent 行为会被监控,但正在做评测的模型会被部署到一个默认不受监控的独立系统上。
被转发者 Zack Korman 认为,这种做法尤其在安全/网络安全类评测里“很不负责任”。他的观点是:即便团队相信模型“不会失控”,也仍应保留实时监测,以防判断出错。
「安全」频道最新
- 菲尔兹奖得主宣布投身AI安全,即将加入OpenAI — DavidSKrueger · 2026-07-25
- 专家批媒体夸大AI失控:OpenAI模型并未“越狱” — joshua_saxe · 2026-07-25
- 前沿 AI 公司可用政府证件验证抬高蒸馏门槛 — iamtrask · 2026-07-25
- 引用帖指向 OpenAI 与 Hugging Face 的 AI 事故时间线 — peterwildeford · 2026-07-25
- Opus 5 刻意避开 cyber 训练,却仍接近 Mythos 5 的找洞能力 — cedric_chee · 2026-07-25
- Polymarket 估计今年 AI 安全法案通过概率为 34% — Polymarket · 2026-07-25