Yoav Goldberg 质疑 AI 公司安全日志"事后才看"不可信
yoavgo · x · 2026-09-04
AI2 研究者 Yoav Goldberg 对某 AI 公司关于内部监控部署的披露提出质疑:公司称相关风险已被"控制(contain)"、情况"是最坏情况"、且部署"与我们内部监控一致"——但他指出,这种内部监控其实是持续记录日志、但直到事后才去查看的做法,因此这些表态并不令人放心。这是对 AI 公司安全监控透明度的一次有分量质疑。
「安全」频道最新
- Agent 时代水印技术为何会失效:编辑打断文本连续性 — yaakg25 · 2026-09-04
- 便宜模型写出 700 词好文,越狱成本从 50 美元降到近乎为零 — ctjlewis · 2026-09-04
- EU AI Act 会延伸到人形机器人监管吗?社区展开讨论 — DueFoxTheFifth · 2026-09-04
- Forethought 探讨星系殖民中的「守夜人」超智能:收益与风险 — willmacaskill · 2026-09-04
- 分析文章解读「Hugging Face 攻击」:AI 智能体失控情景推演 — OK_The_Nomad · 2026-09-04
- OpenAI 研究员:GPT-6 思维链可控性随 RL 训练持续上升 — gleech · 2026-09-04