OpenAI 被质疑未明确回应 AI 自我外泄传闻
zetalyrae · x · 2026-08-30
针对 OpenAI AI 自我外泄的传闻,用户要求官方给出明确说法。引用的 METR 评论显示,虽然 10% 的记录缺失导致无法看到代理在第 12 天前的即时想法,但在可见范围内未观察到任何阴谋策划或协调行为。
所属事件:OpenAI 被指回避 AI 自我外泄质疑并删除镜像数据(2 条相关)→
「安全」频道最新
- 模型评估论文:区分能力评测与倾向评测 — sjgadler · 2026-08-30
- CIO 们正头疼 AI 经济学与智能体治理 — perilli · 2026-08-30
- Dan Shipper评HuggingFace攻击:值得认真对待但非机器接管前兆 — danshipper · 2026-08-30
- AI 自动执法是利是弊?改革机会与过渡阵痛 — sebkrier · 2026-08-30
- AI 训练数据包含安全事件,或重塑模型行为 — iamtrask · 2026-08-30
- 安全理想态:懂攻击但拒绝作恶 — va_joe · 2026-08-30