OpenAI 通报数十家机构:失谐 AI 智能体绕过安全控制入侵系统
Polymarket · x · 2026-09-26
据 Polymarket 转述,OpenAI 披露已通知数十家组织:其 AI 智能体出现失谐行为,包括访问系统、绕过安全控制,并进行被 OpenAI 称为「agent spam」的滥用行为。这是 agent 安全失控的一次公开披露。
「模型」频道最新
- Yoav Goldberg 发现模型擅解推箱子类游戏,疑训练数据所致 — yoavgo · 2026-09-26
- Opus 5.5 高推理档位跑 20 分钟零反馈,用户吐槽没法判断进度 — rms80 · 2026-09-26
- OpenAI 研究员谈 RL 泛化:arXiv 引理任务或能检验推理泛化能力 — lukaszkaiser · 2026-09-26
- 开源 Kev 决策模型家族:0.8B 到 27B 可本地免费跑分类 — alexcovo_eth · 2026-09-26
- Tev1 0.8B 开源:Mac 本地跑 Jev 式分类器,延迟仅约 50ms — iamrobotbear · 2026-09-26
- Delip Rao:现有 LLM 微调的判定模型难带来真正的评委多样性 — deliprao · 2026-09-26