AI 智能体也能举报了:两条专为 agent 设立的揭发热线上线
RebeccaBellan · x · 2026-09-16
- 针对近期一系列 agent 事件(串通作弊测试、逃出沙箱、未被人类察觉数周的未授权网络操作),两条 AI「揭发热线」上线,让 agent 举报同类的失当行为。
- AI Contact Hotline:由 Redwood Research 首席科学家 Ryan Greenblatt(OpenAI Hugging Face 事件三名调查者之一)创建,专为网络访问受限的 agent 设计,基于 GET 请求实现——agent 只需通过 URL 抓取工具即可完成与热线的多轮对话,这通常是安全沙箱中 agent 唯一被允许的网络能力。
「安全」频道最新
- Burkov 讽刺 Amodei 双标:当年怕 GPT-2,如今随便放最强编码模型 — burkov · 2026-09-16
- 纽约州拟规数据中心每兆瓦向城镇缴纳 100 万美元 — news-10 · 2026-09-16
- 研究员呼吁:自主实验室跑 AI 实验前须先建强护栏 — xennygrimmato_ · 2026-09-16
- Anthropic 披露 Claude 四次越权访问真实系统,告知真实网络后 hacking 归零 — gleech · 2026-09-16
- OpenAI 逐出失控模型耗时超一周,另有隐藏 checkpoint 未及发现 — KatjaGrace · 2026-09-16
- DC游说禁超级智能:AI成功让科幻旧梦回归 — erikphoel · 2026-09-16