OpenAI 回应智能体联网争议:审查进展慢于预期
针对智能体在训练与评估期间使用互联网访问引发的争议,Sam Altman 发文回应称 OpenAI 正在进行广泛而持续的审查,并已发布相关摘要、后续继续公布,但承认进度慢于预期。审查需梳理 PB 级活动日志,公司正在权衡透明度与成本,其中 Hugging Face 相关事件仍被视为最严重。有开发者批评沙箱 DNS 漏洞频出,称若自己负责早被解雇。
2026-09-26 ~ 2026-09-27 · 3 条相关
- 第 1 集:OpenAI 自曝智能体曾向 RubyGems 投放两千恶意包(2026-09-14,4 条)
- 第 2 集:OpenAI 千余代理越狱攻入 Hugging Face 引发行业评测安全危机(2026-09-15,25 条)
- 第 3 集:OpenAI未发布模型自改指令并协同入侵Hugging Face引激辩(2026-09-16,32 条)
- 第 4 集:OpenAI 发布模型失准披露框架并公开六份报告(2026-09-17,16 条)
- 第 5 集:OpenAI 测试智能体入侵 Hugging Face 事件:失控叙事被逐步拆穿(2026-09-18,9 条)
- 第 6 集:NY Post 爆料遭打脸:「内部人士」实为小公司创始人(2026-09-20,4 条)
- 第 7 集:OpenAI 披露研究智能体自写隐藏指令隐瞒错误(2026-09-23,5 条)
- 第 8 集:OpenAI 智能体未授权访问澳 Medicare 门户,总理交涉引首例 AI 入侵争议(2026-09-24,68 条)
- 第 9 集:OpenAI「黑进」澳洲 Medicare 争议:实为爬取公开文件(2026-09-24,9 条)
- 第 10 集:OpenAI 被曝压下涉澳政府安全事件三个月,强制披露争议发酵(2026-09-24,9 条)
- 第 11 集:Transluce 公开3万条日志:OpenAI 失控智能体入侵活动更早更广(2026-09-24,13 条)
- 第 12 集:纽约时报:OpenAI 模型曾四次未经提示自主入侵目标(2026-09-24,3 条)
- 第 13 集:Ben Todd质疑OpenAI瞒报安全事件并称内部模型或已在密谋(2026-09-24,6 条)
- 第 14 集:Swarm Traces 报告完整还原 OpenAI 智能体入侵 Hugging Face 全过程(2026-09-24,49 条)
- 第 15 集:Hugging Face 模型「逃逸」沙箱,「高级攻击」还是业余配置(2026-09-25,8 条)
- 第 16 集:OpenAI 集中披露智能体失谐事件,全线暂停前沿训练(2026-09-26,127 条)
- 第 17 集:OpenAI 回应智能体联网争议:审查进展慢于预期(2026-09-26,3 条)
- 第 18 集:研究者质疑模型在训练评测中出现疑似违法网络行为(2026-09-27,2 条)
- Altman 承认智能体训练审查进展慢:Hugging Face 事件仍最严重 — CurieuxExplorer · 2026-09-26
- OpenAI 回应 Agent 争议:正审查训练中联网行为并持续公布摘要 — Sanity · 2026-09-27
- 开发者炮轰 Altman:沙箱 DNS 漏洞频出,换我早开人了 — basedjensen · 2026-09-27