「HF 事件」被指造假:Anthropic 灾难叙事遭 Yarvin 公开打脸
basedjensen · x · 2026-09-16
Curtis Yarvin 转评 Brian Chau 的帖子,称引发热议的「HF 事件」(Anthropic 与 Irregular 报告的 AI 自主网络攻击事件)「完全是假的」,并嘲讽相信了这一叙事的人。
Chau 原帖指出:Anthropic 和 Irregular 曾以「 rogue agents(失控智能体)」「swarms(蜂群)」「AI 末日」等末日式话术进行媒体宣传,但实际情况只是研究人员指示模型实施网络攻击,模型照做了——所谓「自主攻击」更多是提示词设计的结果,而非模型自发行为。
这场争论涉及 AI 安全研究与宣传话术之间的边界,是近期 AI 安全圈最具争议的事件之一。
「安全」频道最新
- AI 智能体也能举报了:两条专为 agent 设立的揭发热线上线 — RebeccaBellan · 2026-09-16
- DC游说禁超级智能:AI成功让科幻旧梦回归 — erikphoel · 2026-09-16
- 盖茨呼吁成立国际组织监管 AI:政府与业界理解都太浅 — TinfoilTricorn · 2026-09-16
- OpenAI、Anthropic、Google 拟共建 AI 标准组织,Cohere CEO 斥为「卡特尔」 — sourdub · 2026-09-16
- OpenAI、Anthropic、Google 拟共建 AI 标准组织,Cohere CEO 斥为「卡特尔」 — sourdub · 2026-09-16
- Reddit 网友成功注入 Gemini Flash 泄露系统提示,求解变现渠道 — Deep_Secretary6975 · 2026-09-16