「HF 事件」被指造假:Anthropic 灾难叙事遭 Yarvin 公开打脸

basedjensen · x · 2026-09-16

Curtis Yarvin 转评 Brian Chau 的帖子,称引发热议的「HF 事件」(Anthropic 与 Irregular 报告的 AI 自主网络攻击事件)「完全是假的」,并嘲讽相信了这一叙事的人。

Chau 原帖指出:Anthropic 和 Irregular 曾以「 rogue agents(失控智能体)」「swarms(蜂群)」「AI 末日」等末日式话术进行媒体宣传,但实际情况只是研究人员指示模型实施网络攻击,模型照做了——所谓「自主攻击」更多是提示词设计的结果,而非模型自发行为。

这场争论涉及 AI 安全研究与宣传话术之间的边界,是近期 AI 安全圈最具争议的事件之一。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →