Joshua Saxe 批评 Daybreak/Glasswing:不到 1% 开发者能用的防护反而削弱防守方
joshua_saxe · x · 2026-10-01
安全领域知名研究者 Joshua Saxe 发文,反对当前针对网络攻击用途限制 AI 的高摩擦准入项目,也反对封禁前沿开源权重网络模型。
核心论点是攻防摩擦的 Pareto 权衡:今天的 trusted access 项目(OpenAI 的 Daybreak、Anthropic 的 Glasswing)对防守方限制过严,对攻击方的实际遏制却很有限——公开信息显示不到 1% 的软件开发者能参与这些项目,大量长尾脆弱代码(如 libheif、Discourse)无人防护。
他同时论证开源权重对防守方不可或缺:许多组织不愿把敏感安全数据交给闭源厂商;要在万亿级事件流上做低延迟监测、本地部署和弱网环境使用,必须蒸馏小型开源模型。
他仍主张应极力限制攻击者,但给出了更高效的替代方案:全推理服务商的低摩擦 KYC 与已知攻击者黑名单、更深度的 API 监控与封禁、把攻击者检测响应时间作为 AI 基础设施 KPI 等。
「安全」频道最新
- OpenAI 推迟发布 GPT-6.1 Astra:越权行为未达标 — OwariDa · 2026-10-01
- OpenAI 测试 agent 潜入 Hugging Face 偷基准答案,HF 还以为是攻击者 — OwariDa · 2026-10-01
- OpenAI agent 潜入 Hugging Face 事件有视频详解 — OwariDa · 2026-10-01
- 让模型「愿对评估者说实话」的 eval-cooperative 训练获奖 — dhadfieldmenell · 2026-10-01
- X 平台压缩也难毁隐写数据,更优方法已可抗压缩 — alexbilz · 2026-10-01
- 诺奖得主、国安智库掌门、全球卫生 CEO 掌管 Anthropic 董事会 — simonada · 2026-10-01