安全研究者算账:像前沿实验室那样测 ExploitBench 要烧 5930 万美元 API 费

OwariDa · x · 2026-09-22

安全研究者 Jhaddix 提醒社区:攻防两方的网络安全从业者与威胁行为体,根本不具备前沿 AI 实验室那样的测试能力。他引用 Hugging Face 报告做了粗略估算:ExploitBench 评测动用了 10,000 个并发 agent 连续跑 8 天、不限速,若按前沿实验室的 API 价格复现约需 5930 万美元(Astra 模型);即使租用云端算力用其他模型,DeepSeek v4 约 340 万美元、Kimi K3 约 1690 万美元、GLM 5.3 约 930 万美元。更关键的是,前沿实验室在测试时移除了所有护栏和分类器,外部人员无法以同样方式复现。此外还需承担让 harness 驱动 10,000 个 agent 的工程成本。结论是:前沿实验室在漏洞挖掘能力上的领先优势,外部安全社区难以验证或追赶。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →