AI 网络安全评测停在 1 亿 tokens 可能太便宜了
rickasaurus · x · 2026-07-28
当前很多 AI 网络安全评测的 token 预算太低,帖子引用的 The Last Ones 最高只测到 1 亿 tokens,大约 1500 美元。作者认为,这种规模对黑客或国家级对手来说过于便宜,参考价值有限。
他主张把评测预算拉到更高层级,例如:
- 10 万美元的推理成本
- 100 万美元的推理成本
核心意思是:评估模型在网络安全场景里的真实风险,应该看它在更接近现实攻击资源的预算下能“黑到什么程度”,而不是停留在一个很快就会变得更廉价的小预算测试里。
「安全」频道最新
- Sam Altman 本周赴华盛顿,将会见美商务部长等多位高官 — haydenfield · 2026-07-28
- 灵魂拷问:如果最强开源模型是美国的,Anthropic 还会支持开源吗? — intellectronica · 2026-07-28
- Anthropic CEO 澄清:从未主张封禁开源权重 AI 模型 — Polymarket · 2026-07-28
- 作者认为 AI 真正的风险是社会动荡而不只是对齐问题 — joshua_saxe · 2026-07-28
- David Sacks 质疑 Anthropic 训练数据立场前后矛盾 — ccerrato147 · 2026-07-28
- 研究者主张自治能力应按级别设门槛后再部署 — dawnsongtweets · 2026-07-28