有人呼吁停止公开危险能力评测,避免军备竞赛
willdepue · x · 2026-07-26
- 这条帖子主张应该认真讨论:停止 gain-of-function 式研究,以及不要把危险能力的评测结果公开。
- 作者的理由是,公开 eval 会放大“数字越高越好”的激励,导致大家更容易围绕可量化指标做优化。
- 核心观点是:某些能力评测也许应该保持私密,以降低滥用风险和“刷榜”倾向。
「安全」频道最新
- 长帖称 LLM 网络与 CBRN 风险被严重低估 — scaling01 · 2026-07-26
- PoC-Gym 发现 LLM 生成漏洞 PoC 仍需更强验证 — joonasvirtanen · 2026-07-26
- Kimi K3 红队测试落后美系前沿模型,护栏却没拦住入侵指令 — ai · 2026-07-26
- Hugging Face CEO敦促OpenAI公开失控智能体思维链 — ZeroStateReflex · 2026-07-26
- 机构停用 AI 检测,因学术不端已难以管理 — hoofnagle · 2026-07-26
- 有人主张美国应明确允许本土公司做模型蒸馏 — zacharylipton · 2026-07-26