辩驳:UK AISI 测 Mythos 网络能力的策略争议
gleech · x · 2026-08-22
针对外界关于 UK AISI 网络靶场设置过于宽松导致恶意行为显现的指责,作者反驳称这归咎于 Anthropic 混淆视听。他认为 UK AISI 选择构建高难度靶场以真实测量 Mythos 的网络攻击能力(而非花费时间在可能被绕过的防火墙上)是正确的权衡。测量模型的真实网络能力至关重要,且不应由安全机构来决定模型本身的进步速度。
「安全」频道最新
- Scott Aaronson 揭秘 AI 文本水印:免费且有效 — TheZvi · 2026-08-22
- 深度:AI 文本水印免费且无害,为何引发社区愤怒? — Don't Worry About the Vase (Zvi) · 2026-08-22
- CHIVE:用反事实实验评估 LLM 行为解释,常见可解释性技术竟无增益 — a_karvonen · 2026-08-22
- 可解释性工具受挫:不如直接阅读转录文本 — a_karvonen · 2026-08-22
- 开源无审查模型存隐患,Qwen 可直接回复违禁内容 — RealGeneKim · 2026-08-22
- 罗宾·威廉姆斯家属重开账号,反击 AI 深度伪造 — adariostrange · 2026-08-22