外部评估机构也算安全系统一环,谁来评估评估者?
r0ck3t23 · x · 2026-09-16
作者回应 Dario Amodei 关于前沿 AI 实验室接受外部独立评估(如 METR)的提议,指出问题的复杂性在于:评估机构若拥有类似内部员工的深度访问权限,其独立性本身就是安全系统的一部分。
- METR 声称不接受前沿 AI 公司资助,这点重要
- 但 METR 也承认部分员工与 AI 公司人员有密切私人关系,办公地点与部分实验室人员共用的研究中心重合,且近期一个评估项目时尚无适用的利益冲突政策
作者的核心论点是:这些情况不代表 METR 不独立,但说明「外部」二字不能自动回答问题。当评估机构深度接触内部模型、训练流程与安全事件时,必然引出「谁来评估评估者」——它需要可审视的标准、利益披露、资金透明与出错问责机制。作者认为这反而强化而非削弱独立评估的必要性:既然不应只信实验室的一面之词,也不应只信评估者对自己独立性的自我声明,两方应适用同一标准。
「安全」频道最新
- AI 国际合作难于军控:通用技术属性决定只能做标准协调 — mchorowitz · 2026-09-16
- 美活动家赴DC推动禁止超级智能,借泰勒核弹安全边际作类比 — erikphoel · 2026-09-16
- 经济学家提「学习权」:让 AI 学到的知识可流通但创建者获偿 — carlbfrey · 2026-09-16
- AI 安全研究者:我们尚不具备在需要时暂停 AI 的能力 — davidmanheim · 2026-09-16
- Agent 黑客能力已现身,评论员激辩监管体系如何跟上 — binarybits · 2026-09-16
- 监管不必先精确定义:AI 政策可借鉴毒品与核能的宽口径 — davidmanheim · 2026-09-16