AI 公司自己选审计方?研究揭示模型评估的利益冲突
rajiinio · x · 2026-07-30
评论指出,当前业界逐渐意识到由 AI 公司主导选择审计方和评估机构会导致严重的激励错位(poor incentive alignment)。这种利益冲突问题并非新事,早在 4 年前的 AIES 会议上,研究者(如 @rajiinio 等)就在相关文献中明确记录并探讨了这一现象。
「安全」频道最新
- AI 辅助破解 7 轮 AES 加密,Anthropic 赞助万美元算力 — jedisct1 · 2026-07-30
- AI年龄验证的两难:保护儿童还是助长监控? — ShakeelHashim · 2026-07-30
- 企业为何封杀直连 PyPI/NPM?四大工程治理痛点 — _jaydeepkarale · 2026-07-30
- AI对齐新思路:用低维结构控制万亿参数模型 — geoffreyirving · 2026-07-30
- Anthropic 安全牌遭质疑:被指借监管打压开源竞争对手 — SerialRealer · 2026-07-30
- 沃尔玛因人脸识别数据库面临隐私诉讼 — Yamapama · 2026-07-30