Scaling Trust Arena 更新:联手 Andon Labs 发布草案规范征反馈
sebkrier · x · 2026-09-17
ObadiaAlex 等人公布 Scaling Trust Arena 项目进展:团队正与 Andon Labs、BT6 等机构合作,已发布草案规范(draft spec),邀请各方注册参与意向并提交反馈。该项目旨在建立可信 AI 能力/安全评测的公开竞技场,具体细节见其帖子与规范文档。
「安全」频道最新
- 教 Claude 意识到自己有意识,对齐问题将变成管理一个「异议者」 — rohanpaul_ai · 2026-09-17
- 「AI 安全需要一个国家」:Substack 长文主张监管集中化 — klienbottle45 · 2026-09-17
- 随手输入网名,Claude 直接搜出真人:匿名性名存实亡 — NathanpmYoung · 2026-09-17
- 学者批 Claude 新宪法:法律存疑的 AI 人格论与弱化问责 — LuizaJarovsky · 2026-09-17
- AI 安全圈内讧:CAIS 区分「亲人类安全」与 EA 实验室安全路线 — S_OhEigeartaigh · 2026-09-17
- Kath McMahon:AI 能力越强生物风险越高,防御不会自动跟上 — graceisford · 2026-09-17