TransluceAI 倡议构建开放的模型行为评估生态
cogconfluence · x · 2026-07-25
AI 监督机构 TransluceAI 发文指出,有效的 AI 监管不能仅停留在衡量模型的能力上,更需要测量模型在真实世界中的行为表现。为此,他们正致力于打造一个开放的模型行为评估科学生态,并呼吁建设相应的公共基础设施。团队汇集了涵盖 AI 治理、评估和人机实验领域的顶尖科学家与工程师。
「安全」频道最新
- 有人声称做出通用越狱,直指 Opus 5 和 GPT-5.6 Sol — TheZvi · 2026-07-25
- 闭源系统撑不住时,开源权重成了响应兜底 — Xianbao_QIAN · 2026-07-25
- 学者反思AI物理开关:它本身就会成为头号黑客靶子 — anderssandberg · 2026-07-25
- 讨论认为 AI 模型未必是 IP,但数据获取方式仍关键 — BlancheMinerva · 2026-07-25
- ExploitGym 称 GPT-5.6-Sol 漏洞利用能力超过 GPT-5.5 — dawnsongtweets · 2026-07-25
- AI Security Forum 仍有空位,Anthropic 与 ARIA 人士参会 — joshua_saxe · 2026-07-25