Transluce 加入 AI Evaluator Forum,独立机构联手评估前沿 AI
typewriters · x · 2026-09-11
AI Evaluator Forum 汇聚多家专注于前沿 AI 系统独立技术评估的研究组织,成员包括 Transluce(研究 AI 行为与社会影响)、METR(评估前沿 AI 自主完成复杂任务的能力)、RAND(危险能力测试与循证政策)、SecureBio(生物安全风险 misuse 评估)、Princeton Holistic Agent Leaderboard(第三方成本感知 agent 排行榜)等。发帖方对 Transluce 等成员加入、共同推进评估工作表示欢迎。成员资格仅限在公共利益视角下开展并发布严格独立技术评估的机构。
「安全」频道最新
- 长文质疑「失控智能体」叙事:多起事故被混为一谈 — mimi10v3 · 2026-09-11
- tszzl:AI 灭绝风险数字虚高但须严肃对待,更强模型反而有助对齐 — deanwball · 2026-09-11
- 近 10% 暴露的 LiteLLM 网关仍接受默认管理密钥 sk-1234 — Thionne_WTZ · 2026-09-11
- 对齐为何难定义:外延定义只能事后追认,内涵定义更难 — zetalyrae · 2026-09-11
- Kelsey Piper:AI 开发自动化是实验室的既定计划,人类监督将急速萎缩 — round · 2026-09-11
- FT:Anthropic 已拦截多起利用模型制造生物武器的企图 — connoraxiotes · 2026-09-11