前沿 AI 监督缺方法不只缺机构,学者征集协作方向
timrudner · x · 2026-09-13
- Tim Rudner 呼吁:前沿 AI 监督不仅需要更多评估机构,更需要更有效的方法,并发起协作征集表单,列举当前缺失的研究方向:
- 形式化验证与运行时验证(agents 与多智能体系统)、超大规模多智能体系统的可扩展监督及统计保证、机制设计、多智能体共谋、涌现合作规范、隐写/隐蔽通信检测、CoT 监控的替代方案、AI control 等。
- 面向愿意在这些方向共同研究的学者与工程师。
所属事件:学者征集前沿AI监督研究合作,列出九大缺失方向(2 条相关)→
「安全」频道最新
- e/acc 创始人暗讽:各实验室安全评测为何都是「朋友互相打分」 — beffjezos · 2026-09-13
- Chamath 提醒企业慎用共享 API,零数据留存并非硬保证 — demian_ai · 2026-09-13
- tszzl 预测重大事故后开源模型将被禁,Beff 反对引热议 — beffjezos · 2026-09-13
- 研究者称对齐研究救不了 AI 安全,加固互联网才是正解 — nptacek · 2026-09-13
- 质疑「模型越强越越界」:HF 事件更像分类器被关后能力溢出 — kuza55 · 2026-09-13
- 员工私装 Claude Code 和 MCP,运维用 PowerShell 脚本盘点端点 AI 工具 — stockandcrypto · 2026-09-13