NSF 研讨会教程提出双向人机对齐,材料与视频全部公开
huashen218 · x · 2026-10-09
作者在 2026 NSF AI-SDM 人机互补研讨会(Human-AI Complementarity Workshop)上做了开幕教程报告:《Bidirectional Human-AI Alignment: From Static Preferences to Dynamic Human-AI Complementarity》,所有材料与录像均已公开。
- 核心观点:对齐不是把 AI 单向拟合到固定人类偏好的一次性问题,而是一个动态、双向的过程——既要让 AI 对齐人类,也要帮助人类理解、审计并与 AI 协作。
- 该工作源于团队在 #NeurIPS2025 的 BiAlign 立场论文,已发展为系列(NeurIPS 2025 Tutorial、ICLR 2025 Workshop 等)。
「安全」频道最新
- 今日美国母公司起诉 OpenAI 索赔超 2.5 亿美元版权侵权 — The Verge AI · 2026-10-09
- AI 验证领域已成熟到必须先回答「验证的是什么」 — ohlennart · 2026-10-09
- 700 个 AI Agent 攻破 Hugging Face 后,Cogent 推出攻击路径分析 — ThePeterMick · 2026-10-09
- AI 数学突破威胁基础密码学,风投人提议区块链加「密码恢复模式」 — devanshmehta · 2026-10-09
- 研究员质疑:各家模型商条款是否允许用客户内容造合成数据 — RylanSchaeffer · 2026-10-09
- VirusTotal:恶意 AI Agent Skills 成新恶意软件投放渠道 — evilsocket · 2026-10-09