COLM 2026 多智能体研究集中亮相,含信念引导「双重智能体」
mohitban47 · x · 2026-10-07
COLM 2026 会议开幕,多位研究者预告将展示多智能体方向的海报论文。其中 Vaidehi Patil 团队的《Playing Along: Learning a Double-Agent Defender for Belief Steering via Theory of Mind》将于 10 月 6 日上午 11 点(太平洋时间)在 Poster Session 1 展示,研究用「双重智能体」防御者基于心智理论进行信念引导。EliasEskin 还将在 AdvML-Frontiers × CoTMA 工作坊做报告,主题涵盖 LLM 系统中的 unlearning、隐私泄露与对抗交互,并可与到会者交流多智能体通信/涌现语言、置信度校准、忠实性等话题,UT Austin 另有教职招聘信息。
所属事件:COLM 2026 展示心智理论「双面 Agent」防御研究(3 条相关)→
「安全」频道最新
- 哈佛发布智能体血液生物标志物发现工具:隐私不出域,AUC 中位提升 4.18 点 — Harvard · 2026-10-07
- Docker 隔离方案:让不可信的 Vibecoded 应用无法外传你的数据 — dtdisapointingresult · 2026-10-07
- 纽约时报刊文:前间谍谈如何对抗 AI 生成的宣传攻势 — nytopinion · 2026-10-07
- 用户发现 ChatGPT 在按下发送前就已把剪贴板截图上传 — Innomen · 2026-10-07
- 警惕:使用「去审查」模型可能让你被黑,安全风险警示 — Thrumpwart · 2026-10-07
- OpenAI 将在欧盟默认给 ChatGPT 输出水印,应对 AI 法案 — Ars Technica AI · 2026-10-07