COLM 2025 附会:共谋行为审计研究将登 AdvML-Frontiers 工坊
nandofioretto · x · 2026-10-05
研究者 ebagdasa 宣布将于 10 月 9 日(周五)在 COLM 2025 的 AdvML-Frontiers × CoTMA 联合工作坊上作关于「审计共谋行为(auditing collusion)」的报告,与其他多位讲者同场。
引用推文中他感谢 Mason Naka、abhinavkumar26、WatIsDas 等合作者的大量工作,并称 Colosseum 是研究多智能体行为的一个很好的基础框架。属于多智能体安全/行为审计方向的学术动态。
「研究」频道最新
- Judea Pearl:逻辑与因果推断是西方科学两大支柱 — yudapearl · 2026-10-05
- 清华 NLP 推出 LexReward:三维分类体系驱动法律大模型奖励建模 — TsinghuaNLP · 2026-10-05
- 蛋白质折叠数据能让大模型更会推理:微调后 10 项基准全涨 — SJUT1 · 2026-10-05
- MotorMind:通用 VLM 免训练操控真机机器人,成功率 95% — UIUC-CS · 2026-10-05
- MBZUAI 发布 HyperBrowseComp:13 语种 423 题压测浏览 Agent — MBZUAI · 2026-10-05
- VaSE:免训练随机 KV 缓存驱逐法,缓解推理模型内存膨胀 — robinomial · 2026-10-05