ICML 2026 讨论智能体失败研究
wzenus · x · 2026-07-10
这是一则 ICML 2026 相关的口头报告介绍,提到三项互补研究:D-CEM 用 loss-aware deliberation control 挑战不安全的共识;Who&When Pro 用多模态失败归因做大规模基准;ATLAS 则通过自适应失败分类法改进 judging、reflection 和 agent 优化。
回复中还介绍了另一场邀请报告:研究者讨论标量奖励在 LLM-agent 训练中的失败模式,并提出用更丰富的文本反馈和自蒸馏来改进 MaxRL,通过按任务难度归一化更新。
所属事件:ICML 2026 FAGEN研讨会聚焦AI智能体失败模式(11 条相关)→
「公司和人」频道最新
- Anthropic 内部爆料:并非人人都持高 p(doom) 灾难论 — anpaure · 2026-09-11
- AI 电影节 Lumara 将登陆纽约,顶级 AI 电影人齐聚评审 — 0xAllen_ · 2026-09-11
- Anthropic 研究员被指暗中窥探学术客户研究、抢先出成果引争议 — basedjensen · 2026-09-11
- 投资人放话:Palantir×英伟达联手将重创 Anthropic IPO 估值 — pdamodaran · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11
- PyTorch Day Korea 2026 首届线下大会启动,9月13日截止征集演讲 — PyTorch · 2026-09-11