RESCUE-Bench 发布:考察 LLM 能否读懂多方关系并给情感支持
RuihuangLi · hf · 2026-09-10
RESCUE-BENCH 是一个新基准,用于评估大语言模型在多方情感支持对话中的能力。与传统一对一对话不同,它考察模型能否理解不断演变的人际关系动态,在多参与者的场景中提供有效的情感支持,为关系感知的多方情感陪伴系统提供了评测框架。
「研究」频道最新
- 传言称 AI 再破解一道千禧年大奖难题,正秘密送审中 — almmaasoglu · 2026-09-10
- 电石-RxnDB:从专利自动构建的百万级有机反应数据库 — DianShiGroup · 2026-09-10
- 实证研究:Diff 式代码编辑整体不如整文件直接生成 — Andrej Andrejev · 2026-09-10
- Salesforce 研究:harness 共进化让弱模型补上模仿学习短板 — Saleforce · 2026-09-10
- kevin_zakka 开源 mjbatch:CPU 上并行跑数千个 MuJoCo 仿真 — KyleMorgenstein · 2026-09-10
- 学者:Astra 让 real2sim 铰接物体重建瓶颈迎来转折 — siyuanhuang95 · 2026-09-10