医学试验案例实测:多数前沿 LLM 验证声明翻车
deliprao · x · 2026-10-06
deliprao 用具体案例演示其 COLM26 研究:一份医学试验证据罗列大量重要细节,结尾注明「试验仅对日本女性开放」;若保留全部细节、仅把声明中的资格条件翻转为「不限族裔」,大多数前沿 LLM 仍会错误接受该声明。由于基准中损坏部分总是最显眼,捷径在此恰好判对负样本,LLM 在这类基准上训练后迅速学会捷径,在真实部署中会产生奇怪效果。
所属事件:UPenn研究:LLM验证声明靠捷径,基准高分高估真实验证能力(6 条相关)→
「研究」频道最新
- PerturBot 用扰动训练打破视觉-语言-动作模型的捷径依赖 — Mingyu Liu · 2026-10-06
- TextReg 治理提示词过拟合,TextGrad 之上最高提升 11.8% — GeorgiaTech · 2026-10-06
- SourceLearn 让智能体沉淀源级能力,15 项评测 13 项第一 — GeorgiaTech · 2026-10-06
- 用表示空间 MMD 后训练扩散语言模型,16B 模型解码更并行 — yresearch · 2026-10-06
- Attention Relay 免训练迁移 LLM 指令遵循能力给文本嵌入模型 — _reachsumit · 2026-10-06
- PSA 搜索代理写程序筛选候选,两基准成功率提升 4-7.6 个百分点 — _reachsumit · 2026-10-06