新论文:LLM 人类模拟还须保住跨环境的行为排序
soumitrashukla9 · x · 2026-10-01
研究者 Kehang Zhu 等人修改后重新发布的论文提出,LLM 模拟人类行为的评估目标不应只盯着复现人类分布或特定时刻的表现。
作者认为另一个同样重要的目标是:保持模型在不同环境之间的行为排序(ordering across environments),即正确还原不同情境下人类行为的相对顺序关系。作者以推文线程形式展开论证(共 6 条)。
「研究」频道最新
- RLTL;DR 论文:自生成反馈让 Pass@128=0 的任务破防至 14-31% — burny_tech · 2026-10-01
- 1000×1000 动力系统数据集发布:覆盖 133 种过程从混沌到大脑气候 — burny_tech · 2026-10-01
- GRASP 实验室四旋翼编队论文获 IROS 2026 最佳学生论文 — NikolaiMatni · 2026-10-01
- ERA 预测研究发布:技术论文与 Nature 论文一并公开 — ymatias · 2026-10-01
- Nature Physics 综述:高阶互作如何超越成对网络刻画复杂系统 — burny_tech · 2026-10-01
- 顶会审稿怪谈:计算机视觉研究者吐槽 novelty 关 — ATHii-127 · 2026-10-01