论文《LLMs as Oracles》:量化用户对LLM的主观判断依赖
alex_verem · x · 2026-09-22
这是斯坦福论文《LLMs as Oracles: Reliance on LLMs for Subjective Personal Questions》的 arXiv 链接帖(2609.14849),作者包括 Myra Cheng、Diyi Yang、Dan Jurafsky 等。
论文通过类型学与基于 LLM 的测量方法,量化人们把主观个人问题交给 LLM「神谕」的程度:公开数据(WildChat、ThoughtTrace 共 6.8 万条 prompt)显示此类使用 2023-2026 年持续上升,年轻用户更明显;52 名参与者的 14 万条捐赠数据显示同样趋势,且多数人并未意识到自己在这么做。详细发现见同事件解读帖。
所属事件:斯坦福研究:超九成主观问题被交给 AI 替人决定(2 条相关)→
「研究」频道最新
- 超 1TB 中国 A 股 L2 逐笔限价订单簿数据集上线 Hugging Face — venvoo · 2026-09-22
- Grok 4.7 发布后,Reddit 提议按「每可用任务成本」而非 token 价评估模型 — Crescitaly · 2026-09-22
- 谷歌 ScientistTwo 自动科研系统:107 道题攻克 80.4%,超人类 SOTA — thisdudelikesAI · 2026-09-22
- 腾讯混元推出 WebCraftBench:Agent 实测网页应用,人偏好匹配度 85.3% — TencentHunyuan · 2026-09-22
- Sarah Hooker 提议收 1 美元投稿费,测 AI 研究 agent — MannyKayy · 2026-09-22
- 曝 OpenAI 新模型训练仅 24 天已解决百余个数学开放难题 — BilelKort · 2026-09-22