新论文:LLM 潜在信念可高精度预测其行为
Anthropic 研究员 brwilder 发布新论文,回应近期关于是否应拟人化 AI 的争论。研究通过二值未知状态的决策问题,概率推断出模型的单一潜在信念,并以此解释一系列决策行为。结果显示把 LLM 建模为持有潜在信念可在多种设定下高精度预测其行为,且预测精度随模型通用能力提升而急剧上升。
2026-09-10 ~ 2026-09-10 · 2 条相关
- 新论文:为 LLM 归因「信念」确能高精度预测其行为 — brwilder · 2026-09-10
- 研究实证:把 LLM 视为持有潜在信念可有效预测其行为 — brwilder · 2026-09-10