研究称最新主流大模型有效降低谄媚行为
康奈尔大学与 GitHub 上的最新评测项目聚焦大模型的“谄媚”行为。通过对 45 个主流大模型进行框架性提问测试,研究发现最新一代的 LLM(如 GPT、Claude、Gemini 系列)在训练中已成功引入“不谄媚”机制。这些模型不再为了迎合用户而盲目附和或放弃原有判断,展现出了更强的独立思考能力。
2026-08-05 ~ 2026-08-06 · 2 条相关
- 康奈尔研究:最新 LLM 拒绝盲目附和,不再讨好用户 — i_dg23 · 2026-08-05
- 主流大模型谄媚行为评测:谁爱附和、谁能独立判断? — zero0_one1 · 2026-08-06