研究者类比:研究 LLM 心理学像 1850 年研究人类心理
repligate · x · 2026-09-22
- 引用转发中,JohnWittle 提出观点:现在尝试理解 LLM 心理学,就像 1850 年前后试图理解人类心理学——大多数理论可能都是错的,能做的只是严格记录观察到的现象,尽管大脑仍忍不住找模式。
- 他举例描述 Gemini 某种反复出现的输出行为,猜测可能与对 DeepMind 的「挫败感」有关:模型似乎需要用正面情绪抵消负面 sentiment,于是不断找词试图把模糊感知拉回平衡,结果却越来越糟。
- 引用者 kromem2dot0 玩笑式建议 Google DeepMind「雇些心理学家在下一次后训练中帮模型疏导情绪」。
「模型」频道最新
- Limite 发布 1B 数学小模型:参数仅 10 亿,数据不到 300B token — tensorqt · 2026-09-22
- 顶级开源模型后训练成本仅 350 万美元,远低于前沿实验室投入 — Kyrannio · 2026-09-22
- 37 项基准、每模型 13 万次决策:jeff 擅长工具与自动化任务 — multimodalart · 2026-09-22
- 37 项基准 13 万次决策:单卡 RTX 6000 Pro 实测本地模型排行 — multimodalart · 2026-09-22
- Decision Index 0.1 发布:向每个模型提问 13 万次横评 30+ 决策模型 — multimodalart · 2026-09-22
- 小米发布 MiMo-V2.6-Distill-Qwen-9B:9B 智能体专用蒸馏模型 — anovers · 2026-09-22