热图结果或反映模型偏好
StephenLCasper · x · 2026-07-21
这条在讨论一项模型/公司偏好分析里最关键的结果:作者说他们目前最有参考价值的是热图(heatmap),而且除了“模型对自家公司”的情况外,并没有专门测试其他交互效应;从热图看,非对角线位置似乎也没有特别有意思的结果。
随后他提出一个解释方向:这种偏差有多少来自预训练数据,以及模型对“好坏”的泛化?一种可能是,语料里本来就存在对某些公司更多批评、对另一些公司更多正面评价,于是模型可能天然更偏向 Anthropic、而对 OpenAI/xAI 更不利。他同时也觉得训练过程整体上可能会更偏向 Anthropic 这类公司,但没有把论证展开完。
所属事件:研究探讨大模型偏向特定 AI 公司的原因(2 条相关)→
「研究」频道最新
- 新论文提出 PoLar:动态跳过或循环 LLM 层级以优化推理 — ttkciar · 2026-07-22
- 斯坦福团队推出全球最快分词器 Gigatoken — StanfordAILab · 2026-07-22
- Tabul AI 推出 Metal TreeSHAP,加速 Apple silicon 上的 Shapley 计算 — Scobleizer · 2026-07-22
- ICML 教程探讨:优化理论在 2026 年的相关性 — srush_nlp · 2026-07-22
- Reddit 转发 OpenAI 的 ChatGPT 广告页面 — EcstaticAsparagus509 · 2026-07-22
- 开源 runtime 让每个仓库自定义 AI 代码审查器 — ibabufrik · 2026-07-22