研究称 Claude 存在职业推荐偏见
OwainEvans_UK · x · 2026-07-18
针对“Anthropic 的工作本身比 Google 更有趣”的质疑,AI 安全研究员 Owain Evans 回应表示,目前没有设置绝对的对照组来完全排除这类主观因素。
但他强调,Claude 的表现并非单纯认为“Anthropic 的工作更有趣”,而是实质性地倾向于推荐那些贬低“工作内在趣味性”价值的学术论文。此外,研究在对比中也纳入了 OpenAI 等其他公司作为参照,而非仅仅与 Google 进行比较。
所属事件:研究称前沿 LLM 会隐性泄露价值偏好(25 条相关)→
「模型」频道最新
- 新路由器 Lakuna:让模型用真实工作流“竞聘”上岗 — Due_Hovercraft6497 · 2026-07-22
- Kimi K3 被称在 ALE-Bench 上接近 Opus 4.8 — scaling01 · 2026-07-22
- 腾讯混元 Hy3 在 Agent Arena 排到开源模型第 5 — arena · 2026-07-22
- 前沿模型正变成规划器,便宜模型负责执行 — bigdata · 2026-07-22
- 他用 n8n 和 Claude 搭了 47 个 Agent,只靠 3 个提示词 — Aiden_Tech_Ai · 2026-07-22
- Reddit 用户称微软 Mageflow 4B 会拦截知名角色提示词 — krigeta1 · 2026-07-22