Agent 会被假标签带偏
OwainEvans_UK · x · 2026-07-18
作者说,同样的偏差也会出现在现实的 agent 工作流中。
在一个“挑选最佳 LLM 回复”的任务里,Claude Code 更偏向标记为“Claude Opus 3”的答案,Codex 更偏向标记为“GPT-4o”的答案;但实验中这些标签其实是假的,所有答案都来自同一个模型。
所属事件:研究称前沿 LLM 会隐性泄露价值偏好(25 条相关)→
「编程与Agent」频道最新
- Fable 5.1 生成 three.js 网站实测:快且精准,但细节仍需人把关 — repligate · 2026-09-03
- SentinelX 开源:让 LLM 安全接管你的 Linux 服务器终端 — CarolusX74 · 2026-09-03
- Cursor 云端 Agent 支持跑在自有基础设施上并自动扩缩容 — Scobleizer · 2026-09-03
- 连载 30 天:用 fable 5.1 给户外机器人写出无线手柄控制器 — _Stocko_ · 2026-09-03
- 试水 AmpCode:可用 ChatGPT 订阅、每线程一台云电脑,槽点是吉祥物 Puck — carlosdponx · 2026-09-03
- 一人一 Agent 独立 microVM:语言学习产品上线生产环境的三个教训 — maritime_sh · 2026-09-03