Delip Rao:现有 LLM 微调的判定模型难带来真正的评委多样性
deliprao · x · 2026-09-26
AI 研究者 Delip Rao 评论 typesafeai 的 Jev 产品,认为其代表了一种将持续存在的产品与 AI 设计思路,但指出市面上的 Jev 类模型几乎都是对现有模型的微调。这会导致「评委」们犯相似错误、在生产中强化同样的偏见——换用这版 Jev 也解决不了问题。他呼吁从零开始构建这类模型,以保证真正多样化的合格判定模型。
所属事件:研究者称 LLM 裁判多为微调产物,偏见同质化堪忧(2 条相关)→
「模型」频道最新
- Ethan Mollick:压缩 prompt 是坏建议,别把输入成本当目标 — emollick · 2026-09-26
- GPT-6 Luna 比 5.6 更省推理 token,难题两者都栽 — mhmazur · 2026-09-26
- 重度用户:Opus 5.5 又快又便宜,抢走我所有正经工作 token — brandon_galang · 2026-09-26
- Reddit 用户实测:Claude Opus 5.5 做游戏强得离谱 — Adorable_Being_763 · 2026-09-26
- Yoav Goldberg 发现前沿模型擅长 Sokoban 类谜题,训练数据成谜 — lukaszkaiser · 2026-09-26
- GPT-6 Astra 实测:初稿骗过 CEO,写作是大升级但有坏习惯 — every · 2026-09-26