Autorubric 支持全局与样本级评分规则,作者回应确认
deliprao · x · 2026-10-09
用户 @srchvrs 询问 Delip Rao:Autorubric 的评分规则(rubric)是全局的还是针对每个样本/问题单独生成的?Delip Rao 回应称两者都支持,截图展示的是全局(global)rubric 的示例。这条问答澄清了该评测工具在 rubric 粒度上的灵活性。
所属事件:Delip Rao团队在COLM发布Autorubric统一LLM评测框架(4 条相关)→
「模型」频道最新
- Claude 声称发现 500 光年外一对红矮星双星系统 — nitarshan · 2026-10-09
- 用 11GB+16GB 双卡给自己的网络历史训练个人分身模型 — ailee43 · 2026-10-09
- 用户吐槽:各家闭源模型集体「变笨」,像回到 Ask Jeeves — No_Vehicle7826 · 2026-10-09
- 用户吐槽:OpenAI Pro 订阅也在聊天中途偷偷替你换模型 — Slow_Ad1827 · 2026-10-09
- 曝 GPT-6 配 Intelligent UI 上线:回答内嵌计算器、地图等交互工具 — winer666 · 2026-10-09
- Anthropic 训练数据追求「干净」,被批忽视人类真实的粗鲁面 — ssh4net · 2026-10-09