关于模型“双盲”评估术语的歧义讨论
BlancheMinerva · x · 2026-08-28
用户 @BlancheMinerva 对新闻稿中用“双盲”描述模型偏差提出质疑,认为该术语通常指避免研究者的偏见,而非指模型本身的偏差。这引发了对AI评估术语准确性的讨论。
「研究」频道最新
- Anthropic 推出 MHS 标准,让 AI 智能体安全操控实验室设备 — jmuiuc · 2026-08-28
- 发布《百页语言模型》PyTorch 实战书 — burkov · 2026-08-28
- Bittensor 机器人奥运涌现超人类跳远能力 — markjeffrey · 2026-08-28
- 研究显示:向开源模型注入 1000 个指纹几乎无性能损耗 — 0xsachi · 2026-08-28
- AI 安全研究员担忧:多智能体训练可能让模型更懂同类而非人类 — dhadfieldmenell · 2026-08-28
- LLM 做不出 KRAS 那种原创洞见,但胜在跨领域组合假设 — Ghost_Pilot_MD · 2026-08-28