前沿AI评测被指正失去人类基准参照
沃顿商学院教授 Ethan Mollick 指出,随着前沿 AI 模型的基准测试日益复杂,当前的评测体系正逐渐丧失一个核心环节:与人类能力的对比。他强调,经过验证的基准测试必须包含人类基线数据,缺乏这一参照已成为当前前沿 AI 评测失真的致命隐患。
2026-07-30 ~ 2026-07-31 · 2 条相关
- 前沿AI评测失真:缺乏人类基线数据成致命隐患 — emollick · 2026-07-30
- Ethan Mollick:前沿 AI 评测正失去人类基准参照 — emollick · 2026-07-31