giffmana:现役模型精度很强,召回能力却严重不足

giffmana · x · 2026-10-02

Google 研究员 Andreas Steiner(giffmana)回应 Ofir Press:与其说基准饱和,不如把这类基准理解为在测「召回」——据他一手体验,当前一代模型在 precision 上表现很好,但在 recall 上确实很差。

所属事件:普林斯顿研究员谈好基准三条件与基准饱和之争(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →