学者实测:Qwen、oss、Gemma 均难胜任学术摘要零结果判别

jon_mellon · x · 2026-09-19

jonmellon 回应 RexDouglass 的追问,确认 Qwen 模型同样未能胜任其学术文本判别任务,Llama oss 和 Gemma 也一样。结合上下文,该任务为判断学术摘要是否为 null finding,作者团队此前测试的廉价模型均表现平平,新模型才首次显得有前景。

所属事件:学者实测判别学术零结果:廉价开源模型集体失灵(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →