学者谈 LLM 标注:靠指令与人工编码标签,新模型表现有前景

jon_mellon · x · 2026-09-19

RexDouglass 追问任务细节与标注指令质量,jonmellon 回应称他们有经过实战检验的指令和多人人工人编码的标签作为测试基准,并重申新模型在其学术问题上表现非常有前景,但他不便评价其在一般任务上的表现。

所属事件:学者实测:廉价开源模型难判学术零结果,新模型现曙光(9 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →