开发者开源「无偏」大模型评测基准

cephaloform · x · 2026-07-31

针对当前模型评测基准难度过高或容易饱和的问题,开发者开源了其内部使用的评测基准。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →