AI评测设计领先实际训练半年,闭源模型将利用所有漏洞

xeophon · x · 2026-08-10

作者指出,AI模型评测(eval)的设计与修复可利用漏洞的进度,通常比实际训练中遇到相同问题领先3到6个月。这反映了开源与闭源模型之间的滞后差异,闭源模型可能会利用它们发现的所有漏洞。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →