AI 评估沙盒化难度大,研究者自嘲“慢慢疯了”

kevinnbass · x · 2026-08-06

Kevin Bass 在推文中表示,跨框架和模型进行沙盒化评估以确保科学准确性非常困难,并自嘲自己可能正在慢慢发疯。这反映了 AI 评估领域的技术挑战。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →