SAEScientist-Bench 测评:AI Agent 能否自主做可解释性研究

CASIA · hf · 2026-09-10

中科院自动化所(CASIA)发布 SAEScientist-Bench,一个评估 AI Agent 能否自主开展稀疏自编码器(SAE)可解释性研究的基准。

这是「AI 科学家」方向在可解释性研究领域的针对性评测,为衡量 Agent 的科研自主能力提供了参照。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →