RadLE-R:模型可靠性接近人类基线

DrDatta_AIIMS · x · 2026-07-13

这条继续展开 RadLE-R(Reliability Index):衡量模型给出“可自动处理”答案时,这个答案到底靠不靠谱。

结果显示:

作者的结论是:模型确实在变准,但它们的“自信”还不能稳定信任;如果自信不可控,自主性就不可控。

所属事件:RadLE 2.0发布:医疗AI评测聚焦不确定性(8 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →