Integrity Bench:衡量模型过度自信程度的新基准

Acne_Discord · reddit · 2026-08-28

AI Explained 和 Pablo Romero 发布了新的评测基准 Integrity Bench,旨在量化 LLM 的过度自信(Overconfidence)行为。

该基准通过设计特定问题,测试模型在不确定或无信息时的表现,区分其是承认无知(I don't know)还是产生幻觉或给出错误的高置信度答案。这对于评估模型的安全性与可靠性至关重要。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →