PosteriorBench:重建准确率高不等于后验估计准
AnimaAnandkumar · x · 2026-09-24
Anima Anandkumar 团队发布 PosteriorBench,将科学逆问题求解的评估从单点重建推进到完整后验分布。
- 许多科学问题只能间接或部分观测,同一测量可对应多种物理解,仅看重建准确率会误导评估
- 团队投入大量算力构建四个任务的高保真参考后验:Darcy 流反演、泊松源恢复、碳捕集与封存、光传输材质推断
- 提供 5 项互补指标供研究者直接评估求解器
- 关键发现:重建准确率更高可能伴随更差的后验恢复,即使强生成式采样器也常常低估不确定性
「研究」频道最新
- 质疑「LLM 痛觉轴」:静态词向量也能复现同样结论 — wschroll · 2026-09-24
- 对比学习语言模型 CLM-8B:推理快至 9 倍,刷榜智能体编码基准 — ChengleiSi · 2026-09-24
- 腾讯 ARC 发布 GAE:几何原生潜空间,FVD 最高降 23% — CSProfKGD · 2026-09-24
- OpenRSI 团队阐述 RSI 理念:智能体扩展洞见生成是 ASI 关键拼图 — ChengleiSi · 2026-09-24
- OpenRSI-Index 扩张招募领域负责人与算力合作伙伴 — ChengleiSi · 2026-09-24
- 通往 RSI 的两步:优化单点研究 vs 改进整个研究系统 — ChengleiSi · 2026-09-24