斯坦福推出 PhilosophyBench:首个大规模评测 AI 哲学能力的基准

ajratner · x · 2026-09-25

斯坦福 AI Lab 与 StanfordHCI 联合发布 PhilosophyBench,首个独立、大规模评测 AI 哲学能力的基准,试图回答「AI 能否产生新颖的哲学思想」。难点在于哲学没有「单元测试」,需要新方法来严格评估 AI 在哲学上的表现。Snorkel AI 通过其 Open Benchmarks Grants 提供支持,正招募哲学家参与。

所属事件:斯坦福发布首个 AI 哲学能力评测基准 PhilosophyBench(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →