斯坦福发布首个大规模 AI 哲学能力评测基准

斯坦福 AI Lab 与 Stanford HCI 团队联合发布 PhilosophyBench,号称首个独立、大规模评估 AI 哲学能力的基准,由 Sebastian Thrun 官宣,项目团队包含哲学家与律师。该基准试图回答「AI 能否产生新颖的哲学思想」这一问题,为衡量模型哲学推理能力提供了系统化工具。

2026-09-25 ~ 2026-09-25 · 3 条相关

另有 1 条近重复转述:simonguozirui