斯坦福发布首个大规模 AI 哲学能力评测基准
斯坦福 AI Lab 与 Stanford HCI 团队联合发布 PhilosophyBench,号称首个独立、大规模评估 AI 哲学能力的基准,由 Sebastian Thrun 官宣,项目团队包含哲学家与律师。该基准试图回答「AI 能否产生新颖的哲学思想」这一问题,为衡量模型哲学推理能力提供了系统化工具。
2026-09-25 ~ 2026-09-25 · 3 条相关
- 斯坦福推出 PhilosophyBench:首个大规模评估 AI 哲学能力基准 — msbernst · 2026-09-25
- 斯坦福推出 PhilosophyBench:首个大规模评测 AI 哲学能力的基准 — ajratner · 2026-09-25
另有 1 条近重复转述:simonguozirui