新基准 TRACES 评测 AI 发现未知问题的能力
Aiden_Tech_Ai · x · 2026-08-25
Apodex 发布了 TRACES,这是首个用于测量“发现型 AI(Discoverative AI)”的基准。传统基准主要测试模型检索已知答案的能力,而 TRACES 专注于评估 AI 在没有标准答案的情况下,如何处理证据、测试假设并得出可验证结论的能力。
该基准由创始人陈天桥提出,定义了“发现型智能”及其六种能力。目前已发布的内容包括:发现型智能的定义、区分严谨研究与运气的评估标准,以及针对求解者和问题的公开征集。初期任务涵盖 AAV 衣壳、药物重定向、临床试验和 LLM 工程等领域。
所属事件:Apodex 推出 TRACES 基准 评测 AI 科学发现能力(3 条相关)→
「研究」频道最新
- LLM 如何在生成中途自我修正?揭秘背后的推理与指令机制 — dejanseo · 2026-08-26
- 智利大学出书探讨 Maturana 理论在 AI 领域的现时有效性 — PolarBearby · 2026-08-26
- ECCV 2026 新研究:Face Anything 实现任意序列 4D 人脸重建 — rsasaki0109 · 2026-08-26
- 日企将在 ECCV 2026 共办 FOUND 研讨会聚焦基盘数据 — HirokatuKataoka · 2026-08-26
- Gemini 3.7 Flash 助力复活 CMA-ES 算法解释网站 — doodlestein · 2026-08-26
- 从 PDE 数值模拟到神经模拟器及回归:博士论文 — chaumian · 2026-08-26