Elicit 推出药物研发 Agent,自建基准测试胜过 Claude

elicitorg · x · 2026-08-06

AI科研平台 Elicit 推出了专为高风险药物研发决策设计的 Research Agent。该智能体围绕五大能力构建,包括内置推理原则的框架、整合多元数据源、提供带引用的决策级输出、默认透明的验证方法,以及可持续积累上下文的项目知识库。

为评估高风险场景下的推理质量,团队还发布了 BioDecisionBench 基准测试,重点考察临床前研究设计等环节。在该评测中,Elicit 的 Smartest 模式覆盖了 76.7% 的关键决策考量,优于 Claude 3.5 Sonnet 的 68.8%。

所属事件:Elicit 发布 Research Agent,专攻高风险药物研发决策(7 条相关)→

原文链接 →

「应用」频道最新

更多「应用」频道 AI 资讯 →