LatchBio 发布抗体发现基准:Opus 与 Gemini 领先 OpenAI 垫底

LatchBio 推出 Antibody Discovery Benchmark,用于测试 AI agent 能否在治疗性抗体发现的各个阶段做出科学决策。基准包含 100 项评测,覆盖来自真实项目的任务。结果显示 Anthropic 的 Opus 与谷歌 Gemini 表现领先,而 OpenAI 模型普遍失分、意外垫底,引发社区对不同模型科研决策能力的讨论。

2026-09-03 ~ 2026-09-03 · 4 条相关

另有 1 条近重复转述:shensi