Claude Opus 5 领跑 ProteinGym-LLM 蛋白评测
新推出的 ProteinGym-LLM(PG-LLM)基准专门评测通用大语言模型预测蛋白变体效应的能力,测试范围覆盖 217 个蛋白质任务。系统评估结果显示,在给定的测试子集中,Anthropic 的 Claude Opus 5 (Max) 表现最优,成功领跑该榜单,证明了顶尖通用大模型在生物蛋白领域的预测潜力。
2026-07-28 ~ 2026-07-28 · 2 条相关
- PG-LLM 基准显示 Claude Opus 5 领跑 217 个蛋白任务 — LeoTZ03 · 2026-07-28
- ProteinGym-LLM 评测中 Claude Opus 5 排名最高 — LeoTZ03 · 2026-07-28