Claude Opus 5 领跑 ProteinGym-LLM 蛋白评测

新推出的 ProteinGym-LLM(PG-LLM)基准专门评测通用大语言模型预测蛋白变体效应的能力,测试范围覆盖 217 个蛋白质任务。系统评估结果显示,在给定的测试子集中,Anthropic 的 Claude Opus 5 (Max) 表现最优,成功领跑该榜单,证明了顶尖通用大模型在生物蛋白领域的预测潜力。

2026-07-28 ~ 2026-07-28 · 2 条相关