PG-LLM 基准显示 Claude Opus 5 领跑 217 个蛋白任务
LeoTZ03 · x · 2026-07-28
PG-LLM 用来测试通用大模型能否预测蛋白变体效应
PG-LLM 是一个新基准,专门评估通用 LLM 对蛋白变体效应预测的能力。
- 基准覆盖 217 个任务。
- 在“50 个变体排序”的结果里,Claude Opus 5 (Max) 以 Spearman ρ = 0.406 领跑所有测试模型。
- 这一成绩还超过了 95 个专门蛋白预测器中的 49 个。
图中还对比了 GPT-5.x、Gemini、Kimi、GLM 等模型,以及 sequence-only 和 alignment/structure 方法的中位数表现,说明通用 LLM 在部分蛋白任务上已经能接近甚至超过不少专用方法。
所属事件:Claude Opus 5 领跑 ProteinGym-LLM 蛋白评测(2 条相关)→
「模型」频道最新
- MachgenAI:账户余额超25美元可免费用Minimax H3 Turbo生成 — TheMoonMidas · 2026-09-23
- 研究者观察:爱晒AI吹捧自己的多是反社会行为者 — repligate · 2026-09-23
- 评Opus 5.5:语料满是摘要的摘要,一手经验最稀缺 — mimi10v3 · 2026-09-23
- Claude Opus 5.5 登 FrontierSWE 第二名,62.3% 仅次于 GPT-6 Astra — scaling01 · 2026-09-23
- Claude 修复后回归,实测者称速度明显变快 — evielync · 2026-09-23
- 仅凭歌词加音频,Opus 5.5 复刻出视觉作品引开发者惊叹 — repligate · 2026-09-23