ProteinGym-LLM 评测中 Claude Opus 5 排名最高
LeoTZ03 · x · 2026-07-28
这项 ProteinGym-LLM 研究把通用大模型放到蛋白变体排序任务里做系统评测,结论是:在文章给出的子集上,Claude Opus 5 (Max) 表现最好。
要点如下:
- 任务是把 50 个蛋白变体按实验适应度从高到低排序
- 用 Spearman ρ 衡量模型排序与实验结果的一致性
- 在 217 个任务上,Claude Opus 5 (Max) 达到 ρ = 0.406
- 作者称它在该排序任务上超过了 95 个专用蛋白预测器中的 49 个
文章还交代了评测设定:模型只拿到实验说明、野生型序列和打乱后的突变体序列,不提供真实适应度、示例、比对或结构信息。
所属事件:Claude Opus 5 领跑 ProteinGym-LLM 蛋白评测(2 条相关)→
「模型」频道最新
- 决策模型 Jev 接入 OM1,在 NVIDIA Isaac Sim 中驱动 Go2 机器人导航 — paigeinsf · 2026-09-23
- 网友辩称随机采样是智能必需:确定性模型或无法「思考」 — burny_tech · 2026-09-23
- 网友预测 2026 秋:Opus 5.5、GPT-6、Qwen4 同期登场 — IanAndrewsDC · 2026-09-23
- Cline 宣称 MiMo-v2.6-Pro 登顶开源权重模型榜 — burny_tech · 2026-09-23
- Anthropic 自嘲式官宣:Opus 5.5 远胜 Opus 5,网友戏称该向旧模型道歉 — repligate · 2026-09-23
- Opus 5.5 创作实测:「建议你把想要的都画出来」 — repligate · 2026-09-23