PDB 数据已被榨干,蛋白结合折叠模型普遍面临数据饥荒
anshulkundaje · x · 2026-10-01
研究者 Alex Camp(由 Anshul Kundaje 转发)在长帖结尾补充观点:目前多个研究团队正尝试补上 Multimer(即分子结合/复合物)折叠模型的能力差距,可能做得不错,但他的整体判断是这一领域已经数据饥荒——PDB(蛋白质结构数据库)中可用的结合信息早已被充分利用完毕,进一步提升结合预测能力缺乏新数据来源。
「研究」频道最新
- 没有评估就是盲建:上下文嵌入模型需对消歧上下文块也高排序 — antoine_chaffin · 2026-10-01
- Pantheon 开源 Argus 机器人数据标注管线,审计九大数据集并放出 3546 条标注 — silver__tsuki · 2026-10-01
- Blender Bench v1 发布:GPT-6 Astra 综合领先,Claude Opus 5.5 拿下建模与布料 — yshan2u · 2026-10-01
- 剑桥发布 SAM-Brain3D,阿尔茨海默等脑病早期检测超越现有方法 — lawrennd · 2026-10-01
- Stanford NLP 推出 UniEvo-VL:自蒸馏训练让多模态模型自我进化 — stanfordnlp · 2026-10-01
- NVIDIA Mid-Harness:执行前采样验证动作,TerminalBench Pass@1 升至 68% — nvidia · 2026-10-01