ProteinDPO 用偏好对齐解决蛋白模型对齐问题

bravo_abad · x · 2026-08-23

Talal Widatalla 等人提出 ProteinDPO,将 LLM 的直接偏好优化(DPO)应用于蛋白质语言模型,解决模型内部偏好与工程实际需求(如稳定性)不匹配的问题。

核心方法:

结果:基于 ESM-IF1 微调后的模型,在偏好对齐方面表现提升。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →