RLXF:用强化学习把实验数据喂回 ESM-2,超越进化选择

bravo_abad · x · 2026-09-13

Blalock 等人提出 RLXF 方法,用强化学习把湿实验测量数据反馈进蛋白质语言模型 ESM-2,使其生成偏向«实验室表现更好»而非«进化会怎么选»:

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →