ProtRL 开源:上传 CSV 即可用强化学习微调蛋白质语言模型
ferruz_noelia · x · 2026-09-01
AI4PD Lab 发布 ProtRL,一个对自回归蛋白质语言模型(pLM)做强化学习微调的框架,配套论文《Guiding Generative Protein Language Models with Reinforcement Learning》已更新预印本。
- 支持 GRPO、Weighted DPO(可选 IRPO 正则)与 REINFORCE(可选熵奖励)三种算法
- 用户上传自己的实验数据 CSV,即可完成微调、RL 训练并生成新蛋白序列,仓库提供示例 notebook(含本地小模型 demo)
- GitHub 已获 115 star,含 benchmarking、示例与训练/生成脚本
「研究」频道最新
- 上交大发布 SafeAtlas-VL:多模态安全从二分类走向连续评分 — SJTU · 2026-09-01
- UIUC 揭秘 LLM 个性化定制的三大隐形成本 — illinois · 2026-09-01
- 阶跃星辰 CE3D++:对话式编辑 3D 与 4D 场景 — stepfun-ai · 2026-09-01
- Xorshift 生成器深度解析获 SoME5 第四名 — AlanZucconi · 2026-09-01
- 负强化非惩罚?Scott Alexander 探讨 AI 训练中的对齐与感知 — davidmanheim · 2026-09-01
- 新书《fMRI 分析基础》发布 42 个交互式教程 — bttyeo · 2026-09-01