RLHF 方法迁移至蛋白质设计,ProteinDPO 提升序列稳定性
BrianHie · x · 2026-08-15
Arc Institute 发布研究成果 ProteinDPO,该方法将教导 LLM 偏好答案的相同技术(RLHF)应用于蛋白质模型,以筛选出更稳定的蛋白质序列。该研究由 Innovation Investigator Brian Hie 等人开发。
「研究」频道最新
- Anthropic研究:多智能体系统协作模式与问题 — rseroter · 2026-08-15
- 低损失不等于高成功率,机器人训练需新评估指标 — mathildepapillo · 2026-08-15
- 用 4B/8B 编码器替代 32B:MiniMax H3 优化实测 — Fit_Ad7343 · 2026-08-15
- RibAssist 3D:肋骨骨折检测与 3D 定位模型 — Kabila Haile Soboka · 2026-08-15
- Anima Anandkumar:AI 模型缺失物理世界理解力 — AnimaAnandkumar · 2026-08-15
- BOSS:LLM 引导智能体自举技能库,零样本完成长程任务 — chris_j_paxton · 2026-08-15