NVIDIA 发布 BioNeMo 推理运行时:生物结构预测吞吐最高提升 2.9 倍
AllThingsApx · x · 2026-09-11
NVIDIA Health 发布 BioNeMo Inference Runtime(BioIR),在保留 PyTorch 工作流的前提下加速生物分子结构预测模型。
技术要点:
- 提供端到端 processor:解析、tokenization、特征生成、GPU 推理、PDB/mmCIF 输出,也支持直接以 PyTorch 模块形式集成
- 三层优化:内核选择、CUDA Graph 捕获的模块优化、Ray 多副本的 pipeline 扩展
- 基准:8xH100 上对 1000 个人类二聚体目标,BioIR 加速的 Boltz-2 达到每 GPU 小时 58.5K 个成功折叠残基,对比 torch 编译的开源实现 20.2K,提升 2.90 倍
- 能耗:折叠 100 万个同规模目标约需 11 MWh,对比公开实现的 35 MWh
生产反馈:生物公司 Proxima 在蒸馏与 refolding pipeline 中实测,H100 上获得 1.6–1.9 倍吞吐提升,短输入最高 3 倍;一个编码 agent 借助 BioNeMo agent skill 一次接入成功,尽管其架构与参考模型差异很大。
所属事件:NVIDIA 开源 BioNeMo 推理运行时公测(9 条相关)→
「Infra」频道最新
- DeepSeek 新模型技术报告:KV Cache 较 DSV4-Flash 缩小 4 倍,训练更稳定 — stochasticchasm · 2026-09-11
- Reflect Orbital 即将首射卫星,想把阳光当商品卖给缺光地区 — kyliebytes · 2026-09-11
- 推理瓶颈演化史:从权重加载到 KV 读取,取决于上下文长度 — YouJiacheng · 2026-09-11
- GPU 和内存之后轮到 CPU:AI Agent 工具调用引发 CPU 短缺 — The Pragmatic Engineer · 2026-09-11
- 开发者晒训练仪表盘:成本约 $11/百万 token,MFU 高得离谱 — jon_durbin · 2026-09-11
- React Native ExecuTorch v0.10 发布,端侧推理最高提速 92 倍 — d_arthez · 2026-09-11