BioNeMo Inference Runtime 是什么?
NVIDIA 推出的推理运行时,可在 NVIDIA GPU 上加速受支持的生物分子结构预测模型,保留 PyTorch 工作流,并使用优化内核和 CUDA Graphs 提升模型执行速度。
(翻译)使用 BioNeMo 推理运行时进行高通量结构预测

Biomolecular structure prediction is now often run at proteome scale, where the goal is to move an entire worklist through the pipeline efficiently.
NVIDIA BioNeMo Inference Runtime(BioIR)面向蛋白质组规模的结构预测,在 GPU 上通过优化内核和 CUDA Graphs 加速推理,并可用 Ray 在单节点多 GPU 上部署完整模型副本。文章以 Boltz-2 为例,介绍端到端处理、串行验证、Ray 扩展、五阶段流水线调优及性能测量,并给出 H100/H200 上相对 OSS torch.compile 的模型前向加速数据。
NVIDIA 推出的推理运行时,可在 NVIDIA GPU 上加速受支持的生物分子结构预测模型,保留 PyTorch 工作流,并使用优化内核和 CUDA Graphs 提升模型执行速度。
在端到端处理器中选择 Ray 后端,可在当前节点每块可见 GPU 上放置一个完整模型副本,并将独立输入分发到副本;容量规则为 engine_stage.compute × engine_stage.num_gpus ≤ 可见 GPU 数。
早期基准测试显示,相对 OSS torch.compile,OpenFold3、Boltz2 和 OpenFold2 monomer 在 H100 上几何平均模型前向加速分别为 1.55×、1.78×、2.56×,在 H200 上为 1.54×、1.75×、2.61×。
高瓴系 CFO 往事:一代顶级机构年轻人的迁徙与突围
Robinhood的财富效应
从担心AI失控 到AI造福人类:比尔盖茨怎么想8点1氪丨选手赛中失禁污染赛道,HYROX中国宣布整改;机构预计美股明年将暴跌21%;苹果推出Siri人工智能
就业率砍半,年轻人靠什么翻盘?AI时代,这三点越早做越好
当罗永浩站在群众的对立面
特朗普“一再让步”:美国加密法案仍未过关
AI风口之下,明星们又想“挤上”牌桌了
上市前交易市场:永续合约化的Pre-IPO资产
一年28倍妖王:谁在爆炒?
从200亿收购失败到650亿IPO:Figma如何用“协作”颠覆设计帝国产品已批量进入全球头部Tier 1产线,「知来具身」要为工业场景打造“开箱即用”的泛化机器人
黄仁勋再谈AI危险论:中国会成为全球开源重要力量
How NVIDIA NVLink 6 Delivers Multi-Layer Resiliency for AI Factories
不止一颗CPU?智能体经济时代,Arm对算力平台有了新理解
AI不会放缓
Meta 打造“组织第二大脑”智能体的设计思路
微信桌面端变“三折叠”,可能是在给小微腾位置
CLARITY法案投票失败 加密监管立法再度搁浅
视频号评论区小蓝词使用指南
美国加密新规又黄了
长期利率为何不愿下跌?
CoinShares Q2 挖矿季报:矿企倒贴钱退出基元律动与无问芯穹达成战略合作,推进高质量Token供给与应用
Opus 5.2深夜上线 RSI真来了?
王强宇履新百望:从发票SaaS工具,到财税垂直大模型,再到企业的Palantir
二次元“赛博分身”撬动日本市场:玩家“沉默”的AI陪伴产品,凭什么次留60%?
Agent开始调用基础设施,Kubernetes准备好了吗?
加密行业今年最重要的一天 可能就是明天
开学季 | 学生理财的三条建议,学生党也可以一样理财