vLLM支持NVIDIA Rubin,MiniMax M3适配进展
先了解这件事
AI 综述
2026年10月10日,SemiAnalysis在X平台发文称vLLM宣布支持NVIDIA Vera Rubin平台,早期测试结果显示在AgentX上运行MiniMax M3模型的吞吐量超过GB200的7.8倍。vLLM社区与@inferact、@NVIDIAAI、@RedHat_AI等合作方自Rubin发布以来持续推进该平台的适配工作。同日稍晚,MiniMax官方账号发文确认,MiniMax M3现已在NVIDIA Vera Rubin NVL72上通过vLLM成功运行,并感谢vLLM、inferact、NVIDIA AI、Red Hat AI等合作方将该模型带到Rubin平台。
报道时间线
10月10日
- MiniMax M3 在 NVIDIA Rubin NVL72 上运行
MiniMax M3 现已在 NVIDIA Vera Rubin NVL72 上通过 vLLM 运行!🙌 感谢 @vllm_project、@inferact、@NVIDIAAI、@RedHat_AI 将 MiniMax M3 带到 Rubin。
- vLLM 支持 NVIDIA Vera Rubin,MiniMax M3 吞吐达 GB200 的 7.8 倍以上
vLLM 宣布支持 NVIDIA Vera Rubin,早期结果显示在 AgentX 上运行 MiniMax M3 的吞吐超过 GB200 的 7.8 倍。@inferact、@NVIDIAAI、@RedHat_AI 与 vLLM 社区自 Rubin 发布以来一直在推进 vLLM 在该平台上的适配,目前进展如推文所述。