跳到正文
原文
vllm_project· @vllm_project · X·· 12 小时前AI 评分59

vLLM 使 DeepSeek-V4.1-Flash 推理提速 1.9 倍、吞吐提升 5.3 倍

AI 导读

vLLM 官方宣布 DeepSeek-V4.1-Flash 在 vLLM 上运行三周后,低并发下速度提升 1.9 倍,在 SemiAnalysis AgentX 上每用户 150 TPS 时吞吐达到 5.3 倍。官方提供了可逐步查看的交互式图表,详见 vllm.ai/blog/2026-10-07-deep…。

正文 · AI 翻译

1/ 从第 0 天算起三周后,DeepSeek-V4.1-Flash 在 vLLM 上低并发时运行速度提升 1.9 倍,在 @SemiAnalysis_ AgentX 上每位用户 150 TPS 时吞吐量达到 5.3 倍。

以下是具体做法,附有可逐步查看的交互式图表 🧵 vllm.ai/blog/2026-10-07-deep…

来源:vllm_project · x.com