GLM 5.3 Flash 在 DGX Sparks 实测达 227 tok/s
先了解这件事
AI 综述
2026年10月8日,Hugging Face CEO Clément Delangue 在 X 上转发/提及 MiaAI_lab 的一项实测:GLM 5.3 Flash 模型在 NVIDIA DGX Sparks 上跑出 227 tok/s 的生成速度。该测试场景为 4 路并发混合流,作者表示这一速度“看起来不太真实,但确实跑出来了”。目前仅有这一条实测披露,尚无更多细节或第三方复现。
报道时间线
10月8日
- GLM 5.3 Flash 在 DGX Sparks 上跑出 227 tok/s
MiaAI_lab 展示 GLM 5.3 Flash 在 DGX Sparks 上以 227 tok/s 运行的实测结果,作者称这一速度看起来不太真实,但确实跑出来了。该测试为 4 路并发混合流场景。