Hugging Face Blog·· 2022-09-16精选AI 评分
用 DeepSpeed 和 Accelerate 实现极快的 BLOOM 推理
Hugging Face 发布教程,展示如何用 DeepSpeed-Inference、Accelerate 和 DeepSpeed ZeRO 为 176B 参数的 BLOOM 模型做推理,并给出各方案在 8x80GB A100 上的吞吐与加载耗时基准。
文章给出 BLOOM 176B 在多种 GPU 配置下的吞吐与加载耗时对比,可据此选择部署方案。
当前提供 AI 导读,完整正文请阅读原文。
来源:Hugging Face Blog · huggingface.co