FluidInference发布0.6B蒸馏模型支持ANE
先了解这件事
AI 综述
2026年10月11日,Hugging Face CEO Clément Delangue 在 X 上发文介绍 FluidInference 的最新进展:该项目将 clef-flash 蒸馏为 0.6B 小模型,并支持 ANE 选项。在 M5 Pro 上,该模型 57 秒完成 1,000 张工单分类任务,输出团队、紧急度和退款信息,平均每张 48 ms,分类效果与 9B 模型相差几个百分点。模型已发布在 Hugging Face,代码见 github.com/FluidInference/Fl。
报道时间线
10月11日
- FluidInference 将 clef-flash 蒸馏为 0.6B 模型并支持 ANE
FluidInference 将 clef-flash 蒸馏为 0.6B 模型,并支持 ANE 选项。在 M5 Pro 上 57 秒完成 1,000 张工单分类,输出团队、紧急度和退款信息,平均每张 48 ms,分类效果与 9B 模型相差几个百分点。模型已发布在 Hugging Face,代码见 github.com/FluidInference/Fl。