Hugging Face Blog·· 2022-10-24AI 评分
Hugging Face 用 🤗 Evaluate 评估语言模型偏见
Hugging Face 在 🤗 Evaluate 库中新增偏见指标与测量方法,用于评估 GPT-2、BLOOM 等因果语言模型的偏见。工作流分两步:用 🤗 Datasets 上的预定义提示词提示模型,再用 🤗 Evaluate 的指标评估生成内容,示例覆盖毒性、语言极性和伤害性三类任务。
当前提供 AI 导读,完整正文请阅读原文。
来源:Hugging Face Blog · huggingface.co