Hugging Face Blog·· 2024-04-23AI 评分
Hugging Face 推出 Open CoT Leaderboard,衡量大模型链式推理增益
Hugging Face 发布 Open CoT Leaderboard,不评模型绝对准确率,而是对比有无链式推理提示下的准确率差值 Δ。该榜单覆盖 LogiQA、LSAT 等 AGIEval 任务,目前实现 Classic 与 Reflect 两种提示策略,Mixtral-8x7B-Instruct-v0.1 已参与评测。
当前提供 AI 导读,完整正文请阅读原文。
来源:Hugging Face Blog · huggingface.co