跳到正文
原文
Hugging Face Blog·· 2024-04-23AI 评分31

Hugging Face 推出 Open CoT Leaderboard,衡量大模型链式推理增益

AI 导读

Hugging Face 发布 Open CoT Leaderboard,不评模型绝对准确率,而是对比有无链式推理提示下的准确率差值 Δ。该榜单覆盖 LogiQA、LSAT 等 AGIEval 任务,目前实现 Classic 与 Reflect 两种提示策略,Mixtral-8x7B-Instruct-v0.1 已参与评测。

当前提供 AI 导读,完整正文请阅读原文。

来源:Hugging Face Blog · huggingface.co