Hugging Face Blog·· 2024-06-18AI 评分
BigCodeBench:下一代 HumanEval 代码生成基准
Hugging Face 发布 BigCodeBench,一个面向大语言模型代码生成的新基准,包含 1,140 个函数级任务,需调用来自 139 个库的多个函数,每项任务平均含 5.6 个测试用例、分支覆盖率平均 99%。
当前提供 AI 导读,完整正文请阅读原文。
来源:Hugging Face Blog · huggingface.co
Hugging Face 发布 BigCodeBench,一个面向大语言模型代码生成的新基准,包含 1,140 个函数级任务,需调用来自 139 个库的多个函数,每项任务平均含 5.6 个测试用例、分支覆盖率平均 99%。
当前提供 AI 导读,完整正文请阅读原文。
来源:Hugging Face Blog · huggingface.co