Hugging Face Blog·· 2024-07-25AI 评分
LAVE:用 LLM 在 Docmatix 上做零样本 VQA 评测,我们还需要微调吗?
Hugging Face 提出 LAVE(LLM-Assisted VQA Evaluation)指标,用 Llama-2-Chat-7b 以 1-3 分制对候选答案打分,在 Docmatix 的 200 张图像子集上评估 MPLUGDocOwl1.5 的零样本表现。
当前提供 AI 导读,完整正文请阅读原文。
来源:Hugging Face Blog · huggingface.co