跳到正文
原文
Hugging Face Blog·· 2024-03-05AI 评分32

UCLA 发布 ConTextual:多模态模型在富文本场景中的图文联合推理评测基准

AI 导读

UCLA 研究者推出 ConTextual,一个面向 LMM 的上下文敏感富文本视觉推理数据集,含 506 条指令,覆盖时间阅读、购物、导航、信息图等 8 类真实场景,并同步上线排行榜。

当前提供 AI 导读,完整正文请阅读原文。

来源:Hugging Face Blog · huggingface.co