Hugging Face Blog·2024-03-05 08:00· 2024-03-05AI 评分32UCLA 发布 ConTextual:多模态模型在富文本场景中的图文联合推理评测基准AI 导读UCLA 研究者推出 ConTextual,一个面向 LMM 的上下文敏感富文本视觉推理数据集,含 506 条指令,覆盖时间阅读、购物、导航、信息图等 8 类真实场景,并同步上线排行榜。正文阅读原文 当前提供 AI 导读,完整正文请阅读原文。来源:Hugging Face Blog · huggingface.co#论文/研究#评测/基准#多模态#数据/训练#OpenAI#Google