MMBench MMBench 是由 OpenCompass 构建的多模态大模型系统化评测基准平台,旨在客观评估大语言模型的跨模态感知与推理能力。 0310 Ai学术论文学术资源与文献检索# AI评测# OpenCompass# VLM评估
FlagEval – 智源大模型通用评测平台 智源研究院推出的开源大模型及多模态模型评测平台,提供科学、客观、多维度的AI模型评估标准。 0430 Ai学术论文学术资源与文献检索# AI评测# 多模态# 大模型