MMMLU MMMLU 是 OpenAI 在 Hugging Face 发布的多语言大规模多任务语言理解评测数据集,基于 MMLU 扩展,覆盖多种语言与学科领域,用于评估大语言模型在知识理解、推理和跨语言能力方面的表现。该数据集适合研究人员、模型开发者和评测平台用于多语言模型基准测试、能力对比与相关实验分析。 AI学习资源 # Hugging Face # 基准测试