C-Eval C-Eval 是一个中文基础模型综合能力评测基准,涵盖多个学科和专业领域,提供标准化的多项选择题数据集与评测结果,用于衡量大语言模型在知识理解、推理和问题解答等方面的能力,支持模型性能对比与研究分析。 AI学习资源 # AI基准测试 # 中文基础模型