CMMLU 的核心能力一览
展示不同语言模型在five-shot和zero-shot测试下的表现,帮助比较模型性能。
提供开发和测试数据,支持快速使用和评估。
提供提示生成方法,方便模型训练和测试。
支持多种评估方式,便于研究者和开发者测试模型能力。
展示不同语言模型在five-shot和zero-shot测试下的表现,帮助比较模型性能。
提供开发和测试数据,支持快速使用和评估。
提供提示生成方法,方便模型训练和测试。
支持多种评估方式,便于研究者和开发者测试模型能力。
展示不同语言模型在five-shot和zero-shot测试下的表现,帮助比较模型性能。
提供开发和测试数据,支持快速使用和评估。
提供提示生成方法,方便模型训练和测试。
支持多种评估方式,便于研究者和开发者测试模型能力。
关于 CMMLU 的常见疑问解答
CMMLU 是一款面向AI聊天场景的 AI 工具。一个综合性的大模型中文评估基准
CMMLU 的核心功能包括:排行榜、数据集、预处理代码、评估工具,覆盖AI聊天场景下的常见需求。
CMMLU 的价格模式为:具体价格见官网,具体功能与额度请以官网为准。
您可以通过官网 https://github.com/haonan-li/CMMLU 直接访问 CMMLU 并开始使用,无需复杂配置即可上手。