CMMLU翻译站点

9小时前发布 1 0 0

需要客观衡量中文大语言模型的知识与推理能力?CMMLU是权威的中文多任务语言理解评估基准,覆盖67个学科超11500道题,支持零样本与少样本评测,为模型研发、学术研究和投资分析提供标准化量化工具,可在其GitHub项目主页获取使用。

所在地:
海外
语言:
en
收录时间:
2026-10-05
需要客观衡量中文大语言模型的知识与推理能力?CMMLU是权威的中文多任务语言理解评估基准,覆盖67个学科超11500道题,支持零样本与少样本评测,为模型研发、学术研究和投资分析提供标准化量化工具,可在其GitHub项目主页获取使用。

数据统计

相关导航

WorkBuddy 全场景 AI 办公工作台

暂无评论

none
暂无评论...