可乐导航网
导航首页
申请收录
关于本站
在线工具
排行榜单
文章归档
未登录
登录后即可体验更多功能
登录
注册
导航首页
申请收录
关于本站
在线工具
排行榜单
文章归档
未登录
登录后体验更多功能
首页
•
CMMLU
CMMLU
2天前更新
4
0
收藏
0
一个综合性的大模型中文评估基准
收录时间:
2026-09-09
打开网站
AI模型评测
CMMLU
打开网站
网站介绍
一个综合性的大模型中文评估基准
数据统计
今日 2
本月 4
累计 4
1
2
3
4
5
6
7
8
9
10
11
12
相关导航
Open LLM Leaderboard
Hugging Face推出的开源大模型排行榜单
3
0
FlagEval
智源研究院推出的FlagEval(天秤)大模型评测平台
3
0
SuperCLUE
中文通用大模型综合性测评基准
3
0
PubMedQA
生物医学研究问答数据集和模型得分排行榜
3
0
MMBench
全方位的多模态大模型能力评测体系
4
0
OpenCompass
上海人工智能实验室推出的大模型开放评测体系
3
0
C-Eval
一个全面的中文基础模型评估套件
3
0
Chatbot Arena
以众包方式进行匿名随机对战的LLM基准平台
2
0
HELM
斯坦福大学推出的大模型评测体系
3
0
网址
网址
文章