可乐导航网
导航首页
申请收录
关于本站
在线工具
排行榜单
文章归档
未登录
登录后即可体验更多功能
登录
注册
导航首页
申请收录
关于本站
在线工具
排行榜单
文章归档
未登录
登录后体验更多功能
首页
•
HELM
HELM
2天前更新
4
0
收藏
0
斯坦福大学推出的大模型评测体系
收录时间:
2026-09-09
打开网站
AI模型评测
HELM
打开网站
网站介绍
斯坦福大学推出的大模型评测体系
数据统计
今日 2
本月 4
累计 4
1
2
3
4
5
6
7
8
9
10
11
12
相关导航
MMLU
大规模多任务语言理解基准
4
0
Chatbot Arena
以众包方式进行匿名随机对战的LLM基准平台
2
0
AGI-Eval
AI大模型评测社区
5
0
FlagEval
智源研究院推出的FlagEval(天秤)大模型评测平台
3
0
OpenCompass
上海人工智能实验室推出的大模型开放评测体系
4
0
C-Eval
一个全面的中文基础模型评估套件
3
0
LLMEval3
由复旦大学NLP实验室推出的大模型评测基准
2
0
MMBench
全方位的多模态大模型能力评测体系
5
0
CMMLU
一个综合性的大模型中文评估基准
4
0
网址
网址
文章