评测榜单旨在为大语言模型和多模态模型提供全面、客观且中立的得分与排名,同时提供多能力维度的评分参考,以便用户能够更全面地了解大模型的能力水平。
数据统计
数据评估
关于OpenCompass司南特别声明
本站六耳AI工具中文导航站提供的OpenCompass司南都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由六耳AI工具中文导航站实际控制,在2024年 12月 26日 下午5:32收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,六耳AI工具中文导航站不承担任何责任。
相关导航
MMBench
MMBench全方位大模型评估
C-EVAl
中文基准模型评估套件
C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models
PubMedQA Homepage
PubMedQA Homepage
生物医学大模型评测
CLUE中文语言理解基准测评
CLUE中文语言理解基准测评
flageval
大模型评测平台
The latest in Machine Learning
大模型多任务语言理解基准
Papers With Code highlights trending Machine Learning research and the code to implement it.
llmeval
LLM-EVAL
复旦大学实验室推出的大模型基准
暂无评论...

