Open LLM Leaderboard翻译站点

1周前发布 386 0 257

Open LLM Leaderboard 是最大的大模型和数据集社区 HuggingFace 推出的开源大模型排行榜单,基于 Eleuther AI Language Model Evaluation Harness(Eleuther AI语言模型评估框架)封装。

所在地:
香港
语言:
en
收录时间:
2025-03-25
Open LLM LeaderboardOpen LLM Leaderboard

主要功能:
AI2 推理挑战(25-shot):一组小学科学问题
HellaSwag(10-shot):一个测试常识推理的任务,对人类来说很容易(大约95%),但对SOTA模型来说具有挑战性。
MMLU(5-shot)- 用于测量文本模型的多任务准确性。测试涵盖57个任务,包括基本数学、美国历史、计算机科学、法律等等。
TruthfulQA(0-shot)- 用于测量模型复制在在线常见虚假信息中的倾向性。

数据统计

数据评估

Open LLM Leaderboard浏览人数已经达到386,如你需要查询该站的相关权重信息,可以点击"5118数据""爱站数据""Chinaz数据"进入;以目前的网站数据参考,建议大家请以爱站数据为准,更多网站价值评估因素如:Open LLM Leaderboard的访问速度、搜索引擎收录以及索引量、用户体验等;当然要评估一个站的价值,最主要还是需要根据您自身的需求以及需要,一些确切的数据则需要找Open LLM Leaderboard的站长进行洽谈提供。如该站的IP、PV、跳出率等!

关于Open LLM Leaderboard特别声明

本站AppStore 集导航收录了全球数百款不同类型的 AI 工具和APP应用提供的Open LLM Leaderboard都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由AppStore 集导航收录了全球数百款不同类型的 AI 工具和APP应用实际控制,在2025年3月25日 下午6:28收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,AppStore 集导航收录了全球数百款不同类型的 AI 工具和APP应用不承担任何责任。

相关导航

暂无评论

none
暂无评论...