产品截图
详细介绍
Open LLM Leaderboard是什么
Open LLM Leaderboard 是最大的大模型和数据集社区 HuggingFace 推出的开源大模型排行榜单,基于 Eleuther AI Language Model Evaluation Harness(Eleuther AI语言模型评估框架)封装。Open LLM Leaderboard通过多种基准测试(如 IFEval、BBH、MATH 等),从指令遵循、复杂推理、数学解题、专业知识问答等多个维度对模型进行评估。排行榜涵盖预训练模型、聊天模型等多种类型,提供详细的数值结果和模型输入输出细节。Open LLM Leaderboard 能帮助用户筛选出当前最先进的模型,推动开源社区的进步。
Open LLM Leaderboard 的主要功能
Open LLM Leaderboard 的评估基准
如何使用Open LLM Leaderboard
Open LLM Leaderboard的应用场景
核心功能
✓替换<your_model>、<your_model_revision>和<output_path>为实际值。
✓对于指令模型,添加--apply_chat_template和--fewshot_as_multiturn选项。