BigHugger
GH Repository · onejune2018

Awesome-LLM-Eval

Awesome-LLM-Eval: a curated list of tools, datasets/benchmark, demos, leaderboard, papers, docs and models, mainly for Evaluation on LLMs. 一个由工具、基准/数据、演示、排行榜和大模型等组成的精选列表,主要面向基础大模型评测,旨在探求生成式AI的技术边界.

stars
656
30-day movement
starts with the next reading
Related entries
60
Connections
1
awesome-listqwenllamaawsome-listsawsome-listevaluationopenaibenchmarkllm-evaluationbertchatglmdatasetchatgptragnlpgpt3llmlarge-language-modelleaderboardmachine-learning
Role
awesome-list
Licence
MIT
Forks
89
Open issues
10
Last push
2025-11-24