onejune2018/Awesome-LLM-Eval
Awesome-LLM-Eval: a curated list of tools, datasets/benchmark, demos, leaderboard, papers, docs and models, mainly for Evaluation on LLMs. 一个由工具、基准/数据、演示、排行榜和大模型等组成的精选列表,主要面向基础大模型评测,旨在探求生成式AI的技术边界.
⭐ 657
⑂ 84
MIT
· 2025-11-24推送
657
Watchers
0
贡献者
0
Commits
0
Releases
47
Open Issues
2025-11-24
最近推送
原文
中文
暂无 README