onejune2018

onejune2018/Awesome-LLM-Eval

Awesome-LLM-Eval: a curated list of tools, datasets/benchmark, demos, leaderboard, papers, docs and models, mainly for Evaluation on LLMs. 一个由工具、基准/数据、演示、排行榜和大模型等组成的精选列表,主要面向基础大模型评测,旨在探求生成式AI的技术边界.

⭐ 657 ⑂ 84 MIT · 2025-11-24推送
657
Watchers
0
贡献者
0
Commits
0
Releases
47
Open Issues
2025-11-24
最近推送
原文 中文
暂无 README