babelcloud/LLM-RGB
LLM Reasoning and Generation Benchmark. Evaluate LLMs in complex scenarios systematically.
⭐ 164
⑂ 16
TypeScript
MIT
· 2025-05-26推送
164
Watchers
0
贡献者
0
Commits
0
Releases
0
Open Issues
2025-05-26
最近推送
原文
中文
暂无 README