FMInference/FlexLLMGen
Running large language models on a single GPU for throughput-oriented scenarios.
⭐ 9.4k
⑂ 592
Python
Apache-2.0
· 2024-10-28推送
9.4k
Watchers
0
贡献者
0
Commits
0
Releases
58
Open Issues
2024-10-28
最近推送
原文
中文
暂无 README