FMInference

FMInference/FlexLLMGen

Running large language models on a single GPU for throughput-oriented scenarios.

⭐ 9.4k ⑂ 592 Python Apache-2.0 · 2024-10-28推送
9.4k
Watchers
0
贡献者
0
Commits
0
Releases
58
Open Issues
2024-10-28
最近推送
原文 中文
暂无 README