jmaczan

jmaczan/tiny-vllm

Build your own high performance LLM inference engine in C++ and CUDA - a smaller version of vLLM

⭐ 1.1k ⑂ 84 C++ Apache-2.0 · 18 天前推送
1.1k
Watchers
0
贡献者
0
Commits
0
Releases
1
Open Issues
18 天前
最近推送
原文 中文
暂无 README