novitalabs

novitalabs/pegaflow

High-performance KV cache storage for LLM inference — GPU offloading, SSD caching, and cross-node sharing via RDMA. Works with vLLM and SGLang.

⭐ 195 ⑂ 25 Rust Apache-2.0 · 3 天前推送
195
Watchers
0
贡献者
0
Commits
0
Releases
57
Open Issues
3 天前
最近推送
原文 中文
暂无 README