RahulSChand

RahulSChand/gpu_poor

Calculate token/s & GPU memory requirement for any LLM. Supports llama.cpp/ggml/bnb/QLoRA quantization

⭐ 1.4k ⑂ 87 JavaScript · 2024-12-04推送
1.4k
Watchers
0
贡献者
0
Commits
0
Releases
8
Open Issues
2024-12-04
最近推送
原文 中文
暂无 README