ModelCloud/GPTQModel
LLM model quantization (compression) toolkit with HW acceleration support for Nvidia, AMD, Intel GPU and Intel/AMD/Apple CPU via HF, vLLM, and SGLang.
⭐ 1.2k
⑂ 202
Python
NOASSERTION
· 7 小时前推送
1.2k
Watchers
0
贡献者
0
Commits
0
Releases
42
Open Issues
7 小时前
最近推送
原文
中文
暂无 README