ModelCloud

ModelCloud/GPTQModel

LLM model quantization (compression) toolkit with HW acceleration support for Nvidia, AMD, Intel GPU and Intel/AMD/Apple CPU via HF, vLLM, and SGLang.

⭐ 1.2k ⑂ 202 Python NOASSERTION · 7 小时前推送
1.2k
Watchers
0
贡献者
0
Commits
0
Releases
42
Open Issues
7 小时前
最近推送
原文 中文
暂无 README