lna-lab/blackwell-geforce-nvfp4-gemm
NVFP4 inference on Blackwell GeForce (RTX 5090/5080/5070 Ti/RTX PRO 6000) — SM120 patches for vLLM + FlashInfer + CUTLASS. 175 tok/s on Qwen3.6-35B MoE.
⭐ 23
⑂ 2
Python
NOASSERTION
· 2026-04-27推送
23
Watchers
0
贡献者
0
Commits
0
Releases
0
Open Issues
2026-04-27
最近推送
原文
中文
暂无 README