lna-lab

lna-lab/blackwell-geforce-nvfp4-gemm

NVFP4 inference on Blackwell GeForce (RTX 5090/5080/5070 Ti/RTX PRO 6000) — SM120 patches for vLLM + FlashInfer + CUTLASS. 175 tok/s on Qwen3.6-35B MoE.

⭐ 23 ⑂ 2 Python NOASSERTION · 2026-04-27推送
23
Watchers
0
贡献者
0
Commits
0
Releases
0
Open Issues
2026-04-27
最近推送
原文 中文
暂无 README