hec-ovi

hec-ovi/vllm-qwen

vLLM + Qwen3.6-27B (BF16) OpenAI-compatible inference server on AMD Strix Halo (Ryzen AI Max+ 395, gfx1151). Vision input, 256K context, /v1/responses with separated reasoning, via TheRock ROCm.

⭐ 17 ⑂ 4 Python Unlicense · 2026-04-27推送
17
Watchers
0
贡献者
0
Commits
0
Releases
0
Open Issues
2026-04-27
最近推送
原文 中文
暂无 README