1 repository on SrcLog
Reproducible Docker + LiteLLM stack for running Qwen 3.6 27B with MTP on AMD RDNA4 (gfx1201). Verified on Radeon AI PRO R9700 32 GB. Built from llama.cpp PR #22673.