10:43
2026-07-17
gist.github.com
artificial-intelligence
Qwen 3.6 config example
A developer shared a configuration example for running Qwen 3.6 with llama-turboquant, a Docker-based CUDA inference container. The setup includes GPU offloading, flash attention, speculative decodingβ¦