Run a 35B AI Model on a 24GB Mac: Two New Ways Compared
Edge0, an open-source framework posted to arXiv on September 16, 2026, reports running a 4-bit Qwen3.6-35B-A3B mixture-of-experts model at 20.4 tokens per second inside 2.9 GiB of peak active memory on a 24 GB Mac mini b…