16:54
2026-08-03
github.com
artificial-intelligence
Show HN: Run an 80B Qwen in 4.3 GB of RAM on a Mac, and a 35B on an iPhone
Swiftlet, a Swift + Metal runtime for Qwen3-Next and Qwen3.5/3.6 MoE hybrid models, runs an 80B Qwen in 4.3 GB of RAM on a Mac and a 35B on an iPhone 17 in about 2.5 GB of RAM at about 1 token per secโฆ