06:12
2026-07-30
github.com
large-language-models
Show HN: Run Full Kimi K3 with 29 GB of RAM
A developer has demonstrated running the full 2.78-trillion-parameter Kimi K3 model on a consumer 64 GB MacBook Pro using a custom inference engine called WASTE, achieving 0.32โ0.34 tokens per second โฆ