11:02
2026-06-30
ronreiter.com
large-language-models
Coding with DeepSeek 4 on a 128GB MacBook Pro
DeepSeek V4 Flash, a 284-billion-parameter Mixture-of-Experts model, now runs locally on a 128GB MacBook Pro via antirez's experimental llama.cpp fork, achieving ~21 tokens/sec generation on the Metalβ¦