DwarfStar 4: Run DeepSeek V4 Flash Locally at 39 t/s
Salvatore Sanfilippo released DwarfStar 4 (ds4), a local LLM inference engine that runs DeepSeek V4 Flash on a MacBook at 26–39 tokens per second without Python, Docker, or an Ollama daemon. The engin…