03:14
2026-08-22
twitter.com
artificial-intelligence
Run frontier models on gaming GPUs
FreeToken, a new inference engine from FlashML, lets users run frontier models on gaming GPUs at interactive speeds, with Qwen3.6 35B running on an 8GB RTX 4060 laptop at 39 tokens per second, DeepSee…