00:00
2026-10-06
joa-ebert.com
large-language-models
Filling in the blanks: Inference using Phobos
Developer Joa released Phobos v0.1.0, an LLM inference stack that compiles every kernel at runtime from the Phobos language, generating 328 tokens per second versus llama.cpp's 260 on a 0.8B model andβ¦