ZML's Steeve Morin releases free LLMD to loosen AI inference from Nvidia
ZML released LLMD, a free inference server for open large language models that runs across Nvidia CUDA, AMD ROCm, Google TPU, Intel oneAPI and Apple Metal, aiming to decouple AI workloads from proprietary hardware. The J…