ZML's Steeve Morin releases free LLMD to loosen AI inference from Nvidia
The Paris startup's closed-source inference server runs Llama, Gemma, Qwen and Mistral models across Nvidia, AMD, TPU, Intel and Apple backends.
评论
?
参与讨论
The Paris startup's closed-source inference server runs Llama, Gemma, Qwen and Mistral models across Nvidia, AMD, TPU, Intel and Apple backends.