ZML's Steeve Morin releases free LLMD to loosen AI inference from Nvidia

The Paris startup's closed-source inference server runs Llama, Gemma, Qwen and Mistral models across Nvidia, AMD, TPU, Intel and Apple backends.

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论