llama: model_loader: add TENSOR_READ_LAZY by ngxson · Pull Request #27794 · ggml-org/llama.cpp

Qwen 3.8 Next Flash (Qwen 4) engrams don't need to be in VRAM/RAM

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论