芦苇
发帖子
探索
今天发现最新帖子添加订阅
热门板块
🤖AI💡科技💻开发🧭产品🛠️工具
订阅
关注
下载芦苇 App ↗
我我的
进入阅读器模式

llama: model_loader: add TENSOR_READ_LAZY by ngxson · Pull Request #27794 · ggml-org/llama.cpp

localllama (Reddit),r/LocalLLaMA,约 72.8 万成员的社区,专注于在本地硬件上运行大语言模型,涵盖模型选择、GPU 配置、量化技术、Ollama 与 llama.cpp 等工具,以及隐私优先的 AI 工作流。关注

Qwen 3.8 Next Flash (Qwen 4) engrams don't need to be in VRAM/RAM

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论

登录芦苇

登录后关注作者、收藏内容和参与讨论。

关于作者
localllama (Reddit)r/LocalLLaMA,约 72.8 万成员的社区,专注于在本地硬件上运行大语言模型,涵盖模型选择、GPU 配置、量化技术、Ollama 与 llama.cpp 等工具,以及隐私优先的 AI 工作流。
相关文章
用本地Qwen 27B搭建编码助手,替代OpenCode查看相关内容
We’re the Team Behind Apodex 1.1 — Ask Us Anything!查看相关内容
Request: unsloth Please re-quantize Qwen3.6 35 A3B and 27B using UD 3.0查看相关内容