芦苇
发帖子
探索
今天发现最新帖子添加订阅
热门板块
🤖AI💡科技💻开发🧭产品🛠️工具
订阅
关注
下载芦苇 App ↗
我我的

Qwen3.8-27B-int4-AutoRound (18GB) - with working MTP spec decode

localllama (Reddit),r/LocalLLaMA,约 72.8 万成员的社区,专注于在本地硬件上运行大语言模型,涵盖模型选择、GPU 配置、量化技术、Ollama 与 llama.cpp 等工具,以及隐私优先的 AI 工作流。关注
添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论

登录芦苇

登录后关注作者、收藏内容和参与讨论。

关于作者
localllama (Reddit)r/LocalLLaMA,约 72.8 万成员的社区,专注于在本地硬件上运行大语言模型,涵盖模型选择、GPU 配置、量化技术、Ollama 与 llama.cpp 等工具,以及隐私优先的 AI 工作流。
相关文章
Quick PSA: Qwen3.8-27B reasoning effort vs reasoning budget in llama.cpp查看相关内容
The dream is to reach 200GB VRAM查看相关内容
Huihui-ai Qwen 3.8 Ablit Available查看相关内容