Qwen-Image 2.1 入门:从一句提示词到一张图,6GB 显存为什么也能跑从普通人的视角解释 Qwen-Image 2.1 如何把一句提示词变成图片,文本编码器、DiT 和 VAE 为什么缺一不可,以及 RTX 3060 6GB 配合 32GB 内存如何通过 Unsloth Desktop 和模型卸载跑起来。 评论点赞收藏3 天前
Jev 深度解读与实测:只做判断的 AI,究竟快在哪里从重复扣费工单出发,解释 Jev 的类型化判断、并行输出与概率校准,并记录 TypeSafe skill 安装和六条中英文样本的真实 API 结果,区分本机体验与官方性能评测。 评论点赞收藏10 天前
Pi Agent 源码解析:从调试环境到双层主循环从源码搭建 Pi Agent 调试环境,并沿着 cli.ts、sdk.ts、agent.ts 和 agent-loop.ts 的真实调用链,分析模型配置、StreamFn 注入、双层 Agent Loop、流式响应和工具调用。 评论点赞收藏17 天前
6GB显存能跑35B MoE吗:FreeToken极限配置、性能压榨与实操教程6GB显存可以尝试运行Qwen3.6-35B-A3B-NVFP4,但代价是更小的专家缓存和KV容量,以及对32GB以上内存、CPU与PCIe带宽的更高依赖。本文给出已验证配置、调优顺序、压测脚本和明确限制。 评论点赞收藏26 天前
聊聊 Java 的类加载机制(一)一说到这个主题,想到的应该是双亲委派模型,不过讲的包括但不限于这个,主要内容是参考深入理解 Java 虚拟机书中的介绍, 一个类型的生命周期包含了七个阶段,加载,验证,准备,解析,初始化,使用,卸载。 评论点赞收藏28 天前
从ASM到ByteKit再到Arthas:一条Java字节码增强链路之前写过几篇 Java Agent 和 Javassist,也单独介绍过 Arthas 的 vmtool。这些内容放在一起看,会发现它们其实一直围绕着同一个问题: 不修改业务源码,能不能在一个 Java 评论点赞收藏32 天前
8GB显存如何跑35B:深入理解FreeToken的专家缓存与CPU-GPU协同FreeToken在8GB显存的RTX 4060笔记本上跑Qwen3.6-35B-A3B达到39.3 tok/s。核心思路是把MoE专家权重留在内存,显存只做热点缓存,未命中的专家一部分搬GPU、一部分交给CPU并行计算。 论文给出q*策略:根据实测PCIe带宽和CPU内存带宽自动决定分流比例。与llama.cpp的静态层卸载不同,FreeToken是动态专家级缓存,支持全局LRU和Prefill双缓冲。 评论点赞收藏38 天前
用 DeepSeek Harness 写现代版 PHPMyAdmin:实测记录最近deepseek发布了harness,试用了一下结合deepseek-4-flash,用它尝试写一个php的现代版phpmyadmin,因为也是一个比较重要且有一点复杂度的应用 试了下除了数据展示有点问题,修了一轮就完成了,整体表现还是不错的 然后看了下它主 评论点赞收藏45 天前
如何在命令行中输出进度条之前就比较好奇,命令行一般输出都是往后追加,好像不知道怎么做覆盖更新,但是很多比较厉害的shell脚本都有那种进度条,甚至整个重绘 所以就来看下,怎么在命令行里输出个会变的进度条, 比如我在命令行中输出两行 评论点赞收藏59 天前
Lenovo G400 Installing Windows 7 Troubleshooting Log最近给一台联想 G400 重装 Windows 7。本来以为只是做个启动盘、装好系统就结束了,实际操作时却遇到了驱动缺失、旧版 IE 无法打开部分网站、Windows Update 报错,以及显卡驱动依赖.NET Framework 评论点赞收藏66 天前
Chrome 扩展开发入门:理清 Popup 与 Content Script最近因为看了下 Chrome 里面置入的小模型,顺手又看了下 Chrome 扩展。 之前其实也接触过一些浏览器扩展,但是一直没有特别系统地看过它的结构,感觉好像就是写一个 html,然后再配几个 js 文件就可以了。 但是真正写起来以后,会发现 Chrome 扩展里面有几个不同的运行环境,尤其是 popup 和 content script,如果没有分清楚,后面调用网页内容或者操作页面 DOM... 评论点赞收藏80 天前
看看 Chrome 的内置模型之前听说chrome在你的电脑里塞了一个小模型,相比于说这个比较容易引起公愤的,可能是因为模型有4g大小,但是感觉也提供了挺大的想象空间 比如在浏览器内就可以直接调用模型进行对话处理,最简单的比如做个翻译啥的, 首先也有具体的硬件条件, 评论点赞收藏87 天前
从 app.test 到小锁:Valet 本地 HTTPS 的完整链路之前在用到valet的时候就觉得这个工具很厉害,因为本地部署很多时候都是比较费劲的,也比较简陋,就直接localhost启动下,但是有时候需要验一下回调的,就需要有域名跟https,当然之前也没想明白的是在本地其实用本地的地址也是可以的,意思就是如果回调地址没限制必须要域名 评论点赞收藏94 天前
GitHub 加速:一种拉取仓库的替代方案今天在尝试使用llama.cpp在mac下本地运行大模型的时候发现拉取llama.cpp的仓库还是比较慢,这点真的是挺难受,可能我们在玩一项技术的时候,有一大半时间都在克服这个问题, 这个方式也是谷歌搜到的,就是走 评论点赞收藏108 天前
本地大模型部署选型工具llmfit推荐上次我是实地使用llama.cpp跑了本地大模型,这种测试成本比较大, 刚好上次看到有个软件可以运行在本地来评估当前机器的性能可以跑什么样的大模型 它就是 评论点赞收藏115 天前
本地部署指南:利用 llama.cpp 运行开源大模型除了购买各种订阅和api服务,还有一种选择就是本地运行模型,但是这个一般来讲还是只能运行一些参数量比较小的, 随着开源权重模型的发展,这个方向也在慢慢的改变,当然差距肯定是有的,只是本地我们可以用来做些辅助工作 之前很多情况下一般都只是能作为玩具,并且由于oll 评论点赞收藏122 天前
关于Vibe Coding(氛围编程)的个人思考一段时间都有在用大模型来辅助编程,不过现在很多都叫成vibe coding了,连胡彦斌都在vibe coding了, 现在是个全民皆可做软件开发的时代,包括像之前那个小猫补光灯,有的人的想法是说点子不重要了 我自己想的有点不一样,vibe 评论点赞收藏129 天前
PHP 技巧:利用 inotify 扩展实现文件变更自动监听偶尔下载一些视频媒体的时候会想要对它进行压缩来缩小占用空间, 但是如果每次等下载完再去用软件压缩会比较麻烦 这里就找到了inotify扩展,可以监听文件变更 这里其实想吹一下小米的mimo2.5模型,因为要装php扩展, 我的是php7.4,网上搜了 评论点赞收藏136 天前