第285期 - 陵水的云

封面图拍摄于国庆去陵水玩了几天,三亚旁边的一个小城市,有海人少,小吃不错,商业化气息不重,不过那几天还挺热的。

记录每周看到的接地气的潮流技术,筛选后发布于此,觉得不错可关注此周刊,方便获取更新通知

潮流工具

Tendedero:把截图挂在屏幕顶上的晾衣绳上
https://github.com/alejandrobujan/tendedero
好久没有看到这么有创意的小工具了,你每截一张图,它都会挂到屏幕顶上的一根绳上,把鼠标停在菜单栏,绳子就滑下来;移开就收起。

Paseo:各种 Coding Agent 的统一界面加手机控制
https://github.com/getpaseo/paseo
我感觉这个相比其他的会简洁一点,优势就是手机可以查看进度和一起工作,不过我还是最喜欢最纯粹的那种 TUI 的体验,不过可能有小伙伴需要的可以试试。

Strata:在你自己的游戏电脑上运行 1250 亿参数的 AI 模型
https://github.com/Niko1221/Strata
听说可以只要 12G 显存就能运行 125B 参数的 Qwen 3.8 Flash Next,且速度 80tok/s 以上,感觉容易让那种最好的 Mac Studio 降点儿价不。

随便看看

买了一本不错的书《艺术:让人成为人》
昨天晚上在多抓鱼线下淘到了一本非常厚实非常大的宝藏书,叫做《艺术:让人成为人》,一只手举起来甚至有点费劲,一早起来迫不及待看,内容非常不错,偏人文学通识,期待可以给后续做新产品带来些不一样的思考和输入。

《岁月神偷》这部香港电影很好看
时隔十年再次一看,还是很好看,很温情,推荐想看剧的小伙伴一看。

对于使用 Personal Agent 的一些小建议
最近看到有一些朋友 GitHub 被封了,其实挺麻烦,应该是通过一些自动化的 Agent 模拟浏览器操作违反了官方规定。

小伙伴们用各种 Agent 的时候,特别是最近大火的各种 Personal Agent 的时候,建议给它加一条硬规则,不要直接通过浏览器自动化操作自己的重要账号,尤其是 X、Reddit、小红书,以及 GitHub、Gmail。

能用官方 API 就用官方 API,有官方 CLI 就用 CLI,对于 MCP 以及第三方 CLI 需要看一下底层实现,有些只是把网页模拟点击、Cookie 或私有接口包了一层,这种也容易有坑,其实也不太合规。

没有合适的官方接口,就让它停下来告诉你,自己手动处理,不要让 Agent 为了完成任务擅自尝试各种解法,触发风控甚至封禁,就有点可惜了。

最后我认为这里的遵守规定和为了避免 Claude 被封是完全不一样的,避免 Claude 被封有一种玄学概念,而且不少告诉你防止被封的人需要仔细看看他的文章里面有没有带 aff 参数的链接,多半是为了卖云主机和各种服务或者推广费用,这里属于玄学,看运气,但是对于已有官方明确说禁止非 API 自动化,以及脚本操作网页的情况我认为是需要遵守的,属于正常的规则防止被滥用问题。

聊聊 ASD-STE100 飞机维修手册和 Skills 的关系
最近给我每天都在使用的工程师合集技能 Waza 加上了一个很有用的操作以及回复规则,来源于 ASD-STE100,一套最开始用于航空维修文档的简化技术英文标准。

最开始是看到 Andrej Karpathy 的推荐,让大模型参考这一套规范来解释事情,回复会更加易读,刚好晚上有空,我顺着看了看规范和官方的 AI 白皮书,发现它对于词语、条件和操作顺序的要求,真的非常适合拿来检查 AI 到底有没有把话讲明白讲清楚,想着基于我的理解给大伙更好懂地解释一下。

可以理解飞机维修手册其实面向阅读的人来源于各个国家,英文不一定是对方的母语,比如说修飞机的时候,拆哪一个零件、什么时候可以操作、前一步做到什么地步才可以继续做下一个步骤,是不是感觉非常像现在我们让 Agent 去做一些事情,我们也是想着尽可能 Agent 非常准确快速地做好,并把我们的诉求理解到位。刚好就和这个飞机维修手册上的说话操作规范非常像。

很多时候,一个词语换一个意思,一句话里面漏掉一个条件,面对说明书操作的人可能会做成不同的操作。好比大公司里面,CEO 的想法是经过多轮传递,很容易会导致很多信息失真,最后做出来的东西可能会和当时想的完全不一样。

这套标准从我的理解正是用来解决这种说话和执行偏差的问题,它由协作规则和词典组成,词典会限制一个词可以用什么词性、表达什么含义,包括这个行业里面的哪些技术属于可以允许使用。同一个东西也不会为了避免重复就换一个名字去做,操作的步骤会需要写清楚条件和顺序等等这样的要求,其实这些放到技术文档里面也非常好理解。

我在 Waza 里面为了让 AI 更好理解,比如说在 write 写作技能里面我放了这样的例子,让 AI 写出来的内容更加清晰明白。

比如“上传完成后,删除本地文件”,如果被 AI 简化成“开始上传,然后删除本地文件”,会很容易出问题,可能文件还没有传完就被删除掉了,这里的“完成”就是决定了什么时候能删除,是必须存在的词。

再比如“只有检查通过,才允许重启” 和 “检查通过后就重启”,前一句就符合这个要求,后一句没有执行要求的动作容易多出很多可能,“才允许”在这里就是那个保持原意的关键词。

这正是我希望 AI 在日常回复和帮我干活时候要注意的地方,把做的结果讲明白、讲清楚,让它和我都不困惑不懵逼,说到点上,不要我再去多问一句更多的才好。比如说代码改好了、测试通过了、已经推送了、用户可以下载了都是对于结果的详细表述,假如它只回一句“已经修复并验证”,这种情况下,我肯定会继续问,到底解决了啥都好了没。

不过我认为,这里没有必要让 AI 去完整参考所有的标准,归纳起来的规则其实非常短,「同一个对象保持同一个名称,指代不清时写明对象,把条件和例外放在对应动作附近,保留先后关系,分清建议、要求和可能性。已经清楚的话就不改,不要为了简短删掉原因和边界。」

当然你也可以直接安装 Waza 的 clarity 规则来使用,或者直接去这里看看。

随便写写

我想说 Gemini 3.8 Flash High 是当前优化产品以及官网文案内容最好的模型

由于这几天我的 Claude 以及 Codex 额度以及好几个 Reset 都用完了,但是还有些事情要做,翻出了半年前当时 199 刀包的一年 Gemini AI,甚至都快忘记了,也想着不抱太大希望去看看谷歌的模型效果有没有进步,于是下载了一个 Antigravity,直接设置当前能设置的最好的这个。

让它去帮我优化 Mole Mac 的一些文案,想着让各个国家的内容尽可能简单、清晰、易懂,输入非常简单的诉求,它就开始干活了,速度很快,文案优化给到了优化前、优化后和原因,仔细看了看,相比之前 GPT 和 Claude 最好模型优化的好了不少,让我挺惊讶,语言很顺畅、真实、清晰,不文绉绉,也没有 AI 那个味道,让我感觉真好,虽然在 Coding 上差了点,居然在文案表达上这么好。

20 刀每月的居然还挺耐用,我让它帮我优化了 Mole 的官网、App 设置项、优化项、清理项,提示文案、描述文案各种,感觉之前我手写的的确有不少没有那么好懂清晰,换成这个以后,真有一种你请了一个语文老师坐到你的旁边帮你考虑小白用户如何更好理解你产品的思路来优化,帮我做了很多事情。

我居然对优化文案上瘾了,然后我又包了一个20 刀的账号,继续使用,一个用完,另外一个刚好重置,把我之前一些产品不好懂的文案、描述几乎全部优化了一遍,包括各种开源的 Readme,非常爽,也非常喜欢,算是找到了用武之地了。

假如你也有类似诉求,非常推荐你把尘封很久的 Gemini 拿出来试试,会让你很惊喜的,可以让它输出前后对比以及原因,先让你 check,让它追求简单、清晰、易懂,不 AI 语气的方式来弄,非常非常不错。

最后一个小建议,大家在用这个优化完成以后,再用 Opus 5.5 去 review 一下,然后让它学习一下。

Codex Pro 200 刀我感觉非常不经用
Codex Pro 200 刀我感觉非常不经用,体感下来只有 Claude Max 200 刀账号的 1/4 不到,前者使用 GPT-6 Astra Medium,后者使用 Opus 5.5 high。

有多不经用呢,正常使用下,还在使用其他模型的同时,几乎可以一天用掉一个 Codex 的重置周额度,2 天左右也能够把它送的那个 62500 积分大概 2500 刀的 Credits 用完,甚至有一种边用边看到额度逐步下降的那种倒计时的感觉,很 Pro 不 Max。

真希望 OpenAI 加油💪 做到和 Opus 5.5 一样的速度快、效果好、额度足的这不可能三角,也更希望国产模型加油,好久没有看到发布亮眼模型了。

随便写写:AI 时代,保持人的活人感、独特性真的非常重要

最近比较搞笑的一件事情就是推特只要一发中文内容,下面就有不少 AI 的回复,我之前会搞笑回复他们说你这个 AI 要用一个好模型,现在看多了后有一种好比一群朋友在开心闲聊,突然冒出来了一个人前言不搭后语帮你乱总结,把原有氛围打乱。

不是很清楚是从哪儿学到的邪修办法,其实已经完全过时了,这样不会给你账号带来任何利益,也不会提升任何你的账号数据,反而容易把号作废,也浪费了 Token,其实不值得,完全变成机器人了。

最近我非常喜欢边 AI Coding 的时候,边看 TESTV 的视频,在 AI 时代前他们活人感也非常强,AI 时代中也完全没有变化,更像是一群玩得很好的朋友组建了一个有趣的公司,也不接广告骗观众,测评有趣的产品,记录他们一群人在重庆巴适的生活,我非常喜欢他们。

相比 AI 时代之前一直看的头部一些数码测评,在 AI 时代时候突然发现几乎都不怎么看了,我甚至都能猜出他们介绍产品时候的手势,微笑时候的样子,说什么语气词,非常有脚本感,虽然视频本身质量非常高,不过让人有点儿感觉疲倦了。

这种感觉正如现在很多使用 AI 生成的图片、视频、内容文章,其实有不少在 AI 时代之前会感觉质量很高,但是重复内核的东西多了以后就正是我看上面评测视频那种疲惫感。

其实我们内容制作本身完全可以不重复,完全可以自己写,即使质量一般,会远远好于重复“高质量”,当然使用 AI 可以带来非常大的水平提升,能够让有想法的人做出之前不可想象的东西,也不需要求人,甚至在很多地方好模型的能力水平已经强于人的方方面面,我也非常受益于模型的进步,帮我效率大幅提升。

做产品其实也是,在产品里面融入你的活人感,你的调性,你的世界观也非常重要,前提是属于你的,你特有的,不是 AI 帮你思考的那种。

假如从想法到产品到运营完全 AI 化,那也会有非常多千篇一律的东西,加上 Token 很足,也有拿着不少认真工程师弄了很多年的产品直接 AI 改写,换一个语言,半天蒸馏完,然后上传到 GitHub 光明正大地开源,随口一说原来那个某些地方不好,我整了一个更好用的,甚至也会想着程序员也就那么回事,我这种啥编程技术也不会的人都可以做出这么“好用”的东西。

殊不知,这种很容易破坏原有很多有想法的工程师继续贡献更多好代码,好思路给社区,千篇一律时间线内容也会让有想法的创作者少发内容,靠量取胜逐步战胜靠质取胜,到时想看好内容的人看不到好内容,想发好内容的人不想发好内容到这里的问题。

玩推特刚好经历了前 AI 和现 AI 时代,我有一个让我很舒服的习惯,就是所有的这种随便说说内容只手打,不使用 AI 生成,可能有错别字,可能不通顺,也可能碎碎念,其实都没啥事,想着这是我保留活人的一个非常好的方式,非常担心自己完全依赖于 AI 科技后把自己变蠢,就像假如开车所有路都自动驾驶,那就完全丧失了开车驾驶的那种乐趣,把自己变成了专车司机,那就没有意思了。

所以我想着尽可能在我还能胜任的地方多用用脑子,就当做一种新的娱乐活动好了。


❤️ 支持作者

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论