乔木博客

RSS: https://blog.qiaomu.ai/feed.xml
记录思考,分享所学,留住当下。

手机快卷到头了,下一个让人忍不住掏钱的新物种长这样

最近大模型领域好像没啥大新闻,唯一让大家兴奋的是 Jev 模型。 一个专为软件自动化决策设计的模型,不能聊天、不能写文章,只做决策。 研究几天,新鲜感很快消退。 不过细想,超快、超便宜的特性,感觉很适合自动驾驶和机器人? 说到机器人,我一个好友的终生梦想就是做机器人,尤其是养老机器人。 年纪大了,就让机器人照顾自己,让子女去追求自己的梦想,不拖累他们的生活。 他原以为做机器人这件事儿可以做一辈子,...
评论点赞收藏14 天前

Seed-2.1-pro-0915 深度实测:多模态 Coding 与 Agent 能力跃升,字节 Seed 基模开始发力

上周和杨攀、橘子、歸藏在「Next Token 词元之外」播客中聊到。 现在很多大模型都开始持续更新,不用版本号。 最近内测的 Doubao-Seed-Evolving 就是这样一款模型。 今年6月,豆包大模型 2.1 发布,已满足生产级任务,成为新的起点。 三个月后,Seed-2.1-pro 升级至 0915 版本,Doubao-Seed-Evolving 同步更新到这个版本。 Evolving...
评论点赞收藏17 天前

豆包工作实测:从日文PDF到官网、视频、PPT全流程演示

上月底,豆包与飞书合并。 上周,豆包推出了工作模式。 昨天,字节跳动正式发布了「豆包工作」。 字节这一系列动作快得不行,目标清晰: 做一个面向生产力场景的独立 Agent 产品。 豆包给人的印象是适合聊天,但新出的「豆包工作」在办公场景到底能不能打?直接上案例。 「豆包工作」现教现学 先说说背景,昨天一个大学同学找我,想学习如何把 AI 用在他的实际业务中。 这个朋友叫吴凡,特别能折腾,做过电脑报...
评论点赞收藏40 天前

扣子终于有桌面端了:云盘双向同步,AI办公终于打通“最后一公里”

字节最近频频发力,扣子最近出了桌面端,主打也是办公场景。 这次扣子桌面端上线,增加了云盘、深度截图等新功能,也终于让 Agent 碰到“本地电脑”。 除读写本地文件更方便外,也能自动识别本地 Codex CLI、Claude Code 接入为 Agent,多 Agent 协作史诗级增强。 模型方面,昨天 GLM 5.3 API 刚出,扣子就接上了,甚至有 Seedance 2.5、MiniMax ...
评论点赞收藏46 天前

豆包更新工作模式,正面硬刚Workbuddy

AI 办公场景现在成了兵家必争之地。 字节终于出手,豆包客户端最近更新,工作任务增强了操作电脑、技能、连接器、工作伙伴等一波功能,体验跟 Codex 非常接近。 能用浏览器、能调 Skill,内置 Office 和飞书办公套件,同时支持本地和云端电脑,合上笔记本也能继续工作。 测试了 7-8 个任务,竟然有点超预期,宇宙厂终于在办公 Agent 场景发力了。 下载安装地址: 先展示几个生成内容,然...
评论点赞收藏48 天前

二次元头像=技术大佬?DeepSeek Harness揭开AI圈隐藏规律

8 月 13 日晚,DeepSeek 发布了 DeepSeek Harness,简称 DSH(有朋友cuimao等戏称 单身汉) 不到两小时,DSH 的 GitHub Star 破万。 12 小时后超 5 万,两天后接近 9 万,成为 GitHub 史上涨星最快的项目之一。 Harness 的原义是马具、缰绳,今天逛辽宁朝阳博物馆,刚好看到个图。😂😂😂 简单说:Harness 是让模型能当 ...
评论点赞收藏49 天前

MIT博士“叛逃“物理系:我要用物理学重写AI的底层逻辑

2024 年 4 月,一篇挂在 arXiv 上的论文在技术社群里炸开了锅。 有人说,统治深度学习几十年的 MLP(多层感知机)可能要被改写了。 也有人说,这不过是又一个"看起来很美"的架构。 这篇论文叫 KAN:Kolmogorov-Arnold Networks,第一作者是 MIT 物理系博士生刘子鸣,导师是因"数学宇宙假说"闻名的 Max Tegmark。 论文发布后三个月内引用超过 75 次...
评论点赞收藏59 天前

谷歌 Gemini 背后的男人,永远的代码之神!

OpenAI 把谷歌的 Gemini 视为最大的竞争对手。 谷歌人工智能这个部门的领导者叫Jeff Dean,是一个传奇程序员。 我来讲讲这个程序员的传奇故事。 Jeffrey Dean: The 100 Most Influential People in AI 2025 | TIME 他的童年 1968年7月23日,杰夫·迪恩(Jeff Dean)出生在夏威夷。 这个太平洋上的群岛,以其火山、...
评论点赞收藏59 天前

CEO上月在AI上花了1.3万美元,却说「自动化是个谎言」

Dan Shipper 上个月的 Codex 账单是 13,000 美元,他的 COO 给了他一个白眼。 但他不打算减少用量。 Every 的 Slack 里现在有 20 个 agent 和 20 个人类,一起工作。 代码、写作、客服、邮件、研究备忘录,能用 AI 处理的流程全部交给了 agent。 27 个全职员工,每人有 AI 订阅,技术岗是 200 美元一个月的 Max 计划,超出的 tok...
评论点赞收藏60 天前

vLLM 背后的人:一个开源项目如何长成一家公司

这期商业访谈录也超级精彩,了解到很多关于 Deepseek 的厉害之处。 小宇宙博客地址: AI 重写成文章,帮没空听的朋友节省3小时: 有人在公司注册前夕接到电话,对方开门见山:你们四个创始人,每人年薪两千万美元,来我们公司做基础设施。 他们没有一个人犹豫,直接拒绝了。 这是游凯超和他的联合创始人们在创立 Inferact 前,经历的最后一次考验。 在此之前,他们已经在 vLLM 这个开源项目上...
评论点赞收藏60 天前

用850个单词统治世界:一个语言学家的疯狂实验

1930年,一位英国语言学家出版了一本书,声称用850个英语单词就能完成日常生活的全部表达。 这听起来不可思议。 英语词汇量超过17万,莎士比亚一个人就用了两万多个不同单词。 850个,够干什么? 但这个想法在二战结束后引发了全球范围的讨论,影响了BBC的广播方式,塑造了今天全球英语教学的基础词汇体系,甚至间接启发了乔治·奥威尔写出《1984》里那门令人不寒而栗的"新话"。 850个单词,是怎么算...
评论点赞收藏62 天前

一个产品经理读完200篇AI论文后,看见了别人看不见的边界

张小珺的播客都很优秀,但我经常会回听这一期播客,对于理解大模型发展很有帮助,常听常新。 谢青池在豆瓣做产品的时候,曾经系统读过城市规划和建筑学的论文。 那是为了做一个叫"阿尔法城"的社区产品,他把杨盖尔的著作翻了个遍,从城市规划的历史脉络里找社区治理的灵感。 2022年,他开始用同样的方法对付AI论文。 两年下来,读了200多篇,存档几百篇。 他不是技术出身,本科和研究生读的是计算机,但毕业就去做...
评论点赞收藏65 天前

Sam Altman:算力赌注、安全惊魂与人类能动性

摊子铺得太大,是去年最大的问题 Altman 曾写过一句话:过去一年很艰难,这在很大程度上是自己的问题。 但接下来 12 个月,可能是 OpenAI 历史上最好的一段时间。 团队去年做了太多事,而这些事单独拿出来看都没有错。 问题是,在这个时代,一家公司真正能做好的大事非常有限。摊子铺得太大,反而稀释了真正重要的事情。 于是团队做了一系列艰难的取舍,重新收拢到一件事上: 造出最好、最丰富、性价比最...
评论点赞收藏66 天前

《AI领导力》 一本让你在 AI 时代永远不落伍的书

2024年底,我刚从字节跳动离职。 字节六年,换了 8 个工区,6 个业务线,做了很多从 0 到 1,又到 0 的产品 😂。 最庆幸和感恩的是,结识了很多优秀的朋友,聪明、务实、理想远大。 离高强度工作环境,不能免俗,先玩了几个月,读书、钓鱼、旅行。 修整结束,和认识十多年的老朋友姚金刚一拍即合,打算写一本关于 AI 的入门书。 可能很多人不知道,姚金刚老师是中国 SEO 界的元老,中国第一届 ...
评论点赞收藏67 天前

K3 用早期的自己优化了自己,这比 2.8 万亿参数更值得琢磨

过去十二个月,有九个月,全球参数量最大的开源模型都是 Kimi 出的。 这件事很容易被当成一个技术 PR 数字滑过去。 但仔细想想,它说明的是另一件事:Moonshot 在坚定地赌,规模这条路对开源模型同样成立,而且他们有能力持续跑在这条路的前面。 这里藏着一个容易被忽略的商业逻辑。 开源最大的模型,不是做慈善。 权重开源意味着模型本身不赚钱,但围绕它的推理服务、生态位和开发者心智会赚钱。 你把最...
评论点赞收藏68 天前

AI 也有潜意识:Anthropic 第一次读到了模型没说出口的念头

AI 每次给你回答,你看到的只是它说出口的部分。 但在说出那段话之前,它的内部发生了什么?它有没有在"想"?它内心有没有一些念头,永远不会出现在输出里? 以前这个问题没有答案,只能猜。 现在 Anthropic 有了一个工具,让他们第一次能看见 AI 没说出口的话。 AI 也有"潜意识" 人脑有一个很有趣的特性:我们每秒处理海量的信息,但其中只有极小一部分能进入"意识",成为我们能说出口、能主动调...
评论点赞收藏68 天前

人生是一场单人游戏:自由的代价,是守住自己的内心

你有没有试过,一个人排队时什么都不做? 不看手机,不戴耳机,不回复消息,只是站在那里。 对很多人来说,这几分钟比工作更难熬。手会下意识伸向口袋,大脑迫切地想找点东西填满空白。 我们以为自己是在获取信息,实际常常只是不愿意和自己单独待在一起。 纳瓦尔说,人生是一场单人游戏。 这句话听起来有些冷,甚至像在鼓励人远离关系。 但他真正想说的,是人生最基本的事实:你看到的世界、赋予生活的意义、产生的欲望和感...
评论点赞收藏70 天前

Anthropic 内部实录:当 Claude 自己开始写 Claude 的代码

Anthropic 产品工程团队现在 65% 的 PR,是由一个叫 Claude Tag 的机器人直接合到主干的。 不是辅助生成代码,是真的自动落地,不需要人工确认。 这是 Anthropic 产品与工程负责人 Cat Wu 和 Thariq Shihipar 在一场炉边对话里聊到的。 两人的话题围绕着 Claude Code: 这个工具从 Sonnet 3.7 发布会上一个不起眼的功能点,怎么在...
评论点赞收藏72 天前

Kimi K3实测,让我不敢相信这是国产模型

一直用 Codex 和 Claude Code,测了 Kimi K3 后,竟有超预期惊喜,真的是强! 刚用时,不了解情况,只敢给一些简单任务,后面越用越牛逼。 后面直接给了 Kimi K3 服务器权限,一口气开发了 6 个完整项目,全部上线、免费开源。 项目覆盖前端、后端构架/数据库开发、AI 模型调用,本地已有项目优化迭代。 全都是一轮对话搞定 MVP,2-5 轮对话完成打磨、发布上线。 毫不夸...
评论点赞收藏81 天前

人机分工反转的一年:独立开发者只剩下 1% 的活,那 1% 是什么

今天邀请我的前同事、好友王启源参加「未来硅世界」第十八期的直播。 直播回放在这里: 让 Claude Sonnet 5 写了总结: 他说当时没看懂 OpenAI 启源在微软 Azure 机器学习平台工作的时候,曾服务过两个大客户: 波音和星巴克。 还有一个不起眼的小客户,做了一个模型,叫 GPT-3。 “我们当时还试用过,觉得,唉,这个东西有什么用呢?好像也没有什么用处。” 后面的故事大家都知道了...
评论点赞收藏91 天前

如何讲好故事:万字学习手册

故事不只属于小说家、导演或脱口秀演员。 产品经理讲需求,创业者讲愿景,销售讲客户案例,管理者讲变革,研究者讲发现,普通人讲自我介绍。 大家都在用故事解决同一个问题: 如何把一个人、一个变化、一组证据和一个意义,组织成别人愿意听、听得懂、记得住、愿意转述、甚至愿意行动的表达。 本文若只能记住一句话,那便是: 好故事不是"发生了什么",而是"谁在乎什么、遇到什么阻碍、做了什么选择、付出什么代价、因此发...
评论点赞收藏94 天前

从伽罗瓦到夸克:需要200年验证的想法,AI能产生吗?

一个 19 岁的少年,在监狱里写下了一套没人看懂的数学笔记。 他把笔记托付给朋友,请他转交给当时最伟大的数学家高斯,朋友尽力了,但没有成功。 这个少年在一场决斗中死去,年仅 20 岁。 又过了二十年,一位叫刘维尔的数学家翻出这些笔记,觉得里面可能有点东西。 又过了二十年,有人把这些想法整理成现代数学能读懂的形式。 再过一百年,物理学家盖尔曼用这套理论预测了夸克的存在。 这个少年叫伽罗瓦。他留下的东...
评论点赞收藏95 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。