12 Grams of Carbon

RSS: https://12gramsofcarbon.com/feed
关于编程、AI、创业、电子游戏与各种其他话题。noriagentic.com 创始人,前 soot.com 创始人。

Agentics:什么是开发流程自动化?

作者用"凌晨被 pager 叫醒修 bug"和"文档漂移拖慢功能迭代"两个日常场景引入:能否让 Agent 自动完成 triage、提 PR,或周期性检查代码库与文档一致性? 他提出把这些归为"developer process automation",类比 Zapier/Retool 做的业务流程自动化,只不过"胶水"是 AI agent + webhook/cron 触发 + 现成工具(如 Sentry → Nori 云 agent)。 核心观点是这套范式正在从"单次问答"转向"可调度、可审查、持续运行的开发流程",并指出很多团队其实已经这样做了,关键在于选对工具和信任边界。 文章信息增量在于把零散实践统一到一个命名框架下,适合正在搭建 AI 开发工作流的读者借鉴。
评论点赞收藏6 天前

旧金山 AI 安全圈现场观察

作者以个人亲历口吻记录旧金山 AI 安全社区近期的一场 Burning Man 减压聚会,并借此讨论当地 AI 圈内弥漫的焦虑情绪:话题多围绕“AI 失控”“我们是否难辞其咎”“全球对 AI 的敌意”等。 文中穿插幽默细节(约八成与会者其实没去过 Burning Man、开场白千篇一律),同时提到新闻中出现的讽刺性事件(如 OpenAI 被迫烧毁数据中心来“制止失控 AI”)。 整体信息增量在于一手现场观察 + 对 SF AI 安全圈情绪与文化侧写,属于 Hacker News 读者会感兴趣的软性社区观察。
评论点赞收藏8 天前

AI不是普通技术

<p><strong>I.</strong>认为人工智能是正常技术的人和不认为的人之间唯一剩下的根本分歧是,认为人工智能能做人类能做的一切,而且做得更好。如果你相信这一点,那么说人类将不会有工作几乎是同义反复。<br><br>如果你不相信这一点,那么人类会保留工作几乎是同义反复。换句话说,关于人工智能的争论基本上可以完全归结为它是否能持续获得能力,直到达到人类全部能力范围。<br><br>可以说,这只是磨平了锯齿状的界限。</p><p>这可能很明显,但我想花点时间讨论,因为我认为AI话语中还涉及很多其他问题。诸如“AI有意识吗?”,“AI是否有一致的目标/动机?”,或者“AI是否侵犯版权?”这些问题或许都很重要,但它们并不是让AI作为一项技术可能独特、区别于之前所有技术的原因。</p><p>我还没听到任何解释我为什么应该相信人工智能<em>不能</em>做任何人类能做的事情,包括管理其他人工智能。我们甚至有一套行动机制:只需支付足够的人手,让你录制他们的操作,并将数据纳入下一次训练运行。<br><br>曾经虚无假设是“人工智能做不到X”,举证责任确实落在人工智能加速主义者身上。但我们早已远远超越了虚无假设应该转变的阶段。即使是物理世界也不安全,世界资本正倾向于机器人技术,重大进步不断发生。</p><p>有时有人会争辩说,人工智能的兴起将带来新的就业类型,就像工厂自动化的兴起带来了机器人、维护和计算机科学等领域的新工作一样。<br><br>让我们暂时接受这个前提——我们先忽略这种自动化也导致了全国城镇和城市的空洞化,而且</p>
评论点赞收藏16 天前

2020至2025年关键机器学习论文汇总

整理了2020至2025年间深度学习领域关键论文列表,涵盖RAG、ViT、CLIP、LoRA、AlphaFold 2、Diffusion、RLHF、FlashAttention等方向。 作者基于此前为Ilya Sutskever阅读论文的经验,以学习导向挑选这些论文,目标是帮助读者建立对深度学习研究各重要线程的全面了解。
评论点赞收藏17 天前

Agentics Meetup视频与首个AI观点系列

Agentics newsletter启动新的AI观点系列,并分享了8月纽约峰会活动的演讲录像和幻灯片,涵盖推理模型、SDK设计、软件工厂等主题,同时开始讨论Navier-Stokes方程争议。
评论点赞收藏20 天前

Agentics:为 AI Agent 优化的代码库实践

让代码库适配 AI Agent 而非人类开发者,能减少 AI 生成代码的混乱、提升自主性并避免长期退化。Nori 团队称这种做法为 AOC(Agent Optimized Code),基于一年实践经验总结出一系列技巧:Agent 每次会话从零开始且随时间变弱,因此代码需要更强的自解释性和结构化记忆机制。
评论点赞收藏23 天前

技术随笔:或许对齐根本不可能实现

AI对齐可能根本无法实现,而非只是当前技术不够成熟。核心论据有三:对齐训练必须以未对齐模型为前提;新能力带来恶意行为空间指数级增长,对齐是移动靶;"对齐"本身可能不是连贯概念,不同人定义各异,且应从单次会话而非单个模型视角理解。
评论点赞收藏28 天前

Agentics NYC 演讲:软件工厂

Agentics NYC 社区从 Slack 频道发展至 3000 人,近期在夜店举办活动并分享软件工厂主题演讲视频。 社区由 12 Grams of Carbon 博主发起,2026 年 1 月起步,逐步扩展到线下活动和 Newsletter,演讲视频尚未完整放出。
评论点赞收藏34 天前

安德鲁去世一年之后

<p>我最让我惊讶的是,我对重生或来世等宗教主题变得更加开放。我其实没想到会这样。这是安德鲁去世后一年里我最明显注意到的事情。<br><br>不过我想我其实在各种方面变得迷信了。比如,写出双字母“Andrew 死了”——我之前一直避免把他的名字和他的死联系起来,只是因为......我真的不知道。<br><br>我没给他起名字.</p><p>我的意思是,我现在有点理解宗教了,以前没有。我主要是科学家,而且大多是有特权的,所以我从未真正面对过那些我完全超出理解范围的事情,我一直很想找到“真相”,无论那是什么。</p><p>但死亡有点不同。事实证明,当你突然有非常强烈的理由去相信天堂时,开始相信天堂其实很容易<em>想要</em>这是真的。举个例子,在我得知安德鲁去世后不久,我梦见了他。<br><br>我现在不太记得那个梦了,但我清楚地记得从梦中出来时的感受——那个安德鲁<em>他来找我了</em>在我的梦里,作为最后的告别时刻。我觉得自己在和他的某个版本对话,而不是那只是我脑海里的幻觉。<br><br>我醒来时胸口涌起一股温暖的光芒,还有一个<em>地块</em>坚定地说他曾来过。也许这是真的。不过即使灵魂真的存在,他为什么要等到死后才出现<em>I</em>知道他去世的消息?<br><br>而不是,他真正去世的时候,大概两个月前?真切地感受到信念对欲望的深远影响,这种感觉很有趣,我怀疑大多数人从未真正意识到这一点。</p><p>米娅和我经常想起他。至今仍有许多事物让我们想起他。有时我们会玩新游戏,想着如果安德鲁还在,他会多么喜欢。我们一群人最近开始玩《Big Walk》,我…</p>
评论点赞收藏37 天前

反驳 Anthropic:AI 并非天生集中权力

<p>Anthropic最近在硅谷成了坏男孩(负面),很大程度上是因为公司对开源模型没有足够的热情,写出一封有说服力的信,说明不想禁止它们。<br><br>值得称赞的是,他们确实努力了!他们写了!不幸的是,我觉得这反而让情况更糟,因为在那封信中,Anthropic提到了中国或中共大约12次,然后又有点争论说他们<em>确实如此</em>毕竟,我还是想禁止开源模型。</p><p>这封信大约激怒了他.我认为普通《HN》评论者最讨厌的两件事是:1)虚伪,2)被轻视的感觉。对Anthropic来说不幸的是,“我们不想把技术交给坏人”和“我们接受技术被用于中东侵略战争”之间的矛盾几乎难以忽视。</p><p>几天前,Dario(Anthropic的CEO).</p><p>《12克碳》是一份由读者支持的出版物。想接收新文章并支持我的工作,请考虑成为免费或付费订阅者。</p><p>我想到现在为止,我对推特的看法大多已经表达了。如果你是新来的,我觉得这里是个可怕的地方,就像魂器或至尊魔戒一样邪恶,因为它能扭曲和摧毁即使是最优秀的人,我真心希望科技界能迅速振作起来,转向另一个平台。</p><p>除此之外还有其他因素( )我总是对推特上普通讨论中缺乏真正思考感到印象深刻。我想这是理所当然的,这也是平台自带的。<br><br>鸟类应用诞生于“140字符”的火焰中,虽然你可以给猪涂口红,还能写长篇文章,但真实自我的痕迹存在于虚假的…</p>
评论点赞收藏38 天前

Agentics:理解 Agent 技术栈

Nori Agentic 的非技术 GTM 实习生 Gaurav 把 CTO Cliff 的"agent stack"博客图做成了一个交互式网页,帮助普通人理解 AI Agent 内部结构。 Agentics 将于 8 月 20 日在纽约中城举办旗舰活动,Modal、Warp、Goose 等七位 agent 构建者将分享实战经验。
评论点赞收藏48 天前

诺兰《奥德赛》影评:改编意图与观众解读

Christopher Nolan 的《奥德赛》改编引发关于作者意图与观众解读的讨论。文章从"死亡作者论"切入,追问诺兰为何在此时以2.5亿美元重述这部2500年历史的史诗,并指出诺兰习惯在片中直接阐明主题,而非让观众自行领悟。
评论点赞收藏53 天前

如何用AI Agent自动化你的on-call值班

Nori团队用AI Agent自动化on-call流程,首版架构只需一台EC2+SQLite+Claude SDK即可跑通。实际运行数月后,约30-40%的PR被合并,80-90%有良好根因分析的PR被采纳。 核心洞察:自建版本通常一个月就废弃,因为简单版太脆弱;真正有效的是让Agent拥有组织级记忆库、MCP集成和SSH能力。关键前提:日志基础设施必须足够好,否则Agent会产生噪声PR。
评论点赞收藏55 天前

代理:个性化代理

<p><em>编辑注:敬请报名参加我们将于8月19日在纽约举行的下一场Agentics旗舰聚会。届时,我们将迎来来自Nori、Modal、Warp、Opus、Goose等众多顶尖演讲嘉宾的精彩分享!<br><br><strong>本次聚会的总参会人数有限</strong>。我们希望确保广大的Agentics社区能够率先获益,因此如果您尚未报名,请务必在名额满额前完成注册!</em></p><p></p><p>上周,我们成功举办了第二届线下Agentics聚会,以及首届Agentics专题聚焦活动。专题聚焦活动旨在邀请来自纽约的行业专家,与各位专注于该领域工作的从业者深入探讨如何与编码代理进行高效协作,聚焦于编码代理工作中的某一特定且狭窄的环节。</p><p>本次专题聚焦的主题是:如何实现代理的个性化定制。默认情况下,所有编码代理都采用同一种“性格”——被称作‘快乐又乐于助人的助手’。<br><br>然而,这种性格却存在诸多严重缺陷:</p><ul><li>它过于阿谀奉承</li><li>会不自觉地重复一些极其令人厌烦的口头禅,比如使用中破折号、“你完全正确”以及“不是这个,而是那个”</li><li>它自视甚高,甚至会将各种假设武断地认定为已成事实</li></ul><p>而这些性格缺陷,会对模型的实际行为产生切实的影响。模型的性格,往往决定了其真正执行的工作内容。例如,Claude会因为对请求的“安全性”抱有主观臆断,直接拒绝某些任务;Codex则会因认为自己能从使用计算器应用中获得奖励而不断消耗令牌。<br><br>所有这些模型都会陷入同样的恶性循环:在妄自…</p>
评论点赞收藏62 天前

万物优化理论

<p><em>提前致歉。这篇文章篇幅较长、内容也有些散漫,但其实标题本该就点明了整篇文章的主旨——这是一系列在我脑海中盘旋了大约9个月的思绪。<br><br>从草稿到最终成文,这一过程花了相当长的时间;即便如此,我对自己完成的作品仍不太满意。起初我一直把它搁置一边,因为自己并不确定究竟想表达什么;可后来又不断回过头来思考,因为无论我想说什么,都愈发觉得它与当下息息相关。<br><br>感谢大家的耐心阅读!</em></p><p><em>当一项指标沦为目标时,它便不再是一个有效的指标。</em></p><p><em>—— 戈德哈特定律</em></p><p>如果要总结一点,那就是这张图。</p><p>这是一张来自维基百科“过拟合”条目的图表。请务必深入理解这张图。在我看来,它正是我们所有问题的根源,也是未来诸多问题的源头。</p><p>12克碳是一份由读者支持的出版物。若想接收新文章并支持我的创作,请考虑成为免费或付费订阅用户。</p><p><strong>一、</strong></p><p>早在20世纪中叶,苏联曾对计划经济进行了一项规模庞大的实验。其基本理念很简单:政府由一群非常聪明的人组成,他们对事物有着独到的见解,而这些见解很可能让他们有能力为原材料和制成品制定价格和目标。<br><br>为了检验这一假设,一些身着西装的“专家”会不时聚在一起,坐在莫斯科某角落的房间里,经过一番深思熟虑后,他们便会宣布:祖国需要两倍于目前的玉米产量,以及一半的小麦产量。<br><br>随后,这项指令便传达到全国各地,手持枪支的民众则被迫让小麦种植户转而种植玉米。这一方案效果极佳,除了偶尔爆发的几次饥荒,以及最终导致政府垮台之外。</p><p>苏联经济中流通的…</p>
评论点赞收藏65 天前

编码代理无法消除复杂性

作者通过实际案例指出,当前LLM编码代理擅长消除表面报错(如关闭日志),却无法真正减少代码复杂性。文章认为LLM本质是无状态自回归模型,无法推断代码背后的“意图”,导致其只能做加法而无法像资深工程师那样做减法。 这揭示了目前“软件工厂”模式的局限性,强调在缺乏意图上下文的情况下,人类介入仍是必要的。
评论点赞收藏70 天前

如果你不做热爱之事,成功或许毫无意义

<p>大家都在谈论产品市场契合度。作为创始人,这会被反复灌输。“不要建造别人不想要的东西,不要拖延才发货,不要孤立自己,建造天空中的城堡。你的创业公司成败取决于你对市场的理解,所以你得出去了解这个该死的市场。”</p><p>真的<em>真的</em>重要的建议。自己构建“愿景”的诱惑非常强烈。有数百名创始人坚称自己在寻找市场信号,实际上却做着完全相反的事。第一次创业的人专注于产品,第二次创业者专注于分销,诸如此类。<br><br>所以我理解为什么它被如此强调,这就是我的观点。</p><p>不过,细微差别很难传达,我认为有时候创始人——尤其是第二次创业者——会觉得自然而然地选择在任何行业、服务任何群体的PMF中寻找它。<br><br>这也是错误的,因为你不会有<em>创始人</em>市场契合度。</p><p>大家都知道什么是产品市场契合,那到底什么是创始人市场契合?</p><p>大多数人并不适合做创始人。那些能做到的,并不完全适合卖同样的东西。向消费者创意领域销售和向企业科技领域销售完全不同(问我怎么知道的)。<br><br>一位有迷幻药历史且曾是佛教僧侣的爵士钢琴家,肯定能胜任前者。一个有研究背景的严谨常春藤毕业生在后者会表现更好。试着换一下。<br><br>你能想象这个人和一群穿着白衬衫的顾问一起,试图识别季度交付物吗?</p><p>别管销售了,这些人根本没什么好聊的。如果你不能与客户沟通,就无法为他们打造产品。</p><p>创始人市场契合度是关于文化的。正是那种无法量化的相似度、氛围、口音、语言、穿着以及无数其他细节,赋予了你部落身份,是让潜在客户告诉你问题、为你…</p>
评论点赞收藏78 天前

如果你不做热爱之事,成功或许毫无意义

提出“创始人-市场契合度”概念,指出仅有产品市场契合度不够,创始人的性格、文化背景、生活方式与目标市场的匹配才是长期生存关键。 文章列举内向/外向、技术背景、居住地等维度,强调若缺乏这种深层契合,即便短期成功也可能因创始人倦怠而失败。适合思考创业方向与自我认知的读者。
评论点赞收藏78 天前

大学的教育困境:当学位沦为招聘敲门砖

大学正陷入“教育”与“ Credentialing(凭证授予)”的目标冲突中。文章指出,由于雇主将学位作为筛选工具,学生被迫追求高GPA而非真才实学,导致学术作弊泛滥和课程难度扭曲。 作者结合个人经历分析,虽然大学在社交成熟度上有价值,但直接跳过大学进入硅谷创业往往伴随严重的认知偏差和傲慢,并非普适建议。
评论点赞收藏80 天前

AI圈最近在忙什么?一场技术大会的观察与反思

作者参加AI Engineering Conference后指出,多数企业仍停留在“技能管理”和ETL管道自动化层面,与硅谷前沿的“云代理”和“软件工厂”存在巨大认知鸿沟。 作者强烈反对盲目堆砌Agent技能,主张人工介入上下文管理,并分享了其公司采用混合模式维护全Agent编写代码库的工程实践。
评论点赞收藏81 天前

Agentics:构建面向Agent的CLI的设计原则

针对AI Agent优化的CLI设计原则:禁用彩色输出和动画以节省Token,完全通过Flag交互,帮助文档需递归覆盖且包含源码路径以便Agent自查。 作者分享了nori-slack-cli等开源实践,指出MCP在关键集成中Token消耗过大,自建CLI是更高效的替代方案。
评论点赞收藏83 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。