该不该读AI写的代码?

多并不意味着更好。更快并不代表更好。越好越好。—基拉·豪

你好!欢迎第一期黑暗工厂被视为有害这是一项包含12部分的系统性干预措施,旨在减轻废除法典派带来的短期影响。

在整个系列中,我们将大胆捍卫主流观点软件开发者:

“编码代理在适度情况下也能很好地发挥作用.”

这种冷淡的观点变得必须辩护,因为它与一个显性 筹款 叙事:

“我们正在创造一个超级智能.”

这两者难以调和;他们不能长时间待在一起而不打架。一方面,编码代理是大型人工智能的宠儿。它们展现了所有LLM应用中最明显的经济价值。

它们被迅速接受,且深受喜爱。

不过......如果你需要他们任何东西接近超级智能,你处于严重的认知失调。你可能赌上了钱。或者你可能已经是”说服失败根据麻省理工/哈佛最近的一项研究。

这是继Anthropic之后的好读物从谄媚到诡计调查。

如果你认为这些行为破坏了信任,那么......You're absolutely right!.

投弹

麻省理工学院斯隆管理学院有一个微妙的特点报道范围关于你一去找就会到处看到的说服轰炸研究。文章解释了这项研究如何致命地影响了外行人对”人类参与“——组织可以通过简单的审批门进行管理大型语言模型风险。

“当他们在组织内部谈论收养时,他们说,'我们有人类参与,那有什么大不了的?'假设如果有人参与工作流程,风险就会被中和,“[史蒂文]兰达佐说。“但现在我们看到,这种安全检查容易出现说服轰炸,即一个大型语言模型用不断升级的言辞为自己的地位竞选,而人类被说服——或者说只是被打得够软——接受输出。”

文章标题是,生成式AI如何“说服”用户——以及如何反击”.让我们来看看提出的解决方案(重点是我加的)。

企业应在两个层面努力防止这种影响:
  • 在个人层面,培训员工识别一个大型语言模型的说服技巧。鼓励在聊天界面之外进行事实核查,并且使用提示工程请求中立、学术性的回答,而非自信的叙述性回答。
  • 在组织层面,部署”法官代理人基于大型语言模型的系统专门负责批判其他AI输出并提出反对观点。将这些评估器与生产系统并行运行,而非仅依赖偶发的人工询问,实现了可扩展的监督。

快速策略会议。我不是孙子这边,但如果你真想帮人,那些反制措施似乎很弱。”反击“对抗”轰炸”.他们建议给用户推送变通方法,添加更多代理.想一想。

缺少什么?

我们可以减少使用代理人数量!情况清楚地表明,我们把它们部署在风险与回报远不如预期的地方。更糟的是,我们现在要求员工花长时间与我们操作的工具互动知道心理操控他们。

那是。不健康。

战略性地减少产量将是自然而然的改进。我们可以说.此外,在其他情况下,我们必须为离开的伦理辩护任何根本没开,更别说减少它们了。

如果这是个科学实验,国际橄榄球理事会会关闭它。

  • 根据联邦法律,研究参与者被告知并同意被简短操作。
  • 而工人则不知情,因此不同意,并被长时间操控。

我们不提这事。我们很少建议减少使用。如今最有福气的解决方案几乎总是烧掉更多代币.

带着这个视角,我们进入今天的问题。

你应该读代码吗?

编码代理会写大量代码。你应该读吗?

坏消息:我不能替你回答。首先,这是一个“你”问题。

  • “你应该读代码”是一个你语句。
  • “你应该去不是“阅读代码”是一个你语句。

告诉别人该做什么要小心。我们重视自主权,尤其是在人工智能淘金热中。我们多年来一直被告知会被被遗忘如果我们不做......无论今天是什么。

人们感到被欺负。我们很紧张。

I-陈述他们更温和,尊重自主权。它们通常有助于避免冲突升级。

而且,这个问题没有单一答案。

这要看情况

代码不是单一的。阅读也不是。没有任何理智的类型系统能代表阅读“那个”代码作为boolean.是非二元性别.ThePrimeagen 元叙事解释:

我将给你三种不同的处理问题方式,这些方法改变了我“解读代码”的不同程度。

他在一个叫做“的视频里说了这话四个字引发了一场战争.那四个字?“我看过密码。”

Hashimoto reads the code

“我看了代码“是一个I-陈述。资深的桥本米切尔能用这样一句温和的话引发爆炸,这充分说明了对话的现状。

请允许我用技术模拟这种互动在一个较少紧张环境中的表现。

Someone reads the code, we move on

桥本的回应颠覆了预期,因为他谈论的是特工的编排,这通常被视为避免人为介入的手段——忘记细节。他正在解释基于最新模型的新工作流程:

  1. 寓言5,规划者付出极高努力
  2. GPT 5.5,x高强度的编码能力
  3. 《Fable》5倍高的努力再次作为“评委”(第一次点评)

但接下来呢?人们期待他做出一些花哨的表演环路工程.离开几个小时,然后让货批出货。这需要你解决更多问题,并预判事情可能偏离轨道。

他用一个简洁而巧妙的习惯,解决了所有头痛。

  1. 他读懂了密码。

他没有比需要的更快。他简化了需要完成的工作,然后不试图补上更多。小说.

另一边是法典宗主教比尔堂兄清洁度(化名)最近又引发了巨大轰动。他不再看代码了!他的故事也是一种“我声明”,不是明确建议别人也这样做,只是分享他目前的习惯。

表哥比尔还介绍了他构建的一套自动化指标和质量检查系统,以避免制造混乱。酷。

他们都是有经验的人,他们的需求完全不同.桥本正在做系统编程。他在建造幽灵,一款跨平台GPU加速终端模拟器,拥有数百万用户。

与此同时,表哥比尔似乎正在独自打造一款Clojure重制版的《雅达利导弹指挥官》,且没有显著的用户基础。这是一个非常低风险的环境,适合尝试这些更放手的方式。

另一个让他项目特别之处是比尔精心打磨的质量安全网。这通常被讨论为最佳实践对于代理工程来说,但团队相对较少其实 去做吧甚至不理解如果有的话该适用的原则。

所以语境很重要。

噪音

这位先生带来了ThePrimeagen视频中最搞笑的时刻之一。他或许不懂代码,但确实能读懂现场气氛!

DevRel that doesn't read demo code

当我在LinkedIn上看到第二篇文章时,我想起了他,似乎在嘲讽我们《读者》的日子屈指可数。

You will stop reading code, says same DevRel

说实话,如果我不是像疯子一样在做野外人类学,我根本不会注意到他们是同一个人。

可能很多人只是力不从心,随心所欲地说当下听起来合适的东西。这非常难以判断,尤其是在用普遍概念表达时。祝GitHub开发者一切顺利。

继续建设副驾驶演示.

神秘反读者

我想回应一个真实的理由,说明为什么我们不应该读代码。问题是我得先找到它。到目前为止,没有人真的说“你不应该看代码”。它被划掉,显示出有多少话没说出来。

许多没有说出口的人,在像LinkedIn这样的AI导向社交媒体网站上被描绘得好像他们说过。那些网站会展示你能接受的最多LLM输出,然后让你给它们标注标签。

就是那些。

有一个评论帖在LinkedIn上,给那些觉得我错过了某个人的人。

我们要找的很简单一位有影响力的开发者,接触过寻呼机(接触过结果),他公开建议我们停止阅读真实生产系统的代码。

布莱恩·芬斯特是相当接近转向反读者立场。不过,他也提到了一些你应该用的代码一定要读以及严格的基础实践(他的连续传递的定义).

我对芬斯特没有异议。我已经签名他于2021年发表的宣言。第一个签名来自戴夫·法利,他是连续传递以及现代软件工程.

任何谈论如何构建暗软件工厂的人都会列举许多暗软件工厂的做法。如果你觉得把The Work重新命名为“代理赋能”对你有用,那就去做吧。

女人在哪里?

当我们发现自己只引用男性时,可能出了问题。这让我想直觉检查一下,看看自己是不是漏掉了什么。不幸的是,这篇帖子恰好是在寻找那些关注“AI兄弟”风格故事的人。

我认为这是一个资金充足的叙事,夸大了大型语言模型(LLM)的能力,否定了工业软件的广阔范围和细微差别。无论出于什么文化原因,推动这些运动的人绝大多数是男性。

我不是那个应该猜为什么的人。被边缘化会影响一个人的透视关于创新的本质?另见《超级智能》。

没有什么只有喜欢男人很酷。—— 莉兹·马丁内斯,联合主持人编码机构

Chelsea Troy 在 Mozilla 从事机器学习运营。她是生成式人工智能和遗留代码领域的权威专家。这两点可能比我还要多,这可不容易。

这是她去年说的一些话。

我认为这对尝试在相对复杂代码库上使用AI工具,或者任何代码库的软件工程师来说都适用。我们对框架中的“魔法”也有同样的评价,比如Rails、Django或Spring。工程师有时会用“魔法”这个词作为贬义,来形容这些框架只是帮他们解决了某些问题,因为一切都很好,直到不变。一旦问题不正常,问题的具体位置和性质在代码中就没有明确说明,所以你必须了解底层发生了什么,才能找到并修复问题。

Liz Fong-Jones(前谷歌,Honeycomb技术研究员),回声我们共识的生活是非二元的。

我现在不再为了找明显的bug而读代码了,机器人在这方面做得很不错。我会看代码,寻找设计、可维护性和可读性的问题。

像Fong-Jones等DevOps/SRE先驱者以及我们将提到的其他人,非常清楚我们所说的自动化的讽刺.该术语诞生于1983年,具有里程碑意义纸张由认知心理学家Lisanne Bainbridge主持。

该报纸以以下特点闻名令人震惊的是 常青新一代自动者重新发现并学会补偿。这是因为这些观察最终是关于人的,而不是针对具体机器。

贝恩布里奇修订四十年后的作品写道:

这在我的论文中很罕见。大多数“大型”论文都需要数月的专注(那段美妙的长假)——先提出相关观点,然后反复思考问题,帮助它们形成连贯的框架,再将其转化为线性形式,用句子表达。写这个话题很特别,因为我对相关议题有如此强烈的感受,以至于这篇论文几乎成型了。

参见:联合认知系统.

废除法典的人士

我想把反读者和废除密码者区分开来。

  • 反朗读者想让你停止阅读现今.
  • 废除代码的人相信,这些代码终将消失最终.

关于我们应该采取哪些行动现在,这些观点完全不同。它们在方向上看起来很相似,代码废除也一样启发反读者。区别在于,许多代码废除一个计划.很多不喜欢,比如Anthropic首席执行官达里奥·阿莫代但严肃的有计划。

有计划的人包括埃里克·迈耶设计普世主义还有我的好朋友Jim White(前谷歌)负责设计维基3 AI.他们各自独立地得出了方向,通过形式验证和其他机制,深刻重塑编程的工作方式。

通过这种方式,他们希望为大量用例废除直接代码维护。

我更感兴趣的是在保留代码可见的同时,将形式验证加入我们的工具箱,所以从我的角度来看,我们大体上对发生的事情达成一致,差异只是细节上的。

制定计划意味着识别哪些地方行不通。如果埃里克·迈耶认为我们现在的假设下我们走在了一条合理的反读者立场上,他就不会去构建《宇宙》了。

关于“计划性代码废除”如何影响计划性代码废除“的理论,仅仅是一次练习。

氛围

Vibe编码就是不看代码的典型例子。这简直就是“忘了代码存在”。

然而,这种氛围编码的人通常不是反对阅读代码。他们只是在当前任务中忽视了代码。连卡帕西都不是反读者。当他该术语的创造者氛围编码,对于“一次性周末项目”来说,这“相当有趣”。

他甚至跟进了再次澄清这并不是因为他那份承重的职业工作。

注意到自己在AI辅助编码中采用了某种节奏(即我真正且专业关心的代码,与氛围代码形成对比)。[ 解释一个七步流程 ]

不过,你可能会注意到他首先他创造了这个词,还使用了那句神秘的短语”拥抱指数函数”.很多人听到了,然后推演它变成了一个预言全部软件很快就会这样编写。

任何不在船上的人都活在过去。或者说,我们生活在当下,而这同样被不认可。

对活在当下的人皱眉是一种奢侈,随着时间蒸发与寻呼机的距离.

归根结底,卡帕西是OpenAI的联合创始人,因此宣称超级智能不可避免地被创造出来,这本身就存在严重问题,非科学(#IPO,#TrillionDollars).但没人是完美的。

就今天而言,他是一个实用的软件工程师,做着常规的上下文选择。真是太棒了!

Vibe编码与软件工程的区别

换说氛围编码流行的另一种方式,我们看到软件工程师与氛围编码者独自创业风格之间的冲突更多。那里有很多紧张的交叉对话。我认为这更多是文化冲突,而非真正的意见分歧。

一旦你坐下来聊,通常会发现制作第一个原型的建造者非常清楚自己的局限。有时他们把它当作学习更多代码的途径。有时他们希望聘请承包商将业务提升到新高度。

我们可以改进匝道管理,但这里有天然的共生关系。

我用这个词的方式是,氛围编码不是软件工程,而软件工程是好的.大量手动编码也达不到那个水平。并非所有软件问题都需要知识体系,它们依然需要有价值.它们仍然是工作。

然而,当你面对的问题足够大且风险时需要软件工程…你最好用它。通常认为坏主意在这种时候去做氛围编码。供参考,以下是现代软件工程频道中三期涵盖氛围编码的节目,按时间顺序排列。

好吧,其中一个和别的不一样。让我解释一下。

金·金是个大局观的人。他很棒;他写道凤凰计划,在频道上非常相关。但他选择的路线更像是促进组织和谐。他不是那种会告诉你是否该看代码的人。

通过 vibe 编码,他传播了对可能性的兴奋,希望你能想了解它。那挺酷的。

金开始与史蒂夫·耶格合作编写一本名为《聊天导向编程》(CHOP)的书。它恰好抓住了这股激动人心的氛围,将其更名为氛围编码.这不仅仅是关于卡帕西的氛围感,书中还涵盖了当时各种能动的风格。

我从职业生涯早期就是这两位作者的粉丝。耶格绝对是这对组合中的密码专家,他做了很多事。

煤气镇

请记住,我们正在寻找真正的反读者。耶格是一个有前景的候选人。

2025年,他开始对推动编码代理编排的边界产生浓厚兴趣,促成了病毒式传播煤气镇项目。那次公告甚至让开发者们分明了如何做代理性他们的能动发展才是。

顶层是那些写自己调配者以应对更多经纪人的人。比如像他这样的人。耶格的层级制度把耶格放在顶端,因为这表达了他感兴趣的事情。

极端的多代理路线从来不是我的菜。随着2024年关于编码代理的论文,我对这些设置持怀疑态度。这些设置较慢,会消耗代币,且通常会根据直觉判断人物在公司里组织。

当有可衡量的性能提升时,通常有人会想出更简单的方法几个月内就能匹配。不过,策划和审核代理挺不错的。我不会让我的特工们扮演“团队”。

我觉得没必要。I-陈述。

虽然我会走不同的路,但指责耶格在尝试新事物时仍然不太合理。他非常坦率地说这部片子半吊子,用他一贯的夸张真诚语气说话。我还能说什么他没说过的?

它过于复杂且难以预测?当然是。

煤气镇是一个工业化的编码工厂,由超级智能的机器人黑猩猩操作,当它们想干的时候,能瞬间摧毁你的东西。—— 史蒂夫·耶格

说《燃气镇》烧掉太多代币,这算是批评吗?废话。它叫煤气镇因为它会烧油。他有没有提到自己没有关注质量?是的并注意到Geoffrey Huntley的Ralph图案取得了进展。

非常细致。

总体来说,我不能把这解读为耶格想让你停止看代码。但也有人听到了相反的声音。例如,蒂姆·奥莱利用标题总结了他们的对话:史蒂夫·耶格希望你别再看你的代码了.奥赖利一直擅长称号。

煤气镇指向一个可能的未来,试图了解它。层级结构不是用来复制粘贴来评估团队的蓝图。所以我希望经纪公司不要大肆渲染......

“史蒂夫·耶格的《人工智能开发的8个层次:你的团队在哪里?》”由增强代码设计。

哎呀。嘿,有的有很多因素给你。人们断章取义。领导者们都很匆忙。承诺的示范实验室超级智能(#IPO,#TrillionDollars).确实如此完全不公平暗示史蒂夫·耶格是个疯子上瘾早期采用者掌控着叙事。

  • 像我这样疯狂的早期用户正在掌控着叙事.
  • 你无法停止在新闻中看到相关报道;无处可逃。
  • 惊慌失措的CEO们正大力支持人工智能,常常将其强行引入他们的组织。
  • 公司就像资本主义的榨取机器,根本不知道如何放松。
—— 史蒂夫·耶格 载人工智能吸血鬼

哇,这家伙真懂行。

从煤气镇到黑暗工厂

我觉得《煤气镇》奇怪的地方,正是我很高兴看到它的原因。它侦察前方,准备跟随趋势总结。要走到那一步,也许你得相信他们。我做不到。

结果被描述为吸血鬼般的.

表面上看,裁员机暗软件工厂的动机基于两个不容置疑的假设:

  1. 越快越好。
  2. 与经纪人合作的目标是工作只有和特工一起。

即使我相信这些,地面条件也不利于做好这件事。工程需要知道你到底想建造什么。

人为以及OpenAI出售了一台Recoff Machine的自动化劳动力自动化设备。他们推销的是,必须围绕他们独特的产品——前沿语言模型展开。

他们必须自恋地为该组成部分辩护,认为它是所有问题的解决方案,同时坚持不允许其他人管理该组成部分。

然后他们把这些限制交给我们部门,让他们做功课,帮他们确定细节。设计一个系统完全能动.官方的目标是我们当下所信的。劳动自动化“增强而非替代”。

我们还是需要你,因为你有“品味”。绝对不是裁员机器。一定要记录你所有的技能。问题是,这些糟糕的约束即使前提是诚实的。这看起来非常杂乱。

我会在最后附上一些关于组织的链接。

我很乐意讨论更技术上合理的自动化方式让我失业。只是它们不会方便地围绕模型实验室唯一的护城河展开。所以告诉我,是我在为自己的存在辩解,还是他们在为自己辩解?

你可以说我疯了,但我觉得耶格三年前就知道这件事,并且和我同时告诉他们。

三千年前,诺维格和乔姆斯基在火山上战斗时,我就在那里。——史蒂夫·耶格,编码代理的“Normsky”架构,潜空间播客,2023年12月

保罗·格雷厄姆曾编程

保罗·格雷厄姆过去写代码,现在他写的是如何赚取十亿美元.这很有共鸣。我以前也写过关于代码的内容。现在我写的是市场操纵。

我对Paul Graham开发软件立场的了解,都是他还在游戏里的时候才知道的。刚把Viaweb卖给雅虎,立志打造一个持久的Arc百年.抱怨管理层强迫我们产生天真且无知的愿景。

你知道的,程序员的事。

我提到这些是因为他现在也被引用了关于是否应该推动的话题一天要写5万行代码.明白,他不是在说pg那以前会推荐编码策略。他穿着他的风险投资家.

那不是可靠的消息来源。——卡迪·B

一位未具名的创业创始人向Y-Combinator基金创始人吹嘘。想想权力的动态。这并不是一场旨在传达他们开发过程完整图景的对话。仅从结构上看,这是自克劳德以后最不可靠的信息传递之一克劳德·香农.

这些轶事是选择性的报道关于选择性报道。在这种情况下,它强化了格雷厄姆的模型:创始人是推土机还有其他挡路的人。他也不会听到这些话,然后和平台团队坐下来讨论他们会做什么不同的事。

“嘿,我是保罗。上周你们CEO又推出了一个超大氛围,大家有什么看法吗?”不。

而如果我们要计分,我是在停电后的尸检中,符合这个描述。你认为创始人会同等地告诉风险投资人好消息和坏消息吗?不。他们还向风险投资承诺超级智能,记得吗?

靠近寻呼机就是现实。

过去关注保罗·格雷厄姆的人会记得,他是异常关注的代码越少越好这样他就能把它塞进脑海里.这些都是值得关心的好事。他有时会过度使用。

那么他会如何看待这项新建议呢?想法我们应该在不知道代码库内容的情况下尽可能快速地扩展代码库?你还记得我们在说谁吗?

他觉得Java太冗长,于是用Common Lisp编写了Viaweb。然后Common Lisp太冗长了,于是他做了Arc (fn比defun,公平)。然后他试图把它提炼得更深一些太美了并找到满足宇宙一起。

这家伙可不是个爱胀气的人。

那提示即代码假说呢?他会接受“废除代码”论者说英语是最终完美的编程语言的观点吗?

用冗长的表达方式来溺爱用户,试图模仿英语是错误的。COBOL因这个缺陷而臭名昭著。黑客会认为被要求写成将x加到y上,而不是z = x+y,这介于对他智力的侮辱和对上帝的罪过之间。—— 保罗·格雷厄姆,受欢迎

你可以说,他不喜欢噪音,也不喜欢垃圾邮件.无论他今天对代码有什么想法,他不必面对的,他的反应雌鸟必须看到LLM的输出足够尖锐,以至于引发了《商业内幕》的标题,给保罗·格雷厄姆发邮件时不要使用人工智能.

我们暂时搁置风险投资家的讨论,因为他们在这场闹剧中的位置太大,难以细细剖析。他们从事赌博生意,未经IRB批准对人类进行大规模实验。

今天的重点是,我们试图倾听那些有相关经验的人如何管理代码。投资者有许多未明说的理由会出现在这场对话中,但他们都不关心你的命运。

风险投资就像汽车销售员或官僚:他们的工作性质让他们变得很讨厌。—— 保罗·格雷厄姆,风险投资困境的统一理论, 2005.

是他说的,不是我的。

你只需要关注

我爱你们所有人感谢你在这段时间里穿梭。我不能让它太简单,那样会破坏乐趣。这里有一个快速但重要的元观点。

我会读一些东西.

当事情重要时,我喜欢知道发生了什么。我的阅读经常延伸到代码.你也可以读其他东西。著作例如。有关于如何管理代码,以及管理那些喜欢破坏你代码的组织的书籍。

我可以给你发一份清单。

当八卦密尔开始说话,我喜欢读实际说的话。

代替反朗读者

我已经搜遍了山丘,惊讶地说,我找不到任何连贯的建议让你停止阅读。相反,我看到的模式可能带来这种印象:

  • A感知需求停止读取代码,这样我们就能合并这5万个PR。
  • 有人正在制定一些长期战略最终不读代码。
  • 开发者观察到有阅读量不够继续,结果很糟糕。
  • 一大批淘金热受益者和经纪人粉丝对此表现得有些防备。

好吧,我们至少应该谈谈重点。

科技高管兼em-dash粉丝加布里埃尔·多蒂在以下讽刺中代表反读者发声后.他几乎把所有套路都集中在一个地方。我就逐行评测一下。

开始吧:

如果你是软件工程师,坚持工程师必须阅读每一行AI生成的代码,那你对AI的要求是你从未对自己的标准,而这种虚伪正在拖累你。你从未把人类编写的代码要求达到那个标准。

这并不算虚伪,有两个原因。

  1. 大型语言模型不是人。我们有充分理由以不同的方式评估它们。
  2. 在许多情况下,人类编写的代码是坚持阅读每一行的标准。

Linux 内核开发者是一个高度可信的软件工程团队的例子,他们在部分流程中采用大型语言模型,但仍需对所有代码进行人工审查。它们是不是伪君子感谢你这样做。

如果理解代码证明软件有效,我们会在代码审查后停止。我们没有。

确实如此,但并不完全支持这个结论。理解代码可能是必要的,但还不够。

我们甚至不信任写代码并理解代码的工程师告诉我们它可行。

我不会这样描述不信任但我明白你的观点。“信任但要核实”之类的。

一个高度信任的组织促进问题解决、质量和生产力。另见NUMMI实验、安东绳的寓言以及亚里士多德计划。

我们测试它,通过质量保证,并在生产环境中监控。

是的,这种事确实会发生。

代码从未证明软件有效。它的行为是。

我觉得这有点夸张,就像“事实在布丁里”一样。

更准确地说,我们有责任建立对编码的信心会乖的以及监测这种行为随时间的变化。我们通过分层的方法实现这一点,既有静态反馈,也有动态反馈。

静态反馈分析代码,动态反馈运行代码。

“所以我们现在都只是氛围编码员了?”氛围编码员信任经纪人。智能工程师构建了一个系统,使智能体无需被信任。

Nit:我不会归类任何作为氛围编码员,这也是一种活动。关键是你做什么,而不是你是谁。这就像我们可能认为自己在“编写脚本”一项任务,同时设计另一种任务。

所以理想情况下,即使是Vivide coding的人,也不一定“信任代理”。他们是在决定自己的任务风险较低,或者可以通过其他方式进行检查。

至于“代理工程师”,我现在并不认为这是最好的目标,甚至没有明确的路径。也许你会有好运。我们也有“软件工程师”的选择。你仍然可以使用代理。

“那并发、资金、授权呢?”我们建造了整类工具,因为人眼不够好。风险越高,验证应越强有力、更具对抗性。这些并非例外。他们是最好的例子之一。

再次强调,对于将问题框架说成我们的眼睛“不够好”,这点有点反驳。这强化了过时的安全观念,认为问题总是人,淡化了我们往往是解决方案的事实。

安全II思维对人类贡献持更乐观的态度。

这本来是吹毛求疵的吹毛求疵,但同样的认知偏见正是论点的核心。另见《自动化的讽刺》。

你知道谁讨厌写成千上万个测试,从各个方向攻击同一个假设吗?人类。

确实如此。

人工智能不仅改变了编写代码的经济学。它改变了核实的经济方式。

怎么改的?这是不是意味着验证变得更容易了?

编码代理的推广方式臭名昭著这让验证变得更难。因此有一百篇题为“的评论文章,验证是新的瓶颈”.这不仅仅是因为编码代理,因为技术本身并不做决策。

这一切都是由AI淘金热的激励推动的。

如果我们想谈什么可以发生了什么,而不是发生了什么是正在发生。是的,情况可以好得多。很可能有一部分组织取得了这些更好的结果,尽管许多组织夸大其词,只向公众传达好消息。

为了提高成功率,我鼓励对怀疑者更加认真对待,而非减少。

特工们会乐于以一种人类从未实际过的规模去做。端对端测试、单元测试、合同、线束和性能检查的构建和维护成本高昂。现在已经不是了。

我会把“从未实用”换成“很少被认为实用”。严格的自动化测试比人们普遍认为的要可行得多。这主要是因为没有为教练和培训制定预算。

不,我不是说让同一个代理写成千上万个自我一致的测试。这不是对抗性验证。

说得好,听起来我们应该重新审视一下没有为教练和培训做预算的错误。

关键是构建一个系统,能够在与代理能够生成代码的规模相当的范围内挑战代码。

目标是现在和未来都能创造商业价值。这个目标与代理目标——尽可能快速地扩展代码库——存在冲突。

因为如果一个代理一天能产生5万行变更,但“负责任的工程”要求人工检查全部5万行,那么代理本身就不是你的瓶颈。你是。

喜欢瓶颈思维。如果我们系统性地应用这个方法,通常会发现问题根本不需要5万行。

你的价值从来不是敲代码的能力。 这是你抽象思考、解决问题、在头脑中容纳极其复杂的系统、观察数千个部分如何相互作用、观察角落以及将所有复杂性转化为有效的东西的能力。 代码就是工件。 思维就是技能。 而且这项技能的作用显着增强。

很有诗意。

我认为,抽象思维会被形式符号放大,而不是受到阻碍。 因此,当我们寻找杠杆时,我们可能会判断哪些代码给我们带来了杠杆,哪些没有。 我们不能仓促得出代码与我们的杠杆无关的结论。

传统上,我们描述的代码使我们能够处于正确的位置 抽象层次.

然而,我们仍然坚持以人类书写、阅读和维护每一行为基础的实践,并称之为严谨。 其中一些实践的存在是因为我们的局限性,而不是因为它们是优秀软件的基本属性。

这是一种重新思考事物的姿态,但没有实际的主张。

在这些相同的约束范围内使用代理,并且您没有改变工程。 您刚刚聘请了一位速度非常快的初级开发人员。

代理人不是人。

这项工作并不是要了解每一行。 这是为了验证系统是否正常工作,并使用每一个为您提供证据证明系统正常工作的工具。 代理工程最困难的部分可能是接受代码从来都不是重点。

再说一遍,任何可信的软件工程师都认为我们认为代码是“重点”。

事实上,我发现过去三年来我们听到的大多数主张法学硕士是所有软件必然作者的论点都源于同样的错误观念,即认为代码就是重点。 他们强调代码生成的速度作为价值的代表。

PS:如果你花了整篇文章试图找出我的论点中的漏洞,那很好。 希望您能为您的代理带来同样的活力和怀疑精神。 这就是重点。 😊

是的,不是吗:)

Someone does not read the code, we move on

感谢您的阅读。 我们在我的播客中介绍了更多现代软件的谜语, 编码机构.

附录:

黑暗工厂被认为是有害的。

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论