与 Claude Code 团队核心成员的对话:内部 AI 编程实战与工程范式转变

与 Claude Code 团队核心成员的对话:内部 AI 编程实战与工程范式转变 图片 1

本月早些时候,我在 人工智能工程师世界博览会 与来自 Anthropic 的 Claude Code 团队的 Cat Wu 和 Thariq Shihipar 合作。 我们讨论了 Claude Code、Claude Tag、Fable、编码代理安全性、评估、工具设计以及 Anthropic 如何使用这些工具本身。

会议的完整视频现已发布 在 YouTube 上。下面是经过编辑的文字记录副本,其中包含额外的链接和我自己的粗体突出显示。

如果您不想观看视频或费力阅读整个文字记录,请注意一些顶级注释:

Claude Tag(Claude 的新协作 Slack 集成)现在占据了 Claude Code 团队 65% 的产品工程 PR。

Claude Code 首先向 Anthropic 员工提供功能,并且仅提供能够证明该群体用户保留的功能

对 Claude Code 的关键更改仍然是手动审核的,但团队越来越依赖于产品“外层”的自动代码审核。

对于 Fable 5 甚至 Opus 4.8 等模型来说,向系统提示添加示例不再是最佳实践。 Claude Code 系统提示符最近缩小了 80%。

同样,“不做 X 和不做 Y”的列表可能会降低最新模型的结果质量。狗粮 Anthropic内部称为“蚂蚁喂食”。

人类真的相信他们的 汽车时尚, 并将其视为 Claude Tag 的一项支持技术。

Thariq 建议抵消编码剂引起的 深蓝通过“更有野心”来对待你所承担的工作。

Fable擅长剪辑视频,Thariq也非常擅长用过剪辑自己的启动视频。

Anthropic 在公开场合(内部)工作的文化是他们成功的关键,这一点从他们在公共 Slack 频道中使用 Claude Tag 的方式可见一斑。

过去一年你日常的工作有什么变化?1:05 Simon:《Claude Code》是在去年二月发布的——它不到一年半,最初只是一个要点克劳德十四行诗3.7号发射.过去一年里,随着我们有了这些真正为我们工作的编码代理,你们日常的工作发生了哪些变化?

Cat:我记得我们刚推出Claude Code和Sonnet 3.7时,你会给它一个任务,并且必须密切监控它尝试做的每一个细节。 我会非常仔细地阅读每一个许可提示。我经常说没有——不,不,你查过这个档案吗? 你查过那个档案了吗?现在每一代车型都非常出色。 我觉得我们都有机会退一步,把更多琐碎的实现工作交给了Claude。 这让我们腾出了很多时间去思考更有创意的工作,比如:既然我们知道Claude Code可以实现很多,我们应该为用户提供什么样的正确体验? 而现在《Fable》则是完全不同的步骤变化。 我们发现很多用例中,现在用Fable可以一次性完成大量功能。

Thariq:我记得我收到的第一条关于Claude Code的短信。我最好的朋友之一说,“你得去试试Claude Code。”那时正好是《Opus 4》发布的时候,我试了一下,心想,“天哪。 我现在得去Anthropic工作了。 ”那就是Opus 4——很棒的模型,但你是在读权限提示。 我们现在的失忆感真是太疯狂了,我会想,哦,自动模式一直都在,对吧? 我甚至不记得有按过“是”和“允许”。 对我来说,我一直努力推动自己的最大目标是,我们必须做出比以往任何时候都更高质量的工作。 输出质量极高。我用它剪辑了很多视频,我心想,好吧,它必须在几个小时内满足我们品牌团队非常严格的要求, 否则我们根本做不到。这就是我用《Fable》想要转变的方式:我们做过的最棒的作品, 比以往任何时候都快。

传统软件工程中哪些部分不再适用?3:39 Simon:有没有一年前仍然适用的传统软件工程,你认为在这个新世界中不再适用?

Cat:我们在工程技能方面看到的最大变化之一:两年前,产品经理通常会去和一群客户交流, 在六个月内与跨职能团队协调一些PRD,并在写出第一行代码之前,详细说明我们将如何实现这些内容。 现在情况完全相反了。对很多工程师来说,我会建议大家多培养商业和产品意识, 明确我们应该做什么,因为从有想法到实现的时间短得多——从六个月缩短到十二个月, 甚至一周。这意味着我们所有人都需要更有品味,去判断什么值得打造,什么能真正影响我们所经营的业务。 所以,这在大多数产品领域中,是对产品品味和商业意识价值的提升,而执行力则略低一些。 当然,对于基础设施来说,仍然非常重视确保所有细节都正确。

Thariq:对我来说,现在重写变得好了。

西蒙:你能做的最糟糕的事现在其实没事了!

塔里克:没错。所有神话般的“男人月”内容——永远不要重写——我现在支持重写。 如果你有一个好的测试套件——我认为重写实际上迫使你确保有一个好的测试套件——但我认为人们低估的是, 代码库是一个规范,也许它是你唯一拥有的规范副本,因为没人知道代码库的每一个分支部分。 你可以把它当作一个文物,提炼出来,或者创造出其他版本。 我们重写了《Bun in Rust》效果很好——现在我正在直播。

Simon:你还没把Claude Code配给Bun-in-Rust吧?

塔里克:内部是有的。

(实际上看起来Anthropic已经开始向所有人发售Bun-in-Rust的Claude代码了6月17日.)

非工程师用Claude Tag做什么?6:36 Simon:最近另一个重大发布是克洛德·塔格——至少对我们其他人来说,已经是一整周大了。我知道在Anthropic,非工程师用得很多。非工程师用Claude Tag做什么?

Cat:Claude Tag 是你团队协作工具中的一个 Claude。我们上周在Slack上发布了它。 《Claude Tag》的不同之处在于它默认支持多人游戏。 一旦你把Claude Tag加入Slack频道,你就可以参与讨论,你的队友也能参与,大家可以一起合作写PR。 另一个重要区别是它是主动而非被动。你可以告诉Claude Tag:“嘿,监控这个频道里的每个bug报告,发布一个修复PR,并标记最后触碰该代码部分的工程师”, 它会在整个频道生命周期内完成,而你不必手动标记。 第三个重大转变是我们已经增加了团队记忆进入了这里。 如果你告诉Claude Tag你的频道偏好,它会记住这些内容,用于后续的每一篇帖子。 如果你总是想让它调试停机,但不想调试警告,只需在频道里用自然语言告诉它, 它会帮你和团队成员记住。

在内部,我们认为克劳德·塔格是克劳德代码的进化。我们认为这是我们内部工作方式的巨大转变。Claude Tag目前为我们65%的产品工程公关负责。

Simon:是针对整个Anthropic,还是只针对Claude Code?

Cat:这只是针对我们的产品工程团队——我们内部版本的Claude Tag目前负责65%的产品公关。这是一个巨大的转变;这占我们公关的50%以上。 我们看到人们在Claude Code和Claude Tag之间分配工作的方式是:当你与代理互动迭代时,Claude代码仍然是处理最复杂任务的最佳场所。 但Claude Tag非常适合让它主动作用于你的......

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论