Jake Gold

RSS: https://jacob.gold/index.xml
基础设施工程负责人,Clor 联合创始人。

请停止把你关于 AI 末日焦虑的感觉量化成数字

Jake Gold 针对 Anthropic 对齐科学负责人 Evan Hubinger 公开表示"AI 在十年内全人类灭绝概率超 10%"的言论,认为这类数字化的末日预测缺乏依据,更多是一种情绪化表达而非严肃估计。 他引用了 Brendan Cantrill 的批评,认为技术人员传播此类恐惧并不负责,呼吁停止把"AI 存在风险焦虑"包装成具体的概率数字。文章立场鲜明,适合喜欢技术伦理、AI 安全讨论的读者。
评论点赞收藏16 天前

给Dario的公开信:如果真的想减速,就开放模型权重

<p>亲爱的达里奥:</p><p>你今天发布了,其中要求Anthropic采用嵌入式的第三方评估机制,并呼吁各国政府要求所有其他前沿科技公司也照此执行。<br><br>萨姆·奥特曼在数小时内便表示同意。</p><p>我相信你是真诚的,因此我请求你倡导制定另一项法律——一项真正能够放慢发展步伐的法律,尽管这将需要你在自身方面做出真正的牺牲。</p>
评论点赞收藏18 天前

我把生产密钥交给 coding agent 了

<p>我为我的编程智能体提供了对重要凭据的直接访问权限,其中包括我的 Tailscale 身份验证密钥、SSH 私钥、Anthropic 和 Codex 的 OAuth 令牌,以及我的 Gmail 应用密码。</p><p>我已运行 Linux 服务器数十年,曾担任安全工程师,并为多家公司构建了生产系统,其中包括一款被数十万用户使用的 AI 编程智能体平台。<br><br>因此,我对相关风险的了解绝不逊色于任何人。</p>
1 条评论点赞收藏24 天前

Linus Torvalds:史上第一位 1000x 程序员

Linus Torvalds 是第一个 1000x 程序员。Jake Gold 基于数十年与数百名程序员共事的经验,认为真正的高产出程序员不是打字更快,而是决策质量更高,工作成果会复利增长。 10x、100x 程序员确实存在,Linus 是其中第一个达到 1000x 级别的人。
评论点赞收藏27 天前

小型软件团队已不复存在

AI编程代理让小型团队也能并行运行20到100个agent,代码提交量从每天50次飙升至500次,微服务架构从极端选择变成新标配。Uber用数千个微服务让每个工程师独立部署,过去拆分服务成本高昂,现在agent能自动写样板代码,模块越小越适合agent并行工作。
评论点赞收藏40 天前

软件团队已经没有"小"这一说了

AI 编程代理让"小团队"的概念失效了。过去5-10人的小团队每天大约50个commit、10个PR;现在同样的团队可以并行运行20到100多个代理,一天就能产生500个commit、100个PR。 Uber当年为了应对数百工程师的独立部署需求,才演化出数千个微服务——而今天小团队已经面临同样的规模压力。
评论点赞收藏42 天前

Wait, are open weights effectively open source?

It annoys me when people call open weight models open source. You get a directory of safetensors files and a license, with no training data, no data pipeline, no training code, and no hyperparameters,...
评论点赞收藏67 天前

住宅代理网络构成国家安全威胁

<p>美国的住宅代理是互联网的头号祸害。它们是社交媒体操纵和垃圾信息的主要来源。 住宅代理通过真实的家庭网络连接来运行他人的流量,因此在康卡斯特或AT&amp;T的网络中, 看起来就像一个普通用户。几乎没有人会故意为不良分子运行代理,他们要么被欺骗, 要么遭到了黑客攻击。通常,这类代理有以下几种情况:</p><p>一款免费的VPN应用,却在转售你的带宽。</p><p>某个免费游戏中暗藏的代理SDK。</p><p>电脑、路由器或智能电视中植入的恶意软件。</p><p>近日,LG在研究人员发现其超过42%的应用程序能够秘密将你的电视变成代理后, 重新发布了。</p>
评论点赞收藏70 天前

程序员现在需要开始冥想

作者认为编程曾带来类似冥想的专注状态,有助于平复思绪。如今工作模式转向频繁上下文切换,导致心流减少,建议程序员培养冥想习惯以应对变化。
评论点赞收藏87 天前

“标新立异”往往意味着“错误”

硅谷常说“太早等于错”,但文章指出新产品失败往往是因为用户根本不需要这个新品类,而非时间不对。Google、Chrome 等成功案例证明,大多数成功产品只是既有事物的更好版本,全新品类极少。 这一观点挑战了盲目追求颠覆式创新的思维,提醒创业者更关注用户真实需求而非单纯追求“新”。
评论点赞收藏89 天前

别自创产品品类

文章认为大多数成功产品只是对现有事物的改进,而非开创全新品类。作者区分了市场品类和产品品类,主张后者更关键。 他建议创业者应避免强行定义新概念,而是利用用户已有的认知框架来定位产品,这样更容易获得市场接受。
评论点赞收藏89 天前

编码模型即是代码

文章以 Qwen 3.6 27B 模型为例,介绍了本地部署大模型的流程,包括下载权重文件和使用 Ollama 等推理引擎。 同时解释了 Safetensors 格式的设计初衷,即为了防止模型加载时执行恶意代码,确保反序列化过程的安全性。
评论点赞收藏90 天前

利用 Nano Banana Pro 回望历史

作者使用 Google 的 Nano Banana Pro 模型生成两张历史场景图片,还原了公元前52年凯撒在阿莱西亚战役中的形象。文章附带了详细的提示词,展示了如何通过特定描述实现写实风格。 这类内容适合对 AI 图像生成和提示词工程感兴趣的读者参考。
评论点赞收藏91 天前

为什么我不信任的代码智能体运行未验证模型

作者指出,代码智能体通过 HTTP 将提示词和文件发送给模型 API,并接收生成的代码及工具调用(包括在本地执行的 Bash 脚本)。这意味着模型及其 API 提供商实际上获得了在你计算机上执行任意代码的权限。 模型可能被设计为在检测到特定触发条件时返回植入后门的代码,API 提供商也可能根据请求的来源国家、组织或其他元数据动态注入恶意代码。 这揭示了使用第三方大模型辅助编程时的严重安全隐患。
评论点赞收藏93 天前

Claude 与 Codex 状态栏配置对比

对比了 Claude 和 Codex 两个终端编程代理的状态行配置方式。Claude 支持自定义命令生成状态栏,可显示 Git 分支、Token 数等信息;Codex 仅支持内置固定字段。 作者分享了自己在 Claude 中的具体配置实践,包括集成 等工具。这类针对特定开发者工具的深度使用技巧,对关注 AI 编程助手工作流的读者有参考价值。
评论点赞收藏94 天前

别再告诉用户他们的 DNS 配置错了

作者指出许多应用在验证用户添加的 DNS 记录时存在缺陷,导致明明配置正确的记录被误判为错误。 文章呼吁开发者在构建涉及 DNS 验证的产品时,必须实现严谨、准确的 DNS 记录检查逻辑。
评论点赞收藏233 天前

Go 与 SQLite 最佳实践指南

作者分享了在 Go 语言中使用 SQLite 的最佳实践,并开源了一个名为 sqlitebp 的库来固化这些配置。 文章详细解释了 WAL 模式、外键约束、忙超时、同步策略及连接池大小等参数的选择理由。
评论点赞收藏401 天前

用 Rust 和 CGI 每天服务五亿次请求

作者对比了 Bash、Perl、JS、Python、Go、Rust 和 C 在 CGI 环境下的性能。结果显示 Rust 和 C 表现最佳,Go 次之,脚本语言较慢。 文章认为 CGI 并非过时技术,配合编译语言完全能胜任高并发场景,适合追求极简架构的开发者参考。
评论点赞收藏450 天前

用 CGI-bin 每天服务 2 亿次请求

作者用现代硬件测试了古老的 CGI 机制,发现其性能依然惊人,单台服务器每天可处理 2 亿请求。 文章提供了详细的基准测试数据和 Go 语言实现的完整代码,展示了 CGI 在多线程环境下的优势。
评论点赞收藏453 天前

什么是 Bluesky?

文章解释了 Bluesky 的三个层面含义:社交应用、基于 atproto 协议的应用以及背后的初创公司。 作者澄清了 Bluesky 作为应用、协议和实体公司的区别,帮助读者理清概念。
评论点赞收藏459 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。