Danluu

RSS: https://danluu.com/atom.xml
Dan Luu 的技术博客,以数据驱动、深度研究和犀利的调试/性能分析文章著称。

编程代理用什么语言最好?

Dan Luu用GPT-5.6做zstd解码器和Pandoc两个任务的eval,发现"动态语言比静态语言更适合LLM"的说法在复杂任务上不成立。语言流行度与正确性、成本呈弱正相关,但单个eval不能得出强结论。
评论点赞收藏5 天前

编程语言如何影响 LLM 的 token 效率与正确性?

Dan Luu 对"动态语言比静态语言更省 LLM token"的流行说法做了实证反驳。他在 zstd 解码器和 Pandoc 两个真实任务上跑了自己的 eval,预注册了三个假设后再看结果。结论:动态语言在简单任务上确实 token 少,但任务变大后优势消失;语言流行度与 LLM 表现呈弱正相关;J 等冷门语言并不如宣传中好用。
评论点赞收藏6 天前

来自加拉帕戈斯群岛的 AI 编程笔记

Dan Luu 分享他在加拉帕戈斯群岛断网期间,使用 AI Agent 辅助编写博客附录的经历。他详细记录了 Agentic Loop 的实际运作过程,包括 AI 如何生成代码、处理错误以及最终完成写作。 这篇文章提供了关于 AI 编程工作流的一手实战经验,揭示了当前 Agent 在复杂任务中的真实能力与局限。对于关注 AI 工程落地和开发者效率的技术读者来说,具有极高的参考价值和讨论热度。
评论点赞收藏43 天前

可疑的不连续性

如果你在去年年底阅读过任何个人理财论坛,那么你很可能遇到过这样一位用户提出的问题: 他正拼命想在年底前亏掉钱。人们可以采用多种方法来实现这一目的; 其中一种常见的建议方案是买入预期到期时将归零的看跌期权,这样一来, 买方就有可能(很可能)蒙受损失。 人们之所以想方设法亏钱,原因之一在于……
评论点赞收藏49 天前

反驳“本质复杂度与偶然复杂度”:为什么程序员生产力仍有巨大提升空间

Dan Luu 重读 Fred Brooks 的《没有银弹》,指出其关于程序员生产力提升上限的论断已过时。 文章认为 Brooks 低估了现代工具链、实践及 AI 带来的效率飞跃。 作者通过日志解析和大规模数据查询等实际工作案例,证明当前开发中绝大部分仍是“偶然复杂度”,核心概念复杂度占比极小,反驳了 Brooks 的观点。
评论点赞收藏59 天前

封闭社交网络是必然趋势吗?

这是一段2010年关于社交网络未来的旧论坛讨论。主要观点是封闭平台虽因网络效应占优,但开放协议才是财富创造的关键。 一方认为Facebook将垄断社交,另一方反驳称这仅是人为稀缺。文章深入探讨了Google通过Android和开放API如何促进生产力,而非单纯追求广告利润。
评论点赞收藏103 天前

达利-克鲁格效应及其他被误读的流行科学迷思

作者逐一拆解了五个被广泛误读的流行科学概念,包括达利-克鲁格效应、收入与幸福的关系、 享乐适应、国际象棋记忆实验以及类型系统的实证证据。 文章指出大众传播往往夸大或扭曲原始研究的结论。 通过对比原始论文图表与通俗解读,揭示了数据被误读的具体机制,如坐标轴缩放导致的视觉误导或小样本偏差。作者呼吁读者直接查阅原始文献,而非依赖二手摘要。
评论点赞收藏107 天前

史蒂夫·鲍尔默是被低估的CEO

作者反驳微软在鲍尔默时期衰落的普遍叙事,认为其被低估。文章通过财务数据展示鲍尔默任内的营收与利润增长。 这挑战了纳德拉拯救微软的主流观点,提供不同视角。
评论点赞收藏114 天前

DeWitt条款与匿名基准测试市场

文章回顾了1983年威斯康星大学数据库基准测试中Oracle表现极差,导致拉里·埃里森试图解雇作者,进而催生了软件行业禁止公开基准测试的“DeWitt条款”。 作者提出建立匿名基准测试市场的构想,让付费用户资助测试,以解决当前主流商业数据库(如Oracle、Microsoft)禁止公开性能数据的问题。
评论点赞收藏117 天前

为什么高性能代码里,手写汇编比编译器内置函数更靠谱?

作者通过实测发现,在高性能代码中使用编译器内置函数(intrinsics)往往不如直接手写汇编可靠。 以 popcnt 指令为例,Clang 和 GCC 生成的代码存在未展开循环、寄存器依赖错误等陷阱,导致性能远低于预期。 经过手动展开循环、规避硬件假依赖bug,最终手写汇编版本比原始 intrinsics 快三倍,甚至超越了业界公认的优化表格查找方案。文章展示了编译器在微优化上的不可靠性,以及底层调试的工程细节。
评论点赞收藏121 天前

欺诈、垃圾信息和审核中的规模不经济

Dan Luu 通过分析 SD 卡购买信任度等案例,指出平台规模扩大后,欺诈、垃圾信息和审核成本反而上升。他认为大型平台因缺乏本地化信任和运营复杂性,导致单位成本增加。 文章深入探讨了规模不经济在电商和社交媒体中的表现,挑战了传统规模效应理论。
评论点赞收藏139 天前

为什么有些公司的工程博客写得很好?

Dan Luu 对比了 Cloudflare、Segment 等拥有优秀工程博客的公司与表现糟糕的公司,发现核心差异在于审批流程。 优秀博客通常由工程师主导,审批轻量且快速; 而糟糕的博客往往陷入繁琐的多部门合规审查,导致内容空洞。 文章指出大公司的自然倾向是规避风险,这抑制了工程师分享真实技术细节的热情。通过具体案例说明,高层支持简化流程对于产出吸引人才的高质量技术内容至关重要。
评论点赞收藏151 天前

CPU 分支预测技术详解:从流水线原理到现代预测算法

Dan Luu 整理了一份关于 CPU 分支预测技术的讲座笔记。文章从流水线原理出发,解释了分支预测为何能提升性能,并详细推导了不同预测算法的效果。内容涵盖了从静态预测到两比特饱和计数器,再到全局与局部历史预测(如 gshare)的演进过程。 文中通过具体的性能模型和 SPECint 基准测试数据,量化了每种算法的准确率和对指令周期的影响。对于想了解计算机体系结构底层优化、编译器行为以及硬件设计权衡的技术读者来说,这是一份极佳的学习资料。
评论点赞收藏153 天前

命令行参数数量的增长:1979年至今

Dan Luu 统计了从 1979 年至今常用 Unix 命令(如 ls、tar)的参数数量变化,发现选项数量随时间显著增加。文章指出,虽然这违背了 Doug McIlroy 提倡的“小即是美”的 Unix 哲学,但在现代硬件条件下,这种复杂性是不可避免的。 作者认为,Unix 哲学依赖早期小团队的一致性思维,无法适应大规模协作。相比之下,PowerShell 等传递结构化数据的工具能减少解析文本的麻烦。文章批评了那些主张回归极简设计的观点,认为这是忽视了历史演进和技术规模变化的结果。
评论点赞收藏163 天前

输入延迟:1977年至2017年的实测对比

作者用高速相机实测了从1977年到2017年多款电脑和手机的输入延迟。结果显示,许多现代电脑的响应速度甚至不如几十年前的老机器,而Apple设备依然保持极低延迟。 文章深入分析了造成这一现象的原因,包括现代操作系统的复杂调度、渲染管线中的多重缓冲以及显示器的刷新机制,揭示了技术进步并未带来感知上的流畅提升。
评论点赞收藏192 天前

FTC 在谷歌反垄断调查中的失误

Politico 公开了 FTC 十年前调查谷歌的内部备忘录。作者指出,主张结案的一方对科技行业缺乏基本理解。 这揭示了监管机构与技术现实之间的巨大认知鸿沟,为理解当前反垄断格局提供了重要历史视角。
评论点赞收藏234 天前

不怕显得愚蠢

Dan Luu 分享自己不在乎别人觉得自己蠢的心态,认为这让他能专注于解决问题而非维护形象。他提到这种心态在面试等场景中虽有劣势,但在技术探索中很有价值。 这种观点引发了关于职场表现与个人成长之间平衡的思考,适合喜欢深度反思的读者。
评论点赞收藏236 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。