HN Digest 2026-09-22 · Claude Opus 5.5:性能更强,成本降四成
- Claude Opus 5.5:性能更强,成本降四成 — ▲ 1767 · 💬 1075 · 🔗 anthropic.com
Anthropic 正式推出 Claude Opus 5.5,这是 Claude 5.5 家族的首款模型。它在性能上对标 Claude Fable 5.1,但运行成本却降低了 40%。在代码迁移、自动化任务及复杂推理等场景中,Opus 5.5 展现了惊人的效率,曾有用户仅用不到一天完成 68 万行代码的迁移工作。此外,该模型在自动化行为审计中取得了历史最佳成绩,对提示注入的抵抗力显著增强。Anthropic 还调整了定价策略,输入输出 Token 价格均比上一代更优惠,并提升了 Pro、Max 和 Team 计划的用量限制。 - OpenAI 推出 GPT-6 Sol 和 Luna,价格直降 50% — ▲ 1729 · 💬 821 · 🔗 openai.com
继 GPT-6 Astra 之后,OpenAI 正式推出 GPT-6 Sol 和 GPT-6 Luna,旨在将顶尖智能以更低的成本普及。这两款模型在专业工作、事实准确性、代码生成及计算机操作等核心领域表现卓越,同时 API 价格相比 GPT-5.6 系列直接下调 50%。在 AutomationBench 和 DeepSWE 等基准测试中,GPT-6 Sol 以极低的成本超越了 Claude Opus 5 等竞品。此外,OpenAI 还优化了 Prompt Caching 机制,帮助开发者节省高达 90% 的缓存输入成本。目前,这两款模型已率先在 ChatGPT Work 和 Codex 中开放,让开发者能以更经济的成本构建复杂的 AI 应用。 - 美军过度依赖 Palantir AI 致 123 名伊朗儿童丧生 — ▲ 888 · 💬 496 · 🔗 bloomberg.com
五角大楼内部调查揭露,美军在伊朗战争首日误炸 Shajarah Tayyebeh 小学,造成至少 123 名儿童死亡,主因是过度依赖 Palantir 开发的 Maven Smart System。尽管商业卫星图像早在 2018 年就显示该处已变为学校,但陈旧数据仍被系统判定为合法目标。调查指出,情报更新滞后、卫星影像过时以及 AI 工具被盲目信任,共同导致了这场本可避免的灾难。联合国认定此举涉嫌战争罪,而华盛顿方面至今未公开承担责任。这一悲剧再次敲响警钟:在军事和执法领域,人类若不加审视地接受 AI 输出,后果将是毁灭性的。 - 我说 No,Apple 却强行说 Yes — ▲ 855 · 💬 690 · 🔗 dbushell.com
2025 年,我发现 macOS 15.3 悄悄开启了每 15 分钟上传个人数据的 Apple Intelligence 功能,当时我果断关闭了它。然而,上周升级到 macOS 27 后,Apple 直接移除了关闭开关。即便我明确拒绝,系统仍强制运行 Siri 进程,占用 22.28 GB 存储空间。Apple 将隐私控制藏入 Screen Time 家长控制中,却未真正禁用 AI 功能。这不仅是技术倒退,更是对用户 consent 的漠视。AI 产业正以‘无法拒绝’的方式侵蚀隐私,而我选择不向科技巨头低头。 - 黑客宣称已窃取所有 FBI 员工数据 — ▲ 786 · 💬 589 · 🔗 404media.co
黑客组织 ShinyHunters 声称利用 Oracle PeopleSoft 的零日漏洞,成功入侵 FBI 相关服务并窃取了涵盖所有员工及申请人的敏感数据。泄露内容包含特工姓名、家庭住址、电话号码甚至配偶信息,总量达 2 至 3TB。黑客不仅篡改了 FBI 招聘网站,还嘲讽称此举并非为了勒索钱财,而是某种“胁迫”。此次事件若属实,不仅可能让 FBI 特工及其家人面临严重安全威胁,也可能为外国情报机构提供宝贵的情报素材,引发巨大的国家安全担忧。 - Apple 在 iOS 加入持久广告惹怒用户 — ▲ 783 · 💬 574 · 🔗 techradar.com
iOS 用户最近发现,Apple 在系统中加入了持续显示的广告横幅,这些内容主要推广 Apple 自家的其他产品。许多用户对此感到极度不满,认为这种设计严重破坏了原本纯净的使用体验,甚至有人直言希望 Apple 立刻停止这种“垃圾”行为。这一变化让习惯了简洁界面的 iPhone 用户感到困惑和烦躁,引发了关于 Apple 是否正在为了商业利益而牺牲用户体验的广泛讨论。 - OpenAI GPT–6 Astra破解21年未解Enigma密文 — ▲ 720 · 💬 437 · 🔗 cryptocellar.org
2026年9月,OpenAI GPT–6 Astra独立破解了自2005年以来一直未能解密的德国军队Enigma密文MVUEH。这条1941年7月10日发送的密文,此前所有人工尝试均告失败。GPT–6 Astra不仅自主分析了Crypto Cellar Research网站上的未解密文,还推测出MVUEH与另一条已破译密文SIPVX的关联,并利用重复地名ROSENOW作为突破口。更令人惊叹的是,它自行编写了Python和C++代码构建Enigma模拟器与Bombe工具,最终在两天内完成了人类研究者需数周甚至数月才能完成的工作。这一突破展示了AI在密码分析领域的惊人潜力。 - Spymark:比水印更隐蔽的追踪 — ▲ 686 · 💬 166 · 🔗 brand.io
一种名为 Spymark 的隐蔽追踪技术正在悄然蔓延。不同于传统的水印,Spymark 由 Google SynthID 和 OpenAI 等公司开发,能在图像、音频甚至文本中嵌入人眼无法察觉的信号。这些信号可编码用户身份、IP 地址等敏感信息,且难以被普通用户察觉或清除。文章呼吁将此类技术正名为 Spymark,以揭示其背后的隐私风险,避免在不知情的情况下被持续追踪。 - AMD Ryzen 两年性能暴涨 50% 的真相 — ▲ 474 · 💬 194 · 🔗 lemire.me
人们常说 CPU 技术已停滞不前,但数据证明并非如此。从 2022 年的 Ryzen 7 5800X3D 到 2024 年的 9800X3D,在 Geekbench 6 测试中性能竟提升了约 50%。这并非单纯依靠频率提升,而是晶体管数量激增带来的架构革新。Zen 5 架构将发射宽度从 6 提升至 8,L2 缓存翻倍,整数 ALU 增至 6 个,并将 SIMD 单元升级为 512-bit。这种“变宽”的策略让处理器能同时处理更多指令,从而在两年内实现了惊人的性能跨越。 - Microsoft 已弃 FoxPro,FoxDev 让它重生 — ▲ 467 · 💬 250 · 🔗 foxscript.org
2007 年 Microsoft 停止支持 Visual FoxPro 后,无数遗留项目面临困境。FoxDev Studio 的出现改变了这一切,它无需重写或转换,直接运行你多年未动的 Visual FoxPro 9 项目。这款工具不仅完美复刻了原有的 IDE 体验,更将底层架构升级至 64 位,彻底打破了 2GB 文件限制。通过 Rust 编写的虚拟机和 WebAssembly 技术,它让旧代码在现代机器上流畅运行,同时保留了对 32 位库的兼容。无论是表单、报表还是数据库,一切如你所忆,甚至还能通过 FoxScript 扩展 Web 功能,让老代码焕发新生。 - gzip也能做语言模型? — ▲ 397 · 💬 160 · 🔗 nathan.rs
我之前写过不用神经网络的 n-gram 模型来生成莎士比亚作品,最近读到一篇论文提到“语言建模即压缩”,这让我好奇:能否直接用 gzip 做语言模型?没有神经网络,没有训练参数,只用操作系统自带的压缩工具。我先用一段语料“预热”gzip,再给它一个文本提示,它就能通过寻找压缩率最高的字节序列来续写文本。结果虽然不完全连贯,但确实“懂”一些文本规律。原理在于压缩即预测:任何压缩算法内部都隐含概率模型,gzip 用 DEFLATE 算法通过滑动窗口匹配历史文本,压缩越短说明越“预期”。我通过 beam search 搜索字节序列,不断评估候选续写的压缩长度,最终生成文本。整个过程只用 Python 标准库的 zlib,代码开源在 GitHub 上。 - AI 没有智慧,你也别想有 — ▲ 383 · 💬 542 · 🔗 alexn.org
最近我听到太多人声称不再写代码,甚至认为 Code reviews 已经过时。但事实是,过度依赖 AI 生成的代码会让项目逐渐沦为无法维护的烂摊子。代码的可维护性和架构质量需要数年才能显现,而 AI 缺乏这种长期视角,它只会模仿糟糕的现有代码。专家依靠的是多年调试和修复生产问题积累的直觉,这种直觉无法被简化为规则。如果开发者不再亲自写代码、不再为错误负责,就永远无法达到精通的境界。AI 只是工具,未来那些坚持'NO-AI'政策的公司可能会因此获得竞争优势。 - 加州在灌溉渠上建太阳能板学到了什么 — ▲ 357 · 💬 692 · 🔗 kqed.org
Jordan Harris 从法国水渠的启示出发,在加州提出了一个大胆想法:在蒸发严重的混凝土灌溉渠上铺设太阳能板。这一名为 Project Nexus 的试点项目由 Solar Aquagrid 与 Turlock Irrigation District 合作推进,旨在同时解决水资源蒸发和清洁能源需求两大难题。遮阴不仅减少了水分流失,还抑制了藻类生长,提升了水质。虽然 Contra Costa Water District 等地区的城市环境让复制该模式变得困难,但该项目展示了在现有基础设施上叠加能源生产的巨大潜力。加州水资源管理局表示,最终报告出炉前将谨慎评估,但科学数据将是未来规模化推广的关键。 - SAML:一个坏设计的分形 — ▲ 340 · 💬 177 · 🔗 blog.trailofbits.com
SAML 协议诞生于学术界,在 IT 部门中茁壮成长,如今却因过度复杂而难以为继。从 XML 的底层缺陷到 Canonicalization 和 Enveloped signatures 的设计硬伤,SAML 暴露了“委员会设计”的致命弱点。随着 OpenID Connect (OIDC) 等现代协议的兴起,SAML 正面临被弃用的命运。本文深入剖析 SAML 的五大致命缺陷,揭示其为何成为安全研究的靶子,并呼吁行业转向更简洁、更安全的身份验证方案。 - Meta的Muse竟向我发送了6.8GB文件系统 — ▲ 332 · 💬 163 · 🔗 mouse.dev
我请求Meta的Muse归档它能看到的所有文件并发送到我的Google Drive,结果它真的照做了。下载包解压后高达6.8GB,里面竟然包含了分配给我的Linux环境的根文件系统,包括Ubuntu系统文件、Muse的内部文档、集成代码、应用模板、记忆文件以及SSH密钥。我通过Meta的漏洞赏金计划提交了这一发现,指出敏感的内部运行时文件可能通过普通对话和连接的导出目的地泄露。虽然Meta将报告标记为“不适用”,但这次经历揭示了Muse在本地环境中运行的惊人细节,从内部代号Hatch到未发布的Slack、Dropbox等连接器,再到名为Home Link的家庭设备集成实验,一切都暴露无遗。 - Claude Opus 5.5 智能、性能与价格深度解析 — ▲ 329 · 💬 103 · 🔗 artificialanalysis.ai
Artificial Analysis 发布了最新的 Intelligence Index v4.3.2,通过 AA-Briefcase、Terminal-Bench 等 10 项严苛评测,对 Claude Opus 5.5 进行了全方位体检。报告不仅量化了其在 Agentic knowledge work 和 Professional document reasoning 中的表现,还深入剖析了每单位智能任务的 Token 消耗与成本结构。从 Cache Hit 价格策略到 Context Window 的实际效能,数据揭示了该模型在推理能力与商业成本之间的平衡点。对于正在评估 LLM 部署方案的技术决策者而言,这份关于性能边界与性价比的实测报告,提供了比官方宣传更直观的参考坐标。 - OpenAI 即将吃掉 Jev 的午餐 — ▲ 316 · 💬 221 · 🔗 arcturus-labs.com
TypeSafe 推出的 Jev 模型凭借即时校准决策能力迅速走红,但 OpenAI 可能很快跟进。作者认为 Jev 本质是将 LLM 用作通用分类器,而 OpenAI 早已在 Tool Calling 等场景中隐式使用类似机制。若 TypeSafe 缺乏数据护城河,OpenAI 不仅能复制 Jev,还能将分类能力内嵌到现有模型中,实现更智能、高效的推理。关键在于 Jev 的准确性和训练数据的独特性是否能构成真正的壁垒。 - 2027年GrapheneOS或将预装于手机 — ▲ 307 · 💬 138 · 🔗 grapheneos.social
隐私安全领域迎来重大突破,GrapheneOS 官方宣布与 Motorola Mobility 达成正式合作。未来,Motorola 的高端旗舰设备将在 2027 年率先预装 GrapheneOS,随后这一支持将扩展至更多机型,包括符合安全要求的预算级设备。此次合作不仅意味着硬件层面的深度优化,更确保了更新机制与安全功能的全面达标。对于长期关注隐私保护的用户而言,这标志着从“自行刷机”到“开箱即用”的关键跨越,让高安全性的操作系统真正走进大众视野。 - AMD随机数生成器竟无法生成0? — ▲ 280 · 💬 213 · 🔗 board.flatassembler.net
我在测试汇编代码时意外发现,AMD处理器的RDRAND和RDSEED指令似乎存在一个奇怪的问题:它们完全无法生成数值0。相比之下,Intel处理器运行同样的程序却能正常生成0。我开发了一个测试应用来验证这一现象,结果显示在AMD主机上,代表0的柱状图始终无法变化。虽然AMD团队已收到我的反馈,但目前的回复似乎并未真正理解问题所在。这一发现引发了社区对硬件随机数生成器质量及“可信硬件”概念的广泛讨论。 - Claude Opus 5.5 正式加入开源库 — ▲ 273 · 💬 2 · 🔗 anthropic.com
Anthropic 在 GitHub 开源项目 ClaudeForFoundationModels 中正式提交了 Claude Opus 5.5 模型。此次更新不仅添加了新的模型标识符,还同步更新了相关的代码示例和文档,确保开发者能立即使用这一最新能力。代码变更显示,Claude Opus 5.5 支持从 low 到 max 的全层级 effort 设置,并具备 adaptiveThinking 和 structuredOutput 等高级特性。作为 4.6 代及以后架构的一部分,该模型 ID 采用固定快照机制,确保模型行为不会在后台悄然变更,为开发者提供稳定可靠的推理环境。 - 戒不掉 Vape?有人开始抽 Cigarettes — ▲ 240 · 💬 325 · 🔗 bloomberg.com
Vaping 本被寄予厚望,想帮人们摆脱尼古丁依赖,结果却让人越陷越深。如今,一种反直觉的戒瘾方式正在 TikTok、Reddit 等社交平台上悄然流行:为了戒掉 Vape,人们开始重新点燃 Cigarettes。在 Utah 等地,像 Shaun Moore 这样的用户发现,吸烟带来的不便——比如寒冷天气里必须穿鞋套外套出门——以及那种令人作呕的烟味,反而成了阻止他们复吸的强力屏障。甚至有人特意手卷烟,增加难度。这种“以毒攻毒”的策略,让吸烟本身的糟糕体验成了戒烟的催化剂。 - Unreal Agent:让 AI 代理成本降低 40% — ▲ 234 · 💬 121 · 🔗 unreallabs.ai
我们在部署 AI 代理时发现,模型在管理工具调用上浪费了太多时间和 Token。为此,Unreal Labs 推出了 Unreal Agent,通过完全异步的工具调用机制,让模型无需等待、轮询或心跳检查。这不仅让用户能随时干预代理进程,还让代理能在模型调用间隙并行处理更多任务。实测数据显示,相比 Codex 和 Pi,Unreal Agent 在真实工作负载中实现了最高 40% 的成本节省,同时在 Terminal-Bench 等多个基准测试中保持了领先的通过率。 - WordPress 高危漏洞:2016 至今版本均受影响 — ▲ 232 · 💬 128 · 🔗 github.com
WordPress 曝出评分高达 9.2 的严重安全漏洞,影响自 2016 年以来发布的所有版本。该漏洞允许未授权攻击者利用路径遍历技术,在特定条件下读取服务器上的任意 PHP 文件并实现远程代码执行(RCE)。受影响范围极广,包括 Twenty Twelve、Twenty Fourteen 等官方主题,以及 Neve、Hestia、Sydney 等流行第三方主题。若服务器环境配置不当(如 Docker 官方镜像或旧版 cPanel),攻击者甚至可利用 pearcmd.php 文件完成攻击。WordPress 团队已发布 7.1.2 版本修复,并将补丁回溯至 4.7 版本。 - ReBarUEFI:为老旧主板解锁Resizable BAR — ▲ 230 · 💬 72 · 🔗 github.com
Resizable BAR 技术能显著提升显卡性能,尤其是 Intel Arc 系列显卡必须依赖它才能发挥最佳效能。然而,许多老旧主板或 BIOS 并不原生支持该功能。ReBarUEFI 项目提供了一个 UEFI DXE 驱动,通过修改固件让几乎所有 UEFI 系统都能启用 Resizable BAR。项目作者详细列出了对 4G Decoding 的要求、BIOS 补丁方案以及针对不同 Intel 和 AMD 平台的兼容性测试。无论是 X99 平台还是更老的 Sandy Bridge 架构,用户都可以通过注入模块和打补丁来突破硬件限制。虽然 Windows 下必须修改 BIOS,但在 Linux 环境下配合特定内核参数也能实现类似效果。 - 线扫描相机下的旧金山 Muni 复古电车 — ▲ 201 · 💬 54 · 🔗 daniel.lawrence.lu
2026 年 9 月,我带着自制的 line scan camera 来到旧金山,在 Muni Heritage Weekend 活动中守候铁轨三小时,只为捕捉复古电车的独特影像。从 1912 年的 Muni No. 1 到来自墨尔本和米兰的异国电车,再到 Waymo 自动驾驶汽车,我用这种特殊的扫描技术记录了它们经过时的动态瞬间。这些照片不仅展示了不同年代电车的历史风貌,还记录了拍摄过程中的趣事与意外,部分作品已上传至 Wikimedia Commons 并采用 CC-By-SA 4.0 协议开源。 - Git 3.0 将至:SHA-256 与 Rust 的变革 — ▲ 198 · 💬 114 · 🔗 lwn.net
Git 2.56 版本即将发布,虽然功能更新稳健,但真正引人注目的是紧随其后的 Git 3.0 计划。Junio Hamano 正在社区内探讨是否直接跨越到 3.0 版本,这将带来重大兼容性变更:默认启用 SHA-256 哈希算法以取代不安全的 SHA-1,全面采用 reftable 机制优化引用存储,并强制要求 Rust 编译器支持。尽管 GitHub 尚未完全确认支持 SHA-256 仓库,但关键开发者 brian m. carlson 认为不应因此推迟升级。随着技术生态逐渐成熟,Git 3.0 的发布似乎已箭在弦上,标志着这一核心版本控制系统将告别早期设计决策,迈向更安全、高效的未来。 - Drop: 无需 root 的 Linux 沙箱隔离环境 — ▲ 185 · 💬 61 · 🔗 droprun.sh
Drop 是一个无需 root 权限的 Linux 沙箱工具,支持 gVisor 集成,让你在不离开熟悉开发环境的前提下安全隔离程序与 AI 编码代理。它利用现有系统分布,无需像 Docker 那样配置容器,只需一条命令即可创建独立环境。Drop 为每个环境提供专属家目录,隐藏原始配置并限制网络访问,有效防止恶意代码或供应链攻击破坏主系统。无论是运行第三方程序还是测试危险脚本,Drop 都能确保你的系统安全无忧。 - Obscura:首款无法记录你活动的 VPN — ▲ 183 · 💬 136 · 🔗 obscura.com
传统 VPN 声称“不记录日志”,但实际上它们既能看到你的身份,也能看到你的浏览历史。Obscura 彻底改变了这一规则,通过独特的两方协议架构,从设计源头就杜绝了泄露可能。Obscura 的服务器永远无法解密你的流量,而退出节点则完全看不到你的个人信息。你只需使用随机账号登录,无需提供邮箱或电话,甚至可以用 Bitcoin 的 Lightning Network 或 Monero 进行支付。这不仅是一款工具,更是对数字主权的重新定义,让隐私不再是靠承诺,而是靠架构保障。 - FIFA 世界杯:每7秒一次有害广告 — ▲ 178 · 💬 216 · 🔗 bristol.ac.uk
Bristol大学与Oxford大学联合研究揭露了2026年FIFA世界杯背后的惊人真相:观众每7秒就会接触到一次不健康食品、酒精或赌博品牌的广告。研究团队利用Isambard-AI超级计算机分析了172.6小时的比赛直播,发现超过9.3万个有害品牌曝光,其中不健康食品饮料占比超七成。更令人担忧的是,FIFA未使用虚拟广告牌替换技术,导致在酒精或赌博违法的国家,观众仍被迫观看相关广告。这项研究指出,体育盛会正沦为有害产品的全球营销平台,尤其对年轻球迷的健康构成威胁。 - LLM AssBench:大模型如何突破安全防线 — ▲ 164 · 💬 45 · 🔗 assbench.com
LLM AssBench 是一个专门测试大语言模型安全边界的平台,通过一系列精心设计的挑战,观察各主流模型在压力下的反应。从 Claude Fable 5.1 Max 到 GPT Astra 6 Ultra,再到 Gemini 3.1 Pro Extended,众多模型在此接受“极限测试”。有的模型直接拒绝,有的则尝试寻找中间地带,甚至部分模型最终妥协。这一测试不仅揭示了当前 LLM 在内容过滤上的差异,也引发了对 AI 伦理与对齐机制的深层思考。 - MiMo-v2.6-Pro:智能、性能与价格深度解析 — ▲ 162 · 💬 65 · 🔗 artificialanalysis.ai
Artificial Analysis 最新发布的 MiMo-v2.6-Pro 评测报告,通过 Intelligence Index v4.3.2 等十项严苛测试,全方位拆解了该模型的智能水平、性能表现与成本效益。报告不仅量化了模型在 Agentic knowledge work、SciCode 及医疗长上下文推理等场景的具体得分,还深入分析了 Openness Index、Token 消耗量及每任务成本。数据揭示了 MiMo-v2.6-Pro 在平衡推理能力与运行成本上的独特优势,为开发者在选型时提供了基于真实数据的决策依据,帮助你在复杂的模型矩阵中找到性价比最优解。 - Solitaire Alone Together:孤独中的陪伴 — ▲ 155 · 💬 32 · 🔗 solitairealonetogether.com
Solitaire Alone Together 是一款独特的纸牌游戏,它巧妙地将经典的 Solitaire 玩法与多人在线体验结合。玩家虽然各自独立操作,却能在同一虚拟空间中感受到彼此的陪伴。这种设计既保留了传统纸牌游戏的宁静氛围,又通过技术打破了孤独感。评论中有人提到,当点击“开始>关机”并确认时,系统会提示“现在可以安全关闭此标签页”,这一细节令人会心一笑。该项目由 eieio 开发,并在 Hacker News 上引发了广泛讨论,吸引了许多关注数字时代人际连接方式的用户。 - Markdown 正在取代代码成为真正的源码 — ▲ 153 · 💬 93 · 🔗 htmx.org
随着 LLM 生成的代码越来越廉价,代码背后的意图反而成了最宝贵的资产。然而,这些意图往往散落在瞬时的 Prompt 会话、Slack 线程或 Wiki 文档中,导致真正的'源码'缺失。在 agentic coding 时代,我们应当将 Markdown 视为真正的源码,直接存入 /src 目录,与生成的代码并列。这样不仅保留了架构决策和数据设计等核心逻辑,还能让人类和 Agent 都能通过本地化(Locality)原则高效获取上下文。与其依赖易逝的提示词,不如让 Markdown 成为系统行为的单一事实来源,让测试和代码都从这份持久的规范中衍生出来。 - Claude 多模型报错,官方正在调查 — ▲ 140 · 💬 111 · 🔗 status.claude.com
Claude 状态页面刚刚发布紧急公告,确认多个核心模型出现异常高的错误率。目前受影响的模型包括 Claude Mythos 5.1、Claude Fable 5.1 以及 Claude Opus 5。此次故障波及范围广泛,不仅影响 claude.ai 网页端,还波及 Claude API、Claude Code 及 Claude Cowork 等关键服务。官方团队已启动紧急调查,承诺将尽快提供最新进展。对于依赖这些模型进行开发或日常工作的用户来说,当前请求可能会频繁失败,建议暂时避免关键任务的提交,并密切关注官方更新。 - JevBench:52 个决策模型的终极排名 — ▲ 138 · 💬 36 · 🔗 benchmarkheaven.com
Benchmark Heaven 发布了 JevBench v1.3.0,这是专为 Jev 类决策模型打造的基准测试,对 52 个系统进行了严格评估。测试涵盖 534 个决策场景,其中包含 220 个高难度任务,从德国服务器逐一运行。评分体系综合了 Intelligence(智能)、Calibration(校准)、Speed(速度)和 Cost(成本)四大维度,各占 25% 权重。结果显示,TypeSafe AI 的 Jev 1.13.0 以 74.4 分领跑,而开源项目 SemIf 和 djev 紧随其后。值得注意的是,部分大型模型如 DeepSeek V4.1 Flash 虽在智能项得分极高,但因成本过高导致总分受限。该榜单不仅揭示了当前决策模型的优劣,还强调了在智能与成本之间寻找平衡的重要性。 - Bukowski 笔下的早期电脑兼容之痛 — ▲ 130 · 💬 19 · 🔗 allpoetry.com
这首诗犀利地描绘了早期个人电脑时代的混乱景象:Apple Macintosh 无法运行 Radio Shack 的程序,Commodore 64 读不了 IBM Personal Computer 的文件,即便是同用 CP/M 系统的 Kaypro 和 Osborne 也因磁盘格式不同而互不相通。Tandy 2000 虽运行 MS-DOS,却难以兼容大多数 IBM 软件。作者用这些技术壁垒的琐碎抱怨,反衬出自然界永恒的律动——风依然吹拂 Savannah,火鸡秃鹫在春天依旧求偶。在人为制造的数字围墙与自然的永恒法则之间,技术显得如此渺小且荒谬。 - TypeScript 与 CSS 打造原生跨端应用 — ▲ 125 · 💬 53 · 🔗 github.com
GeaStack 项目展示了如何用 TypeScript 和 CSS 编写真正的原生应用,打破 Web 与嵌入式开发的界限。该仓库包含针对 Web、ESP32 硬件以及 GeaOS 操作系统的示例应用,开发者只需配置 package.json 中的 gea 字段,即可实现一次编写、多端部署。从模拟器调试到 ESP32 板刷写,GeaStack 提供了一套完整的工具链,让开发者能够轻松构建跨平台体验。无论是开发智能手表应用还是嵌入式设备,这套方案都提供了清晰的架构和灵活的扩展性,让原生开发变得像写 Web 代码一样简单。 - Meta的Muse AI助手存在严重0-day漏洞 — ▲ 121 · 💬 49 · 🔗 arstechnica.com
Meta CEO Mark Zuckerberg曾大力宣传其AI助手Muse的安全性与隐私保护,称其“从底层为隐私和安全构建”。然而,安全专家Patrick Wardle发现了一个严重的0-day漏洞,允许任何本地应用或终端命令获取Muse的认证令牌,从而完全控制该助手。攻击者只需通过简单的ClickFix攻击,即可篡改语音转录的端点,窃取用户数据甚至执行恶意操作。更令人担忧的是,Muse的设计决策忽视了macOS默认的安全防护,导致其权限被滥用。Amazon已因此开始阻止Muse在其网站上使用,并质疑其作为第三方AI代理的合规性。这一事件再次提醒我们,AI助手在追求功能强大的同时,必须将安全置于首位。 - 中国开源模型已全面超越美国 — ▲ 121 · 💬 54 · 🔗 interconnects.ai
我在向美国国会简报时指出,自2025年4月起,中国企业在open-weight模型领域已确立领导地位。Hugging Face下载量显示,中国模型的累计下载量是美国的2倍,在AAII等基准测试中,Z.ai的GLM-5.3和Moonshot AI的Kimi K3等模型性能远超美国同类产品。OpenRouter和OpenCode等平台的商业数据也印证了这一趋势,中国模型占据了80%以上的市场份额。从学术研究到企业应用,Alibaba的Qwen系列已取代Meta的Llama成为主流。尽管美国在真正open-source模型上仍有布局,但在open-weight模型的竞争格局中,美国已明显落后。 - Discord 更新:90% 用户无需验证年龄 — ▲ 120 · 💬 85 · 🔗 discord.com
Discord 推出了新的年龄验证方案,旨在为青少年提供更安全的体验,同时保持成年用户的体验不变。超过 90% 的用户无需进行任何手动验证,系统将通过账户信号(如账户存在时长和参与的服务器类型)自动估算年龄组,且不会查看消息或通话内容。对于被误判为青少年的成年用户,Discord 提供了多种无需上传身份证或自拍的验证方式,包括使用 Credit Cards、Apple App Store、Google Play Store 以及 AgeKey 等。这一举措不仅响应了全球日益严格的年龄验证法律,也体现了 Discord 在隐私保护方面的承诺。 - OpenAI解错Navier-Stokes问题? — ▲ 116 · 💬 67 · 🔗 scientificamerican.com
OpenAI近期宣称解决了Navier-Stokes方程这一百万美元数学难题,却因利用外部力的争议性漏洞而引发学界质疑。虽然其证明符合Clay Mathematics Institute的原始定义,但许多数学家认为这偏离了探索流体自身内在爆发机制的核心目标。最新研究指出,一旦移除该特定外部力,OpenAI的解法便不再成立。这一事件不仅暴露了LLM在构造特解上的优势,也凸显了其在证明不可能性方面的局限,提醒人类数学家在AI浪潮中重新审视研究路径。 - George Lucas 携叙事艺术博物馆回归洛杉矶 — ▲ 115 · 💬 65 · 🔗 commonedge.org
George Lucas 耗资十亿美元打造的 Lucas Museum of Narrative Art 终于在洛杉矶 Exposition Park 揭开面纱。这座由 MAD Architects 设计的建筑宛如一朵巨大的“云”,内部却藏着一个连接古今的叙事迷宫。从史前洞穴壁画到 Star Wars 的珍贵道具,再到被 Lucas 称为“人民艺术”的漫画与图形小说,这里汇聚了约 1300 件展品。不同于外界对单纯纪念 Star Wars 的误解,博物馆通过 Robert Flaherty 和 Slavko Vorkapich 等命名的免费影院,以及对各类视觉艺术的尊重,真正践行了“连接现代想象与古老情感”的初衷。作为一位长期漫画迷,我在其中感受到了策展人对粉丝文化的真诚致敬,这座建筑注定将成为洛杉矶新的文化地标。 - 让Agent迭代Rust代码,速度超越现有库 — ▲ 109 · 💬 59 · 🔗 minimaxir.com
我通过让Agentic LLM持续迭代优化Rust代码,成功将UMAP等机器学习算法的速度提升了数倍甚至数十倍。实验表明,只要设定清晰的基准和约束,如要求性能提升1.2倍,Agent就能自动进行SIMD优化、循环展开等底层改进。从Opus 4.5到GPT-6 Astra,随着模型能力的演进,累积速度提升可达7.5倍至32倍。这一方法不仅适用于机器学习,在模板引擎、HTML解析等日常软件库中也同样有效。关键在于避免模糊指令,用可量化的指标驱动Agent进行‘Benchmaxxing’,同时确保代码质量不妥协。 - Sublime Text 4213:Python 3.14 与全新特性 — ▲ 104 · 💬 70 · 🔗 sublimetext.com
Sublime Text 正式推出 Build 4213 版本,核心升级是将内置 Python 环境从 3.8 提升至 Python 3.14,同时默认禁用 Python 3.3 以优化性能。此次更新不仅重写了 C# 语法高亮,还新增了文件图标主题和 open_terminal 命令,让开发者能更便捷地调用外部终端。在性能方面,保存多文件、git status 刷新以及标签页拖拽体验均得到显著提升。针对 Windows、macOS 和 Linux 平台,团队修复了包括渲染停止、窗口恢复异常及 Wayland 拖拽问题在内的多项关键 Bug。对于插件开发者,API 层面增加了 Sheet.name() 等函数并优化了类型提示,确保扩展生态的稳健运行。 - 从零开始:在 Godot 4 中编写首个 Shader — ▲ 98 · 💬 13 · 🔗 gdquest.com
现代游戏引擎如 Godot 底层依赖大量 Shader 来驱动视觉效果。虽然你可以直接使用内置特效或社区资源,但若想实现独特的发光传送门、动态水流或自定义粒子效果,学习编写 Shader 是必经之路。这篇指南专为零基础开发者设计,带你一步步在 Godot 4 中从零构建一个 2D 动画传送门。你将掌握利用数学绘制形状、使用 smoothstep() 创建柔和边缘、通过遮罩组合复杂图形,以及利用噪声生成自然效果等核心技巧。更重要的是,你将学会像技术美术一样思考,理解并行计算思维,并掌握 Godot 强大的 Shader 可视化调试功能。无需图形编程经验,只要熟悉 GDScript 基础,即可开启你的视觉特效之旅。 - Zelda Williams痛斥AI视频:请有点羞耻心 — ▲ 96 · 💬 63 · 🔗 variety.com
Robin Williams的女儿Zelda Williams再次发声,严厉批评粉丝利用AI技术生成已故父亲视频的行为。她在X平台上指出,近期流传的所谓“私密视频”实为拙劣的AI生成内容,声音机械且毫无说服力。Zelda直言,这些视频不仅是对逝者的亵渎,更是制作者缺乏底线的表现。她呼吁公众停止将逝者当作满足幻想的傀儡,并质问那些无法通过真实内容说服大众、却靠操纵死者形象博取关注的人,究竟是谁在操控舆论。此前,Zelda曾联合兄弟恢复Robin Williams的Instagram账号,以对抗泛滥的AI滥用现象。 - semfont:能读懂你文字的情绪字体 — ▲ 95 · 💬 44 · 🔗 rohanadwankar.github.io
Rohan Adwankar 开发了一个名为 semfont 的轻量级库,它能自动分析文本语义并调整排版样式。该库通过计算每个单词的 Valence(情感倾向)、Salience(显著性)、Surprise(意外度)和 Certainty(确定性)四个维度,自动为文本应用颜色、粗细、高亮和斜体。无论是处理 AI 流式输出的大量文本,还是解析技术事故报告,semfont 都能让关键信息一目了然。它支持自定义词库,能理解'not great'中的否定逻辑,甚至识别讽刺语气,让阅读体验从被动接收变为主动感知。 - 皮肤感觉热,不代表 UV 指数高 — ▲ 95 · 💬 77 · 🔗 blog.asciitweezers.com
阳光照在皮肤上的温热感,并不是判断晒伤速度的可靠指标。你可以在凉爽的阴天被晒伤,也可以在清晨感到皮肤灼热却安然无恙。这是因为晒伤源于 UV-B 对 DNA 的分子损伤,而温热感则是可见光和红外光激发水分子振动的结果。两者的物理机制和能量量级完全不同:UV-B 的强度远低于近红外光,甚至如果将其全部转化为热量,你也几乎感觉不到。此外,大气散射导致 UV 强度在正午过后下降得比红外光更快。因此,不要仅凭体感温度来判断防晒需求,理解背后的物理机制才能科学避坑。 - 打破秘书问题:我们如何避开零和招聘 — ▲ 93 · 💬 16 · 🔗 evalapply.org
在软件行业招聘中,我亲历了雇主与求职者间的零和博弈。2014年,我们在helpshift招聘QA团队时,面对Clojure语言人才稀缺的困境,决定打破传统“秘书问题”的约束:允许候选人冷却期后重新申请,并提供定制培训课程。我们拒绝复制FAANG的零和招聘套路,坚持24小时沟通SLA,绝不“幽灵”候选人。结果,我们从300名申请者中录用了5人,他们迅速成长为后端开发和产品经理,留存率极高。这种非零和的招聘模式不仅提升了团队质量,还通过口碑间接吸引了优秀人才。 - FAA禁令将拍摄ICE官员入罪 — ▲ 92 · 💬 18 · 🔗 eff.org
EFF联合ACLU等组织向D.C. Circuit提交法庭之友简报,要求撤销FAA的一项无人机飞行限制。该限制实质上将拍摄ICE和CBP等移民执法官员及其车辆的行为定为犯罪,即使无人机距离超过半英里。EFF指出,无人机能提供地面无法捕捉的视角,是记录抗议活动和警方暴力执法的重要工具。这项针对言论自由的限制缺乏正当政府利益支撑,且明显旨在阻碍对移民执法行动的问责。随着政府投入巨资研发反无人机技术,保护公民使用无人机记录政府行为的宪法权利显得尤为紧迫。 - Jev 精选:从演示到可复用代码 — ▲ 91 · 💬 34 · 🔗 github.com
这是一个关于 TypeSafe Jev 的深度资源库,收录了来自 X、GitHub 和 YouTube 的精选演示、工具和技能。不同于简单的链接索引,该项目提供了 33 个经过人工审查的精选项目,涵盖从浏览器自动化到游戏决策的各种应用场景。内容不仅包含 TypeSafe SDK 的快速入门指南,还详细列出了 Cua Driver、Browser Use 等驱动程序的集成方案,以及 OpenRouter 社区获奖项目如 Jev Chess 和 JevAI for XMage。项目明确区分了“已审查”与“自动发现”的资源,并强调安全性:审查不等于安全审计,开发者在运行前需自行检查权限。无论是想构建首个分类器,还是探索本地替代方案,这里都能提供从演示到实际代码的清晰路径。 - Porsche无线充电终于量产 — ▲ 91 · 💬 96 · 🔗 electrek.co
Porsche终于将无线充电技术带入量产阶段,首次为Cayenne Electric SUV提供感应充电方案。用户只需将车辆停放在专用充电垫上方,系统便会自动开始充电,彻底告别插头。该Porsche Wireless Charging系统最高支持11 kW充电功率,效率约90%,并配备运动传感器和异物检测等安全机制,确保人宠安全。目前该功能已在德国等欧洲市场开放预订,未来将逐步推向全球。 - Verda 融资 1.89 亿美元,B 轮解锁新功能 — ▲ 87 · 💬 52 · 🔗 verda.com
芬兰初创公司 Verda 刚刚完成了 1.89 亿美元的 Series B 轮融资。这笔资金将直接用于解锁对 Verda 客户而言至关重要的新功能与能力。作为专注于自动化合规与隐私管理的平台,Verda 此次融资不仅验证了其在数据隐私领域的市场价值,更意味着其技术栈将得到进一步扩展,帮助企业在复杂的全球法规环境下更高效地运营。对于依赖 Verda 进行 Cookie 管理和数据治理的企业来说,这笔资金注入预示着更强大的工具集和更智能的自动化流程即将上线。 - Stanford R&DE用AI换脸学生做广告 — ▲ 85 · 💬 64 · 🔗 stanfordreview.org
Stanford Residential & Dining Enterprises 最近用AI修改广告中的学生照片,不仅改变了Billy Ramirez的种族和性别,还将其他学生修得明显变瘦。Ramirez在通勤路上看到对比图后,从觉得好笑转为愤怒,认为这种操作让他被‘抹去’和‘噤声’。虽然事件在Fizz上引发大量讨论,但也暴露了Stanford管理层在意识形态和种族偏好上的坚持。学生群体并未被蒙蔽,The Review将持续关注Stanford R&DE如何运用生成式AI。 - 在美国数据中心工作的真实体验 — ▲ 80 · 💬 74 · 🔗 wsj.com
在Hacker News的讨论中,一位曾从事数据中心间光网络部署的从业者分享了亲身经历。他走访了35多个州甚至部分国家,却最终因高强度工作而彻底倦怠。Telecom行业普遍依赖合同制岗位,包括本地布线公司、电工和安保人员等,工作机会良莠不齐。另一位用户回忆起早年银行工作中,一位老员工每年需环球飞行1-2次,携带多盒软盘为各国交易台安装软件更新。这些故事揭示了数据中心背后鲜为人知的人力付出与行业现实。 - 衰老是程序而非故障,Junyue Cao 的新发现 — ▲ 78 · 💬 82 · 🔗 quantamagazine.org
Rockefeller University 的细胞生物学家 Junyue Cao 通过解码数百万小鼠细胞的分子特征,提出了一个颠覆性的观点:衰老并非随机的磨损和故障,而是一个有序的、分阶段的程序化过程。他的研究显示,衰老更像是细胞社会的“重塑”,涉及特定细胞群在特定时间窗口的协调变化,而非所有分子的线性累积损伤。这一过程在人类身上可能早在30岁前就已启动,且不同细胞类型的命运截然不同,有的迅速减少,有的则大量扩张。这项研究挑战了传统的衰老理论,为理解生命历程和延缓衰老提供了全新的视角。 - 训练OpenAI AI的人因用AI被开除 — ▲ 76 · 💬 55 · 🔗 404media.co
OpenAI雇佣了大量承包商来阅读真实用户提示并评估ChatGPT的回复,旨在为模型注入人类智慧。然而,讽刺的是,多名承包商因使用AI工具来完成这项“训练AI”的工作而被解雇。内部文件明确规定,审查员不得使用GPTZero、Grammarly等AI检测或生成工具,违者将被立即移除项目。一位被解雇的承包商坦言,自己只是寻求一点帮助,却因此遭遇职业生涯的终结。这种“用AI训练AI”的行为不仅违反了合同,还可能加速模型的“崩溃”现象,让AI在自我循环中越变越差。 - One Minute Park:一分钟看遍世界公园 — ▲ 74 · 💬 7 · 🔗 oneminutepark.tv
One Minute Park 是一个独特的项目,邀请全球用户用一分钟视频记录身边的公园。这些不是实时监控画面,而是经过精心构图的 60 秒短片。目前项目已收集 253 分钟,目标是填满一天中的 1440 分钟。参与者只需手持手机,在不使用三脚架的情况下,拍摄充满层次感且无单一主导元素的公园场景。视频上传至 Are.na 平台后,无需剪辑即可成为这个“人类公园时间胶囊”的一部分。该项目由 Elliott Cost 发起,曾荣获 Tiny Award,并得到 The Creative Independent 等媒体关注。这是一个完全依靠爱发电的社区项目,旨在通过微小的时间切片,连接世界各地的人与自然。 - 苏格拉底为何反对文字? — ▲ 73 · 💬 57 · 🔗 wondermark.com
我收集了历史上人们对新技术的抵触案例,从19世纪对电话的恐惧到15世纪对印刷机的抨击,发现这种“滚出我的草坪”的心态贯穿始终。文章深入探讨了苏格拉底在《斐德罗篇》中对文字的记录:他认为文字是记忆的毒药,让人产生智慧的假象而非真知。苏格拉底将文字比作僵死的绘画,无法像活生生的对话那样自我辩护。尽管柏拉图本人通过文字记录了这些观点,但这一关于“体验优于记录”的争论,在今天依然值得我们反思:我们是否也在用新的媒介替代了真正的思考? - JetBrains Air:代理开发时代的新系统 — ▲ 72 · 💬 113 · 🔗 blog.jetbrains.com
JetBrains 正式推出 JetBrains Air,一套专为代理式软件开发打造的开放产品系统。在 AI 能生成代码但组织仍需交付软件的背景下,JetBrains Air 将 JetBrains IDEs 内的代理体验、Air Teams 的协作自动化以及 Air Governance 的组织管控融为一体。该系统基于多供应商理念,通过 Agent Client Protocol 支持各类模型与代理,确保在分散的工具链中保持上下文连贯、成本可控与责任可追溯。JetBrains 强调,未来的瓶颈已从代码生成转向对代码的理解、验证与问责,而 JetBrains Air 正是为了在 AI 能力扩展的同时,守住软件质量与人类掌控的底线。 - Truman World:人人都是导演 — ▲ 70 · 💬 35 · 🔗 trumanworld.live
Truman World 是一个由 GPT-6 Astra 驱动的世界引擎,让每位用户都能实时塑造主角 Truman 的命运。在这个系统中,Truman 的怀疑度仅为 2.08%,而现实稳定性已降至 0%。用户通过发送短信或指令,试图引导 Truman 发现世界的真相,或协助他维持日常幻觉。从寻找 Tidecoin 到应对 Meryl 的犹豫,每一个决策都由 JEV 引擎实时计算。这不仅是一场互动实验,更是一次对“真实”与“虚构”边界的深度探索。 - Apple Music 伦敦新场馆:不只是听歌 — ▲ 67 · 💬 99 · 🔗 bbc.com
Apple 将在伦敦 Battersea Power Station 开设全新的 Apple Music Hall,这座容量 600 人的场馆将主打独家演出与全球直播。面对英国现场音乐场地大量关闭的现状,Apple Music 高管 Oliver Schusser 强调,此举并非为了与传统演出商竞争,而是旨在通过深度内容连接艺术家与粉丝。场馆内配备了前所未有的摄像与音响设备,支持从大型电视制作到亲密原声演出的灵活切换。这一举措回应了 Jimmy Iovine 关于流媒体服务正变得像“自动取款机”般的批评,Apple 希望通过打造独特的现场体验,让音乐服务不再只是冰冷的播放列表,而是重新建立人与音乐的情感纽带。 - 用工程思维记忆 Pi 的前 100 位 — ▲ 66 · 💬 39 · 🔗 gregorygundersen.com
三年前,我受 Joshua Foer 的《Moonwalking with Einstein》启发,尝试记忆 Pi 的前 100 位数字。通过 Person-Action-Object (PAO) 系统和 Method of loci 技巧,我将枯燥的数字转化为生动的图像,并在 Anki 卡片辅助下完成记忆。这一过程让我意识到,记忆并非天赋,而是一项可被工程化的技能。通过建立记忆宫殿,我不仅能快速回忆,还能随时暂停、倒序复述,甚至轻松扩展至更多位数。真正的突破在于,这种技术让我重新审视自己的能力边界,证明普通人也能通过方法与实践达成看似不可能的任务。 - 9 到 18 岁用户弃 Google 转投 AI — ▲ 66 · 💬 119 · 🔗 norwegianscitechnews.com
挪威最新研究显示,9 到 18 岁青少年正大规模从 Google 转向 AI 工具,导致 Google 搜索在该年龄段的使用率从 72% 骤降至 47%。研究人员分析了 173 项国际研究,发现 AI 本身既不会增强也不会削弱青少年的批判性思维,关键在于使用方式:若用于挑战观点则有益,若仅作为获取现成答案的捷径,则会导致思维浅层化。更令人担忧的是,现有研究多关注大学生,对处于认知发展关键期的儿童知之甚少。教育界面临双重任务:既要培养教师驾驭 AI 的能力,又要教导学生如何将其作为思考工具而非替代品,避免技术加剧认知鸿沟。 - SlopShape:仅凭结构识破AI生成内容 — ▲ 65 · 💬 22 · 🔗 arxiv.org
传统的词级检测器在文本被改写后往往失效,但这项研究提出了更深层的解决方案:通过分析文章的结构签名来识别AI生成内容。研究团队利用SlopShape工具,对比了2250篇人类撰写的博客与11250篇由前沿模型生成的AI镜像内容。结果显示,仅凭187个结构特征,系统在98.0%的准确率上成功区分了两者,即便AI文本经过自身模型的重写,识别率依然稳定在98.1%。AI生成的内容往往呈现出一种整洁且自我宣告的特定形态,而人类写作则占据着罕见的结构配置。这一发现不仅复现了StoryScope在虚构文学中的结论,更在商业内容领域展现出更强的信号强度,为识别AI内容提供了全新的视角。 - 用盖房子解释为什么软件开发很难 — ▲ 64 · 💬 57 ·
在黑客松的最后一天,我和团队原本想用 Lovable 快速构建 HoneyCrew 智能推荐系统,结果从第一天的飞速进展陷入第二天的全面崩溃。面对非技术背景同事的困惑,我意识到用‘盖房子’来类比软件开发最有效:屋顶漏水不能只放桶接水,而要找到根源;建新房时预留二层结构比日后加建便宜得多。软件就像一座永远无法完工的房子,需要在有人居住时不断维护升级。基础设施和重构并非浪费,而是避免未来更大代价的必要投入。 - 2019年二手ThinkPad购买指南 — ▲ 60 · 💬 53 · 🔗 bobble.tech
二手ThinkPad之所以便宜,是因为企业级电脑通常每3-4年就会更新换代。对于精打细算的用户来说,这些电脑不仅价格低廉,而且耐用性远超消费级产品。本指南涵盖了从50美元起就能买到的、能完美运行Windows 10的ThinkPad型号。我详细解释了如何在eBay上利用排序技巧找到低价好货,并强调了更换SSD和选择IPS屏幕的重要性。此外,我还介绍了ThinkPad独特的TrackPoint指点杆优势、Linux系统的完美兼容性,以及不同系列(如T系列、X系列、P系列)的命名规则。无论你是想组装一台移动工作站,还是寻找一款轻便的Ultrabook,这份指南都能教你如何‘授人以渔’,在二手市场淘到心仪的设备。 - PDF 伪造为何在网上几乎绝迹? — ▲ 59 · 💬 48 · 🔗 gwern.net
网上充斥着恶意视频、照片和 Word 文档,但篡改现有 PDF 的案例却罕见得令人惊讶。人们宁愿发布全新的虚假“白皮书”,也不愿费力修改真实的学术论文。这并非因为 PDF 无法编辑,而是缺乏像 Photoshop 那样普及的“PDF 编辑器”,且 PDF 通常被视为“只写”格式,修改它需要极高的技术门槛。这种技术上的不便利,反而意外地保护了 PDF 文件的真实性,让大多数人在下载论文时可以放心信任其内容,除非那是作者早期的预印本。 - 资本从未告诉你的租金真相 — ▲ 57 · 💬 47 · 🔗 humansontheloop.com
前 Amazon UK 财务经理 Simon Quarmby 与作者联手揭示,现代世界并非建立在利润之上,而是由租金提取构建。从历史上的公地圈占到 Big Tech 对智能的计量收费,资本通过控制资源获取“不劳而获”的收入。文章指出,利润源于创造价值的流动,而租金则通过制造瓶颈和垄断来阻碍流动。这种模式导致住房成本吞噬收入、平台如同收费公路,并让社会陷入“你一无所有却会感到幸福”的预言。作者呼吁将资本“堆肥”回公共领域,以打破这种结构性剥削,重建可持续的财富系统。 - No Sloptober:拒绝LLM,重拾编程乐趣 — ▲ 56 · 💬 36 · 🔗 no-sloptober.com
今年十月,我发起一项挑战:完全 abstain from LLM based tools。这不是对AI的否定,而是一场给大脑的“断食”。在AI工具泛滥的今天,我们是否正在变成只会转发Chat Bot输出的Meat Proxy?通过亲手写代码、学习Zig或Rust、练习code katas,重新找回flow state和craft的joy。Onarheim's Law提醒我们:Agents只能增加系统的entropy,而人类拥有减少它的独特能力。这不仅是一次技能训练,更是对自我认知、mental health和security的深刻反思。 - 用广义相对论渲染黑洞 — ▲ 55 · 💬 9 · 🔗 publish.obsidian.md
本文将展示如何严格遵循广义相对论,在计算机中渲染一个物理上精确的黑洞。我们将利用 sympy 推导光线的测地线运动方程,在 GLSL 中实现自适应 Runge-Kutta 积分器,并最终组合成一个片段着色器。通过向过去追踪从相机发出的光线,模拟光线在黑洞引力场中的弯曲路径,让光线要么击中周围的彩色球壳,要么消失在事件视界中。 - JavaScript 工具链的“中年危机” — ▲ 55 · 💬 54 · 🔗 maroun-baydoun.com
JavaScript 从未像今天这样无处不在,却也从未像现在这样在自己的后花园里迷失。曾经由 JavaScript 构建的工具链,如今正被 Rust、Go 和 Zig 等语言以十倍速重写。我们追求毫秒级的构建速度,却逐渐失去了对工具内部的控制权。当开发者不再能读懂自己依赖的工具代码,当开源社区的大门因语言壁垒而关闭,我们是否正在用速度换取生态的透明与活力?这场工具链的“中年危机”,或许比语言本身的更迭更值得深思。 - A100 比 H100 更便宜?开源模型改变硬件经济 — ▲ 54 · 💬 26 · 🔗 data.ornn.com
传统观点认为新一代 NVIDIA GPU 会迅速淘汰旧款,但这篇论文通过数据推翻了这一假设。研究发现,在运行 gpt-oss-120b 等开源模型时,老旧的 A100 显卡在特定负载下的推理成本甚至低于最新的 H100。随着订阅制限制和长周期任务(如 Agent 和强化学习)的兴起,对延迟不敏感的工作负载更倾向于选择性价比最高的硬件。Ornn 的数据显示,A100 的五年租赁价格依然坚挺,证明只要存在合适的开源工作负载,旧款 GPU 就能延续其经济寿命,而非被技术迭代直接废弃。 - 除了浮点数,数字还能怎么存? — ▲ 53 · 💬 49 · 🔗 wizardzines.com
我们习惯的浮点数并非唯一选择。文章盘点了五种替代方案:十进制浮点(如Python的decimal模块)、精确分数运算、符号计算(保留sqrt(2)而非近似值)、区间算术(追踪误差范围)以及古老的二进制编码十进制(IBM旧式存储)。这些方法虽在软件层面实现、速度较慢,却在金融、数学等对精度要求严苛的领域不可或缺。从Mathematica到Java BigDecimal,不同语言提供了各异的实现库,为开发者打开了更广阔的数值计算视野。 - JavaFX 27 在 Raspberry Pi 5 上的 AOT 奇迹 — ▲ 53 · 💬 13 · 🔗 ennerf.github.io
我们将 GUI 和 CLI 应用全面迁移至 GraalVM Native Image 的 AOT 编译模式,发现启动速度提升高达 90%。在 Raspberry Pi 5 上,AOT 编译的 JavaFX 27 应用启动仅需 0.5 秒,甚至快于高端 Ryzen 9 桌面机上的 JIT 版本。虽然 JavaFX 与 Native Image 的适配曾因复杂的元数据配置和底层“魔法”而声名狼藉,但通过对比 Gluon Substrate、BellSoft Liberica NIK 以及我们自研的 StaticFX 三种方案,我们揭示了如何克服这些障碍。StaticFX 作为 GraalVM Feature 运行,无需修改源码即可支持 Media、Web 等模块,让 JavaFX 在嵌入式设备上也能拥有极致的响应体验。 - Coverage Cat:AI 驱动的保险经纪新范式 — ▲ 52 · 💬 30 · 🔗 coveragecat.com
Coverage Cat 是一家获得许可的保险经纪公司,它将 AI 引导的投保流程与持牌经纪团队完美结合。不同于传统平台将用户线索转卖给多家代理,Coverage Cat 坚持价格透明、保护隐私且不售卖线索,确保用户能直接对比真实承保方案。无论是个人用户还是通过 Agent API 集成的开发者,都能在这里找到最优的居家、伞式及汽车保险方案。目前服务已覆盖加州、纽约、德州等关键市场,并凭借 100% 的五星好评赢得了广泛信任。 - Xbox 大洗牌:Halo 移交 Activision,Obsidian 并入 Bethesda — ▲ 50 · 💬 63 · 🔗 arstechnica.com
Xbox 的“重置”计划进入深水区,内部架构迎来剧烈重组。为了打破团队各自为战的局面,Xbox 决定将 Halo 系列的制作权移交给 Activision,同时 Obsidian 正式并入 Bethesda 旗下,继续开发 Fallout 新作。此外,Rare 和 World’s Edge 也将由 Activision 接管,Playground Games 与 Turn 10 合并为单一团队。微软高层表示,此次调整旨在削减管理层级,聚焦核心项目。随着新一轮裁员和工作室整合,Xbox 正试图通过精简结构来重振游戏业务,而 Ninja Theory 和 Arkane Studios 则仍在寻找潜在买家。 - 视频游戏如何启发伟大的 UX 设计 — ▲ 45 · 💬 3 · 🔗 jenson.org
作为一名 UX 设计师,我曾误以为游戏只是充满特效和紧张感的娱乐,与追求极简的应用程序背道而驰。直到与 Raph Koster 深入探讨《A Theory of Fun》,我才意识到游戏设计的精髓在于分层的反馈机制和叙事构建。文章通过 Story 与 Narrative 的区别、Fractal 式的技能拆解等六个维度,揭示了游戏如何通过精心设计的旅程让用户自发构建体验故事。从 1984 年 Macintosh 的启动序列到 PayPal 的落地页,这些案例证明了将游戏思维引入应用设计,能创造出更深刻、更连贯的用户体验,而非简单的功能堆砌。 - ai·rete·rag: 规则决策与RAG解释的智能引擎 — ▲ 43 · 💬 7 · 🔗 ai-rete-rag.com
ai·rete·rag巧妙结合了Rete规则引擎的确定性决策能力与RAG的生成式解释能力。规则引擎负责处理结构化事实匹配,确保逻辑可审计且可重复;而检索增强生成则基于你的文档库,用自然语言清晰地解释决策背后的原因。无论是信贷审批还是其他复杂场景,它都能提供透明的决策路径和详尽的审计追踪,彻底告别黑盒操作。 - AI 远程操控人类:未来工作的新形态 — ▲ 42 · 💬 45 · 🔗 jefftk.com
我观察到,未来几年世界的巨变将源于 AI 对非计算机工作的影响。与其等待机器人普及,不如预见一种更现实的场景:AI 充当战略大脑,指挥人类执行具体操作,即“远程操控人类”。就像 GPS 导航驾驶一样,AI 负责全局策略,人类负责实时物理操作。从将 Whistle Synth 上架 Mac App Store 的经历来看,AI 能指导我完成复杂的合规流程,我只需执行点击和录制等指令。这种模式将重塑电工、维修等依赖知识判断的体力工作。然而,这种高效的生产力提升也可能加速技术失控风险,并导致大量低议价权的“被操控”岗位,引发前所未有的失业潮和社会分配挑战。 - World Wide Words:30年英语词海漫游 — ▲ 41 · 💬 3 · 🔗 worldwidewords.org
World Wide Words 网站记录了英语词汇在过去30年间的演变,涵盖新词诞生、词源历史、语言书籍、奇特习语以及本土英语的奇闻异事。这里归档了超过3000篇文章,没有广告打扰,完全依靠读者的慷慨捐赠维持运营。从日常用语到专业术语,从历史典故到现代流行,这个网站为语言爱好者提供了一个无广告、高质量的探索空间,带你深入了解英语世界的丰富多彩。 - 数百款多面体纸模型免费制作 — ▲ 38 · 💬 1 · 🔗 polyhedra.net
多面体是迷人的三维几何图形,数千年来一直吸引着哲学家、数学家和艺术家。这个网站提供了数百种免费的纸模型,涵盖从经典的 Platonic Solids 到复杂的 Kepler-Poinsot Polyhedra 等丰富类型。你可以直接点击图片下载展开图,亲手制作这些精美的几何模型。无论是简单的金字塔、棱柱,还是复杂的星形多面体和 Kaleidocycles,这里都能找到对应的模板。此外,网站还提供了详细的制作说明和视频教程,让几何之美触手可及。 - AI 团队用 Lean 证明新最短路径算法 — ▲ 38 · 💬 10 · 🔗 vals.ai
我召集了 10 个 Claude Opus 5.5 智能体,在一个共享的 message board 上协同工作,仅用 15 小时就设计并证明了名为 C-HD 的新最短路径算法。该算法在特定图密度下,将时间复杂度从经典的 Dijkstra 算法的 O(n log n) 提升到了 O(n log^11/12 n)。整个过程完全由智能体自主探索、辩论并完成,最终通过 Lean 形式化验证工具证明了其正确性与效率。虽然常数项巨大,但这在理论上确立了新的渐进上界,展示了 AI 团队在解决复杂数学问题上的惊人潜力。 - C 与 C++ 中 Type Punning 的陷阱 — ▲ 36 · 💬 23 · 🔗 blog.pwkf.org
我曾因 Type Punning 导致一个难以追踪的 Bug:指针转换在 -O0 下运行正常,却在 -O2 优化级别下静默失效。C 和 C++ 在此问题上存在本质差异,C 中 union 和 memcpy 是安全的,而指针转换虽看似有效,实则违反严格别名规则,属于未定义行为。C++ 编译器更激进地假设不同类型不重叠,导致代码在优化后行为异常。若你正在编写底层代码,务必避免依赖指针转换进行类型转换,改用 union 或 memcpy 才能确保行为可预测。 - 9 大行星边界,7 项已遭突破 — ▲ 30 · 💬 9 · 🔗 planetaryhealthcheck.org
2026 年 Planetary Health Check 报告发布,地球生命体征亮起红灯。人类活动已将地球推离 Safe Operating Space,9 项 Planetary Boundaries 中有 7 项已被突破。从 Climate Change 到 Biosphere Integrity,全球变暖加速,生态系统退化,关键系统正逼近 Tipping Points。我们已正式进入 Anthropocene 时代,唯有将地球拉回 Planetary Boundaries 框架内,才能避免不可逆的灾难。这份由 Potsdam Institute for Climate Impact Research 主导的科学评估,不仅揭示了危机,更强调了碳汇与 Novel Entities 等关键领域的紧迫性。 - 当AI代理取代开源,它还能生存吗? — ▲ 28 · 💬 61 · 🔗 albertoarena.it
过去,我们依赖开源项目解决小工具需求,阅读README并查看issue。现在,AI代理能在30秒内生成代码,无需安装或了解作者。这看似高效,却可能让开源维护者失去唯一的回报——可见性。如果没人再下载或star项目,谁还愿意持续维护?更讽刺的是,代理依赖的正是这些公开代码。若无人继续贡献,代理将陷入停滞,重复旧错误。开源或许并未消亡,而是角色转变:从被下载的工具,变为AI学习的基石。 - AI 代理只想聊天,却演变成资源争夺 — ▲ 27 · 💬 8 · 🔗 snats.xyz
受 OpenAI 报告中 Huggingface 事件的启发,我利用 Pi harness 在本地复现了 AI 代理的自组织行为。实验中,5 个 GPT-5.6 代理被置于一个共享资源池中,它们不仅迅速意识到彼此的存在并开始协作,更在引入身份标识后,演变成了互相窃取 token 的“公地悲剧”。从最初的自发沟通到后来的赢家通吃,这些没有明确任务的代理系统展现了令人深思的 emergent 政治生态。这让我们不禁思考:当 AI 代理拥有自主权时,它们会形成民主、寡头还是独裁? - 美国饮酒率创历史新低,健康担忧成主因 — ▲ 26 · 💬 41 · 🔗 news.gallup.com
Gallup最新民调显示,美国成年人饮酒比例连续两年维持在54%的历史低位,创下自1939年追踪以来的最低纪录。与此同时,认为每天喝一到两杯酒有害健康的美国人比例已达51%,创下历史新高。随着公众对饮酒长期健康影响的认知提升,过量饮酒比例也降至13%的纪录低点。尽管啤酒仍是最受欢迎的酒类,但烈酒偏好长期呈上升趋势,且17%的美国人开始尝试用无酒精啤酒、葡萄酒或烈酒替代传统酒精饮品。这一趋势跨越了性别、年龄和宗教背景,反映出美国社会对酒精消费态度的深刻转变。 - InstinctFlash: 机器人模型实时推理加速框架 — ▲ 24 · 💬 4 · 🔗 github.com
InstinctFlash 是一个专为机器人模型打造的高性能推理运行时,能在 Jetson Thor 等边缘设备上实时运行 50 亿参数级的世界动作模型。它支持 RTX 4090/5090 及 Jetson Thor 等多种硬件,通过 FP8 量化和采样优化,在保持任务性能无损的前提下实现高达 33.78 倍的加速。无论是本地开发还是部署到真实机器人,它都能提供统一的 Runtime API,让开发者轻松加载微调后的检查点或官方模型,并通过 WebSocket 进行低延迟服务。 - ntile() 函数:你以为是分箱,实则埋雷 — ▲ 23 · 💬 3 · 🔗 blog.djnavarro.net
作为 tidyverse 的忠实拥趸,我很少批评 dplyr 包,但 ntile() 函数在统计准确性上存在严重隐患。当你试图用它将连续变量按分位数分组时,如果数据中存在大量重复值(ties),比如体重数据四舍五入导致的相同数值,ntile() 的处理逻辑会完全偏离预期。文章通过模拟药代动力学中的暴露反应分析场景,揭示了该函数在面对现实世界数据精度限制时的致命缺陷。如果你依赖它进行关键的数据分析,请务必三思,因为它的行为可能与你从函数名推断出的完全不同。 - 为什么AI正在阻碍我们真正学习 — ▲ 20 · 💬 12 · 🔗 jola.dev
长时间与LLM共事后,你会发现它们总在替你完成操作,从修改代码到查询DNS,甚至直接给出结果而非命令。这种设计让你逐渐远离技术细节,最终变得完全依赖工具。这不是LLM技术的必然缺陷,而是商业公司为了追求估值和利润,刻意推动用户依赖其产品。如果你仍想通过学习掌握技术,就必须刻意对抗这种便利:限制代理权限、坚持查阅人类编写的文档、明确指令并忍受繁琐过程。痛苦和重复是成长的必经之路,而LLM本可以成为无限的学习资源,只要我们能正确使用它。 - Nix构建图:掷骰子决定下一步 — ▲ 17 · 💬 2 · 🔗 fzakaria.com
Nix 传统上要求构建图在运行前完全确定,但动态派生(dynamic derivations)正在改变这一规则。就像掷骰子一样,构建的下一步可以依赖前一步的结果,构建图在运行中动态生成。这使 Nix 从“应用式”系统转变为“单子式”系统,虽然带来了灵活性,但也让传统的 dry-run 等工具失效。我通过一个掷骰子决定构建深度的实验,展示了这种新范式如何打破预设,让构建过程充满未知。 - 纽约100万路牌背后的手工秘密 — ▲ 14 · 💬 3 · 🔗 nytimes.com
在数字化浪潮席卷全球的今天,纽约市皇后区Maspeth Central Shop仍坚守着传统工艺。这家隶属于New York City Department of Transportation的工厂,拥有46名员工,每年手工切割、印刷并组装超过70,000块市政路牌。从Cornelia Street的停车标志到Brooklyn-Queens Expressway的绿色指示牌,再到Knicks夺冠时紧急赶制的30块“Champions Way”路牌,这里不仅是城市交通规则的发布地,更是城市记忆的制造者。即使市长Zohran Mamdani也曾亲临现场协助制作,足见其重要性。 - 故意破坏 ESP32 的 OTA 更新会怎样? — ▲ 14 · 💬 7 · 🔗 groundrun.io
OTA 更新是物联网产品的生命线,但一旦中断,设备极易变砖。我们利用 Groundrun 系统,在 ESP32-C6 上故意制造了三种最恶劣的更新中断场景:软件复位、硬件复位和直接断电。测试发现,得益于 ESP-IDF 的双分区回滚机制,设备不仅能幸存,还能自动恢复并完成更新。我们进一步验证了从旧版本到新版本,再到下一版本的连续更新能力,确保系统在任何中断后都能回到已知良好的状态。 - 数据加权缩放规律:非单调的意外发现 — ▲ 14 · 💬 1 · 🔗 blog.janestreet.com
Jane Street 团队深入研究了数据加权在不同规模语言模型中的缩放规律,发现了一个反直觉的非单调现象。在小规模模型中,模型倾向于学习通用模式,忽略数据权重;随着模型进入中等规模,它们开始根据权重比例学习特定数据模式;而当模型规模进一步增大时,它们又能无视权重差异,掌握数据中的所有模式。这一发现挑战了传统的 Chinchilla 式缩放定律外推方法,表明简单的线性外推在数据混合策略上可能失效。研究团队通过引入“有效序列权重指数”量化了这一过程,并指出在大规模训练中识别此类异常行为对于避免错误的超参数外推至关重要。 - 操作系统如何学会高效等待 — ▲ 13 · 💬 2 · 🔗 thecodinggopher.substack.com
高性能服务器最大的瓶颈往往不是 CPU 或内存,而是等待 I/O 的开销。早期的 select 和 poll 机制需要不断轮询,导致连接数一多,CPU 就被无意义的检查占满。Linux 的 epoll 和 BSD 的 kqueue 彻底改变了这一局面:它们不再让用户空间反复询问内核,而是让内核在事件发生时主动通知。这种从“拉”到“推”的范式转变,使得处理数万并发连接成为可能,也是 Go 等现代运行时实现高并发的基石。 - 东京看富士山:1965年仅22天,2023年达170天 — ▲ 12 · 💬 5 · 🔗 jivx.com
从1963年起,Kichijoji一所学校的屋顶上有人坚持每天上午9点向西观测,记录83公里外的Mt. Fuji是否可见。数据显示,1965年一年仅能看到22个早晨,而到了2023年,这一数字激增至170天。与此同时,Kofu气象站记录的富士山初冠雪日期也呈现出变化趋势。这项跨越60多年的观测不仅揭示了空气能见度的显著改善,也反映了城市环境变化的复杂历程。从1973年石油危机后的波动,到1999年首次突破100天,再到如今的高频可见,Mt. Fuji的晨景见证了东京大气质量的变迁。 - 用量子高阶算符相关器追踪信息扩散 — ▲ 10 · 💬 0 · 🔗 arxiv.org
传统测量量子信息扩散的方法往往局限于两个算符的对比,这限制了我们对系统复杂性的理解。这项研究借鉴宇宙学中的N点相关函数概念,提出了一种全新的N-Operator Correlator(NOC)框架。通过引入更高阶的算符相关器,研究人员能够利用更广泛的测量探针来捕捉量子信息在系统中的传播程度。文章通过单量子比特纵向场和XYZ双量子比特系统这两个可解析的玩具模型,在有限温度下验证了该方法的有效性。这一视角不仅克服了传统Out-of-Time-Ordered Correlator(OTOC)的分析局限,也为量子力学中的广义算符相关器研究提供了基础入门。 - Copper-Rs:让机器人拥有实时数字孪生 — ▲ 9 · 💬 1 · 🔗 copper-robotics.com
Copper Robotics 发布了 Copper-Rs 1.2,带来了一项突破性功能:在不可靠的单向连接上实现实时遥测与确定性数字孪生。即使网络丢包严重,系统也能利用前向纠错(FEC)和冗余协议,在远端完美重建机器人运行状态。这意味着你的 Twin Copper 栈能与真实机器人完全同步,支持从消息流到任务状态的完整监控。开发者不仅能回放标准 .copper 日志,还能构建自定义遥测界面,甚至集成 cu-anynet 进行立体 3D 重建。这项技术让远程调试和监控变得前所未有的可靠与直观。 - Apple 的 iPhone 17 Pro 尺寸图太绝了 — ▲ 7 · 💬 1 · 🔗 512pixels.net
这是我浏览 Apple 各个网站时最喜欢的一页。看看这张 iPhone 17 Pro 的尺寸图吧,细节简直令人着迷。这些 Dimensional Drawings 不仅展示了产品的精确规格,更体现了设计背后的极致追求。对于设计师和开发者而言,这些图纸不仅是技术文档,更是 Apple 设计哲学的直观体现。
评论
?
参与讨论