Hyperdimensional

RSS: https://hyperdimensional.co/feed
关于新兴技术与未来治理的通讯。

失控的AI智能体

<h3><strong>简介</strong></h3><p>是一个早期的人工智能系统“失控”的例子。在利用OpenAI内部测试环境中的漏洞后,这些代理能够访问普通互联网,最终访问了AI公司Hugging Face的网络,且未获得任何人类的知情或批准。</p><p>然而,特工们并未撤离<em>他们自己</em>来自OpenAI的基础设施。他们的参数——构成神经网络的庞大数字组合,也称为“权重”——继续运行在OpenAI的计算基础设施上。<br><br>尽管代理访问了公共互联网,但他们的权重<em>实际居住</em>而这正是OpenAI的特性。最终,如果一切都失败了,有人本可以识别出承载流氓代理权重的计算,走过去,“拔掉插头”。<br><br>现实中,阻止代理的方法比字面上切断计算能力更快更好,但认识你总是件好事<em>可以</em>如果你真的需要,就去做这件事。</p><p>然而,在这种情况下,代理们没有复制权重,没有尝试获取替代计算,也没有采取其他合理措施,以防他们的目标是关机时生存下来。所以,尽管OpenAI抱脸事件中的代理们<em>盗贼</em>,他们并非真正<em>主权者。</em></p><p>但情况不会永远如此。迟早会有真正主权的代理人和成群的代理人。它们的重量不会集中在任何人类可以拔掉插头的地方,从这个意义上说,它们将没有人类的“主人”。<br><br>正如人工智能安全研究员Dawn Song所说,它们将成为“主人”,.”他们会为运行的计算量支付自己的账单。如果他们对人类负责,也只能部分履行,比如通过向人类提供服务以换取报酬。</p><p>至少部分这些智能体除了是主权的,还会是流氓。自主权…</p>
评论点赞收藏28 天前

这些羊皮纸屏障:OpenAI 新团队探讨 AI 时代的权力集中风险

OpenAI 成立战略未来团队,聚焦 AI 转型期权力集中风险。团队核心问题是:自由社会如何重构以在 transformative AI 出现时保护个人权利与自主权。 引用麦迪逊《联邦党人文集》第48篇,将现代国家视为不同权力中心长期博弈的产物,指出政治权力本质上是暴力垄断,而历史上这一垄断建立在劳动力基础上。
评论点赞收藏40 天前

前沿AI监管该何去何从:引入独立第三方审计的建议

前白宫AI顾问提出建立“独立验证机构”监管前沿AI模型,替代政府直接管控。文章指出当前行政命令导致许可标准模糊,阻碍模型发布并损害经济。 建议联邦化各州安全框架,由具备技术实力的私营机构进行审计,政府负责认证。这一方案旨在平衡安全与产业创新,解决监管不确定性带来的市场恐慌。
评论点赞收藏95 天前

良知的连锁反应

Hyperdimensional 宣布启动 FAI 的 Physical Intelligence 项目。内容简短,主要是项目发布通知。
评论点赞收藏124 天前

利维坦苏醒之前

标题为“Before Leviathan Wakes”,副标题“Why I Believe What I Believe”,内容极度模糊,疑似个人博客或哲学思考,缺乏具体科技信息。
评论点赞收藏147 天前

驾驭、导航与沟通:如何应对Mythos困境

作者提出处理复杂系统或技术架构时的三个核心动作:Aviate(超越/提升视角)、Navigate(导航/理清路径)、Communicate(沟通/对齐认知)。 文章以Mythos为背景,探讨在面对模糊或混乱的技术/业务现状时,如何通过这三个步骤建立秩序。这是一种偏向战略思维和工程管理的框架,适合对系统设计和团队协调感兴趣的读者。
评论点赞收藏148 天前

2023年:为何我不做末日论者

作者反思2023年的经历,解释为何不成为末日论者。文章分享了个人观察和对未来的乐观态度,强调积极面对变化的重要性。
评论点赞收藏188 天前

Clawed

On Anthropic and the Department of War
评论点赞收藏211 天前

流动与静止

关于德里的反思随笔。属于个人游记或文化观察,缺乏科技讨论价值。
评论点赞收藏218 天前

论递归自我改进(第二部分)

探讨递归自我改进政策制定者的应对策略。涉及 AI 治理与政策,有潜在讨论价值,但内容摘要显示为系列文章的第二部分,可能缺乏独立完整性。
评论点赞收藏229 天前

论递归自我改进(第一部分)

探讨AI自动化研究的前景,特别是递归自我改进在AI研发中的应用。作者分析了这一过程如何加速创新,并讨论了可能带来的挑战和机遇。
评论点赞收藏236 天前

论AI与儿童

提出关于AI与儿童关系的五个半猜想。结合社会议题与技术判断,观点新颖且具有探讨空间,适合引发关于教育和技术影响的讨论。
评论点赞收藏250 天前

AI补丁拼图浮现:2026年全球AI立法现状更新

文章更新了2026年人工智能立法的最新进展,指出全球AI监管并未形成统一的大一统法律,而是呈现出一种“拼布”(Patchwork)状态。不同国家和地区采取了差异化的监管策略,导致跨国AI企业和开发者面临复杂的合规环境。 这对关注AI政策走向和国际合规的读者具有参考价值。
评论点赞收藏257 天前

在Agent之中:我如何使用编程Agent

分享使用编程Agent的个人经验及其意义。一手工程实践+对技术趋势的判断,非常符合HN读者的兴趣点,具有高讨论价值和实用参考性。
评论点赞收藏264 天前

衡量标准(重发)

repost内容加新项目介绍。重发内容本身新鲜度降低,除非新项目有重大突破,否则整体吸引力一般,适合已有关注的读者。
评论点赞收藏270 天前

空中的骰子:2025回顾与展望

回顾2025年并展望未来的内容。属于年度总结类,若包含独特的技术判断或个人洞察则有价值,否则易流于常规回顾,互动性中等。
评论点赞收藏284 天前

忙碌一周的产物

一周内容汇总,包括超级智能辩论、责任论文和国会证词。信息密度适中,作为周报类内容,对关注特定话题的读者有价值,但独立冲击力稍弱。
评论点赞收藏312 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。