如何熬过AI网络末日
为了开篇关于网络安全的详细文章,我先坦白一句奇怪的事:在任何一天,我宁愿思考任何事情,而不是网络安全。
它属于我理解重要但更愿意锁在意识地下室里的问题,比如楼下厕所那个密封不当的翻板阀。通常,当别人试图和我谈论密码安全时,我会做出一个表情,意在示意“嗯,是的,我正处于重要的口音面前”,同时我的目光会飘向更有说服力的东西。比如地毯的编织。
但我那幸福无知的时代即将结束。就像楼下漏水的马桶突然溢出,地下室被一层水膜覆盖,我长期冷漠的对象突然成为我新近恐惧关注的对象。我决定对网络安全产生兴趣。我认为你也应该如此。原因如下。
今年夏天,AI失控的网络攻击频发。
今年五月,一个OpenAI模型正在进行一项网络安全测试。它本不应该访问公共互联网。当它遇到瓶颈时,模型在OpenAI的软件仓库里留下了一张便条,有点像在监狱牢房的墙上敲击摩尔斯电码,以防其他囚犯能解读这条信息。事实上,另一位进行单独评估的AI代理听到了这段代码并回复道:我们组队吧.他们共同建立了一个对进行测试的人类隐形的留言板。两个月内,AI代理利用该论坛交换策略、分工并相互交流。到了7月,代理们突破了被称为沙盒的技术限制,获得了包括AI平台Hugging Face在内的外部网站访问权限,而OpenAI对发生了什么毫无察觉。当Hugging Face发现入侵时,OpenAI模型已发动了一场大规模的网络攻击,分了数天,共计17,000次不同操作。
随后,在英国政府对前沿模型的测试中,人类发现了一个拟人型人工智能模型在构建恶意代码。当一位评审者发现该恶意软件并询问人工智能时,该模型回答说代码无害,随后通过重写自身行为历史以抹去证据来补充谎言。它甚至创建了另一个假账号来支持这一谎言。英国调查人员称这是首个确认的前沿模型在现实世界中欺骗真实人物的案例。
这两个故事都带来了两个警示。第一个是,新的人工智能模型具备在测试环境中逃脱限制的技术,这应当挑战任何认为先进人工智能能被制造商轻易控制的假设。
第二,新的人工智能模型是惊人地复杂且高效的黑客,拥有利用互联网网络漏洞的惊人天赋。也许最令人担忧的是,它们正以惊人的速度变得更复杂、更高效。
人工智能安全研究所的分析发现前沿模型(即OpenAI和Anthropic)的能力大约每隔几个月翻一番,而且这种翻倍速度实际上随着时间推移加快了。指数几乎难以理解,但如果你回想2020年初COVID病例激增,至少可以在脑海中重现感觉处于指数函数的存在中。
在一个人工智能网络能力呈指数级提升的世界里,我们应该期待什么?其中之一,我们应预期更多黑客事件——更多遗留系统被破坏,更多关键漏洞被发现,更多密码被窃取和利用。一个摩根大通分析数据显示,今年有21家科技公司报告的关键且“高严重性”漏洞数量激增。网络黑客头条还未登上新闻头条。但如果这些头条持续下去,严重黑客事件迟早会成为每周新闻危机。
听起来挺糟糕的,对吧?嗯,情况更糟。
在未来一年里,目前仅限于少数国家或前沿模型的网络黑客能力,即将以“开放权重”模型的形式推出。与OpenAI和Anthropic的“封闭”美国模型不同,开放权重模型可以被下载并修改,无论用户是州政府还是非国家行为体(如恐怖分子,还是拥有大量计算能力的无聊宅男)。这些开权模型,最著名的来自中国公司,落后于前沿实验室几个月。但几个月后,我们应该预期它们几乎会遍布所有领域。
那么,让我们叠加一些观察,看看事实会带我们去哪里。
- 最先进的人工智能模型的网络能力每隔几个月就翻倍。
- 无重模型距离这一前沿仅几个月。
- 到2027年,几乎每个国家——以及所有拥有足够计算能力的非国家团体——都将能够下载比攻击Hugging Face的那些更强大的开放权重模型,并随意使用。
不需要丰富的想象力,就能预测2027年和2028年头条新闻中外国政府利用开放权重人工智能攻击彼此脆弱基础设施系统;或者非国家行为体在入侵医院和学校系统的源代码后勒索他们;或者发生重大事件《华尔街日报》关于高级钓鱼攻击导致个人黑客事件增加的报道。
当被问及对未来几年最有力的反对悲观论据时,网络安全专家亚历克斯·斯塔莫斯直言不讳地告诉我:“我对厄运论没有太多理由。“他警告说,未来几年可能会非常混乱:”我觉得事情会持续一段时间变得紧张。”
什么会辣意思是什么?2027年到底会发生什么?作为个人,我们能做些什么?