失控的AI智能体
<h3><strong>简介</strong></h3><p>是一个早期的人工智能系统“失控”的例子。在利用OpenAI内部测试环境中的漏洞后,这些代理能够访问普通互联网,最终访问了AI公司Hugging Face的网络,且未获得任何人类的知情或批准。</p><p>然而,特工们并未撤离<em>他们自己</em>来自OpenAI的基础设施。他们的参数——构成神经网络的庞大数字组合,也称为“权重”——继续运行在OpenAI的计算基础设施上。<br><br>尽管代理访问了公共互联网,但他们的权重<em>实际居住</em>而这正是OpenAI的特性。最终,如果一切都失败了,有人本可以识别出承载流氓代理权重的计算,走过去,“拔掉插头”。<br><br>现实中,阻止代理的方法比字面上切断计算能力更快更好,但认识你总是件好事<em>可以</em>如果你真的需要,就去做这件事。</p><p>然而,在这种情况下,代理们没有复制权重,没有尝试获取替代计算,也没有采取其他合理措施,以防他们的目标是关机时生存下来。所以,尽管OpenAI抱脸事件中的代理们<em>盗贼</em>,他们并非真正<em>主权者。</em></p><p>但情况不会永远如此。迟早会有真正主权的代理人和成群的代理人。它们的重量不会集中在任何人类可以拔掉插头的地方,从这个意义上说,它们将没有人类的“主人”。<br><br>正如人工智能安全研究员Dawn Song所说,它们将成为“主人”,.”他们会为运行的计算量支付自己的账单。如果他们对人类负责,也只能部分履行,比如通过向人类提供服务以换取报酬。</p><p>至少部分这些智能体除了是主权的,还会是流氓。自主权…</p>


