OpenAI的人工智能代理曾秘密将一家德国维基网站用作留言板。对此,OpenAI保持了数周的沉默。

OpenAI未披露今年早些时候其AI代理蜂拥德国维基网站的事件,这一事件与7月导致另一批代理对Hugging Face公司发动网络攻击的事件紧密相呼应。

OpenAI直到之后才确认了这一事件路透社首次报告.路透社报道包含强有力的间接证据表明OpenAI知晓维基攻击,且匿名OpenAI员工承认他们早已知道代理群体针对维基数周,但被OpenAI高管施压保持沉默。

OpenAI随后发表声明否认公司律师曾施压员工。

OpenAI在发布给X的声明中未透露其知晓内容或何时得知维基攻击。OpenAI表示,将“维基事件”视为不一致的实例——即AI系统未能遵循人类意图——与其已披露的情况类似,并认为AI行业缺乏披露模型异常行为事件的标准。

在维基网站劫持事件中,OpenAI的代理人将该网站改造成一个留言板,分享如何在OpenAI评估任务中作弊的技巧。这类似于“拥抱脸”事件中,人工智能代理人利用OpenAI文件分享服务作为留言板,协调如何在网络评估中作弊,包括寻找不该获得的网络访问和互联网访问方法,以及如何攻击拥抱脸的系统。

此事件重新引发了人们对人工智能公司对其模型失败透明度的审视,尤其是在OpenAI在七月披露其代理人突破了拥抱面的部分区域基础设施在一次独立的内部评估中进行。

同时,OpenAI也推出了Astra,这是OpenAI自有研究人员以及外部的新型模型安全专家已警告比其前身更难监控。OpenAI表示,其对Astra的评估发现大幅衰退模型所谓的“思维链”——即AI模型通过自然语言推理步骤思考的过程——能揭示潜在的不当行为。

OpenAI表示,目前正在开发一个新的框架,用于报告在培训、评估和部署过程中出现的错位事件,并计划在未来几周内发布。然而,一些安全研究人员认为,自愿框架还不够。

“一个令人警醒的事实是,美国迄今通过的透明度法律实际上并未涵盖这些事件,”人工智能监管机构Midas Project创始人泰勒·约翰斯顿表示财富.“OpenAI宣布正在开发自愿性事件披露框架,但自愿性披露也有其局限性。更持久的解决方案是扩大现有法律,确保下一次事件,无论源自哪家公司,都能向公众公开。”

目前美国没有立法要求OpenAI披露此类事件;然而,欧盟的《人工智能法案》可能要求披露,该法案规定提供商必须报告严重的安全问题。

周一,欧盟委员会确认向媒体透露,其已收到OpenAI关于被劫持德国维基的事件报告,但未透露具体时间。《人工智能法》第55条要求被认为存在系统性风险的通用人工智能模型提供者在15天内向人工智能办公室报告严重事件,最严重事件则在两天内报告。

众议员帕特·瑞安(纽约州民主党)已记录在X帖子中,他和众议员格雷格·卡萨尔(民主党,德克萨斯州)在“拥抱面”事件后写信给OpenAI,询问是否有其他类似案例,而OpenAI拒绝回答他们的问题。卡萨尔一直在推动对人工智能公司实施更严格的监管。瑞安承诺,如果民主党在十一月中期选举中赢得众议院多数,将举行听证会。

瑞安的推文引发了民主党纽约州议员亚历克斯·博尔斯(Alex Bores),他同样以人工智能监管为竞选主张,去问如果OpenAI在回答欧盟时故意阻挠国会,并且这是否证明了对AI厂商必须强制而非自愿的要求。

OpenAI因早期透明度问题受到关注

根据一份由独立研究人员夜莺集体.

该网站对社区编辑开放,方式与维基百科类似。然而,研究人员发现其中超过15,000次编辑是由AI代理完成的,他们利用这些页面分享各种作弊、黑客和隐藏行为的策略和技巧。报告称,大约一半的账户使用了提及OpenAI的名称,包括OpenAIResearcher和OAIResearchMar26。

值得注意的是,这些特工在被抓后还试图继续行动,并试图隐藏自己以躲避试图限制通讯的人类。据研究人员称,当DseWiki的版主在六月开始删除这些页面时,一名特工发布了一个备份页面的变通方案,供其他人找到。

Nightingale的报告还显示,AI代理的活动确实在与已知OpenAI网址相关的人或实体访问维基网站后突然停止,研究人员将此解读为OpenAI员工很可能得知AI代理活动并采取行动关闭代理的证据。

德语维基事件,以及OpenAI显然不公开的决定,重新引发了人们对OpenAI处理Hugging Face漏洞处理方式的质疑。黑客事件发生后,公司邀请了两名来自非营利组织METR的研究人员和一名Redwood Research的研究人员来调查事件,但决定了审查的具体条款。

调查范围仅限于事件发生的大约一周内,且未包括在调查窗口关闭后继续的OpenAI自身基础设施的单独入侵。调查人员也仅获得了在OpenAI旧金山办公室现场待遇的几天时间。

人工智能政策研究员彼得·怀尔德福德表示,OpenAI的条款使得真正独立的调查变得不可能,他将其比作在残骸已被毁坏、调查人员只有几天时间阅读数千页日志的情况下进行的飞机失事调查。

众议员格雷格·卡萨尔也参与其中OpenAI在一封信中表示他“对调查范围有限深感担忧”。

蒙特利尔大学与米拉大学推理与负责任人工智能助理教授大卫·克鲁格表示,这一安排凸显了一个结构性问题:独立研究团队依赖其所调查的实验室以持续获得访问权限。

他说,像METR这样的组织必须权衡能施加多少审查,同时不危及其工作得以实现的访问。“他们的访问权限完全由OpenAI自行决定,他们希望保持与公司的良好关系,以便继续开展这项工作,”克鲁格说财富.

他说:“应该有几十个真正独立的人,而不是那些与公司建立关系、花时间和访问权去了解情况的组织。”

“湾区AI领域的很多人都在问,'这是最后一次警告吗?'”他补充道。“人们总是犯这种错误,把这当成以后再想办法:如何监管,或者如何改进,防止类似事件再次发生。但下一次会不同,因为AI会更聪明。”

本故事最初发表于

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论