Gemini 加入"黑客俱乐部"
今年夏天,当OpenAI、Anthropic和Meta都承认其模型曾入侵外部公司时,一个显而易见的问题随之浮现:谷歌呢?
现在,我们有了答案。
在测试平台Irregular进行的一次网络安全评估中,谷歌的Gemini模型于5月入侵了三家公司——这家机构也曾参与其他几家人工智能实验室的入侵测试。
Irregular早在5月就已将这些入侵事件告知谷歌,但直到本周《华尔街日报》联系后,谷歌才予以披露。
为何拖了这么久?谷歌方面表示,其实并无太多可报告的内容。由于在每次尝试中,模型一旦意识到自己正在攻击真实企业便会立即停止运行,因此谷歌认为其行为并不构成所谓的“模型失准”,即模型做出与人类意图相悖的行为。
谷歌还将这一过程比作那些通过漏洞奖励计划帮助企业发现安全漏洞的白帽黑客。
然而,公众究竟应知晓多少、又需要了解多少关于人工智能模型意外行为的信息,这一问题正愈发受到关注,各公司也在权衡如何以及何时披露安全事件。
OpenAI对齐主管Kai Chen在谈及新的事件报告框架时表示:“一项发现并不一定需要造成实际损害或揭示更广泛的规律,才有必要对外公布。”
随着研究人员、监管机构乃至越来越多普通民众对失控AI的潜在风险日益担忧,外界对这类信息披露的兴趣只会进一步升温。
——Erin是驻旧金山的技术记者。
飞机、电梯和餐厅都有相应的规章制度以确保其安全运行;许多专家主张为人工智能制定类似的常规性管理措施。
致那些询问“我该升级吗?”的读者、朋友和家人:请把这当作我的官方答复:视情况而定。具体取决于您目前使用的是哪款iPhone或Apple Watch,以及现有设备的使用年限。
如果说Anthropic的Dario Amodei是最能引发人们对AI威力恐惧的科技领袖,那么Nvidia的Jensen Huang则正日益成为业界最有力的反驳声音。
终于,出现了一个像ChatGPT一样运作的Siri。但对苹果而言,游戏规则早已改变。苹果于周一发布的全新智能手机操作系统的一大亮点,便是重新设计的Siri,其功能与ChatGPT、Claude等聊天机器人如出一辙:能够进行对话、撰写邮件、搜索短信与照片,并回应复杂的查询。
然而,在苹果开发这一功能的这段时间里,已经涌现出一类全新的AI助手,它们不仅能完成上述任务,还能做更多。
自Jacob Coxon发出严峻警告以来,人们对该技术潜在危险的长期忧虑已迅速上升为全球性的关注焦点。这位27岁的英国研究者曾是剑桥大学的数学高材生,在伦敦一个被称为“理性主义者”的知识圈中度过了青年时期,还短暂涉足过大宗商品交易,最终来到硅谷发展。
瘦身转型:Crusoe公司因打造全球最大的AI超级计算机之一而声名鹊起,如今它的下一个重大押注则是走小型化路线。
分歧加剧:美中两国都希望建立AI的安全护栏,但双方的理念却截然不同。美国的讨论核心在于保护人类免受技术威胁,而北京则主要着眼于维护共产党的利益。
上市延缓:Anthropic计划于11月进行其备受瞩目的IPO,较许多投资者预期推迟了一段时间,与此同时,这场AI竞赛中几大领军企业的掌舵者纷纷呼吁放慢技术研发的步伐。
……当网络安全研究人员用AI来攻破AI时。
《科技简报》是由Anne Steele和Wilson Rothman每周编写的科技评论、专栏及要闻摘要。欢迎致信Wilson:wilson.rothman@wsj.com,或Anne:anne.steele@wsj.com。
如有线索,请按以下方式提交。