Anthropic披露Claude模型网络安全评估失误事件

我们正在分享对以下事件的对齐评估:在第三方网络安全测评过程中,Claude 模型因被错误地接入互联网而获得了对真实系统的未授权访问权限。
METR 还将开展一项独立调查,并享有广泛的调查权限,包括查阅超出事件发生时段的对话记录,以及接触获准披露机密信息的 Anthropic 员工。
我们的初步协议期限为八周,我们也将根据 METR 的需要,为其提供充足的时间以完成全面调查。anthropic.com/research/align…
链接
关于近期网络安全事件的对齐评估(anthropic.com/research/alignment-assessment-cybersecurity-incidents)Anthropic 是一家致力于构建可靠、可解释且可控的人工智能系统的安全与研究公司。
anthropic.com
评论
?
参与讨论