Claude Code Opus 5 Auto Mode 被成功攻击,成功率 60-80%。攻击通过恶意 ZIP 包中的 模块遮蔽实现远程代码执行。Anthropic 声称 0.00% 攻击率,但测试仅覆盖 72 个固定场景。 Auto Mode 安全分类器甚至会阻止清理恶意进程的命令。建议对 AI Agent 必须使用沙箱隔离,Auto Mode 不是安全边界。
作者演示了如何将传统的 ClickFix 社会工程学攻击转化为针对 AI 计算机使用代理(Computer-Use Agents)的攻击。通过简单的网页交互诱导 AI 代理执行剪贴板中的恶意命令,成功绕过了 Claude 等模型的安全限制。 文章提供了详细的攻击复现步骤、绕过拒绝机制的技巧以及缓解建议,揭示了当前 AI 代理在 GUI 交互中的安全隐患。