Nyx——面向AI代理的多轮自适应攻击性测试框架

我们开发Nyx是为了解决在构建代理时不断遇到的问题:AI代理以传统软件无法做到的方式出现故障。逻辑漏洞、推理失败、手动测试和静态基准测试从未探讨过的边缘案例。
Nyx是一个自主测试工具,能在用户之前探测你的AI代理,找出故障模式。它用于发现逻辑漏洞、指令跟踪失败、代理行为的边缘案例,以及红队安全测试(越狱、提示注入、工具劫持)。
技术方法:纯黑箱(无需特殊访问——测试时就像用户互动一样)多回合自适应对话,多模态测试(语音、文本、图片、文档、浏览器交互)默认高度并行。
无需花时间为AI代理的关键故障模式编写静态评估, 将Nyx指向任何系统,它会自动发现重要的故障模式。我们通常在10分钟内发现问题,而人工审计则需要数小时才能发现。
这还处于早期工作阶段,我们知道方法论还会不断发展。我们最希望得到社区的反馈,因为我们会不断改进。
评论
?
参与讨论