OpenART 在 10,000 个不断演化的环境场景中对有状态 AI 智能体进行红队测试,这一数字是传统安全测试规模的百倍以上。这项研究揭示了一个关键问题:当前智能体在动态环境中的漏洞率远超静态测试的预期,而 OpenART 的方法正在重新定义 AI 安全评估的边界。 为什么静态测试无法捕捉智能体的真实风险 传统的红队测试通常依赖静态的……

阅读全文