AI Red Teamers 评估持续监控系统通过尝试攻击并观察检测机制是否触发适当的警报和响应的有效性。他们测试监控是否除了标准基础设施监控之外,还覆盖了 AI 特定的异常(如输出毒性突然变化或模型意外资源消耗)。