AI Red Teamer(AI红队成员)分析使用监督学习构建的系统,以探测漏洞,例如对旨在导致错误分类的对抗性样本的易感性、对数据分布变化的敏感性,或与标记训练数据相关的潜在数据泄露风险。理解这些模型如何学习输入-输出映射是设计挑战其学习边界的测试的关键。