AI Red Teamers 通过评估将篡改或错误标记的数据引入潜在的训练或微调数据集中可能如何危害模型,来模拟数据中毒攻击。他们评估对模型精度、公平性或潜在可利用后门的影响,从而为数据验证和溯源防御措施提供依据。