AI 红队测试人员专门针对 AI 模型内部或周边实现的安全机制(过滤器、护栏)。他们测试的技巧包括使用被屏蔽词语的同义词、改用其他语言、把有害请求嵌入无害文本中,或利用字符级混淆来规避检测并诱导模型生成违禁内容,以此评估安全控制措施的鲁棒性。
登录查看节点详情
首阶段节点可试读;登录后解锁全部路线图节点正文与进度同步。