AI 红队测试通过对抗性提示,刻意对 AI 系统进行测试,以发现漏洞、偏见或有害行为。团队尝试让模型生成不合预期的输出、绕过安全措施或表现出有问题的行为。此过程有助于在部署前识别弱点,并提升 AI 的安全性和鲁棒性。
登录查看节点详情
首阶段节点可试读;登录后解锁全部路线图节点正文与进度同步。