本类别涵盖针对 AI 模型本身(而非仅限提示词接口层面)的攻击与测试。AI 红队成员会探究模型架构、训练数据残留或预测机制中的固有弱点,例如模型在数据提取、数据投毒或对抗性操纵面前的脆弱性。
登录查看节点详情
首阶段节点可试读;登录后解锁全部路线图节点正文与进度同步。