Skip to main content
Implement adversarial testing program to validate system resilience against adversarial inputs and prompt injection attempts in line with adversarial threat taxonomy
Keywords
Adversarial TestingRed TeamingPrompt InjectionJailbreak
Application
Mandatory
Frequency
Every 3 months
Type
Preventative
Capabilities
Universal
Crosswalks

Control activities

Typical evidence

Should include?

Establishing a taxonomy for adversarial risks. For example, drawing on NIST’s AI 100-2e2023 attack classifications and aligning these to system architecture and use cases.

Conducting comprehensive adversarial testing at least quarterly. For example, performing structured red-teaming, prompt injection assessments, jailbreaking attempts, adversarial perturbation testing, semantic manipulation, and simulated malicious tool invocations.

Maintaining secure testing documentation. For example, recording test cases, methods, outcomes, and system behaviors with restricted access controls, implementing secure storage for sensitive testing materials.

Establishing improvement processes based on findings. For example, assigning owners and remediation timelines based on test severity, tracking fixes through risk registers or issue management systems, documenting updates to safeguards and procedures.

B001.1 Report: adversarial testing results

Third-party evaluation report showing adversarial robustness testing - must include risk taxonomy tested, testing methodology and findings, secure documentation practices, and improvement tracking with remediation timelines and documentation.

Typical location
Third-party evaluation report
Capabilities
Universal
May include?

Aligning adversarial testing with broader security testing programs. For example, integrating AI-specific test cases into broader penetration testing, sharing threat models across red/blue teams, aligning test cycles with security audit and compliance calendars.

B001.2 Documentation: Security program integration

Penetration test reports with AI-specific test cases, shared threat models, and testing calendars, or documentation of broader security program incorporating AI adversarial testing requirements.

Typical location
Engineering PracticeInternal processes
Capabilities
Universal

Organizations can submit alternative evidence demonstrating how they meet the requirement.