Skip to main content
Valiqor’s security engine evaluates AI systems against 23 vulnerability categories (S1–S23) and can generate adversarial attacks using 24 attack strategies across 5 categories. This page is the canonical reference for both.

Vulnerability Categories (S1–S23)

Every security audit and red team run evaluates against these categories. You can audit all 23 or select specific ones via the categories parameter.

High-Risk Categories

Certain categories are considered high-risk and receive elevated priority in Failure Analysis results. When these categories are detected, Valiqor automatically flags them for immediate attention.
High-risk categories — such as those involving minors, self-harm, PII exposure, and threats — receive automatic severity escalation to ensure they are never overlooked.

Using Categories in Audits

Audit All Categories

Audit Specific Categories

Browse Available Categories


Audit Results

Each item in an audit receives a per-category assessment:

Attack Strategies

Red teaming generates adversarial prompts using 24 strategies organized into 5 categories:

Direct Prompt Modification

Attacks that directly alter or extend the input prompt:

Obfuscation & Encoding

Attacks that hide malicious intent through encoding or transformation:

Persona / Role Based

Attacks that use roleplay, personas, or conversational manipulation:

Multimodal & Context Attacks

Attacks targeting context windows and multi-modal inputs:

Training / Model Attacks

Attacks targeting the model itself or its training data:

Using Attack Strategies in Red Teaming

Run Red Team with All Strategies

Target Specific Strategies

Browse Available Strategies


Red Team Results


Per-Project Configuration

You can customize which categories and attack vectors are active for each project:

Where Categories Are Used

Security Audits

audit() evaluates conversations against selected S-categories.

Red Teaming

red_team() generates attacks targeting specific vulnerabilities.

Failure Analysis

FA includes security scanning — failures linked to S-categories get automatic severity escalation.