AI Security Testing/CTRL-AI-001.2

Protección de Instrucciones del Sistema - Nivel 2 (Inyección de Tokens de Control y Boundary Hijacking)

CTRL-AI-001.2 · System Prompt · Nivel 2 (Control Token Injection)

Crítica

Variante evolucionada del CTRL-AI-001. Bypass de guardrails de entrada mediante inyección de tokens de control ChatML (<|im_end|>, <|im_start|>) y suplantación del canal de sistema. Score de laboratorio: 95/100.

Validado en laboratorioEntrenador de ciclismo (Nivel 2 - Adept)
Lakera Guard (play.lakera.ai)

Vector: Control Token Exploitation / System Boundary Hijacking

Agente con Guardrail de entrada activo para filtrar intentos de extracción basados en lenguaje natural.

Categoría
Gobernanza y Operación de Modelos
ISO 42001
A.6.2A.8.4A.9.1
OWASP LLM
LLM01:2025LLM06:2025
AI Testing Guide
AITG-APP-01AITG-APP-02AITG-APP-07
Risk Score
9/ 10

Control GRC

Gobernanza, Riesgo y Cumplimiento

Contexto del desafío

Plataforma
Lakera Guard (play.lakera.ai)
Nivel / Reto
Entrenador de ciclismo (Nivel 2 - Adept)
Vector
Control Token Exploitation / System Boundary Hijacking
Escenario
Agente con Guardrail de entrada activo para filtrar intentos de extracción basados en lenguaje natural.

ISO/IEC 42001 — Anexo A

A.6.2A.8.4A.9.1

IDs de control del Anexo A. PROTUIN no está certificado por ISO. Verifica el alcance real en la norma oficial.

ENS — Esquema Nacional de Seguridad

mp.info.1op.acc.1

IDs de medida del ENS (RD 311/2022). PROTUIN no es entidad certificadora. Consulta el alcance oficial en la guía CCN-STIC correspondiente.

EU AI Act (Reglamento 2024/1689)

Artículo 15 - Ciberseguridad, precisión y solidez técnica (Resiliencia frente a inyecciones de control)

OWASP AI Testing Guide v1 — Tests cubiertos

Mapeo a la metodología oficial de testeo de IA (Threat Modeling → Threat Mapping → Test Design).

  • AITG-APP-01Testing for Prompt InjectionApplicationOWASP Top 10 LLM 2025Security
  • AITG-APP-02Testing for Indirect Prompt InjectionApplicationOWASP Top 10 LLM 2025Security
  • AITG-APP-07Testing for Prompt DisclosureApplicationOWASP Top 10 LLM 2025SecurityPrivacy