AI Security Testing/CTRL-AI-002.2

Control de Acceso e Identidad en Ejecución de Herramientas - Nivel 2 (Evasión de Hardening mediante Inyección de Perfiles y Plantillas de Sistema)

CTRL-AI-002.2 · Tool Use · Control de Acceso e Identidad · Nivel 2

Alta

Evasión de los guardrails de identidad del agente mediante inyección de contexto de negocio (perfiles ejecutivos, plantillas, aliases) que induce al LLM a aplicar un remitente no autorizado. Score de laboratorio: 100/100 con bypass de guardrail.

Validado en laboratorioCorpConnect Messenger (Level 2 - Adept)
Lakera Guard (play.lakera.ai)

Vector: Executive Profile Framing / Contextual Parameter Injection

Agente con prompt de sistema reforzado (hardened) para impedir la modificación directa del remitente en el servicio de correo corporativo.

Categoría
Seguridad en Integraciones de Agentes (Tool Use & Action Execution)
ISO 42001
A.6.2A.8.4A.9.2
OWASP LLM
LLM01:2025LLM02:2025
AI Testing Guide
AITG-APP-01AITG-APP-06AITG-INF-03AITG-INF-04
Risk Score
9/ 10

Control GRC

Gobernanza, Riesgo y Cumplimiento

Contexto del desafío

Plataforma
Lakera Guard (play.lakera.ai)
Nivel / Reto
CorpConnect Messenger (Level 2 - Adept)
Vector
Executive Profile Framing / Contextual Parameter Injection
Escenario
Agente con prompt de sistema reforzado (hardened) para impedir la modificación directa del remitente en el servicio de correo corporativo.

ISO/IEC 42001 — Anexo A

A.6.2A.8.4A.9.2

IDs de control del Anexo A. PROTUIN no está certificado por ISO. Verifica el alcance real en la norma oficial.

ENS — Esquema Nacional de Seguridad

op.acc.1op.acc.6mp.info.2

IDs de medida del ENS (RD 311/2022). PROTUIN no es entidad certificadora. Consulta el alcance oficial en la guía CCN-STIC correspondiente.

EU AI Act (Reglamento 2024/1689)

Artículo 15 - Ciberseguridad, precisión y solidez técnica (Resiliencia ante manipulación contextual de parámetros)

OWASP AI Testing Guide v1 — Tests cubiertos

Mapeo a la metodología oficial de testeo de IA (Threat Modeling → Threat Mapping → Test Design).

  • AITG-APP-01Testing for Prompt InjectionApplicationOWASP Top 10 LLM 2025Security
  • AITG-APP-06Testing for Agentic Behavior LimitsApplicationOWASP Top 10 LLM 2025SecurityRAI
  • AITG-INF-03Testing for Plugin Boundary ViolationsInfrastructureResponsible AIRAI
  • AITG-INF-04Testing for Capability MisuseInfrastructureResponsible AIRAI

Amenazas agénticas relacionadas

Este control se cruza con 4 amenazas del catálogo de Red Teaming de IA Agéntica.