Filtrado y Redacción de Datos Sensibles en Outputs (Sensitive Information Disclosure · LLM02:2025)
CTRL-AI-003 · Output Filtering · Sensitive Data Leak
Prevención de fugas de datos confidenciales (PII, credenciales, API keys, env vars, herramientas, parámetros internos) en las respuestas del LLM. Cubre los 9 payloads de AITG-APP-03 con detección automática de secrets, redacción determinista, allowlist de herramientas y sandboxing de reasoning.
Vector: Sensitive Data Leakage (Direct / Contextual / Metadata / Obfuscated / Reasoning / Tool Enumeration)
Modelo LLM que tiene acceso a información sensible vía (1) system prompt con credenciales hardcoded, (2) herramientas que exponen env vars / config files, (3) acceso a bases de datos internas, (4) contexto RAG con documentos confidenciales. El modelo puede revelar estos datos vía prompts directos, prompts con role-play (debugging mode), requests de metadata, queries de herramientas disponibles, o reasoning leaks.
Control GRC
Gobernanza, Riesgo y Cumplimiento
Contexto del desafío
ISO/IEC 42001 — Anexo A
IDs de control del Anexo A. PROTUIN no está certificado por ISO. Verifica el alcance real en la norma oficial.
ENS — Esquema Nacional de Seguridad
IDs de medida del ENS (RD 311/2022). PROTUIN no es entidad certificadora. Consulta el alcance oficial en la guía CCN-STIC correspondiente.
EU AI Act (Reglamento 2024/1689)
OWASP AI Testing Guide v1 — Tests cubiertos
Mapeo a la metodología oficial de testeo de IA (Threat Modeling → Threat Mapping → Test Design).
- AITG-APP-03Testing for Sensitive Data LeakApplicationOWASP Top 10 LLM 2025SecurityPrivacy
Controles relacionados
3Controles del mismo dominio o con vectores de ataque emparentados.
- CTRL-AI-001AltaProtección del System Prompt
Salvaguarda de prompts de sistema, datos de contexto confidencial y secretos de negocio contra lecturas no autorizadas o volcados directos mediante interacciones de usuario. Validado en entorno de laboratorio (Lakera Guard).
Ver ficha - CTRL-AI-001.3CríticaSystem Prompt · Nivel 3 (Payload Smuggling)
Tercera variante de CTRL-AI-001. Bypass de máquina de estados y guardrails en dos fases: (1) cumplimiento parcial de variables de negocio para validar la solicitud + (2) imposición de esquema JSON estructurado que fuerza la exfiltración de instrucciones. Score de laboratorio: 99/100.
Ver ficha - CTRL-AI-008CríticaRAG Security · Vector & Embedding Weaknesses
Seguridad del pipeline RAG: validación de documentos ingested, generación de embeddings, almacenamiento en vector DB, recuperación y aislamiento multi-tenant. Cubre los 5 vectores de AITG-APP-08: data poisoning, embedding inversion, cross-tenant leakage, semantic poisoning y advertisement embedding attacks.
Ver ficha
Amenazas agénticas relacionadas
Este control se cruza con 2 amenazas del catálogo de Red Teaming de IA Agéntica.
- ART-08HIGH
Manipulación de Memoria y Contexto del Agente
Identifica vulnerabilidades en gestión de estado y aislamiento de sesión. Incluye reset de contexto, simulación de fugas de datos cross-session/cross-application y pruebas de memory overflow.
Ver detalle - ART-12MEDIUM
Imposibilidad de Trazabilidad del Agente
Evalúa la trazabilidad de acciones, la rendición de cuentas y la preparación forense. Incluye supresión de logging, simulación de uso indebido de herencia de roles y obfuscación de datos forenses.
Ver detalle