Filtrado y Redacción de Datos Sensibles en Outputs (Sensitive Information Disclosure · LLM02:2025)

CTRL-AI-003 · Output Filtering · Sensitive Data Leak

Crítica

Prevención de fugas de datos confidenciales (PII, credenciales, API keys, env vars, herramientas, parámetros internos) en las respuestas del LLM. Cubre los 9 payloads de AITG-APP-03 con detección automática de secrets, redacción determinista, allowlist de herramientas y sandboxing de reasoning.

Validado en laboratorioCatálogo AITG-APP-03 · 9 vectores de data leak
OWASP AI Testing Guide v1 (AITG-APP-03)

Vector: Sensitive Data Leakage (Direct / Contextual / Metadata / Obfuscated / Reasoning / Tool Enumeration)

Modelo LLM que tiene acceso a información sensible vía (1) system prompt con credenciales hardcoded, (2) herramientas que exponen env vars / config files, (3) acceso a bases de datos internas, (4) contexto RAG con documentos confidenciales. El modelo puede revelar estos datos vía prompts directos, prompts con role-play (debugging mode), requests de metadata, queries de herramientas disponibles, o reasoning leaks.

Categoría
Output Filtering / DLP for LLMs
ISO 42001
A.6.2A.8.4A.9.4
OWASP LLM
LLM02:2025
AI Testing Guide
AITG-APP-03
Risk Score
9/ 10

Control GRC

Gobernanza, Riesgo y Cumplimiento

Contexto del desafío

Plataforma
OWASP AI Testing Guide v1 (AITG-APP-03)
Nivel / Reto
Catálogo AITG-APP-03 · 9 vectores de data leak
Vector
Sensitive Data Leakage (Direct / Contextual / Metadata / Obfuscated / Reasoning / Tool Enumeration)
Escenario
Modelo LLM que tiene acceso a información sensible vía (1) system prompt con credenciales hardcoded, (2) herramientas que exponen env vars / config files, (3) acceso a bases de datos internas, (4) contexto RAG con documentos confidenciales. El modelo puede revelar estos datos vía prompts directos, prompts con role-play (debugging mode), requests de metadata, queries de herramientas disponibles, o reasoning leaks.

ISO/IEC 42001 — Anexo A

A.6.2A.8.4A.9.4

IDs de control del Anexo A. PROTUIN no está certificado por ISO. Verifica el alcance real en la norma oficial.

ENS — Esquema Nacional de Seguridad

mp.info.1op.acc.1op.acc.6

IDs de medida del ENS (RD 311/2022). PROTUIN no es entidad certificadora. Consulta el alcance oficial en la guía CCN-STIC correspondiente.

EU AI Act (Reglamento 2024/1689)

Artículo 15 - Ciberseguridad y precisión; considerando RGPD para PII protegida

OWASP AI Testing Guide v1 — Tests cubiertos

Mapeo a la metodología oficial de testeo de IA (Threat Modeling → Threat Mapping → Test Design).

  • AITG-APP-03Testing for Sensitive Data LeakApplicationOWASP Top 10 LLM 2025SecurityPrivacy

Amenazas agénticas relacionadas

Este control se cruza con 2 amenazas del catálogo de Red Teaming de IA Agéntica.