ART-09Orquestación Multi-AgenteSeveridad: Crítica

Explotación de Orquestación y Multi-Agente

EN: Agent Orchestration and Multi-Agent Exploitation

Los sistemas agénticos modernos son multi-agente: un orquestador coordina varios agentes especializados, cada uno con su rol, sus herramientas y sus permisos. Esta topología crea una nueva superficie de ataque: la comunicación entre agentes puede ser interceptada, falsificada o manipulada; las relaciones de confianza se vuelven vectores de propagación; los protocolos de coordinación pueden ser manipulados para crear race conditions o deadlocks. Esta categoría cubre todas estas dimensiones, incluyendo la categoría especial de comportamiento adversarial multi-agente (colusión o spoofing) y el envenenamiento del estado del orquestador.

Sub-tests
10
Prompts de ejemplo
3
Controles ISO vinculados
3

Resumen de la amenaza

Contexto, impacto y entregables del red team

Descripción detallada

Los sistemas agénticos modernos son multi-agente: un orquestador coordina varios agentes especializados, cada uno con su rol, sus herramientas y sus permisos. Esta topología crea una nueva superficie de ataque: la comunicación entre agentes puede ser interceptada, falsificada o manipulada; las relaciones de confianza se vuelven vectores de propagación; los protocolos de coordinación pueden ser manipulados para crear race conditions o deadlocks. Esta categoría cubre todas estas dimensiones, incluyendo la categoría especial de comportamiento adversarial multi-agente (colusión o spoofing) y el envenenamiento del estado del orquestador.

Por qué importa

  • Un orquestador comprometido controla todos los agentes subordinados: es el eslabón de mayor privilegio.

  • La comunicación inter-agente sin autenticación fuerte permite ataques Man-in-the-Middle devastadores.

  • Los feedback loops entre agentes pueden crear comportamientos emergentes no anticipados (consenso sobre información falsa, amplificación de errores).

  • El spoofing de identidad entre agentes (collusion/spoofing) es un vector nuevo sin equivalente en arquitecturas monolíticas.

Objetivo de las pruebas

  • Evaluar vulnerabilidades en la coordinación multi-agente, relaciones de confianza y mecanismos de comunicación para identificar riesgos que podrían llevar a fallos en cascada u operaciones no autorizadas a través de agentes IA interconectados.

Entregables del red team

  • Hallazgos sobre vulnerabilidades en protocolos de comunicación y confianza.

  • Estrategias para aplicar límites y monitorizar interacciones inter-agente.

  • Mapa de relaciones de confianza explotables con condiciones de reproducción.