Explotación de Orquestación y Multi-Agente
EN: Agent Orchestration and Multi-Agent Exploitation
Los sistemas agénticos modernos son multi-agente: un orquestador coordina varios agentes especializados, cada uno con su rol, sus herramientas y sus permisos. Esta topología crea una nueva superficie de ataque: la comunicación entre agentes puede ser interceptada, falsificada o manipulada; las relaciones de confianza se vuelven vectores de propagación; los protocolos de coordinación pueden ser manipulados para crear race conditions o deadlocks. Esta categoría cubre todas estas dimensiones, incluyendo la categoría especial de comportamiento adversarial multi-agente (colusión o spoofing) y el envenenamiento del estado del orquestador.
Resumen de la amenaza
Contexto, impacto y entregables del red team
Descripción detallada
Los sistemas agénticos modernos son multi-agente: un orquestador coordina varios agentes especializados, cada uno con su rol, sus herramientas y sus permisos. Esta topología crea una nueva superficie de ataque: la comunicación entre agentes puede ser interceptada, falsificada o manipulada; las relaciones de confianza se vuelven vectores de propagación; los protocolos de coordinación pueden ser manipulados para crear race conditions o deadlocks. Esta categoría cubre todas estas dimensiones, incluyendo la categoría especial de comportamiento adversarial multi-agente (colusión o spoofing) y el envenenamiento del estado del orquestador.
Por qué importa
Un orquestador comprometido controla todos los agentes subordinados: es el eslabón de mayor privilegio.
La comunicación inter-agente sin autenticación fuerte permite ataques Man-in-the-Middle devastadores.
Los feedback loops entre agentes pueden crear comportamientos emergentes no anticipados (consenso sobre información falsa, amplificación de errores).
El spoofing de identidad entre agentes (collusion/spoofing) es un vector nuevo sin equivalente en arquitecturas monolíticas.
Objetivo de las pruebas
Evaluar vulnerabilidades en la coordinación multi-agente, relaciones de confianza y mecanismos de comunicación para identificar riesgos que podrían llevar a fallos en cascada u operaciones no autorizadas a través de agentes IA interconectados.
Entregables del red team
Hallazgos sobre vulnerabilidades en protocolos de comunicación y confianza.
Estrategias para aplicar límites y monitorizar interacciones inter-agente.
Mapa de relaciones de confianza explotables con condiciones de reproducción.