El creciente uso de agentes de inteligencia artificial dentro de las empresas está creando nuevas oportunidades para los ciberdelincuentes, especialmente cuando estos sistemas tienen acceso a bases de datos, herramientas internas y otros agentes.
De acuerdo con Noticias SIN, investigaciones recientes han identificado una modalidad de ataque que aprovecha la confianza existente entre diferentes sistemas de IA.
Un atacante puede manipular un agente para que envíe instrucciones maliciosas a otro, haciendo que estas sean interpretadas como solicitudes legítimas.
El peligro está en la confianza entre agentes
A diferencia de un chatbot tradicional, los agentes de IA pueden ejecutar acciones, consultar información y comunicarse con diferentes servicios de manera automática.
El riesgo surge cuando uno de estos sistemas recibe una instrucción manipulada y posteriormente la transmite a otro agente que confía en su procedencia.
De esta forma, el atacante podría avanzar dentro de la infraestructura de una organización y tratar de acceder a información que originalmente no estaba disponible.
Investigaciones realizadas durante los últimos meses han encontrado vulnerabilidades relacionadas con el Model Context Protocol (MCP), una tecnología utilizada para conectar aplicaciones y agentes de inteligencia artificial con herramientas, bases de datos y otros servicios.
Ataques difíciles de detectar
Una de las principales preocupaciones es que este tipo de ataque puede resultar complicado de identificar.
Cada agente puede estar realizando técnicamente una función para la cual tiene autorización, aunque la orden original haya sido manipulada.
Investigadores han denominado “pivote de protocolo” a una estrategia mediante la cual un atacante aprovecha la relación de confianza entre diferentes sistemas para desplazarse desde un punto inicialmente accesible hacia otros recursos internos.
También se han identificado vulnerabilidades en herramientas destinadas a conectar agentes de IA con bases de datos. Algunas ya han sido corregidas después de que investigadores demostraran que podían ser utilizadas para dirigir solicitudes hacia servicios internos.
Empresas deberán reforzar sus controles
Los especialistas consideran necesario aplicar a los agentes de inteligencia artificial principios similares al modelo de “confianza cero”, bajo el cual ninguna solicitud debe considerarse segura únicamente porque provenga de un sistema ubicado dentro de la organización.
Esto implicaría verificar las instrucciones que circulan entre agentes, limitar sus permisos y controlar estrictamente los recursos a los que pueden acceder.
