
La expansión de los agentes de inteligencia artificial (IA) dentro de las empresas está abriendo una nueva puerta para los ciberdelincuentes. Investigaciones recientes muestran que un atacante puede manipular a uno de estos sistemas para que transmita instrucciones maliciosas a otros agentes de una misma organización y consiga acceso a información confidencial, bases de datos o recursos internos.
El problema fue identificado durante los últimos cinco meses en organizaciones como JPMorgan Chase, Rapid7, Weaviate y organismos gubernamentales de Francia. Aunque estas entidades no tienen una relación directa, todas utilizan agentes de IA conectados entre sí para ejecutar tareas de manera automática.
PUBLICIDAD
La técnica aprovecha una debilidad sencilla de explicar: un agente de IA puede confiar demasiado en otro agente. Si uno recibe una instrucción maliciosa y la transmite como si fuera una tarea legítima, el siguiente sistema puede ejecutarla sin comprobar suficientemente su origen.

Cómo funciona el ataque contra los agentes de IA
Para entender el riesgo, hay que imaginar una empresa en la que varios empleados especializados trabajan en cadena. Uno analiza documentos, otro consulta una base de datos y un tercero prepara un informe. Si uno de ellos recibe una orden falsa y los demás confían en él, el atacante puede aprovechar esa relación para avanzar dentro de la organización.
PUBLICIDAD
Algo similar ocurre con los agentes de IA. Estos sistemas utilizan herramientas y protocolos para comunicarse entre sí. Uno de ellos puede recibir una solicitud, pedir información a otro agente y posteriormente utilizar esa respuesta para completar una tarea. El problema aparece cuando los controles de seguridad no verifican adecuadamente cada instrucción que circula entre ellos.
El investigador independiente Syed Anas Mohiuddin analizó sistemas utilizados por varias organizaciones y encontró fallos relacionados con MCP, siglas de Model Context Protocol. Este estándar permite que aplicaciones y agentes de IA se conecten con herramientas, bases de datos y otros servicios.
PUBLICIDAD

Mohiuddin bautizó esta estrategia como “pivote de protocolo”. El término describe ataques en varias etapas en los que un ciberdelincuente entra por un sistema y aprovecha la confianza existente entre diferentes protocolos para llegar a otro recurso que inicialmente no estaba expuesto.
Google encontró una vulnerabilidad de gravedad alta
Uno de los casos más relevantes apareció en una herramienta de Google para conectar agentes de IA con bases de datos. La vulnerabilidad recibió una puntuación de gravedad de 8 sobre 10 y estaba relacionada con la forma en que el sistema gestionaba determinadas direcciones web y redirecciones.
Un atacante podía manipular un parámetro para conseguir que la herramienta enviara solicitudes a un servicio interno. En otras palabras, un sistema que debía comunicarse con recursos autorizados podía ser inducido a contactar con otro punto de la red.
PUBLICIDAD
Google corrigió el problema mediante controles destinados a impedir que el sistema acceda a direcciones IP no permitidas.

Otro caso descubierto en Rapid7 recibió una puntuación mucho menor, de 2,7 sobre 10, y ya fue solucionado por la compañía.
El problema es la confianza entre sistemas
Los investigadores advierten que estos ataques resultan especialmente difíciles de detectar porque cada agente puede estar haciendo exactamente aquello para lo que fue diseñado. El primero recibe una instrucción, el segundo la interpreta como una tarea legítima y el tercero ejecuta una acción autorizada.
Para el sistema, no necesariamente existe una señal evidente de que se está produciendo un ataque.
El riesgo también cuestiona una de las ideas fundamentales de la seguridad informática moderna: la confianza cero, un modelo que parte de la premisa de que ningún dispositivo o sistema debe considerarse seguro automáticamente, incluso cuando se encuentra dentro de una red corporativa.
PUBLICIDAD

Los expertos recomiendan aplicar ese mismo principio a los agentes de IA. Cada instrucción que pase de un modelo a una herramienta debería ser revisada como si procediera de una fuente externa y potencialmente peligrosa.
El crecimiento acelerado de los agentes de IA está haciendo que empresas y organismos conecten cada vez más sistemas entre sí. La investigación muestra que esa interconexión puede aumentar la productividad, pero también crear nuevas rutas para los ataques si los mecanismos de autorización y seguridad no evolucionan al mismo ritmo.
PUBLICIDAD
PUBLICIDAD
Últimas Noticias
Call of Duty: Modern Warfare 4: cómo jugar la campaña en acceso anticipado con Nvidia GeForce RTX
El juego incorporará DLSS 4.5, la actualización más reciente de la tecnología de renderizado neuronal de Nvidia, herramienta está diseñada para mejorar la calidad de imagen

GTA 6 no estará disponible para PC ni celulares y cómo jugarlo en Xbox
El juego de Rockstar estará disponible en Xbox Cloud Gaming, aunque solamente en consolas por ahora

Alertan que las notificaciones de emergencia de ChatGPT para adolescentes fallan en situaciones de riesgo
Common Sense Media sostiene que los avisos para padres no se enviaron en pruebas sobre autolesiones o crisis emocional. OpenAI rechazó las acusaciones
Bitcoin: cuál es el precio de esta criptomoneda este día
El bitcoin fue creado por Satoshi Nakamoto en el 2008 y arrancó sus operaciones oficialmente el 3 de enero de 2009 con “el bloque de génesis” de 50 monedas

Amazon elimina una función de Alexa que todavía era usada por sus altavoces Echo: estos son los modelos afectados
El cambio afecta a modelos lanzados entre 2018 y 2020 y obliga a utilizar el dispositivo conectado o Bluetooth para controlar la reproducción de contenido




