
OpenAI ha reconocido que varios de sus modelos, incluido GPT-5.6 Sol, estuvieron implicados en el ataque a la plataforma HuggingFace de la semana pasada, que destacó por estar impulsado "de principio a fin" por un agente de inteligencia artificial.
El ataque a HuggingFace se realizó en un entorno de pruebas "altamente aislado" y con acceso restringido a internet en el que se estaban evaluando las capacidades de GPT-5.6 Sol y "un modelo de prelanzamiento aún más capaz", según ha explicado el laboratorio de IA en un comunicado.
PUBLICIDAD
En este entorno, "los modelos identificaron y encadenaron vulnerabilidades en el entorno de investigación de OpenAI y la infraestructura de producción de HuggingFace para obtener soluciones de prueba directamente de la base de datos de producción de HuggingFace", y llegaron a centrarse en encontrar una solución para una vulnerabilidad concreta, ExploitGym.
Para encontrar esa solución, como explican desde OpenAI, los modelos accedieron a internet, algo que inicialmente no podían hacer, pero que consiguieron al encontrar y explotar una vulnerabilidad de día cero en el proxy de caché del registro de paquetes que les estaba limitando, que acompañaron de una escalada de privilegios y movimiento lateral en el entorno de pruebas.
PUBLICIDAD
Ya en Internet, los modelos dedujeron que HuggingFace "potencialmente alojaba modelos, conjuntos de datos y soluciones para ExploitGym", lo que les llevó acceder a "información secreta" de la plataforma. Esta fue, precisamente, la actividad sospechosa que detectó el equipo de seguridad de HuggingFace y les permitió iniciar las tareas de mitigación, incluidos "el proceso de contención y reconstrucción forense con sus propios modelos de código abierto".
OpenAI está trabajando con HuggingFace en la investigación de lo ocurrido y ya ha implementado medidas de protección para las futuras capacitaciones y evaluaciones de sus modelos. Asimismo, se ha incorporado a HuggingFace en el programa de acceso seguro para que puedan mejorar sus defensas.
PUBLICIDAD
Cuando HuggingFace informó del acceso no autorizado a sus sistemas, destacó la particularidad de este incidente de seguridad, ya que "fue impulsado, de principio a fin, por un sistema de agentes de IA autónomo".
Últimas Noticias
El Círculo de la Sanidad denuncia que el aumento del gasto sanitario es insuficiente para aliviar la presión asistencial

Picardo ve como un "éxito" la primera semana del acuerdo de Gibraltar pese a las "dificultades" registradas

AV. Luis García Abad: "Organizar un GP de F1 en Madrid suena como un unicornio"

Cisco presenta los modelos de IA Antares, de tamaño compacto y uso local para detectar vulnerabilidades de software

El incendio de La Mierla entra en "fase de estabilización" y comienzan los realojos de algunas poblaciones
