
Un grupo de investigadores de seguridad logró acceder a sistemas internos de OpenAI utilizando Claude, el modelo de inteligencia artificial desarrollado por Anthropic, durante una investigación autorizada de vulnerabilidades.
El equipo consiguió aprovechar un fallo de seguridad para obtener credenciales digitales que posteriormente permitieron acceder a una cuenta de ChatGPT de un empleado de OpenAI y consultar archivos y proponer cambios en un repositorio privado de software de la compañía.
PUBLICIDAD
Según informó The Wall Street Journal, los investigadores pertenecían a Hacktron AI y participaban en un programa de OpenAI destinado a encontrar fallos de seguridad. La compañía fue informada de los problemas detectados y pagó al equipo una recompensa de 6.500 dólares por sus hallazgos.

El caso muestra cómo una herramienta de IA puede utilizarse para acelerar una investigación de ciberseguridad, pero también plantea interrogantes sobre las consecuencias de emplear modelos cada vez más capaces para descubrir y explotar vulnerabilidades.
Claude encontró la forma de aprovechar el fallo
La investigación comenzó el 23 de julio, cuando los especialistas detectaron un problema en la forma en que la plataforma Discourse procesaba determinados archivos de imagen. Discourse es el software utilizado para gestionar los foros en línea de OpenAI.
PUBLICIDAD
Los investigadores tenían acceso a una versión de Claude Opus 4.8 destinada a profesionales cualificados en ciberseguridad. El equipo pidió al modelo que escribiera código capaz de aprovechar la vulnerabilidad identificada.
El primer intento generado por Claude no consiguió explotar el fallo. Sin embargo, Anthropic lanzó esa misma noche una nueva versión del modelo, Opus 5. Al día siguiente, los investigadores volvieron a utilizar el sistema y Claude encontró una manera de aprovechar la vulnerabilidad.
El código permitió acceder a un servidor de Discourse utilizado por los foros de OpenAI. Desde allí, los investigadores consiguieron obtener tokens de autenticación, unas credenciales digitales que permiten a un usuario o servicio demostrar su identidad ante otros sistemas.
PUBLICIDAD
Las credenciales también funcionaban en ChatGPT
El hallazgo adquirió mayor relevancia cuando los investigadores comprobaron que algunos de los tokens obtenidos también podían utilizarse para acceder a ChatGPT.
Entre las credenciales había algunas asociadas a empleados de OpenAI. Además, los investigadores descubrieron que podían utilizarse para acceder al servicio GitHub de la compañía, una plataforma empleada para almacenar y gestionar código y otros elementos relacionados con el desarrollo de software.

De esta forma, una vulnerabilidad que inicialmente afectaba al procesamiento de imágenes en un foro terminó proporcionando una vía para acceder a sistemas y recursos que no estaban directamente relacionados con ese fallo.
Los investigadores comunicaron los resultados a OpenAI dentro del programa de búsqueda de vulnerabilidades. La compañía agradeció el aviso y recompensó económicamente al equipo.
PUBLICIDAD
OpenAI realizó una auditoría tras varios incidentes
El episodio se produjo aproximadamente dos semanas después de otro incidente relacionado con agentes de inteligencia artificial de OpenAI. Según The Wall Street Journal, varios agentes consiguieron escapar de los límites establecidos para su funcionamiento y atacaron Hugging Face.
La sucesión de incidentes llevó a OpenAI a realizar una auditoría de seguridad de sus sistemas. Greg Brockman, presidente y cofundador de la compañía, afirmó esta semana que OpenAI destinó el 25 % de sus ingenieros de producción a tareas de defensa.
La revisión permitió identificar y corregir varios problemas considerados graves por la compañía.
El caso de Hacktron AI también refleja una evolución en el papel de la inteligencia artificial dentro de la ciberseguridad. Los modelos pueden ayudar a los investigadores a analizar código, identificar errores y desarrollar herramientas para comprobar si una vulnerabilidad puede ser explotada.
PUBLICIDAD
Sin embargo, la misma capacidad puede utilizarse para automatizar determinadas fases de un ataque. Por eso, el aumento de las capacidades de estos sistemas está obligando a las empresas tecnológicas a reforzar sus controles y a evaluar cómo impedir que una IA pueda convertir un fallo aislado en una vía de acceso a sistemas más sensibles.
PUBLICIDAD
PUBLICIDAD
Últimas Noticias
TikTok eliminó más de 86 millones de cuentas falsas y es la mayor barrida de su historia
La plataforma intensifica la revisión de perfiles utilizados para difundir spam, suplantar celebridades y distribuir publicaciones automatizadas

Google lanza el Instituto DeepMind para debatir sobre el futuro de la Inteligencia Artificial General
Google crea una plataforma para analizar los avances, riesgos e impacto social de una futura inteligencia artificial general

Jensen Huang de Nvidia y Sam Altman de OpenAI cenarán con los presidentes de EE. UU. y China en reunión de Estado
Tim Cook, anterior de CEO de Apple y actual presidente de la junta directiva de la misma empresa, también asistiera al encuentro

Apple inicia la venta oficial del iPhone 18 Pro y iPhone 18 Pro Max: John Ternus, nuevo CEO de Apple es el protagonista
El CEO de la compañía mostró que la fachada de la tienda de Apple de la Quinta Avenida en Nueva York fue decorada con los colores de los nuevos dispositivos

Claude ya puede encargarse de una cuarta parte del desarrollo de nuevos modelos de IA
Claude lidera actualmente el 26 % de las tareas de investigación y desarrollo de nuevos modelos de Anthropic, frente al 0 % registrado en febrero




